何が起きたか

arXivは2026-09-03、Continual Field-Adaptive Models(CFAMs) for Post-Deployment Physical AIという論文を公開した。論文は、危険な現場で人の代わりに動く「unattended interactive autonomy」に必要な能力として、配備後も学習を続けるフィジカルAIの枠組みを提案している。CFAMは、実験室でのfew-shot学習と、展開後のgradient-freeなオンデバイス更新を組み合わせる設計である。

詳細

CFAMの中核は、凍結されたslow-learning componentと、fast-learningなCapsule Fieldの補完構造だ。slow componentはSensor、Reasoning、Actionの3つのcorticesで構成され、Sensorが多様な入力を3Dに基づく幾何へ写像し、Reasoningがタスクを技能に分解して結果を評価し、Actionが幾何技能を実行する。 Capsule Fieldは、現場で得た学習をCompetence Capsulesとしてone-shotかつgradient-freeに保存する。論文は、manipulator、quadruped、humanoid、quadrotor、off-road vehicleの5つの身体でCFAMを評価し、同一のin-house multi-embodiment datasetを使って、pi0、CogACT、SpatialVLAと比較した。

Key Facts

CFAMは、配備後に自律的なgradient-free on-device updatesを行うフィジカルAIの枠組みである。[1]
slow-learning componentはSensor、Reasoning、Actionの3 corticesで構成される。[1]
Capsule Fieldは、現場学習をCompetence Capsulesとして保存する。[1]
評価対象はmanipulator、quadruped、humanoid、quadrotor、off-road vehicleの5種類である。[1]
CFAMは、標準的なpolicyが全prior-training datasetで学習した運用点に対し、40%のデータ、または2.5x fewer trajectoriesで到達したとされる。[1]

本紙の見方

CFAMの新しさは、配備後のフィジカルAIに「継続学習」を組み込む点にある。ただし、論文が開示しているのは無制限な自己進化ではなく、verified near-OOD casesに限ったautonomous captureと、能力を壊さない範囲での更新である。つまり、現場で何でも学ぶ設計ではなく、既存能力の保持を前提に学習幅を絞った方式だと読める。 本紙の関連記事はないため、過去報道との接続はできないが、論文の構成自体は実装上の分業が明確である。Sensorは3D-grounded geometryの入力変換、Reasoningは技能分解と評価、Actionは幾何技能の実行を担う。これに対してCapsule Fieldは、展開後の経験をCompetence Capsulesとして蓄積するため、入力理解・意思決定・実行・現場記憶の4層が分かれている。これは、単一モデルを後から微調整するより、現場で得た局所知識を切り出して保持する設計に近い。 業界構造への含意としては、フィジカルAIの競争軸が「初期性能」だけでなく、「配備後にどこまで安全に更新できるか」に移る可能性がある。特に、同じin-house multi-embodiment datasetでpi0、CogACT、SpatialVLAと比べた点は、モデル単体ではなく身体横断の学習設計が評価対象になり始めたことを示す。今後の焦点は、verified near-OODの判定条件、Competence Capsulesの保存粒度、40%のデータで到達した運用点が実機でも維持されるか、そしてopen-world noveltyをscope外に置いた制約の下でどこまで実用性が出るかである。

なぜ重要か

論文が示すのは、配備後のフィジカルAIに必要な条件が、追加学習の有無ではなく、能力を保ちながら現場適応できるかにあるという点だ。実験室でのfew-shot学習と、展開後のオンデバイス更新を分けているため、学習資源が限られる現場での適用条件を具体化している。 また、5種類の異なる身体で評価していることから、ロボット本体の差よりも、共通の学習・記憶・更新の枠組みがボトルネックになりやすい構図が見える。