何が起きたか

arXivは2026年10月6日、実行中に生じる未知の視覚障害に対する適応手法「Self-supervised Adaptation from Leftover Trajectories(SALT)」を掲載した。SALTは、直前のアクションチャンクのうち未実行部分であるleftover trajectoryを自己教師信号として使い、テスト時に方策を更新する。論文は、LIBERO-10での平均成功率改善と、実機でのタスク進捗の改善を報告している。

詳細

論文は、連続するアクションチャンクが時間的に重なる点を利用し、leftover trajectoryを現在の予測に対する時間整合した目標として用いる設計を示した。視覚変化の発生時には、汚染前に形成された計画を残すleftoverが適応の支点となるとし、これをTransition Anchoringと呼んでいる。 また、適応後の方策を保持したまま現在のチャンクを再生成し、そのleftoverを次の再計画の目標にすることで、補正を実行軌道に沿って伝播させるSequential Correction Propagationを提案した。監督信号は方策自身の予測のみで構成され、障害注釈、専門家行動、対象領域デモは不要としている。軽量な適応ゲートは、正常軌道のみで較正され、更新開始のタイミングを決める。 評価では、LIBERO-10上で5種類の持続的な視覚障害に対し、平均成功率がSmolVLAで43.9%から53.2%へ、GR00T N1.7で58.7%から66.0%へ上昇した。実機では、デジタル障害と物理障害を平均したタスク進捗が0.49から0.61へ改善した。

Key Facts

arXivは2026年10月6日、論文「Adapting Vision-Language-Action Models to Unknown Visual Disruptions During Execution」を掲載した。[1]
論文はSelf-supervised Adaptation from Leftover Trajectories(SALT)を提案し、leftover trajectoryを自己教師信号として用いる。[1]
SALTは障害種別の注釈、発生時刻の注釈、専門家行動、対象領域デモを必要としないとしている。[1]
LIBERO-10では、5種類の持続的な視覚障害に対する平均成功率がSmolVLAで43.9%から53.2%へ、GR00T N1.7で58.7%から66.0%へ上昇した。[1]
実機では、デジタル障害と物理障害を平均したタスク進捗が0.49から0.61へ改善した。[1]

本紙の見方

SALTの新しさは、未知の視覚障害を前提にしながら、外部ラベルや実演を追加せずに自分自身の予測を教師信号へ転用した点にある。ロボットの実行中に起きる視覚の乱れに対して、左側に残った未実行軌道をそのまま再利用する発想は、学習済み方策の再学習ではなく、実行中の補正に焦点を当てた設計だといえる。一方で、評価自体はLIBERO-10と実機のタスク進捗にとどまり、どの程度広い操作系に一般化するかはまだ限定的である。 本紙の過去報道はないため、既報との連続性は置かない。とはいえ、論文が示したTransition AnchoringとSequential Correction Propagationは、単発の補正ではなく、補正を次の再計画へ引き継ぐ構造を持つ。ここにこの手法の実務上の意味がある。視覚障害が起きた瞬間だけを直すのではなく、残余軌道を足場にして次のチャンクへ修正を伝播させるため、実行ループのどこで更新を入れるかが性能を左右するとみられる。更新開始を決める適応ゲートも、正常軌道のみで較正されており、異常検出を明示的に外部依存しない点が特徴である。 業界構造への含意としては、VLAモデルの性能差が静的ベンチマークだけでなく、実行中の視覚変動への耐性で再評価される余地がある。LIBERO-10ではSmolVLAとGR00T N1.7の両方で改善が示されており、モデル名の違いよりも、実行時の補正機構の有無が重要な変数になる可能性がある。データ面では、障害注釈なしで自己教師化できるため、ラベル収集のボトルネックを回避しやすいが、逆にいえば正常軌道の品質と、leftoverがどこまで有効な目標になるかが前提になる。今後確認すべき論点は、障害の種類が変わった場合の安定性、ゲートの誤作動率、長い実行系列で補正が累積したときの崩れ方、そして実機での0.61という進捗改善がどのタスク群に再現するかである。

なぜ重要か

SALTは、視覚が崩れた瞬間に外部ラベルへ頼らず、方策自身の出力を使って立て直す設計であるため、実機運用での再学習コストを下げる余地がある。論文はLIBERO-10での成功率改善と実機での進捗改善を示しており、評価軸が静的認識ではなく実行時の復元力に移りうることを示唆する。

日本への影響

日本企業や研究機関に直接の取引関係は示されていないが、ロボットの実行時補正では正常軌道の品質と実機評価系が重要になる。視覚センサー、制御ソフト、実機検証の組み合わせを持つ国内勢にとっては、ラベルなし適応をどこまで再現できるかが焦点になりうる。