何が起きたか
arxiv.orgに2026年8月24日付で公開された論文は、凍結した視覚言語行動(VLA)ポリシーへのプロンプト追記が、意味内容に関わらず実行を破壊する現象を報告した。監査では、生の追記文で平均成功率が92.47%から3.00%に低下し、意味のある追記と長さを揃えた無意味な追記の両方が全500状態で失敗した。提案手法TOWN-VLAは、候補生成とポリシー入力への権限を分離し、900ルートの監査で全ルートが契約に従い、525ルートがベースと完全一致、375の許可プロンプトがタスク署名を保持した。
詳細
TOWN-VLAは、固定の互換性ルールが正規の簡潔な命令を承認し、それ以外は元のベースプロンプトを完全に復元する。評価では、マッチした4×7のLIBERO-Plusで各手法10,030エピソードを実施し、成功率が69.5%から73.1%に上昇(95%信頼区間1.89〜5.45ポイント、+362エピソード)。6つの摂動軸と4つのスイートすべてで改善した。物理的なPiPERアームでは、凍結したPiZero-5チェックポイントを使用し、各手法150試行で成功率が52.7%から78.7%に上昇(p=3.16×10^-6)。
Key Facts
| 生の追記文で平均成功率が92.47%から3.00%に低下し、意味のある追記と無意味な追記の両方が全500状態で失敗した。 | [1] |
| TOWN-VLAは、候補生成とポリシー入力への権限を分離するプロンプト権限インターフェースを導入した。 | [1] |
| 900ルートの監査で、525ルートがベースと完全一致し、375の許可プロンプトがタスク署名を保持した。 | [1] |
| LIBERO-Plus評価(各手法10,030エピソード)で成功率が69.5%から73.1%に上昇した。 | [1] |
| 物理PiPERアームで成功率が52.7%から78.7%に上昇した(p=3.16×10^-6)。 | [1] |
本紙の見方
本論文が示したのは、VLAポリシーへのプロンプト介入が「意味」ではなく「形式」で破壊的に作用するという点だ。生の追記文で成功率が92.47%から3.00%へと30分の1以下に落ち、しかも意味のある追記も無意味な追記も全500状態で失敗する。これは、追記されたテキストが実行プロンプトに入る瞬間に制御介入となるためで、形式崩壊と呼ぶにふさわしい。TOWN-VLAはこの問題に対し、候補生成と権限を分離し、固定の互換性ルールで承認された簡潔な命令のみを許可し、それ以外はベースプロンプトを完全復元する。この設計は、凍結したVLAポリシーを再学習なしで守る点で実用的だ。 評価結果は、LIBERO-Plusで69.5%から73.1%への改善(95%信頼区間1.89〜5.45ポイント)と、物理PiPERアームで52.7%から78.7%への大幅な改善(p=3.16×10^-6)を示す。特に物理ロボットでの改善幅は大きく、シミュレーションと実機のギャップを埋める可能性を示唆する。ただし、成功率の絶対値はまだ78.7%であり、実運用にはさらなる向上が必要だ。 この研究の含意は、VLAポリシーの展開において、プロンプトの「形式」を厳格に管理する必要性を強調する点にある。従来の研究はプロンプトの意味内容に焦点を当てがちだが、形式崩壊は形式そのものが実行を支配しうることを示す。これは、プロンプトエンジニアリングの常識を覆すものであり、今後のVLAシステム設計では、入力の権限管理が必須になるだろう。 未確定の論点として、オラクルなしのアドミッション較正が次の展開目標とされているが、その具体的な方法や性能は未公開だ。また、TOWN-VLAの互換性ルールがどのように定義されるか、他のVLAモデルやタスクへの一般化可能性も検証が必要である。
なぜ重要か
VLAポリシーへのプロンプト介入が形式崩壊を起こすという発見は、ロボット操作の信頼性に直結する。TOWN-VLAの権限管理アプローチは、凍結モデルを守りながら性能を向上させる実用的な枠組みを提供し、今後のVLA展開の安全性と効率性に影響を与える。