何が起きたか
2026年5月16日、arXivに「Contrastive Conceptor Activation Steering (COAST): Unlocking Vision-Language-Action Models through Hidden States」と題する論文が公開された。COASTは、VLAモデルの隠れ状態を利用してタスク成功率を向上させる訓練不要の手法で、3種類の異なるアーキテクチャ(フローマッチングVLA、自己回帰VLA、拡散ポリシー)で有効性を示した。
詳細
COASTは「conceptor」と呼ばれる線形演算子を用いて、少数の成功・失敗ロールアウトからタスクに重要な部分空間を特定する。推論時にはVLAの潜在表現をその成功部分空間へ誘導することで、タスク成功率を改善する。論文によると、シミュレーションと実機ロボットのタスク成功率を絶対平均でそれぞれ20%以上、40%以上向上させた。また、失敗モードはタスク間で共通の構造を持つ一方、成功表現はタスク固有であることが示された。この構造により、類似した失敗モードを持つタスクでは、再フィッティングなしで既存のconceptorを転用できる。
Key Facts
| COASTは、conceptorを用いて成功に重要な部分空間を特定し、推論時にVLAの潜在表現を誘導する手法である。 | [1] |
| COASTは、フローマッチングVLA、自己回帰VLA、拡散ポリシーの3つの異なるアーキテクチャで評価された。 | [1] |
| COASTは、シミュレーションと実機ロボットのタスク成功率を絶対平均でそれぞれ20%以上、40%以上向上させた。 | [1] |
| 失敗モードはタスク間で共通の構造を持つ一方、成功表現はタスク固有であることが示された。 | [1] |
| 類似した失敗モードを持つタスクでは、再フィッティングなしで既存のconceptorを転用できる。 | [1] |
なぜ重要か
VLAモデルはロボット制御の有望なアプローチだが、実環境での脆さが課題だった。COASTは訓練不要で成功率を大幅に向上させるため、ロボット学習の実用化を加速させる可能性がある。また、隠れ状態の構造を利用する手法は、モデルの解釈可能性や効率的な適応にもつながる。