Basim Azam
収録論文 3本 ・ フィジカルAI/ロボット学習
世界モデルVLA/ロバスト性VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 潜在世界モデルの計画能力の限界世界モデル2026/9/30
凍結した自己教師あり視覚バックボーンに基づく行動条件付き世界モデルを評価し、予測が計画に使えるのは想像軌道の範囲内かその少し先に限られ、より長い想像軌道か近いサブゴールが必要だと示した。
- 両刃の剣としての推論:視覚-言語-行動モデルにおけるアーキテクチャと段階横断的ロバスト性VLA/ロバスト性2026/7/1
推論ステップを追加するとVLAモデルのロバスト性が向上するかを、3つのモデル(推論なし、テキストCoT、潜在反復ループ)で比較し、潜在反復モデルが最も脆弱であることを示した。また、推論出力を安全信号として利用する防御手法の限界も明らかにした。
- 思考の改変が行動を変える:VLAロボット操作におけるChain-of-Thoughtの脆弱性の探究VLA2026/3/1
VLAモデルが生成する推論トレースを人為的に破壊すると、物体名の置換のみが成功率を大きく低下させ、行動デコーダが推論の質ではなく実体参照の整合性に依存していることを示した。