Mohsen Hariri
Case Western Reserve University
収録論文 2本 ・ フィジカルAI/ロボット学習
VLAVLA/ロボットマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WHEREを正し、HOWを保つ:参照誘導によるVision-Language-Actionモデルの組合せ的一般化VLA2026/9/29
VLAモデルが視覚的ショートカットに依存して組合せ的一般化に失敗する問題に対し、学習不要のラッパーReGuideを提案し、対象物の位置情報を用いて意味的・幾何的に再結合することで成功率を大幅に改善した。
- 想像による回復:推論時カウンターファクチュアル再調整による視覚言語行動モデルの復旧VLA/ロボットマニピュレーション2026/8/14
視覚言語行動モデルがオンラインの外乱(目標変更や物理的摂動)に直面した際、失敗データや再学習なしに、推論時に「もしも」の継続を想像してロボットと環境を最小限に再調整する訓練不要の回復フレームワークを提案した。