Disheng Liu
Case Western Reserve University
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAVLA/ロボットマニピュレーション探索/ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WHEREを正し、HOWを保つ:参照誘導によるVision-Language-Actionモデルの組合せ的一般化VLA2026/9/29
VLAモデルが視覚的ショートカットに依存して組合せ的一般化に失敗する問題に対し、学習不要のラッパーReGuideを提案し、対象物の位置情報を用いて意味的・幾何的に再結合することで成功率を大幅に改善した。
- 想像による回復:推論時カウンターファクチュアル再調整による視覚言語行動モデルの復旧VLA/ロボットマニピュレーション2026/8/14
視覚言語行動モデルがオンラインの外乱(目標変更や物理的摂動)に直面した際、失敗データや再学習なしに、推論時に「もしも」の継続を想像してロボットと環境を最小限に再調整する訓練不要の回復フレームワークを提案した。
- GSMem: 3Dガウススプラッティングを永続的空間記憶として用いたゼロショット身体化探索と推論探索/ナビゲーション2026/3/1
3Dガウススプラッティングを永続的な空間記憶として活用し、エージェントが初期観察で見逃した対象を後から再観察できるようにする、ゼロショットの身体化探索・推論フレームワークを提案した。