Dongjin Kim
収録論文 2本 ・ フィジカルAI/ロボット学習
VLAVLA/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボットのように見る:ロボット中心のポイントマップによる視覚言語行動モデルVLA2026/7/1
視覚言語行動モデル(VLA)がカメラ視点とロボット座標系のずれで性能を落とす問題を、ロボット座標系の3D座標を画素に格納したポイントマップを入力に用いることで解決し、既存VLAに最小限の変更で統合できることを示した。
- 3D HAMSTER: 3D軌道ガイダンスによる階層型視覚言語行動モデルの計画と制御の橋渡しVLA/操作2026/6/1
階層型VLAモデルにおいて、プランナーが直接3D軌道を予測できるようにし、2Dガイダンスの幾何学的歪み問題を解決した。実世界操作で優れた性能を示した。