Chongshan Fan
収録論文 2本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 意味と物理の整合を図る連続的視覚-言語-行動の共同学習による行動クローニングVLA2025/11/1
視覚・言語・固有感覚入力を連続的に共同学習し、双方向クロスアテンションで意味と物理のずれを解消することで、行動クローニングの累積誤差を抑え、滑らかで一貫した操作を実現するフレームワークを提案した。
- モジュラー身体知能による構造化タスク解決:ルービックキューブを事例としてマニピュレーション2025/7/1
知識ベース・視覚言語モデル・大規模言語モデルを組み合わせ、実演データなしでルービックキューブを解くロボットシステムを構築し、実機で79%の成功率を達成した。