Chengmeng Li
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚言語行動モデルのための身体性転移学習VLA2025/11/1
事前学習済みVLAモデルをマルチロボットに効率的に転移するET-VLAを提案し、合成継続事前学習とEmbodied Graph-of-Thoughtで二腕ロボットの協調タスク性能を向上させた。
- ActiveUMI: ロボット不要の人間デモンストレーションによる能動的知覚を伴うロボットマニピュレーションマニピュレーション2025/10/1
VRテレオペレーションキットとセンサ付きコントローラで人間の両手作業デモを収集し、頭部運動による能動的知覚も学習してロボットに転移するデータ収集フレームワークを提案。6つの両手タスクで平均70%の成功率を達成。
- PointVLA: 3D世界をVision-Language-Actionモデルに注入するVLA2025/3/1
事前学習済みVLAモデルを再学習せずに、軽量モジュールで点群入力を注入し3D空間推論能力を付与するフレームワークを提案。
- Diffusion-VLA: 自己生成推論による汎用性と解釈性を備えたロボット基盤モデルVLA2024/12/1
自己回帰モデルと拡散モデルを組み合わせ、自己生成した推論を方策学習に注入することで、解釈性が高く汎用性のある視覚運動方策を実現したロボット基盤モデル。
- CoA-VLA: 視覚・テキストのアフォーダンス連鎖による視覚言語行動モデルの改善VLA2024/12/1
ロボットの行動予測に、物体・把持・空間・移動の4種類のアフォーダンスを視覚とテキストで段階的に推論させることで、複雑なタスクでの精度と頑健性を高める手法を提案。