Zipeng Fu
収録論文 14本 ・ フィジカルAI/ロボット学習
VLAマニピュレーションナビゲーション/VLA模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Ego-Pi: 自己中心視点の人間・ロボットデータによるVLAファインチューニングVLA2026/6/6
ロボット操作のデータ不足を解決するため、自己中心視点の人間データを活用してVLAモデルをファインチューニングし、ロボットが新しいタスクの意味を学習し、既存スキルを組み合わせて新行動を生み出せることを示した論文。
- CoT-VLA:視覚的思考連鎖推論を用いた視覚-言語-行動モデルVLA2025/3/1
将来の画像フレームを視覚的目標として自己回帰的に予測してから行動系列を生成することで、視覚的思考連鎖推論をVLAに組み込み、実世界タスクで17%の性能向上を達成した。
- お手伝いわんちゃんボット:脚式ロボットと視覚言語モデルによるオープンワールド物体取得マニピュレーション2024/10/1
四足歩行ロボットにグリッパと視覚言語モデルを組み合わせ、未知の屋内環境で指示に従って物を取ってくるシステムを実現した。
- 脚付きUMI:操作中心の全身コントローラによる移動型マニピュレーションマニピュレーション2024/7/1
手持ちグリッパで実世界の操作データを収集し、シミュレーションで全身コントローラを訓練して、四足歩行ロボットに操作スキルを実装するフレームワークを提案。
- Mobility VLA:長文脈VLMとトポロジカルグラフによるマルチモーダル指示ナビゲーションナビゲーション/VLA2024/7/1
デモ動画と自然言語・画像の指示を入力とし、長文脈VLMで目標フレームを特定、トポロジカルグラフに基づく低レベル方策で実環境をナビゲートする階層型VLAを提案した。
- HumanPlus:ヒューマノイドの人間動作模倣とシャドーイング模倣学習2024/6/1
人間の動作データセットとRGBカメラによるリアルタイムシャドーイングを組み合わせ、ヒューマノイドが自律的に多様なタスクを模倣学習できるフルスタックシステムを構築した。
- Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation2024/1/1
- Adapt On-the-Go: Behavior Modulation for Single-Life Robot Deployment2023/11/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Robot Parkour Learning2023/9/1
- Deep Whole-Body Control: Learning a Unified Policy for Manipulation and Locomotion2022/10/1
- Coupling Vision and Proprioception for Navigation of Legged Robots2021/12/1
- Minimizing Energy Consumption Leads to the Emergence of Gaits in Legged Robots2021/11/1
- RMA: Rapid Motor Adaptation for Legged Robots2021/7/1