Zifeng Gao
Tsinghua University
収録論文 4本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 受動的実行から能動的探索へ:実環境におけるエージェント型身体性マニピュレーションマニピュレーション2026/9/24
ロボットが指示をただ実行するのではなく、計画・知覚・実行の3モジュールを連携させて環境と動的に相互作用し、隠れた対象物を能動的に探索して操作するフレームワークを提案した。
- CLAP: 人間の動画から視覚-言語-行動モデルを学習するための対照的潜在行動事前学習VLA2026/1/1
人間の動画からロボットの行動スキルを抽出し、視覚-言語-行動モデルを事前学習するフレームワークCLAPを提案。対照学習で人間の動画をロボットの行動語彙に整合させ、効率的なスキル転移を実現した。
- VLA-RL:スケーラブルな強化学習による汎用ロボットマニピュレーションの習得VLA2025/5/1
事前学習済みVLAモデルをオンライン強化学習で改善し、スパース報酬をVLMベースの報酬モデルで補うことで、LIBEROの40タスクで最高性能を達成した。
- ManiCM: ロボットマニピュレーションのための一貫性モデルによるリアルタイム3D拡散ポリシーマニピュレーション2024/6/1
拡散モデルに一貫性制約を課すことで、点群入力からロボットの行動を1ステップで生成するリアルタイムマニピュレーションモデルを提案し、従来手法を平均10倍高速化した。