Jerry Bai
XPENG Robotics
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA世界モデル/操作ヒューマノイド/模倣学習/世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- IronMind: カメラ空間自己中心事前学習によるヒューマノイド巧みな操作のスケーリングVLA2026/9/30
自己中心的な人間動画と異種ロボットデータを用いて、カメラ空間行動表現で身体ギャップを埋め、ヒューマノイドの巧みな操作のためのVLAモデルを事前学習する手法を提案。
- XPACE: 異種経験からの世界モデルと行動モデルの統合学習VLA2026/9/15
人間とロボットの多様な経験を動画予測で結びつけ、行動予測と世界シミュレーションを同時に行う統合モデルを提案し、ヒューマノイドロボットで人間の技能をロボット未経験タスクへ転移できることを示した。
- AnyWorld: 因子分解された自己中心的世界モデルによるクロス身体汎化世界モデル/操作2026/8/29
人間の単一インタラクション動画を、ロボット固有の多様なロールアウトに拡張する世界モデルフレームワークを提案。行動・カメラ・身体の因子に分解し、身体・視点・シーンの再構成を可能にする。
- UniT: 人間からヒューマノイドへのポリシー学習と世界モデリングのための統一物理言語に向けてヒューマノイド/模倣学習/世界モデル2026/4/1
人間の映像データを活用してヒューマノイドロボットの学習を行うため、視覚的アンカリングに基づく統一潜在アクショントークナイザー(UniT)を提案し、異なる身体構造間のギャップを埋める。