Zeyuan Ding
収録論文 5本 ・ フィジカルAI/ロボット学習
ワールドモデルVLAナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Pelican-Sim 1.0:身体性知能のための汎用ワールドモデルシミュレータワールドモデル2026/9/10
視覚文脈とロボット行動から将来の観測を予測する汎用ワールドモデルシミュレータを提案し、統一行動表現やMoE、効率的なロールアウト生成により行動制御性と映像品質を大幅に向上させた。
- Pelican-VLA 0.5: 行動前に注意を向けることで汎化を向上VLA2026/7/1
視覚言語理解、未来フレーム生成、行動予測を統合したVLAモデルを提案し、注意レベルの汎化を達成。ボトルネックトークンの導入により、未見のシーンやロボットでも操作対象に注意が向くことを示した。
- Pelican-Unify 1.0: 理解・推論・想像・行動を統合した身体化基盤モデルVLA2026/5/1
単一のVLMと統一未来生成器を用いて、理解・推論・想像・行動を一つのモデルで統合的に学習・実行する身体化基盤モデルを提案し、各能力のベンチマークで高い性能を達成した。
- Robo-Cortex: 二重粒度認知記憶と自律知識誘導による自己進化型具現化エージェントナビゲーション2026/5/1
ロボットが過去の経験からナビゲーションのヒューリスティックを自律的に抽出し、戦略を進化させる自己進化型フレームワークを提案した。
- Pelican-VL 1.0:身体知能のための基盤ブレインモデルVLA2025/11/1
7B〜72Bパラメータのオープンソース身体知能向けマルチモーダル基盤モデルを開発し、大規模データと新学習機構DPPOにより既存モデルを上回る性能を達成した。