Yuchen Zhu
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Juno: 視覚-言語-行動モデルのための予測潜在表現の活用VLA2026/10/7
行動条件付きJEPAを基盤に、事前学習・方策学習・実機展開の3段階で予測潜在表現を統合し、VLAモデルの成功率を向上させたフレームワーク。
- LM-X: 進捗・イベント・不確実性予測による説明可能な汎用ロボット操作の行動モデリングVLA2026/8/26
汎用VLAポリシーに、タスク進捗・イベント遷移・局所信頼性を明示的に予測する3つの信号を導入し、制御に内在する説明可能性を実現した。大規模事前学習と実ロボットデータで高い成功率を達成した。
- InternVLA-A1:ロボットマニピュレーションのための理解・生成・行動の統合VLA2026/1/1
シーン理解・視覚的予測・行動実行の3つの専門家をMixture-of-Transformersで統合したVLAモデルを提案し、実世界12タスクで既存手法を上回る性能を達成した。
- マスクから世界へ:世界モデル構築のための実践ガイド世界モデル2025/10/23
初期のマスクモデルから統一アーキテクチャ、対話型生成モデル、記憶拡張システムへと至る世界モデル構築の道筋を、生成・対話・記憶の3要素に焦点を当てて解説する。