Xu He
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA脳型ナビゲーション世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- JEPA-VLA:VLAモデルに動画予測埋め込みが必要な理由VLA2026/2/1
動画で事前学習した予測埋め込み(V-JEPA 2)をVLAモデルに適応的に統合し、サンプル効率と汎化性能を大幅に向上させる手法を提案。
- 従来型PNTと脳型PNTの差異と融合に関する予備的検討脳型ナビゲーション2025/10/1
従来の機械的PNTと生物の脳に着想を得たPNTの違いを多層的に整理し、両者を統合する4層フレームワークを提案したロードマップ論文。
- RationalVLA:デュアルシステムを備えた合理的視覚言語行動モデルVLA2025/6/1
曖昧・不可能な指示を拒否しつつ、実行可能な指示に基づくロボットアーム操作を行う二重システムの視覚言語行動モデルを提案し、新ベンチマークRAMAで評価した。
- iVideoGPT:インタラクティブな動画生成モデルによるスケーラブルな世界モデル世界モデル2024/5/1
視覚・行動・報酬をトークン列に統合した自己回帰型Transformerで、次トークン予測によりエージェントが想像環境内で対話的に行動できる世界モデルを構築し、大規模な操作軌跡で事前学習した。
- Learning from Naturalistic Driving Data for Human-like Autonomous Highway Driving2020/5/1