Yingyan Li
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA自動運転/VLA自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Xiaomi-Robotics-1: 10万時間以上の実世界軌道データによる視覚言語行動モデルのスケーリングVLA2026/7/1
10万時間以上の実世界の操作軌跡データを用いて、汎用的な視覚言語行動(VLA)モデルを事前学習し、未見環境での指示追従や少量データでの適応を可能にする基盤モデルを構築した。
- Xiaomi OneVL: ワンステップ潜在推論と視覚言語説明によるプランニング自動運転/VLA2026/4/1
自動運転のVLAモデルにおいて、潜在推論を視覚世界モデルで強化し、明示的CoTを超える精度を実現しつつ、推論速度を回答のみの予測と同等に高速化したフレームワークを提案した。
- DynVLA: 自動運転における行動推論のための世界ダイナミクス学習自動運転/VLA2026/3/1
自動運転向けVLAモデルDynVLAを提案し、行動生成前に世界のダイナミクスを予測する新しいCoTパラダイムを導入した。
- DriveDPO:安全な選好最適化によるエンドツーエンド自動運転の政策学習自動運転2025/9/1
人間模倣とルールベース安全性を統合した選好最適化で運転軌道を学習し、NAVSIMで最高性能を達成した手法。
- 統一視覚言語行動モデルVLA2025/6/1
視覚・言語・行動を離散トークン列として自己回帰的にモデル化し、大規模動画から因果ダイナミクスを学習する統合VLAモデルUniVLAを提案。