Quanyun Zhou
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA軌道予測
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Xiaomi-Robotics-1: 10万時間以上の実世界軌道データによる視覚言語行動モデルのスケーリングVLA2026/7/1
10万時間以上の実世界の操作軌跡データを用いて、汎用的な視覚言語行動(VLA)モデルを事前学習し、未見環境での指示追従や少量データでの適応を可能にする基盤モデルを構築した。
- RotVLA: 回転潜在アクションを用いた視覚言語行動モデルVLA2026/5/1
連続的な回転群SO(n)上の潜在アクション表現を導入し、離散量子化の問題を解決したVLAモデルを提案。大規模データで事前学習し、下流タスクで高い性能を達成。
- Xiaomi-Robotics-0:リアルタイム実行可能なオープンソース視覚言語行動モデルVLA2026/2/1
大規模なロボット軌道と視覚言語データで事前学習し、非同期実行のための学習技術と展開時のタイムステップ調整により、民生用GPUで高速かつ滑らかなリアルタイム動作を実現したVLAモデルを提案。
- IMPACT: 行動意図を考慮した適応的文脈トリミングによるマルチモーダル軌道予測軌道予測2025/4/1
行動意図と軌道を同時に予測し、意図と占有予測を利用して不要なエージェントや地図要素を動的に刈り込むことで、精度・解釈性・効率を高めた軌道予測フレームワークを提案。