何が起きたか
Xiaomiは2026年2月13日、視覚言語行動(VLA)モデル「Xiaomi-Robotics-0」を発表し、コードとモデルチェックポイントをオープンソースとして公開した。同モデルはリアルタイム実行に最適化され、コンシューマー向けGPUで高速なロールアウトを実現するとしている。
詳細
Xiaomi-Robotics-0は、大規模なクロスエンボディのロボット軌跡データと視覚言語データで事前学習され、基盤となるVLMの視覚意味知識を保持しつつ、汎用的な行動生成能力を獲得する。ポストトレーニングでは、非同期実行のための技術を導入し、推論遅延に対処。デプロイ時には、予測されたアクションチャンクのタイムステップを整列させ、シームレスなリアルタイムロールアウトを実現する。評価では、シミュレーションベンチマークで最先端の性能を達成し、実機の両腕操作タスクでも高い成功率とスループットを示した。
Key Facts
| XiaomiはVLAモデル「Xiaomi-Robotics-0」を発表し、コードとモデルチェックポイントをオープンソース化した。 | 出典一覧 |
| 同モデルはリアルタイム実行に最適化され、コンシューマー向けGPUで高速なロールアウトを実現する。 | 出典一覧 |
| 事前学習には大規模なクロスエンボディのロボット軌跡データと視覚言語データを使用する。 | 出典一覧 |
| ポストトレーニングでは非同期実行のための技術を導入し、推論遅延に対処する。 | 出典一覧 |
| シミュレーションベンチマークで最先端の性能を達成し、実機の両腕操作タスクでも高い成功率を示した。 | 出典一覧 |
本紙の見方
今回の発表は、Xiaomiがロボット掃除機などの家庭用ロボットにAIを組み込む戦略の一環とみられる。同社は2026年8月に「Robot Vacuum 6」シリーズの国際展開を準備しており、その中で「Xiaomi-Robotics-0」のようなVLAモデルが将来の製品に応用される可能性がある。本モデルはリアルタイム実行に重点を置き、コンシューマー向けGPUで動作する点が特徴で、コストを抑えたロボットへの搭載を意識しているとみられる。これは、高価な専用ハードウェアを必要とせずに高度な操作を実現する方向性を示しており、ロボット掃除機の段差乗り越えなどの高度な動作に寄与する可能性がある。一方で、実機での性能は特定のタスクに限定されており、汎用性や安全性の検証は今後の課題となる。また、オープンソース化により、他社や研究機関がこのモデルを基に開発を進めることで、ロボットAIの標準化が進む可能性もある。次に注目すべきは、このモデルが実際の製品に搭載される時期や、家庭用ロボットでの実用性の検証結果である。
なぜ重要か
XiaomiがロボットAIの基盤モデルをオープンソースで公開したことで、家庭用ロボットの知能化が加速する可能性がある。特に、リアルタイム実行と低コストGPU対応は、実用化へのハードルを下げるものであり、今後の製品展開に影響を与えるとみられる。