何が起きたか

Xiaomiは2026年4月20日、自動運転向けの統一VLA・ワールドモデルフレームワーク「OneVL」を発表した。OneVLは潜在大脳推論を並列処理で実現し、4つのベンチマークで明示的CoTを上回る精度を達成したとしている。コードはオープンソースとして公開された。

詳細

OneVLは、言語デコーダーに加えて視覚ワールドモデルデコーダーを導入し、潜在空間に道路形状やエージェントの動き、環境変化の因果ダイナミクスを内面化させる。3段階のトレーニングパイプラインで軌跡・言語・視覚の目的を段階的に整合させる。推論時には補助デコーダーを破棄し、すべての潜在トークンを単一の並列パスで事前入力するため、応答のみの予測と同じ速度になる。4つのベンチマークで、潜在大脳推論手法として初めて明示的CoTを上回ったとしている。

Key Facts

Xiaomiは2026年4月20日、OneVLを発表した。[1]
OneVLは潜在大脳推論を並列処理で実現し、応答のみの予測と同じ速度を達成した。[1]
OneVLは4つのベンチマークで、潜在大脳推論手法として初めて明示的CoTを上回った。[1]
OneVLは言語デコーダーに加えて視覚ワールドモデルデコーダーを導入した。[1]
OneVLのコードはオープンソースとして公開された。[1]

本紙の見方

OneVLの発表は、Xiaomiが自動運転分野でVLAとワールドモデルを統合する新たなアプローチを示した点で注目される。従来のCoT推論は精度が高いが遅延が課題であり、潜在大脳推論は高速だが精度が劣るというトレードオフがあった。OneVLは視覚ワールドモデルデコーダーを導入することで、潜在空間に因果ダイナミクスを内面化させ、このトレードオフを解消したと主張する。 本紙の過去報道では、Xiaomiが2026年7月に具身智能向けの統一生成モデル「Xiaomi-Robotics-U0」を発表し、ワールドモデルをロボット分野に応用していた。OneVLは同じワールドモデル技術を自動運転に展開したもので、Xiaomiがワールドモデルを核としたAI戦略を進めていることがうかがえる。また、2026年7月には自社ロボットを自動車生産ラインに投入しており、自動運転とロボットの技術シナジーを狙う姿勢が見える。 業界構造への含意として、OneVLは自動運転のリアルタイム推論における潜在大脳推論の可能性を示す。従来の明示的CoTが主流である中で、潜在大脳推論が精度で上回ったことは、今後の自動運転AIの設計に影響を与える可能性がある。また、オープンソース化により、他社がこの技術を利用できるため、業界全体の技術進歩を加速させる可能性がある。 未確定の論点としては、OneVLの実車での性能や、Xiaomiの自動運転システムへの実際の搭載時期が挙げられる。論文ではベンチマークでの精度向上が示されているが、実環境での安全性や信頼性は未検証である。また、潜在大脳推論の解釈可能性や、複雑な交通状況での汎化性能も今後の検証が待たれる。

なぜ重要か

OneVLは、自動運転AIにおける推論速度と精度のトレードオフを解消する可能性を示した。Xiaomiがワールドモデル技術を自動運転に応用したことで、同社のAI戦略がロボットから自動運転まで一貫していることが明確になった。今後の実車搭載や性能検証が、自動運転業界の技術トレンドを左右する可能性がある。