何が起きたか
NVIDIAは2025年10月30日、自動運転向けの視覚言語行動モデル(VLA)「Alpamayo-R1」を発表した。同モデルは、因果推論(Chain of Causation)と軌道計画を統合し、複雑な運転シナリオに対応する。論文では、軌道のみのベースラインと比較して計画精度が最大12%向上し、クローズドループシミュレーションでの接近率が35%減少したと報告している。
詳細
Alpamayo-R1は、Cosmos-Reason(Physical AI向けに事前学習された視覚言語モデル)と拡散ベースの軌道デコーダを組み合わせたモジュール型アーキテクチャを採用する。学習は、教師あり微調整で推論を引き出し、強化学習で推論と行動の整合性を強化する多段階戦略を取る。モデル規模は0.5Bから7Bパラメータまで拡張され、一貫した性能向上が確認された。実車テストでは99ミリ秒のレイテンシでリアルタイム性能を達成し、都市部での展開に成功したとしている。モデル重みはHugging Faceで公開され、推論コードはGitHubで提供される。
Key Facts
| NVIDIAは2025年10月30日、自動運転向けVLAモデル「Alpamayo-R1」を発表した。 | [1] |
| Alpamayo-R1は、因果推論(Chain of Causation)と軌道計画を統合する。 | [1] |
| 軌道のみのベースラインと比較して、計画精度が最大12%向上し、クローズドループシミュレーションでの接近率が35%減少した。 | [1] |
| 強化学習による事後学習で、推論品質が45%、推論と行動の整合性が37%向上した。 | [1] |
| 実車テストで99ミリ秒のレイテンシを達成し、都市部での展開に成功した。 | [1] |
なぜ重要か
Alpamayo-R1は、自動運転におけるAIモデルの進化を示すとともに、NVIDIAが推論シフトの中でソフトウェア層でも存在感を強める可能性を示唆する。自動運転の安全性向上には、解釈可能な推論と正確な制御の統合が重要であり、その実現に向けた一歩として注目される。