何が起きたか

Google DeepMindは2026年7月30日、ロボット向けの身体化推論モデル「Gemini Robotics ER 2」を発表した。同モデルはロボットの高次脳として、対話、物理世界の理解、複数ステップのタスク計画を担い、モーター制御は下位のVLAモデルに委ねる。前世代ER 1.6からのアップグレードで、連続ビデオフィードによる自己進捗の追跡とマルチロボット協調を新たに導入した。開発者向けにGemini API、Google AI Studio、Gemini Enterprise Agent Platform(プライベートプレビュー)で公開される。

なぜ重要か

ロボット向けに使う開発者にとっては、対話、物理世界の理解、複数手順の計画を担う上位モデルとして、下位の視覚・言語・行動モデルに制御を渡せる点が重要です。連続する映像で進捗を追跡し、失敗時にやり直したり次の手順へ切り替えたりできるとしており、複雑な作業の手順管理に関わります。