何が起きたか

Hugging Face上で、LeRobotが「xvla-google-robot」というモデルを公開した。このモデルは、視覚と言語の入力から行動を生成する視覚言語行動(Vision-Language-Action)モデルであり、Googleロボット向けに設計されている。モデルはSafetensors形式で提供され、模倣学習に利用される。ライセンスはApache-2.0で、米国リージョン向けとされる。関連する論文はarXivにプレプリントとして公開されている(arXiv:2510.10274)。

Key Facts

LeRobotがHugging Face上で「xvla-google-robot」モデルを公開した。[0]
モデルは視覚言語行動(Vision-Language-Action)モデルであり、模倣学習に用いられる。[0]
ライセンスはApache-2.0で、米国リージョン向けとされる。[0]
関連論文はarXiv:2510.10274として公開されている。[0]

なぜ重要か

この公開は、ロボット学習分野における視覚言語行動モデルの普及を促進する可能性がある。Apache-2.0ライセンスにより、商用利用を含む幅広い活用が可能となり、模倣学習の研究や実用化が加速するとみられる。