何が起きたか

Hugging Faceのモデルリポジトリ「lerobot/xvla-base」に、ロボットの視覚言語行動(VLA)モデル「xvla-base」が公開された。このモデルは、模倣学習によるロボット制御を目的としており、safetensors形式で提供されている。ライセンスはApache-2.0で、米国リージョンにホストされている。関連する論文はarXivにプレプリントとして公開されている(arXiv:2510.10274)。

Key Facts

Hugging Face上で「lerobot/xvla-base」として視覚言語行動モデルが公開された。[0]
モデルは模倣学習によるロボット制御向けで、safetensors形式で提供される。[0]
ライセンスはApache-2.0で、arXivに論文が公開されている(arXiv:2510.10274)。[0]

なぜ重要か

視覚と言語を統合した行動モデルは、ロボットの柔軟なタスク実行を可能にする基盤技術として注目されている。Apache-2.0ライセンスでの公開により、研究・産業利用が促進され、ロボットの模倣学習分野の発展に寄与するとみられる。