何が起きたか

Hugging Face上で、模倣学習用の視覚言語行動モデル「xvla-widowx」が公開された。このモデルは、ロボットの動作生成に用いられる。ライセンスはApache-2.0で、米国リージョンで提供される。

詳細

Hugging Faceのモデルリポジトリ「lerobot/xvla-widowx」に、視覚言語行動モデル「xvla-widowx」が公開された。このモデルは、模倣学習(imitation learning)とロボティクス(robotics)の分野で利用される。モデルは、視覚と言語の入力からロボットの行動を生成するVision-Language-Actionモデルであり、safetensors形式で提供される。 モデルカードには、関連論文としてarXiv:2510.10274が引用されている。ライセンスはApache-2.0で、リージョンは米国(us)と指定されている。

Key Facts

Hugging Face上で「lerobot/xvla-widowx」が公開された。[0]
モデルは視覚言語行動(vision-language-action)モデルである。[0]
模倣学習(imitation learning)とロボティクス(robotics)向けである。[0]
モデルはsafetensors形式で提供される。[0]
関連論文はarXiv:2510.10274である。[0]
ライセンスはApache-2.0である。[0]
リージョンは米国(us)である。[0]

なぜ重要か

この公開は、ロボットの模倣学習における視覚言語行動モデルの利用を促進する可能性がある。オープンソースライセンス(Apache-2.0)で提供されるため、研究者や開発者が広く利用できる。