何が起きたか

Hugging Faceのモデルリポジトリに、khoavucao2511氏による「so101_vla_jepa_11_08_26_freeze_Qwen3_45000steps_batch16_chunk100」が公開された。このモデルは、ロボット工学向けの視覚言語行動(VLA)モデルであり、JEPA(Joint Embedding Predictive Architecture)を統合したものとされる。モデルはLeRobot形式のsafetensorsファイルで提供され、ライセンスはApache-2.0。トレーニングにはデータセット「vasco281204/so101_green_block_36」が使用され、関連する論文はarXiv:2602.10098として公開されている。

Key Facts

Hugging Face上でモデル「so101_vla_jepa_11_08_26_freeze_Qwen3_45000steps_batch16_chunk100」が公開された。[0]
モデルはロボット工学向けのVLA-JEPAモデルであり、LeRobot形式のsafetensorsファイルで提供される。[0]
ライセンスはApache-2.0。[0]
トレーニングにはデータセット「vasco281204/so101_green_block_36」が使用された。[0]
関連論文はarXiv:2602.10098として公開されている。[0]

なぜ重要か

VLA-JEPAモデルの公開は、ロボットの知覚と行動学習の分野における進展を示すものであり、オープンソースライセンス(Apache-2.0)で提供されることで、研究者や開発者がモデルを利用しやすくなる可能性がある。