何が起きたか

VLABenchは2026年8月15日、Hugging Face上でロボット向けの事前学習モデル「pifast-pretrain-vlabench-primitive-aligned」を公開した。モデルはvision-language-action(VLA)モデルであり、pi0-fastとVLABenchを基盤としている。ライセンスはApache-2.0で、米国(region:us)を対象としている。

詳細

このモデルは、ロボット操作タスクのための事前学習済みモデルであり、pi0-fastアーキテクチャを採用している。VLABenchは、視覚と言語の指示から行動を生成するVLAモデルの一種で、OpenPIプロジェクト(arxiv:2412.18194)に関連している。モデルは「primitive-aligned」という名称から、プリミティブ動作に合わせた調整が行われている可能性がある。

Key Facts

VLABenchが「pifast-pretrain-vlabench-primitive-aligned」をHugging Faceで公開[1]
モデルはpi0-fastとVLABenchを組み合わせたvision-language-actionモデル[1]
ライセンスはApache-2.0[1]
対象地域は米国(region:us)[1]
OpenPIプロジェクト(arxiv:2412.18194)に関連[1]

なぜ重要か

この公開は、ロボット操作におけるVLAモデルの事前学習の進展を示すものであり、Apache-2.0ライセンスによりコミュニティでの利用や改良が促進される可能性がある。