何が起きたか
Do-Hyun-robot氏は、ロボット制御向けの視覚言語行動モデル「SmolVLA」をファインチューンしたポリシー「smolvla_dohyun_v4_policy」と「smolvla_dohyun_policy」をHugging Faceで公開した。両モデルはApache-2.0ライセンスの下で提供され、リージョンは米国とされている。
詳細
公開されたモデルのうち「smolvla_dohyun_v4_policy」は、データセット「Do-Hyun-robot/train_v2_merged」を用いて学習されており、ベースモデルは「lerobot/smolvla_base」である。一方、「smolvla_dohyun_policy」はデータセット「Do-Hyun-robot/train_v1_merged」を使用し、同じく「lerobot/smolvla_base」をベースとしている。両モデルとも、関連する論文としてarXiv:2506.01844が参照されている。 これらのモデルは、ロボット工学の分野で利用されることを想定したもので、Hugging Face上で「lerobot」「safetensors」「robotics」「smolvla」といったタグが付けられている。ライセンスは両方ともApache-2.0で、商用利用を含む幅広い用途に利用可能とされる。
Key Facts
| Do-Hyun-robot氏が「smolvla_dohyun_v4_policy」を公開。 | [0] |
| 「smolvla_dohyun_v4_policy」はデータセット「Do-Hyun-robot/train_v2_merged」を使用。 | [0] |
| 「smolvla_dohyun_v4_policy」のベースモデルは「lerobot/smolvla_base」。 | [0] |
| 「smolvla_dohyun_v4_policy」のライセンスはApache-2.0。 | [0] |
| 「smolvla_dohyun_v4_policy」のリージョンはus。 | [0] |
| Do-Hyun-robot氏が「smolvla_dohyun_policy」を公開。 | [1] |
| 「smolvla_dohyun_policy」はデータセット「Do-Hyun-robot/train_v1_merged」を使用。 | [1] |
| 「smolvla_dohyun_policy」のベースモデルは「lerobot/smolvla_base」。 | [1] |
| 「smolvla_dohyun_policy」のライセンスはApache-2.0。 | [1] |
| 「smolvla_dohyun_policy」のリージョンはus。 | [1] |
なぜ重要か
SmolVLAはロボット制御のための視覚言語行動モデルであり、そのファインチューン済みポリシーが公開されることで、ロボット開発者が特定のタスク向けに調整されたモデルを利用できるようになる。Apache-2.0ライセンスにより商用利用も可能で、ロボット工学の研究開発を促進する可能性がある。