何が起きたか
Figureは、ヒューマノイド向けのVision-Language-Action(VLA)モデル「Helix」に関する2つの重要な進展を発表した。1つ目は「Project Go-Big」と名付けた大規模なヒューマノイド事前学習データ収集イニシアチブであり、Brookfield Asset Managementとの提携により、世界最大かつ最も多様なヒューマノイド事前学習データセットを構築するとしている。Brookfieldは世界で10万戸以上の住宅ユニット、5億平方フィートの商業オフィススペース、1億6千万平方フィートの物流スペースを所有しており、FigureはすでにBrookfieldの環境でデータ収集を開始し、今後数ヶ月で規模を拡大する予定である。2つ目は、人間の一人称視点動画のみで学習した後、自然言語コマンド(例:「冷蔵庫に行って」)で雑然とした実世界の空間をナビゲートできる「ゼロショットの人間ビデオからロボットへの転送」を達成したと発表した。これはヒューマノイドロボティクスで初めてのことだとしている。
Key Facts
| Figureは、ヒューマノイド向けVLAモデル「Helix」の2つの進展を発表した。 | [0] |
| 1つ目の進展は「Project Go-Big」で、世界最大かつ最も多様なヒューマノイド事前学習データセットを構築する取り組みである。 | [0] |
| FigureはBrookfield Asset Managementとの提携を発表し、Brookfieldの資産基盤(1兆ドル、10万戸以上の住宅ユニット、5億平方フィートの商業オフィススペース、1億6千万平方フィートの物流スペース)を活用してProject Go-Bigを加速させるとしている。 | [0] |
| FigureはすでにBrookfieldの環境でデータ収集を開始しており、今後数ヶ月でプログラムを拡大する予定である。 | [0] |
| 2つ目の進展として、Helixは人間の一人称視点動画のみで学習した後、自然言語コマンド(例:「冷蔵庫に行って」)で雑然とした実世界の空間をナビゲートできる「ゼロショットの人間ビデオからロボットへの転送」を達成した。 | [0] |
| Figureは、このゼロショット転送はヒューマノイドロボティクスで初めてのことだとしている。 | [0] |
なぜ重要か
この発表は、ヒューマノイドロボットが実世界の多様な環境で学習するためのデータ収集方法と、人間の行動を直接ロボットに転送する可能性を示すものである。特に、Brookfieldとの提携により、大規模かつ多様な実世界環境でのデータ収集が可能になる点は、ロボットの汎用性向上に寄与する可能性がある。