何が起きたか

Figureは、物流におけるパッケージ操作・仕分けという新たな実世界用途を発表した。この用途では、コンベアベルト間でのパッケージの移動や、スキャンのための配送ラベルの向きの調整が必要となる。同社は、自社設計のVision-Language-Action(VLA)モデルであるHelixのSystem 1(低レベルの視覚運動制御ポリシー)に対し、以下の改良を施したとしている。 - 暗黙のステレオ視覚:3D理解が向上し、より正確な奥行きを考慮した動作が可能に。 - マルチスケール視覚表現:低レベルのポリシーが細部を捉えつつ、シーン全体の理解を保持。 - 学習された視覚的プロプリオセプション:各ロボットが自己較正可能になり、ロボット間の転移がシームレスに。 - スポーツモード:テスト時の高速化技術により、デモンストレータより速い実行速度を高い成功率と器用さを維持しながら達成。 また、データ品質と量のトレードオフを調査し、わずか8時間の厳選されたデモデータで器用で柔軟なポリシーが得られたとしている。

Key Facts

Figureは、物流におけるパッケージ操作・仕分けという新たな実世界用途を発表した。[0]
Figureは、自社設計のVision-Language-Action(VLA)モデルであるHelixを先週発表した。[0]
Helix System 1に、暗黙のステレオ視覚、マルチスケール視覚表現、学習された視覚的プロプリオセプション、スポーツモードという改良を加えた。[0]
わずか8時間の厳選されたデモデータで、器用で柔軟なポリシーが得られたとしている。[0]

なぜ重要か

物流におけるパッケージ操作・仕分けは、Figureのビジネスの主要な応用であり、この用途への取り組みがHelix System 1の汎用的な改良につながったとしている。これにより、他の用途にも恩恵が及ぶ可能性がある。