何が起きたか
Figureは、物流におけるパッケージ操作・仕分けという新たな実世界用途を発表した。この用途では、コンベアベルト間でのパッケージの移動や、スキャンのための配送ラベルの向きの調整が必要となる。同社は、自社設計のVision-Language-Action(VLA)モデルであるHelixのSystem 1(低レベルの視覚運動制御ポリシー)に対し、以下の改良を施したとしている。 - 暗黙のステレオ視覚:3D理解が向上し、より正確な奥行きを考慮した動作が可能に。 - マルチスケール視覚表現:低レベルのポリシーが細部を捉えつつ、シーン全体の理解を保持。 - 学習された視覚的プロプリオセプション:各ロボットが自己較正可能になり、ロボット間の転移がシームレスに。 - スポーツモード:テスト時の高速化技術により、デモンストレータより速い実行速度を高い成功率と器用さを維持しながら達成。 また、データ品質と量のトレードオフを調査し、わずか8時間の厳選されたデモデータで器用で柔軟なポリシーが得られたとしている。
Key Facts
| Figureは、物流におけるパッケージ操作・仕分けという新たな実世界用途を発表した。 | [0] |
| Figureは、自社設計のVision-Language-Action(VLA)モデルであるHelixを先週発表した。 | [0] |
| Helix System 1に、暗黙のステレオ視覚、マルチスケール視覚表現、学習された視覚的プロプリオセプション、スポーツモードという改良を加えた。 | [0] |
| わずか8時間の厳選されたデモデータで、器用で柔軟なポリシーが得られたとしている。 | [0] |
なぜ重要か
物流におけるパッケージ操作・仕分けは、Figureのビジネスの主要な応用であり、この用途への取り組みがHelix System 1の汎用的な改良につながったとしている。これにより、他の用途にも恩恵が及ぶ可能性がある。