何が起きたか
Physical Intelligenceは2025年11月17日、VLAモデル「π*0.6」を発表した。同社は新たな学習手法「Recap」を開発し、自律経験で強化学習した結果、最難関タスクのスループットが2倍以上に向上し、失敗率を2倍以上低減したとしている。実証では、エスプレッソ製造を5:30から23:30まで、新居で50種類の未見の洗濯物を数時間中断なく折りたたみ、実際の工場でチョコレート包装用の段ボール箱59個を組み立て・ラベル貼りすることに成功した。
なぜ重要か
重要なのは、実世界で動くロボットでは手本学習だけだと小さな操作ミスが連鎖して止まりやすく、長時間の連続作業や新しい対象への対応が難しいという課題に、この発表が正面から答えている点です。Physical Intelligenceによれば、今回の学習法は人の修正に加えてロボット自身の試行結果も学習に使い、新居での50種類の未見の洗濯物や、実工場で使う包装箱59個の組み立て・ラベル貼りのように、条件の違う作業を中断なく続けられることを示しました。