何が起きたか
同社はデモンストレーション、コーチング、強化学習の3段階でロボットを訓練する手法「Recap」を用いて、π*0.6を開発した。π*0.6はエスプレッソ製造、段ボール箱組み立て、洗濯物折りたたみなどのタスクで、スループット2倍以上、失敗率2分の1以下を達成したと発表した。
なぜ重要か
Physical Intelligenceによると、Recapは人の示範だけでは起きやすい累積誤差を、修正の介入と自律経験で補うための学習手法です。エスプレッソ作成や箱組み立て、洗濯物折りたたみのように、連続して動く実機で安定して速く動かしたい場面が対象で、同社はπ*0.6で処理量と失敗率を改善したとしています。