何が起きたか
Physical Intelligenceは2025年12月16日、人間の一人称視点動画をロボット基盤モデルπ0.5の追加学習に用いることで、ロボットデータが限られたタスクでの性能が約2倍向上したと発表した。同社は、卵の色分け整理など4つの汎化シナリオで性能が平均約2倍に向上したと報告している。
なぜ重要か
ロボットの実演データを十分に集めにくい作業を扱う研究者や開発者にとって、人の装着カメラ動画をそのまま追加学習に使えるかは、学習データの集め方を左右する論点です。Physical Intelligenceは、卵の色分けや整理先の指定など、ロボット側にはない場面を人の動画で補った4課題で平均約2倍の改善が出たとし、しかも人とロボットの見え方や動きの違いを埋める特別な変換なしで成り立った点を示しました。