何が起きたか
arXivは2026-09-29、論文「OTRetarget: Joint Robot and Object Motion Retargeting via Optimal Transport」を公開した。論文は、人間のデモからヒューマノイドロボットの動作を移す際に、ロボット形状に合わせつつ環境との相互作用を保つ必要があるとし、ロボットと複数物体の動きを同時に再割り当てする統一手法を提案している。
詳細
手法は、表面間の相互作用を signed distances、closest surface points、relative directions で表現し、entropic optimal transport によって人間・ロボット・物体間でこれらの量を移す構成である。その結果を制約付き逆運動学に組み込み、接触の保持と動作スタイルの両立を図りながら、各フレームでロボット姿勢と物体姿勢を同時最適化する。論文は、シーンや実演を再スケーリングせずに robot-object と object-object の相互作用を扱えるとしている。
Key Facts
| 論文名は「OTRetarget: Joint Robot and Object Motion Retargeting via Optimal Transport」である。 | [1] |
| arXiv掲載日は2026-09-29である。 | [1] |
| 提案手法は、signed distances、closest surface points、relative directions を用いて相互作用を表現する。 | [1] |
| 手法は entropic optimal transport を使って、人間・ロボット・物体の幾何間で量を移す。 | [1] |
| OMOMOで検証し、robot-object interaction Jaccard score 87%、depth error 8.7 mm を示した。 | [1] |
本紙の見方
この論文の新しさは、ロボットの姿勢だけを人間から写すのではなく、物体の軌道も含めて同時に再割り当てする点にある。一方で、実演の接触や相互作用を保つという問題設定自体は、ヒューマノイドの模倣制御やロコマニピュレーション研究の延長線上にある。つまり、課題の定義は既存分野に沿いながら、表面幾何に基づく記述と最適輸送を組み合わせて、ロボット・物体・環境を一つの最適化問題として扱ったところに焦点があるとみられる。 数値面では、OMOMOで robot-object interaction Jaccard score 87%、depth error 8.7 mm を示し、比較対象の OmniRetarget はそれぞれ28%、29.3 mm であった。ここから読み取れるのは、評価軸が単なる姿勢再現ではなく、接触状態と距離誤差をどこまで保てるかに置かれている点である。特に Jaccard と depth error を併記しているため、動作の見た目と接触幾何の双方を見ていることが分かる。これは、ロボット単体の軌道生成よりも、物体を伴う作業での再現性を重視した設計だと考えられる。 本紙の見方では、この成果は学習済みポリシーの前段にある「参照動作の作り方」を細かく詰めた研究である。G1 humanoid に対しては、再割り当てした参照を使って reinforcement learning で訓練した whole-body policies により、両手で箱を持ってテーブルに置く動作まで示している。ただし、論文本文からは、実機での成功率、汎化範囲、データ量、失敗条件、推論時間は読み取れない。今後確認すべき論点は、対象物体や接触形状が変わった場合の頑健性、シーンを再スケーリングしない制約の実用範囲、そして物体・ロボット・環境の相互作用をどの程度まで一般化できるかである。
なぜ重要か
人間のデモからロボットと物体の動きを同時に整合させる方法が示されたことで、両手作業や接触を伴うタスクの参照生成に使える可能性がある。論文では、OMOMOで従来法 OmniRetarget を上回る指標と、実機の G1 humanoid への転送例が示されており、評価の軸が姿勢再現から相互作用の保持へ移っていることが分かる。