何が起きたか
2025年9月30日、arXivに論文「OmniRetarget: Interaction-Preserving Data Generation for Humanoid Whole-Body Loco-Manipulation and Scene Interaction」が公開された。この研究は、人間の動作をUnitree G1ヒューマノイドの強化学習ポリシー訓練用の運動参照に変換するデータ生成エンジン「OmniRetarget」を提案するものである。
詳細
従来のリターゲティング手法は、人間とロボットの身体差(エンボディメントギャップ)により、足の滑りや貫通などの物理的に非現実的なアーティファクトを生成しがちだった。また、人間と物体、環境との相互作用を無視する傾向があった。OmniRetargetは、インタラクションメッシュを用いてエージェントと地形、操作対象物との間の空間的・接触関係を明示的にモデル化し、ラプラシアン変形を最小化しながら運動学的制約を課すことで、運動学的に実現可能な軌道を生成する。さらに、タスク関連の相互作用を保持することで、単一のデモンストレーションから異なるロボットの身体、地形、物体構成への効率的なデータ拡張を可能にする。
Key Facts
| OmniRetargetは、人間の動作をUnitree G1ヒューマノイドの強化学習ポリシー訓練用にリターゲットするデータ生成エンジンである。 | [1] |
| OmniRetargetは、インタラクションメッシュを用いてエージェント、地形、操作対象物間の空間的・接触関係をモデル化する。 | [1] |
| OmniRetargetは、ラプラシアン変形の最小化と運動学的制約の強制により、運動学的に実現可能な軌道を生成する。 | [1] |
| OmniRetargetは、単一のデモンストレーションから異なるロボットの身体、地形、物体構成へのデータ拡張を可能にする。 | [1] |
| 評価では、OMOMO、LAFAN1、および自社のMoCapデータセットからモーションをリターゲットし、8時間以上の軌道を生成した。 | [1] |
| OmniRetargetは、広く使われるベースラインと比較して、運動学的制約の充足と接触保存の点で優れているとされる。 | [1] |
| 生成された高品質データにより、Unitree G1ヒューマノイドは、5つの報酬項と単純なドメインランダム化のみで、最大30秒の長期的なパルクールとロコ操作スキルを実行できる。 | [1] |
なぜ重要か
この研究は、ヒューマノイドロボットの複雑なスキル学習におけるデータ生成の課題に対処するものであり、特に人間と環境の相互作用を保持することで、より現実的で汎用的な動作生成を可能にする。Unitree G1での実証は、実機への応用可能性を示している。