何が起きたか
研究チームは2025年2月12日付でarXivにプレプリント「Learning Humanoid Standing-up Control across Diverse Postures」を公開した。この論文では、ヒューマノイドロボットの立ち上がり制御をゼロから学習する強化学習フレームワーク「HoST (Humanoid Standing-up Control)」を提案している。提案手法は、マルチクリティックアーキテクチャと多様なシミュレーション地形でのカリキュラムベースの訓練を活用し、姿勢適応的な動作を学習する。訓練後の制御ポリシーはUnitree G1ヒューマノイドロボットに直接展開され、実験室と屋外の広範な環境でスムーズで安定した立ち上がり動作を達成したと報告されている。
詳細
既存の立ち上がり制御アプローチは、ハードウェアの制約を無視したシミュレーションに限定されるか、事前定義された地面固有の動作軌道に依存しており、実世界のシーンで多様な姿勢からの立ち上がりを実現できていない。HoSTはこのギャップを埋めるため、シミュレーションから実機への転送を可能にするロバストなフレームワークとして設計された。 実世界展開を成功させるため、HoSTは動作の平滑化正則化と暗黙の動作速度制限を用いて、物理ハードウェア上の振動的・激しい動作を軽減している。実験結果では、制御ポリシーが広範な実験室および屋外環境でスムーズで安定したロバストな立ち上がり動作を達成したとしている。ビデオとコードはプロジェクトページで公開されている。
Key Facts
| 研究チームは2025年2月12日付でarXivにプレプリントを公開した。 | [1] |
| 提案されたフレームワークは「HoST (Humanoid Standing-up Control)」と呼ばれる。 | [1] |
| HoSTは強化学習を用いて立ち上がり制御をゼロから学習する。 | [1] |
| HoSTはマルチクリティックアーキテクチャとカリキュラムベースの訓練を活用する。 | [1] |
| 訓練は多様なシミュレーション地形で行われる。 | [1] |
| 制御ポリシーはUnitree G1ヒューマノイドロボットに直接展開された。 | [1] |
| 実験結果では、広範な実験室および屋外環境でスムーズで安定した立ち上がり動作を達成したと報告されている。 | [1] |
| ビデオとコードはhttps://taohuang13.github.io/humanoid-standingup.github.io/で公開されている。 | [1] |
なぜ重要か
この研究は、ヒューマノイドロボットの立ち上がり制御を実世界の多様な姿勢に拡張するものであり、転倒回復などの既存の移動・操作システムへの統合が期待される。シミュレーションから実機への直接展開を可能にする点で、ロボットの実用性向上に寄与する可能性がある。