Nicolas Perrin-Gilbert
収録論文 9本 ・ フィジカルAI/ロボット学習
強化学習モデル予測制御歩行
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 品質多様性のための行動基盤モデル強化学習2026/9/28
行動基盤モデル(BFM)の潜在行動空間を探索空間として品質多様性(QD)探索を行うBFM-QDを提案し、密な移動・疎なナビゲーション・接触の多い操作で従来のパラメータ空間ベース手法を上回ることを示した。
- 二次モデル近似による分散低減モデル予測パス積分モデル予測制御2026/2/1
MPPIのサンプリングに二次近似モデルを事前分布として組み込み、残差項の分散を抑えることで少ないサンプル数でも高精度な制御を実現する手法を提案。
- 一次ソボレフ強化学習強化学習2025/11/1
価値関数の値だけでなく状態・行動に対する微分もベルマンターゲットに一致させるソボレフ型損失を導入し、批評家の収束を速め方策勾配を安定化させるTD学習の改良を提案。
- 参照不要のサンプリングベースモデル予測制御歩行2025/11/1
手作り歩容や接触系列に頼らず、サンプリングベースMPCで歩行・走行・跳躍・逆立ちなどの多様な運動を創発的に獲得する手法を提案。
- Single-Reset Divide & Conquer Imitation Learning2024/2/1
- Leveraging Sequentiality in Reinforcement Learning from a Single Demonstration2022/11/1
- Divide & Conquer Imitation Learning2022/4/1
- Exploratory State Representation Learning2021/9/1
- State Representation Learning from Demonstration2019/10/1