Maxence Faldor
収録論文 4本 ・ フィジカルAI/ロボット学習
歩行進化計算/強化学習強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 白紙状態から創発的能力へ:実世界の教師なし品質多様性によるロボットスキル発見歩行2025/8/1
実世界で四足歩行ロボットが多様な移動スキルを教師なしで自律的に発見・習得する手法URSAを提案し、損傷適応タスクでも有効性を示した。
- 行動変異による大規模並列化で方策勾配品質多様性をスケーリング進化計算/強化学習2025/1/1
MAP-Elitesを方策勾配で拡張し、集中型actor-criticに依存せず大規模並列化可能にしたASCII-MEを提案。単一GPUで250秒未満に高性能な多様方策群を生成し、既存手法より平均5倍高速。
- 品質多様性アクタークリティック:価値と後継特徴クリティックによる高性能で多様な行動の学習強化学習2024/3/15
価値関数と後継特徴の2つのクリティックを制約付き最適化で統合し、高いリターンと多様なスキルを同時に獲得するオフポリシー強化学習手法QDACを提案した。
- Synergizing Quality-Diversity with Descriptor-Conditioned Reinforcement Learning2024/1/1