Pavel Kolev
収録論文 8本 ・ フィジカルAI/ロボット学習
歩行制約付き強化学習模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LoComposition: 歩容事前知識なしの地形適応型・高エネルギー効率四足歩行歩行2026/6/14
報酬設計をタスク・制約・エネルギー最小化・地形適応に分離し、歩容の事前知識なしで効率的な四足歩行を実現。実機Go2でゼロショット転送に成功し、コスト・オブ・トランスポートを56%削減した。
- 制約付き強化学習のための確率的決定ホライズン制約付き強化学習2026/2/4
制約違反がホライズンを短縮する確率的決定ホライズン(SDH)を提案し、制約付きRLのオフポリシーかつ正則化アルゴリズムを開発した。
- Dual-Force: 模倣制約下でのオフライン多様性最大化の強化模倣学習2025/1/1
模倣制約下でオフラインデータから多様な行動を学習する手法を提案し、ファンデルワールス力を用いた多様性推定と事前学習済み報酬エンコーディングで安定化を図り、Solo12の歩行と障害物回避で有効性を示した。
- Learning Diverse Skills for Local Navigation under Multi-constraint Optimality2023/10/1
- Real Robot Challenge 2022: Learning Dexterous Manipulation from Offline Data in the Real World2023/8/1
- Benchmarking Offline Reinforcement Learning on Real-Robot Hardware2023/7/1
- Offline Diversity Maximization Under Imitation Constraints2023/7/1
- Versatile Skill Control via Self-supervised Adversarial Imitation of Unlabeled Mixed Motions2022/9/1