Shengren Rao
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 拡散モデルとPPOの統合による強化学習のサンプル効率と探索の向上強化学習2024/9/1
オフラインで学習した条件付き拡散行動事前分布をLoRA等でオンライン適応し、PPOの探索を改善するオンポリシー手法PPO-DAPを提案。MuJoCo 8タスクでサンプル効率が向上。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
オフラインで学習した条件付き拡散行動事前分布をLoRA等でオンライン適応し、PPOの探索を改善するオンポリシー手法PPO-DAPを提案。MuJoCo 8タスクでサンプル効率が向上。