Motoki Omura
収録論文 3本 ・ フィジカルAI/ロボット学習
強化学習オフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 大規模強化学習におけるアンサンブル方策勾配法のポリシー多様性の再考強化学習2026/3/1
アンサンブル方策勾配法において、ポリシー間の多様性をKL制約で調整するCoupled Policy Optimizationを提案し、探索効率と最終性能を向上させた。
- 最適輸送写像によるWasserstein正則化を用いたオフライン強化学習オフライン強化学習2025/7/1
オフライン強化学習において、入力凸ニューラルネットワークで最適輸送写像をモデル化し、Wasserstein距離による正則化を敵対的学習なしで安定に計算する手法を提案。D4RLベンチマークで既存手法と同等以上の性能を示した。
- オンライン強化学習におけるベルマン最適作用素からベルマン作用素への段階的遷移強化学習2025/6/1
連続行動空間のアクター・クリティック強化学習において、ベルマン最適作用素を徐々にベルマン作用素へと切り替えるアニーリング手法を提案し、学習加速と過大評価バイアスの抑制を両立させた。