Zhongyi Wang
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 批判者ガイダンスによるサンプル効率的な拡散ベース強化学習強化学習2026/5/1
拡散ポリシーを用いた強化学習において、探索と活用のバランスを改善するため、訓練不要のガイダンス技術を拡散過程に統合し、批判者ネットワークが高価値と判断する領域へ行動生成を誘導する手法CGPOを提案した。MuJoCoの5つのタスクで最先端の性能を達成した。