Runzhe Wu
収録論文 2本 ・ フィジカルAI/ロボット学習
模倣学習強化学習理論
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 状態拡散とスコアマッチングによる模倣学習の新枠組み模倣学習2024/10/17
拡散モデルの考え方を逐次意思決定に持ち込み、状態をノイズ拡散させてスコアマッチングで専門家と学習者の状態分布の差を測る、敵対的でない安定な模倣学習手法を提案。
- 決定論的ダイナミクスにおける線形ベルマン完全性下での計算効率の良い強化学習強化学習理論2024/6/1
線形ベルマン完全性を満たす決定論的MDPに対し、最小二乗回帰にランダムノイズを注入する楽観的価値反復により、計算効率の良い強化学習アルゴリズムを提案した。