Yunqiang Pei
収録論文 2本 ・ フィジカルAI/ロボット学習
強化学習オフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 非専門家の観測データからの効果的なサブゴール誘導による目標到達方策学習強化学習2024/9/1
非専門家の行動なし観測データから長期的な目標到達方策を学ぶため、拡散モデルでサブゴールを生成し、状態-目標価値関数で効率的な探索を促す手法を提案した。
- 拡散モデルを最適化器として活用するオフライン強化学習の効率的計画法オフライン強化学習2024/7/1
拡散モデルのサンプリングを軌道生成と最適化に分離し、自己回帰モデルで高速に実行可能な軌道を生成しつつ拡散モデルで最適化することで、オフライン強化学習の計画を3〜10倍高速化した。