Benjamin Ellis
収録論文 1本 ・ フィジカルAI/ロボット学習
オフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 方策誘導拡散モデルによるオフライン強化学習オフライン強化学習2024/4/1
拡散モデルで行動方策の軌道を生成し、目標方策の誘導を加えることで、オフライン強化学習の性能を向上させる手法を提案した論文。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
拡散モデルで行動方策の軌道を生成し、目標方策の誘導を加えることで、オフライン強化学習の性能を向上させる手法を提案した論文。