Cristina Cipriani
収録論文 1本 ・ フィジカルAI/ロボット学習
オフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- オフライン強化学習における拡散ポリシーのためのノイズ空間ポリシー勾配オフライン強化学習2026/9/7
拡散ポリシーを強化学習に統合するため、ノイズ空間で価値関数を定義し、クリーンな行動空間の価値推定のみを用いてノイズ潜在変数を最適化するポリシー勾配法を提案した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
拡散ポリシーを強化学習に統合するため、ノイズ空間で価値関数を定義し、クリーンな行動空間の価値推定のみを用いてノイズ潜在変数を最適化するポリシー勾配法を提案した。