Max Beier
収録論文 1本 ・ フィジカルAI/ロボット学習
オフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 連続時間オフライン強化学習のための作用素モデルオフライン強化学習2025/11/13
連続時間の制御拡散過程を再生核ヒルベルト空間で学習し、作用素論に基づく動的計画法でオフライン強化学習の価値関数の大域的収束と有限サンプル保証を与えた論文。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
連続時間の制御拡散過程を再生核ヒルベルト空間で学習し、作用素論に基づく動的計画法でオフライン強化学習の価値関数の大域的収束と有限サンプル保証を与えた論文。