Petar Bevanda
収録論文 2本 ・ フィジカルAI/ロボット学習
オフライン強化学習最適制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 連続時間オフライン強化学習のための作用素モデルオフライン強化学習2025/11/13
連続時間の制御拡散過程を再生核ヒルベルト空間で学習し、作用素論に基づく動的計画法でオフライン強化学習の価値関数の大域的収束と有限サンプル保証を与えた論文。
- カーネルベース最適制御:無限小生成作用素によるアプローチ最適制御2024/12/1
再生核ヒルベルト空間上で非線形確率システムの最適制御を学習する手法を提案し、無限小生成作用素をデータから直接学習してHJB再帰と統合する。