Nicolás Hinrichs
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 能動的推論を凸マルコフ決定過程として捉える強化学習2026/7/22
能動的推論(AIF)の期待自由エネルギー最小化を、閉ループ制御ポリシーに対して凸マルコフ決定過程(MDP)として定式化し、鏡像降下アルゴリズムを導出した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
能動的推論(AIF)の期待自由エネルギー最小化を、閉ループ制御ポリシーに対して凸マルコフ決定過程(MDP)として定式化し、鏡像降下アルゴリズムを導出した。