Haicheng Wang
収録論文 1本 ・ フィジカルAI/ロボット学習
世界モデル/探索
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 好奇心批評家:累積予測誤差の改善を利用した世界モデル学習のための扱いやすい内的報酬世界モデル/探索2026/4/20
世界モデルの累積予測誤差の改善を内的報酬とする手法を提案し、現在の遷移の予測誤差と漸近誤差ベースラインの差という扱いやすい代理報酬を導入した。確率的グリッドワールドで既存手法より高速かつ高精度な学習を実証した。