Scott Sanner
収録論文 6本 ・ フィジカルAI/ロボット学習
世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OPINE-World: オントロジー誤差優先の対話的探索によるARC-AGI-3向けプログラム的世界モデリング世界モデル2026/7/1
LLMエージェントが環境との相互作用からオブジェクト中心のプログラム的世界モデルをオンライン学習する手法を提案し、ARC-AGI-3ベンチマークで高い性能を達成した。
- Constraint-Generation Policy Optimization (CGPO): Nonlinear Programming for Policy Optimization in Mixed Discrete-Continuous MDPs2024/1/1
- Risk-Aware Transfer in Reinforcement Learning using Successor Features2021/5/1
- {\epsilon}-BMC: A Bayesian Ensemble Approach to Epsilon-Greedy Exploration in Model-Free Reinforcement Learning2020/7/1
- Bayesian Experience Reuse for Learning from Multiple Demonstrators2020/6/1
- Contextual Policy Transfer in Reinforcement Learning Domains via Deep Mixtures-of-Experts2020/3/1