Aditya Grover
収録論文 6本 ・ フィジカルAI/ロボット学習
世界モデル強化学習/LLM報酬
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- マスクから世界へ:世界モデル構築のための実践ガイド世界モデル2025/10/23
初期のマスクモデルから統一アーキテクチャ、対話型生成モデル、記憶拡張システムへと至る世界モデル構築の道筋を、生成・対話・記憶の3要素に焦点を当てて解説する。
- 大規模言語モデルフィードバックによる意思決定エージェントのためのオンライン内的報酬強化学習/LLM報酬2024/10/1
LLMのフィードバックを非同期で利用し、RL方策と内的報酬関数を同時に学習する分散アーキテクチャONIを提案。NetHackで最先端性能を達成し、大規模オフラインデータセットを不要にした。
- Guided Flows for Generative Modeling and Decision Making2023/11/1
- Semi-Supervised Offline Reinforcement Learning with Action-Free Trajectories2022/10/1
- Learning from an Exploring Demonstrator: Optimal Reward Estimation for Bandits2021/6/1
- Reset-Free Lifelong Learning with Skill-Space Planning2020/12/1