Perry Dong
Stanford University
収録論文 5本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 世界モデルを用いたQ学習強化学習2026/8/17
Q学習に世界モデルを組み合わせ、実データのみで学習しつつ想像上の軌道で探索を行うことで、サンプル効率と性能を向上させる手法を提案した。
- EXPO-FT: Sample-Efficient Reinforcement Learning Finetuning for Vision-Language-Action Models2026/5/1
- Posterior Behavioral Cloning: Pretraining BC Policies for Efficient RL Finetuning2025/12/1
- What Matters for Batch Online Reinforcement Learning in Robotics?2025/5/1
- RLIF: Interactive Imitation Learning as Reinforcement Learning2023/11/1