Qinqing Zheng
収録論文 4本 ・ フィジカルAI/ロボット学習
強化学習/LLM報酬
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 大規模言語モデルフィードバックによる意思決定エージェントのためのオンライン内的報酬強化学習/LLM報酬2024/10/1
LLMのフィードバックを非同期で利用し、RL方策と内的報酬関数を同時に学習する分散アーキテクチャONIを提案。NetHackで最先端性能を達成し、大規模オフラインデータセットを不要にした。
- Guided Flows for Generative Modeling and Decision Making2023/11/1
- Dual RL: Unification and New Methods for Reinforcement and Imitation Learning2023/2/1
- Semi-Supervised Offline Reinforcement Learning with Action-Free Trajectories2022/10/1