Benjamin Freed
収録論文 2本 ・ フィジカルAI/ロボット学習
マルチエージェント強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 部分報酬分離によるマルチエージェントPPOのクレジット割り当てマルチエージェント強化学習2024/8/1
MAPPOに注意機構ベースの部分報酬分離を導入し、大規模チームを動的に小グループに分解してクレジット割り当てを改善する手法PRD-MAPPOを提案。StarCraft II等でデータ効率と性能を向上させ、共有報酬設定にも拡張した。
- Learning Cooperative Multi-Agent Policies with Partial Reward Decoupling2021/12/1