Aditya Kapoor
収録論文 11本 ・ フィジカルAI/ロボット学習
マルチエージェント強化学習マルチエージェント計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- マルチエージェント強化学習のための低ランクエージェント特化適応(LoRASA)マルチエージェント強化学習2025/2/1
共有ポリシーに低ランクのエージェント特化行列を追加することで、パラメータ共有の効率性を保ちつつ各エージェントの専門化を促進するマルチエージェント強化学習手法を提案。
- マルチエージェント強化学習における時間・エージェント間の報酬再分配マルチエージェント強化学習2025/2/1
マルチエージェント強化学習の信用割り当て問題に対し、モデル精度に依存せず最適方策を保証する報酬再分配手法TAR²を提案し、SMACLiteやGRFで学習加速と性能向上を示した。
- スパースなマルチエージェント強化学習における最適方策保存のためのエージェント・時間クレジット割り当てマルチエージェント強化学習2024/12/1
スパースなグローバル報酬を時間方向とエージェント方向に再分配するTAR²を提案し、ポテンシャルベース報酬整形との等価性を理論的に示して最適方策を保ちながら学習を安定・高速化した。
- 部分報酬分離によるマルチエージェントPPOのクレジット割り当てマルチエージェント強化学習2024/8/1
MAPPOに注意機構ベースの部分報酬分離を導入し、大規模チームを動的に小グループに分解してクレジット割り当てを改善する手法PRD-MAPPOを提案。StarCraft II等でデータ効率と性能を向上させ、共有報酬設定にも拡張した。
- LLaMAR: 部分観測環境におけるマルチエージェントロボットの長期計画マルチエージェント計画2024/7/1
言語モデルを用いて、部分観測可能なマルチエージェント環境での長期タスク計画を自己修正しながら実行する手法を提案し、家庭内タスクと捜索救助タスクで成功率を30%向上させた。
- Concept-based Anomaly Detection in Retail Stores for Automatic Correction using Mobile Robots2023/10/1
- SocNavGym: A Reinforcement Learning Gym for Social Navigation2023/4/1
- Auto-TransRL: Autonomous Composition of Vision Pipelines for Robotic Perception2022/9/1
- Challenges in Applying Robotics to Retail Store Management2022/8/1
- Learning Cooperative Multi-Agent Policies with Partial Reward Decoupling2021/12/1
- A Toolkit to Generate Social Navigation Datasets2020/9/1