Mayank Baranwal
収録論文 3本 ・ フィジカルAI/ロボット学習
群制御マルチエージェント強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 共に立ち上がれ:協調的異種プレイによるリアルタイム複数ロボットタスク割り当ての最適化群制御2025/2/1
倉庫での複数ロボットのリアルタイムタスク割り当てを、自己対戦に着想を得た二重エージェント強化学習で最適化し、バッテリー管理や衝突回避も考慮したフレームワークMRTAgentを提案。
- マルチエージェント強化学習における時間・エージェント間の報酬再分配マルチエージェント強化学習2025/2/1
マルチエージェント強化学習の信用割り当て問題に対し、モデル精度に依存せず最適方策を保証する報酬再分配手法TAR²を提案し、SMACLiteやGRFで学習加速と性能向上を示した。
- スパースなマルチエージェント強化学習における最適方策保存のためのエージェント・時間クレジット割り当てマルチエージェント強化学習2024/12/1
スパースなグローバル報酬を時間方向とエージェント方向に再分配するTAR²を提案し、ポテンシャルベース報酬整形との等価性を理論的に示して最適方策を保ちながら学習を安定・高速化した。