Stefano Albrecht
収録論文 1本 ・ フィジカルAI/ロボット学習
マルチエージェント強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- マルチエージェント強化学習における時間・エージェント間の報酬再分配マルチエージェント強化学習2025/2/1
マルチエージェント強化学習の信用割り当て問題に対し、モデル精度に依存せず最適方策を保証する報酬再分配手法TAR²を提案し、SMACLiteやGRFで学習加速と性能向上を示した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
マルチエージェント強化学習の信用割り当て問題に対し、モデル精度に依存せず最適方策を保証する報酬再分配手法TAR²を提案し、SMACLiteやGRFで学習加速と性能向上を示した。