Adam Casselman
収録論文 1本 ・ フィジカルAI/ロボット学習
マルチエージェント強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ポテンシャルゲームと低ランク政策構造によるマルチエージェント到達回避MDPマルチエージェント強化学習2024/10/1
マルチエージェント到達回避MDPを局所フィードバック政策で解き、ポテンシャルゲーム構造を利用して通信・メモリ・計算量を削減しつつ最適解に近い性能を達成する手法を提案。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
マルチエージェント到達回避MDPを局所フィードバック政策で解き、ポテンシャルゲーム構造を利用して通信・メモリ・計算量を削減しつつ最適解に近い性能を達成する手法を提案。