Sanika Bharvirkar
収録論文 1本 ・ フィジカルAI/ロボット学習
マルチエージェント強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 部分的観測動的ゲームにおける未知の対戦相手に対するレベルK政策の編成マルチエージェント強化学習2026/10/4
未知の対戦相手の推論レベルを推定して応答を選ぶ従来手法を、部分的観測マルコフゲームにおける動的な政策編成問題として定式化し、強化学習ベースの編成器が分類ベースより高いリターンを達成することを示した。