Jai Malegaonkar
収録論文 3本 ・ フィジカルAI/ロボット学習
強化学習マルチエージェント強化学習群制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 報酬構造が強化学習におけるエピソード探索と神経記憶の相互作用を形成する強化学習2026/8/5
部分観測強化学習において、探索ボーナスと記憶アーキテクチャの相互作用を制御された環境で調査し、報酬の構造(密度ではなく)がその相互作用パターンを決定することを示した。
- 調整には時としてランダム性が必要であるマルチエージェント強化学習2026/5/1
協調マルチエージェント強化学習において、対称な観測下で決定的方策が役割分化できない問題を、エージェントごとに乱数をサンプリングして順位付けし注意をマスクするDiamond Attentionで解決し、ゼロショット転移を実現した。
- GAMMS: グラフベースの敵対的マルチエージェントモデリングシミュレータ群制御2026/2/1
グラフで表現できる環境でのマルチエージェントシミュレーションを、軽量かつ拡張可能に実行できるオープンソースフレームワークGAMMSを提案。可視化や外部ツール連携を備え、LLMを含む多様なエージェントを扱える。