Eberhard Gill
収録論文 4本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- オンライン強化学習制御アルゴリズム解釈のためのCritic適合損失景観の可視化強化学習2026/3/1
オンライン強化学習のCriticネットワークの学習過程を低次元部分空間に射影して損失景観を可視化し、定量的指標で性能を比較する手法を提案。
- オフポリシー強化学習への批判的マッチ損失ランドスケープ可視化の適応強化学習2026/3/1
オンライン強化学習向けの批判的マッチ損失ランドスケープ可視化手法を、リプレイベースのオフポリシー強化学習(SACなど)に適応させ、批判的学習の最適化幾何学を可視化する手法を提案した。宇宙機の姿勢制御問題に適用し、収束・発散のケースで異なる幾何学的パターンを示すことを確認した。
- 強化学習の解釈のための損失ランドスケープ可視化フレームワーク:ADHDPケーススタディ強化学習2026/3/1
強化学習の学習過程を可視化するフレームワークを提案し、ADHDPアルゴリズムを宇宙機の姿勢制御に適用して、損失曲面や状態TDマップなど4つの視点から学習ダイナミクスを解釈する。
- A model-based framework for learning transparent swarm behaviors2021/3/1