Swaminathan S K
収録論文 2本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 方向条件付きポリシー:構成部分ゴールスコアリングによるオンライン目標条件付き強化学習強化学習2026/6/15
目標までの距離の勾配のみに依存する方向条件付きポリシーを提案し、オンライン目標条件付き強化学習の性能を向上させた。
- SPAARS: 抽象探索と行動空間の洗練された活用による安全なRLポリシー整合強化学習2026/3/1
オフラインからオンラインへの強化学習において、潜在空間での安全な探索から生の行動空間での活用へと移行するカリキュラム学習フレームワークを提案し、デコーダの再構成損失による性能上限を克服する。