Aritra Hazra
収録論文 4本 ・ フィジカルAI/ロボット学習
強化学習模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 方向条件付き方策によるオンライン目標条件付き強化学習強化学習2026/10/4
コントラスティブ強化学習の批評家が持つ表現空間の幾何学を直接活用するため、方策を方向と距離で条件付ける手法を提案し、ナビゲーションとマニピュレーションで成功率を向上させた。
- 方向条件付きポリシー:構成部分ゴールスコアリングによるオンライン目標条件付き強化学習強化学習2026/6/15
目標までの距離の勾配のみに依存する方向条件付きポリシーを提案し、オンライン目標条件付き強化学習の性能を向上させた。
- SPAARS: 抽象探索と行動空間の洗練された活用による安全なRLポリシー整合強化学習2026/3/1
オフラインからオンラインへの強化学習において、潜在空間での安全な探索から生の行動空間での活用へと移行するカリキュラム学習フレームワークを提案し、デコーダの再構成損失による性能上限を克服する。
- DiffClone: 拡散モデルによる方策学習で強化したロボット行動クローニング模倣学習2024/1/1
拡散モデルを用いた条件付き方策学習により、オフライン実演データからのロボット行動クローニングを強化するDiffCloneを提案し、実機オンライン評価で有効性を検証した。