Christian Scherer
収録論文 1本 ・ フィジカルAI/ロボット学習
模倣学習/逆強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 学習報酬を用いた大規模行動モデルのコヒーレントなオフポリシー改善模倣学習/逆強化学習2026/6/1
大規模な事前学習済みロボット操作ポリシーを、逆強化学習で学習した稠密報酬を用いて微調整し、スパース報酬のRLベースラインよりも高い成功率を達成した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
大規模な事前学習済みロボット操作ポリシーを、逆強化学習で学習した稠密報酬を用いて微調整し、スパース報酬のRLベースラインよりも高い成功率を達成した。