Qicheng He
収録論文 1本 ・ フィジカルAI/ロボット学習
模倣学習/逆強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 拡散ベースのポリシーにおける隠れた報酬の回復模倣学習/逆強化学習2026/5/1
拡散モデルと逆強化学習を統合し、スコア関数が専門家のソフトQ関数の勾配を回復することを利用して、敵対的学習なしで報酬を抽出するフレームワークを提案した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
拡散モデルと逆強化学習を統合し、スコア関数が専門家のソフトQ関数の勾配を回復することを利用して、敵対的学習なしで報酬を抽出するフレームワークを提案した。