Yunxian Hou
収録論文 1本 ・ フィジカルAI/ロボット学習
模倣学習/強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 高次行動監督による強力な方策クラス模倣学習/強化学習2026/10/8
模倣学習や強化学習において、0次(行動ラベル)だけでなく1次(行動の時間変化)も同時に監督する損失を提案し、既存の方策モデルに構造変更なしで組み込めるようにした。連続制御タスクで性能とロバスト性が大幅に向上。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
模倣学習や強化学習において、0次(行動ラベル)だけでなく1次(行動の時間変化)も同時に監督する損失を提案し、既存の方策モデルに構造変更なしで組み込めるようにした。連続制御タスクで性能とロバスト性が大幅に向上。