Yuan-yih Shang
収録論文 1本 ・ フィジカルAI/ロボット学習
模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 保守性を超えて:モデルベース模倣学習のための回復可能性条件付き探索模倣学習2026/9/27
モデルベース模倣学習において、保守的方策学習と能動的データ収集を分離し、メイン方策が専門家行動へ戻れる回復可能な未知状態に探索を集中させるRECONを提案。歩行・ナビゲーション・操作タスクで効率と性能を改善。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
モデルベース模倣学習において、保守的方策学習と能動的データ収集を分離し、メイン方策が専門家行動へ戻れる回復可能な未知状態に探索を集中させるRECONを提案。歩行・ナビゲーション・操作タスクで効率と性能を改善。