Wensen Mao
収録論文 1本 ・ フィジカルAI/ロボット学習
目標条件付き強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 制約なし目標ナビゲーションのための世界モデル学習目標条件付き強化学習2024/11/1
リプレイバッファ内の任意のサブゴール間の状態遷移をモデル化する世界モデルベースの探索アルゴリズムMUNを提案し、新しい目標設定への汎化性能を向上させた。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
リプレイバッファ内の任意のサブゴール間の状態遷移をモデル化する世界モデルベースの探索アルゴリズムMUNを提案し、新しい目標設定への汎化性能を向上させた。