Yuting Tang
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 遅延報酬の単純和を超えて:強化学習のための非マルコフ報酬モデリング強化学習2024/10/26
遅延報酬が単純な報酬の和ではなく複雑な構造を持つ場合を扱うRLCoDe問題を提案し、非マルコフ成分の重み付き和でモデル化するCoDeTrを開発した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
遅延報酬が単純な報酬の和ではなく複雑な構造を持つ場合を扱うRLCoDe問題を提案し、非マルコフ成分の重み付き和でモデル化するCoDeTrを開発した。