Zuolin Tu
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- リカレント強化学習の安定化のための文脈エンコーダ専用学習率強化学習2024/5/24
部分観測マルコフ決定過程(POMDP)向けのリカレント強化学習において、文脈エンコーダに他層より低い学習率を設定することで訓練の安定性を高める手法RESeLを提案し、18のPOMDPタスクと5つのMDPタスクで有効性を示した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
部分観測マルコフ決定過程(POMDP)向けのリカレント強化学習において、文脈エンコーダに他層より低い学習率を設定することで訓練の安定性を高める手法RESeLを提案し、18のPOMDPタスクと5つのMDPタスクで有効性を示した。