Dhruv Rohatgi
収録論文 1本 ・ フィジカルAI/ロボット学習
部分観測強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 蒸留か決定か?部分観測強化学習におけるアルゴリズム的トレードオフの理解部分観測強化学習2025/10/3
部分観測強化学習において、特権的な潜在状態情報を用いた専門家蒸留と標準的な強化学習の間のトレードオフを理論モデルと実験で調査し、潜在ダイナミクスの確率性が選択に影響することを示した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
部分観測強化学習において、特権的な潜在状態情報を用いた専門家蒸留と標準的な強化学習の間のトレードオフを理論モデルと実験で調査し、潜在ダイナミクスの確率性が選択に影響することを示した。