Darshan Deshpande
収録論文 1本 ・ フィジカルAI/ロボット学習
世界モデル/強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- マスク拡散言語モデルはエージェント強化学習のための強力で制御可能なテキストベース世界モデルである世界モデル/強化学習2026/5/7
テキストベースの世界モデルを、初期状態やタスク文脈などの要素に分解し、マスク拡散言語モデルが自己回帰モデルより優れた一貫性と多様性を持つことを示し、強化学習の訓練環境として有効なフレームワークを提案した。