Zhuo Sun
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA強化学習オフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- オフライン視覚制御のための有向時間表現VLA2026/10/6
凍結した視覚モデル特徴上で、目標到達コストを測る有向準距離を学習し、それを時間的クリティックとして目標条件付き方策を直接学習する手法を提案。
- 拡散ポリシー最適化による世界モデル強化学習のスケーリング強化学習2026/5/25
世界モデルを用いた強化学習において、探索と価値学習の構造的不整合がスケーリングのボトルネックであることを特定し、拡散ポリシー表現で統一するMBDPOを提案した。
- フィッシャー装飾子:局所輸送写像によるフローポリシーの精緻化オフライン強化学習2026/4/1
オフライン強化学習におけるフローポリシーの最適化を、局所輸送写像として再定式化し、フィッシャー情報行列に基づく異方性最適化を導入して、従来の等方性近似による最適性ギャップを改善した。