Davis Zong
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習/視覚
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 確率的分離ポリシー勾配による効率的なオンポリシー視覚強化学習強化学習/視覚2026/5/1
軌道ロールアウトのランダム摂動でポリシー勾配を推定し、単一GPUで数時間の学習を実現する軽量な視覚強化学習手法SDPGを提案。視覚MuJoCoベンチマークで既存手法より高速・低メモリ・高報酬を達成し、実機へのsim-to-real転送も実証した。