Zhuolun Zhao
収録論文 2本 ・ フィジカルAI/ロボット学習
強化学習/操作模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FlowDPG: フローマッチングポリシーに対する決定論的ポリシー勾配の実世界操作への応用強化学習/操作2026/6/1
フローマッチングポリシーにDDPGスタイルの強化学習を適用する際、時間方向の逆伝播(BPTT)を回避する蒸留フレームワークを提案し、実世界の長期的な両腕組み立てタスクで92%の成功率を達成した。
- ZeroMimic: Web動画からロボット操作スキルを蒸留模倣学習2025/3/1
人間の一人称視点動画データセットから、多様な物体や未知の環境で即時展開可能な画像ゴール条件付き操作スキルポリシーを生成するシステムを提案。