Poorvi Hebbar
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FlowDPG: フローマッチングポリシーに対する決定論的ポリシー勾配の実世界操作への応用強化学習/操作2026/6/1
フローマッチングポリシーにDDPGスタイルの強化学習を適用する際、時間方向の逆伝播(BPTT)を回避する蒸留フレームワークを提案し、実世界の長期的な両腕組み立てタスクで92%の成功率を達成した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
フローマッチングポリシーにDDPGスタイルの強化学習を適用する際、時間方向の逆伝播(BPTT)を回避する蒸留フレームワークを提案し、実世界の長期的な両腕組み立てタスクで92%の成功率を達成した。