Avishek Joey Bose
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 最適Qガイダンスによるフローマップポリシーの整合強化学習2026/5/12
拡散やフローマッチングに基づく生成ポリシーの推論コストを削減するため、任意のジャンプ(1ステップを含む)を学習するフローマップポリシーを提案し、オフラインからオンラインへの強化学習において、批評家のQ値に基づく信頼領域最適化で適応させる手法を導入した。