Byungwoo Park
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 提案条件付きリファインメントフローによる拡散方策の改善強化学習2026/9/29
拡散・フロー方策のKL正則化の限界を克服するため、批評家に基づく提案選択と条件付きリファインメントフローを組み合わせたPReFlowを提案し、オフラインRLとオンライン微調整で高い性能を達成した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
拡散・フロー方策のKL正則化の限界を克服するため、批評家に基づく提案選択と条件付きリファインメントフローを組み合わせたPReFlowを提案し、オフラインRLとオンライン微調整で高い性能を達成した。