Guohao Dai
収録論文 3本 ・ フィジカルAI/ロボット学習
強化学習/フローマッチングVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ScoRe-Flow: スコアベース強化学習によるフローマッチングの完全な分布制御強化学習/フローマッチング2026/4/1
フローマッチングポリシーを強化学習で微調整する際、スコア関数によるドリフト変調と学習可能な分散予測を組み合わせ、遷移の平均と分散を分離制御する手法を提案。D4RLや操作タスクで高速収束と成功率向上を実証。
- STEP: 時空間一貫性予測によるウォームスタート視覚運動ポリシーVLA2026/2/1
拡散ポリシーの推論遅延を、時空間一貫性予測で高品質なウォームスタート行動を生成し、速度対応摂動注入で実行停止を防ぐことで高速化した手法。
- SpecPrune-VLA: 行動認識型自己投機的プルーニングによる視覚言語行動モデルの高速化VLA2025/9/1
VLAモデルの推論を高速化するため、時空間的一貫性を利用して視覚トークンを行動レベルと層レベルで動的に枝刈りする学習不要の手法を提案し、成功率を維持しつつ最大1.7倍の高速化を実現した。