Shaopeng Zhai
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA/ポストトレーニングVLA/ロボット学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HELP: ロールアウト分割による人間効率的な大規模ロボットポストトレーニングVLA/ポストトレーニング2026/7/1
VLAモデルのポストトレーニングにおいて、2人の専門オペレータが12台のロボットを同時監視し、ロールアウトを自動分割する手法を提案し、人間の労力あたりのポリシー改善とタスクスループットを最大化する。
- フローマッチングVLAにおける保守的SFTによる基盤能力の保持VLA/ロボット学習2026/5/1
フローマッチング型VLAモデルのファインチューニング時に生じる破壊的忘却を防ぐため、モデルの信頼度に応じて学習信号を動的にスケーリングする保守的教師あり学習(ConSFT)を提案し、LIBEROやRoboTwinベンチマークで既存手法を上回る性能を確認した。
- ロボット実世界強化学習のための視覚-言語-行動-批評家モデルVLA2025/9/1
大規模データで学習したVLAベースのプロセス報酬モデルVLACを提案し、報酬設計を不要にするとともに、実世界のマニピュレーション4タスクで成功率を約30%から約90%へ向上させた。