Bingwen Wei
収録論文 2本 ・ フィジカルAI/ロボット学習
強化学習/ワールドモデルVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboScape-R: 報酬と観測を統合したワールドモデルによる汎化可能なロボティクス強化学習強化学習/ワールドモデル2025/12/1
ワールドモデルを汎用環境プロキシとして用い、状態遷移の理解から報酬を生成する強化学習フレームワークを提案し、多様なシーンへの汎化性能を向上させた。
- RLはVLAの汎化に何をもたらすか?実証研究VLA2025/5/26
VLAモデルの汎化性能を評価するベンチマークを構築し、RL微調整(特にPPO)がSFTより意味理解と実行頑健性を大幅に向上させることを示した実証研究。