Philip Schroeder
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SOLE-R1: ビデオ言語推論を唯一の報酬とするオンボット強化学習VLA2026/3/1
ビデオと言語目標からタスク進捗を推論するモデルSOLE-R1を開発し、これを唯一の報酬としてロボットが未見の操作タスクをゼロショットで強化学習できるようにした。
- ROVER: 視覚言語モデルによる身体性タスクのための動画再帰推論VLA2025/8/1
長い動画を短いサブタスクに再帰的に分割し、視覚言語モデルが局所的なフレーム列を正確に推論できるようにするフレームワークROVERを提案。ロボット操作動画でのタスク進捗推定や動画QAで性能を向上させた。