Stephen Tu
収録論文 8本 ・ フィジカルAI/ロボット学習
報酬モデリングVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Robometer:軌道比較による汎用ロボット報酬モデルのスケーリング報酬モデリング2026/3/1
軌道内の進捗監督と軌道間の選好監督を組み合わせた報酬モデルを提案し、100万軌道のデータセットで学習することで、汎用性の高い報酬関数を実現した。
- CLAM: ラベルなし実演からのロボット学習のための連続潜在行動モデルVLA2025/5/1
行動ラベルなしの観察列とタスク非依存のプレイデータのみから、自己教師ありダイナミクス予測で連続潜在行動を推論し、実機ロボットの制御方策を学習する手法を提案。
- Revisiting Energy Based Models as Policies: Ranking Noise Contrastive Estimation and Interpolating Energy Models2023/9/1
- Robots That Ask For Help: Uncertainty Alignment for Large Language Model Planners2023/7/1
- Agile Catching with Whole-Body MPC and Blackbox Policy Learning2023/6/1
- Visual Backtracking Teleoperation: A Data Collection Protocol for Offline Image-Based Reinforcement Learning2022/10/1
- Learning Model Predictive Controllers with Real-Time Attention for Real-World Navigation2022/9/1
- Learning Contracting Vector Fields For Stable Imitation Learning2018/4/1