Thomas Weng
収録論文 11本 ・ フィジカルAI/ロボット学習
ロボット学習VLA強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BCでQ関数を作る:模倣学習からQ値を抽出してロボット上で強化学習を行うロボット学習2026/5/1
模倣学習(BC)のポリシーからQ関数を抽出し、オンライン強化学習でBCとRLの行動をQ値で切り替えることで、効率的なオフラインからオンラインへの学習を実現する手法Q2RLを提案した。
- 黄金のチケット:単一のノイズベクトルで生成ロボットポリシーを改善VLA2026/3/1
事前学習済みの拡散・フローマッチングポリシーに対し、ガウス分布から毎回サンプリングする代わりに固定の初期ノイズ(黄金のチケット)を与えることで、追加学習なしにタスク成功率を向上させる手法を提案。
- SOLE-R1: ビデオ言語推論を唯一の報酬とするオンボット強化学習VLA2026/3/1
ビデオと言語目標からタスク進捗を推論するモデルSOLE-R1を開発し、これを唯一の報酬としてロボットが未見の操作タスクをゼロショットで強化学習できるようにした。
- ROVER: 視覚言語モデルによる身体性タスクのための動画再帰推論VLA2025/8/1
長い動画を短いサブタスクに再帰的に分割し、視覚言語モデルが局所的なフレーム列を正確に推論できるようにするフレームワークROVERを提案。ロボット操作動画でのタスク進捗推定や動画QAで性能を向上させた。
- 不確かさ推定で残差強化学習を加速する強化学習2025/6/1
ベース方策の不確かさを利用して探索を効率化し、確率的なベース方策にも対応できる残差強化学習手法を提案。シミュレーションと実機で既存手法を上回る性能を示した。
- 目標対比報酬による実機ロボット強化学習強化学習2024/10/1
人間や他ロボットの行動なし動画から密な報酬関数を学習し、実機ロボットの強化学習を効率化する手法GCRを提案。
- Neural Grasp Distance Fields for Robot Manipulation2022/11/1
- Learning to Singulate Layers of Cloth using Tactile Feedback2022/7/1
- FabricFlowNet: Bimanual Cloth Manipulation with a Flow-based Policy2021/11/1
- Cloth Region Segmentation for Robust Grasp Selection2020/8/1
- Multi-modal Transfer Learning for Grasping Transparent and Specular Objects2020/6/1