Stephen Hart
収録論文 6本 ・ フィジカルAI/ロボット学習
ロボット学習VLA模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BCでQ関数を作る:模倣学習からQ値を抽出してロボット上で強化学習を行うロボット学習2026/5/1
模倣学習(BC)のポリシーからQ関数を抽出し、オンライン強化学習でBCとRLの行動をQ値で切り替えることで、効率的なオフラインからオンラインへの学習を実現する手法Q2RLを提案した。
- SOLE-R1: ビデオ言語推論を唯一の報酬とするオンボット強化学習VLA2026/3/1
ビデオと言語目標からタスク進捗を推論するモデルSOLE-R1を開発し、これを唯一の報酬としてロボットが未見の操作タスクをゼロショットで強化学習できるようにした。
- 黄金のチケット:単一のノイズベクトルで生成ロボットポリシーを改善VLA2026/3/1
事前学習済みの拡散・フローマッチングポリシーに対し、ガウス分布から毎回サンプリングする代わりに固定の初期ノイズ(黄金のチケット)を与えることで、追加学習なしにタスク成功率を向上させる手法を提案。
- 同変拡散ポリシー模倣学習2024/7/1
拡散モデルを用いた模倣学習にSO(2)同変性を導入し、ノイズ除去関数のサンプル効率と汎化性能を向上させる手法を提案。
- ADAMANT: A Pipeline for Adaptable Manipulation Tasks2022/9/1
- Deploying the NASA Valkyrie Humanoid for IED Response: An Initial Approach and Evaluation Summary2019/10/1