Charles Xu
収録論文 9本 ・ フィジカルAI/ロボット学習
VLAVLA/強化学習マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- π0.7: 操縦可能な汎用ロボット基盤モデルと創発的能力VLA2026/4/1
多様なコンテキスト条件付けを用いて、未見環境での言語指示追従やゼロショットの身体汎化を実現するロボット基盤モデルπ0.7を提案した。
- RLトークン:視覚言語行動モデルを用いたオンライン強化学習のブートストラップVLA/強化学習2026/4/1
事前学習済みの視覚言語行動モデル(VLA)にRLトークンと呼ばれる小型の表現を追加し、その上で強化学習を行うことで、実ロボット上で数時間の練習だけで効率的に微調整できる手法を提案した。
- RLDG: 強化学習によるロボット汎用方策の蒸留マニピュレーション2024/12/1
強化学習で生成した高品質なデータを用いて汎用ロボット方策を微調整する手法を提案し、人間のデモより最大40%高い成功率を達成した。
- 人間参加型強化学習による精密で器用なロボットマニピュレーションマニピュレーション2024/10/1
人間のデモと修正を組み込んだ視覚ベース強化学習システムを提案し、動的操り・精密組立・両腕協調などの多様なタスクを1〜2.5時間の訓練でほぼ完璧な成功率かつ高速に学習できることを示した。
- Octo: オープンソースの汎用ロボットポリシーVLA2024/5/1
80万件の軌道データで学習したTransformerベースの汎用ロボットマニピュレーションポリシーを提案し、言語や目標画像で指示でき、新しいセンサーや行動空間にも短時間でファインチューニング可能であることを示した。
- SERL: A Software Suite for Sample-Efficient Robotic Reinforcement Learning2024/1/1
- FMB: a Functional Manipulation Benchmark for Generalizable Robotic Learning2024/1/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Multi-Stage Cable Routing through Hierarchical Imitation Learning2023/7/1