Siddharth Karamcheti
収録論文 15本 ・ フィジカルAI/ロボット学習
マルチタスク学習マニピュレーションVLA人ロボット協働
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ReSteer: マルチタスクロボットポリシーの操縦可能性の定量化と改善マルチタスク学習2026/3/1
マルチタスクロボットポリシーが指示に従ってタスクを切り替える能力(操縦可能性)を定量化し、データ生成と自己改善により向上させるフレームワークを提案した。
- マルチタスク巧みな操作のための大規模行動モデルの慎重な検証マニピュレーション2025/7/1
大規模行動モデル(LBM)をシミュレーションと実世界で厳密に評価し、マルチタスク事前学習が単一タスクより成功率・堅牢性・データ効率を高めることを統計的に示した。
- ProVox: 状況に応じた人とロボットの協調のためのパーソナライズと先回り計画VLA2025/6/1
大規模言語モデルを活用し、ユーザーの好みや意図を事前に取り込んで、指示を待たずに先回りして行動を計画する協働ロボットの枠組みを提案した。家庭内の調理補助タスクでのユーザー研究により評価した。
- ボーカルサンドボックス:状況に応じた人とロボットの協働のための継続学習と適応人ロボット協働2024/11/1
音声対話やキネステティック教示など多様な教示から、ロボットが低レベル技能と高レベル計画を継続的に学習・適応する枠組みを提案し、ギフト袋詰めとLEGOストップモーション制作で有効性を示した。
- OpenVLA: オープンソースの視覚-言語-行動モデルVLA2024/6/1
97万件の実機ロボット実演で学習した7BパラメータのオープンソースVLAモデルを提案し、閉源モデルRT-2-Xを上回る汎用マニピュレーション性能と効率的なファインチューニングを実現した。
- DROID: 大規模実環境ロボットマニピュレーションデータセットマニピュレーション2024/3/1
北米・アジア・欧州の50名が12ヶ月かけて564シーン・84タスクで収集した76k軌道・350時間のロボット操作データセットを構築し、学習ポリシーの性能と汎化性能が向上することを示した。
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Toward Grounded Commonsense Reasoning2023/6/1
- Language-Driven Representation Learning for Robotics2023/2/1
- "No, to the Right" -- Online Language Corrections for Robotic Manipulation via Shared Autonomy2023/1/1
- Eliciting Compatible Demonstrations for Multi-Human Imitation Learning2022/10/1
- LILA: Language-Informed Latent Actions2021/11/1
- Learning Visually Guided Latent Actions for Assistive Teleoperation2021/5/1
- ELLA: Exploration through Learned Language Abstraction2021/3/1
- Learning Adaptive Language Interfaces through Decomposition2020/10/1