Brian Ichter
収録論文 52本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- π0.7: 操縦可能な汎用ロボット基盤モデルと創発的能力VLA2026/4/1
多様なコンテキスト条件付けを用いて、未見環境での言語指示追従やゼロショットの身体汎化を実現するロボット基盤モデルπ0.7を提案した。
- MEM: 視覚言語行動モデルのためのマルチスケール具現化メモリVLA2026/3/1
ロボットの長期タスク遂行のために、ビデオベースの短期記憶とテキストベースの長期記憶を組み合わせたマルチスケールメモリアーキテクチャを提案し、15分に及ぶ複雑なタスクを可能にした。
- π*0.6:経験から学ぶVLAVLA2025/11/1
実世界での経験と人間の修正を活用した強化学習手法RECAPにより、洗濯物畳みや箱組み立て、エスプレッソ抽出などのタスクを高成功率で実行できる汎用VLAモデルπ*0.6を開発した。
- 知識を保護する視覚-言語-行動モデル:高速学習・高速推論・より良い汎化VLA2025/5/1
連続制御用のアクションエキスパートを組み込んだVLAモデルにおいて、学習速度と知識転移が損なわれる問題を分析し、VLMバックボーンを保護する学習手法を提案した。
- π0.5: オープンワールド汎化を実現する視覚-言語-行動モデルVLA2025/4/1
異種タスクの共同学習により、未知の家庭環境でもキッチンや寝室の掃除などの長期的で器用な操作を実行できるVLAモデルπ0.5を提案した。
- Hi Robot: 階層型視覚言語行動モデルによるオープンエンドな指示追従VLA2025/2/1
視覚言語モデルを階層的に用い、複雑な指示や実行中のフィードバックを解釈してロボットの低レベル行動に変換するシステムを提案し、片腕・双腕・移動ロボットで評価した。
- FAST: 視覚言語行動モデルのための効率的な行動トークン化VLA2025/1/1
離散コサイン変換に基づく新しい行動トークン化手法FASTを提案し、高頻度で器用なロボットタスクにおける自己回帰型VLAの学習を可能にした。
- π0: 汎用ロボット制御のための視覚-言語-行動フローモデルVLA2024/10/1
事前学習済み視覚言語モデルにフローマッチングを組み合わせ、多様なロボットの大規模データで訓練することで、洗濯物畳みや箱組み立てなどの器用なタスクをゼロショットや言語指示で実行できる汎用ロボット基盤モデルを提案した。
- LLaMAR: 部分観測環境におけるマルチエージェントロボットの長期計画マルチエージェント計画2024/7/1
言語モデルを用いて、部分観測可能なマルチエージェント環境での長期タスク計画を自己修正しながら実行する手法を提案し、家庭内タスクと捜索救助タスクで成功率を30%向上させた。
- CoNVOI: 視覚言語モデルを用いた屋内・屋外環境における文脈認識ナビゲーションナビゲーション2024/3/1
視覚言語モデルを活用し、周囲の状況をゼロショットで分類して文脈に応じた行動指示を生成し、障害物のない領域を番号で注釈した画像から経路を選択することで、屋内・屋外での自律ナビゲーションを実現する手法。
- Learning to Learn Faster from Human Feedback with Language Model Predictive Control2024/2/1
- PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs2024/2/1
- AutoRT: Embodied Foundation Models for Large Scale Orchestration of Robotic Agents2024/1/1
- SpatialVLM: Endowing Vision-Language Models with Spatial Reasoning Capabilities2024/1/1
- Chain of Code: Reasoning with a Language Model-Augmented Code Emulator2023/12/1
- Foundation Models in Robotics: Applications, Challenges, and the Future2023/12/1
- RoboVQA: Multimodal Long-Horizon Reasoning for Robotics2023/11/1
- Conditionally Combining Robot Skills using Large Language Models2023/10/1
- Navigation with Large Language Models: Semantic Guesswork as a Heuristic for Planning2023/10/1
- Video Language Planning2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Physically Grounded Vision-Language Models for Robotic Manipulation2023/9/1
- RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control2023/7/1
- Large Language Models as General Pattern Machines2023/7/1
- Language to Rewards for Robotic Skill Synthesis2023/6/1
- PaLM-E: An Embodied Multimodal Language Model2023/3/1
- Grounded Decoding: Guiding Text Generation with Grounded Models for Embodied Agents2023/3/1
- Scaling Robot Learning with Semantically Imagined Experience2023/2/1
- Semantic Mechanical Search with Large Vision and Language Models2023/2/1
- RT-1: Robotics Transformer for Real-World Control at Scale2022/12/1
- Code as Policies: Language Model Programs for Embodied Control2022/9/1
- Open-vocabulary Queryable Scene Representations for Real World Planning2022/9/1
- LM-Nav: Robotic Navigation with Large Pre-Trained Models of Language, Vision, and Action2022/7/1
- Inner Monologue: Embodied Reasoning through Planning with Language Models2022/7/1
- Mechanical Search on Shelves with Efficient Stacking and Destacking of Objects2022/7/1
- Do As I Can, Not As I Say: Grounding Language in Robotic Affordances2022/4/1
- Mechanical Search on Shelves using a Novel "Bluction" Tool2022/1/1
- Value Function Spaces: Skill-Centric State Abstractions for Long-Horizon Reasoning2021/11/1
- Multi-Task Learning with Sequence-Conditioned Transporter Networks2021/9/1
- Learning Language-Conditioned Robot Behavior from Offline Data and Crowd-Sourced Annotation2021/9/1
- Broadly-Exploring, Local-Policy Trees for Long-Horizon Task Planning2020/10/1
- Learning Object-conditioned Exploration using Distributed Soft Actor Critic2020/7/1
- Model-based Reinforcement Learning for Decentralized Multiagent Rendezvous2020/3/1
- Neural Collision Clearance Estimator for Batched Motion Planning2019/10/1
- Learned Critical Probabilistic Roadmaps for Robotic Motion Planning2019/10/1
- Zero-shot Imitation Learning from Demonstrations for Legged Robot Visual Navigation2019/9/1
- Robot Motion Planning in Learned Latent Spaces2018/7/1
- Learning Sampling Distributions for Robot Motion Planning2017/9/1
- Group Marching Tree: Sampling-Based Approximately Optimal Motion Planning on GPUs2017/5/1
- Perception-Aware Motion Planning via Multiobjective Search on GPUs2017/5/1
- Real-Time Stochastic Kinodynamic Motion Planning via Multiobjective Search on GPUs2016/7/1
- Deterministic Sampling-Based Motion Planning: Optimality, Complexity, and Performance2015/5/1