Norman Di Palo
収録論文 16本 ・ フィジカルAI/ロボット学習
VLA模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Gemini Robotics 1.5:高度な身体性推論・思考・動作転移で汎用ロボットの最前線を押し広げるVLA2025/10/1
異種ロボットデータから学ぶ動作転移機構と自然言語での多段階推論を組み合わせたVLAモデルと、身体性推論に特化したモデルを発表し、複雑な多段階タスクの実行と解釈性を向上させた。
- Gemini Robotics:AIを物理世界へVLA2025/3/1
Gemini 2.0を基盤に、ロボットを直接制御できる汎用VLAモデル「Gemini Robotics」と、空間・時間理解を強化した推論モデル「Gemini Robotics-ER」を提案した論文。
- R+X: 日常の人間動画からの検索と実行VLA2024/7/1
ラベルなしの一人称視点人間動画から言語指示に応じて関連クリップを検索し、文脈内模倣学習でロボットが即座にスキルを実行できるフレームワーク。
- 拡散拡張エージェント:効率的な探索と転移学習のためのフレームワークVLA2024/7/1
大規模言語モデル・視覚言語モデル・拡散モデルを組み合わせ、過去の経験を拡散モデルで目標指示に合わせて変換する後知恵経験拡張により、強化学習のサンプル効率と転移学習を改善するフレームワークを提案。
- キーポイント行動トークンによるロボットの文脈内模倣学習模倣学習2024/3/1
視覚観察と行動軌跡をトークン列に変換し、言語学習済みTransformer(GPT-4 Turbo)を追加学習なしで使って少数の実演から模倣学習を実現する手法を提案。
- DINOBot: Robot Manipulation via Retrieval and Alignment with Vision Foundation Models2024/2/1
- On the Effectiveness of Retrieval, Alignment, and Replay in Manipulation2023/12/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Language Models as Zero-Shot Trajectory Generators2023/10/1
- Towards A Unified Agent with Foundation Models2023/7/1
- Demonstrate Once, Imitate Immediately (DOME): Learning Visual Servoing for One-Shot Imitation Learning2022/4/1
- Learning Multi-Stage Tasks with One Demonstration via Self-Replay2021/11/1
- Coarse-to-Fine for Sim-to-Real: Sub-Millimetre Precision Across Wide Task Spaces2021/5/1
- SAFARI: Safe and Active Robot Imitation Learning with Imagination2020/11/1
- Regularizing Trajectory Optimization with Denoising Autoencoders2019/3/1
- Improving Model-Based Control and Active Exploration with Reconstruction Uncertainty Optimization2018/12/1