Fei Xia
収録論文 62本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Evaluating Gemini Robotics Policies in a Veo World Simulator2025/12/1
- Gemini Robotics 1.5: Pushing the Frontier of Generalist Robots with Advanced Embodied Reasoning, Thinking, and Motion Transfer2025/10/1
- Bridging Perception and Action: Spatially-Grounded Mid-Level Representations for Robot Generalization2025/6/1
- Chain-of-Modality: Learning Manipulation Programs from Multimodal Human Videos with Vision-Language-Models2025/4/1
- Gemini Robotics: Bringing AI into the Physical World2025/3/1
- Vision Language Models are In-Context Value Learners2024/11/1
- IPPON: Common Sense Guided Informative Path Planning for Object Goal Navigation2024/10/1
- Gen2Act: Human Video Generation in Novel Scenarios enables Generalizable Robot Manipulation2024/9/1
- Mobility VLA: Multimodal Instruction Navigation with Long-Context VLMs and Topological Graphs2024/7/1
- VADER: Visual Affordance Detection and Error Recovery for Multi Robot Human Collaboration2024/5/1
- GenCHiP: Generating Robot Policy Code for High-Precision and Contact-Rich Manipulation Tasks2024/4/1
- CoNVOI: Context-aware Navigation using Vision Language Models in Outdoor and Indoor Environments2024/3/1
- BEHAVIOR-1K: A Human-Centered, Embodied AI Benchmark with 1,000 Everyday Activities and Realistic Simulation2024/3/1
- PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs2024/2/1
- Learning to Learn Faster from Human Feedback with Language Model Predictive Control2024/2/1
- Generative Expressive Robot Behaviors using Large Language Models2024/1/1
- AutoRT: Embodied Foundation Models for Large Scale Orchestration of Robotic Agents2024/1/1
- SpatialVLM: Endowing Vision-Language Models with Spatial Reasoning Capabilities2024/1/1
- Chain of Code: Reasoning with a Language Model-Augmented Code Emulator2023/12/1
- Toward General-Purpose Robots via Foundation Models: A Survey and Meta-Analysis2023/12/1
- Distilling and Retrieving Generalizable Knowledge for Robot Manipulation via Language Corrections2023/11/1
- RoboVQA: Multimodal Long-Horizon Reasoning for Robotics2023/11/1
- Creative Robot Tool Use with Large Language Models2023/10/1
- Video Language Planning2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Navigation with Large Language Models: Semantic Guesswork as a Heuristic for Planning2023/10/1
- Physically Grounded Vision-Language Models for Robotic Manipulation2023/9/1
- Q-Transformer: Scalable Offline Reinforcement Learning via Autoregressive Q-Functions2023/9/1
- Gesture-Informed Robot Assistance via Foundation Models2023/9/1
- RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control2023/7/28
- Large Language Models as General Pattern Machines2023/7/1
- Robots That Ask For Help: Uncertainty Alignment for Large Language Model Planners2023/7/1
- RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control2023/7/1
- Principles and Guidelines for Evaluating Social Robot Navigation Algorithms2023/6/1
- Sonicverse: A Multisensory Simulation Platform for Embodied Household Agents that See and Hear2023/6/1
- Language to Rewards for Robotic Skill Synthesis2023/6/1
- Open-World Object Manipulation using Pre-trained Vision-Language Models2023/3/1
- PaLM-E: An Embodied Multimodal Language Model2023/3/1
- Grounded Decoding: Guiding Text Generation with Grounded Models for Embodied Agents2023/3/1
- Scaling Robot Learning with Semantically Imagined Experience2023/2/1
- RT-1: Robotics Transformer for Real-World Control at Scale2022/12/1
- A Contextual Bandit Approach for Learning to Plan in Environments with Probabilistic Goal Configurations2022/11/1
- Robotic Table Wiping via Reinforcement Learning and Whole-body Trajectory Optimization2022/10/1
- Open-vocabulary Queryable Scene Representations for Real World Planning2022/9/1
- Learning Model Predictive Controllers with Real-Time Attention for Real-World Navigation2022/9/1
- Code as Policies: Language Model Programs for Embodied Control2022/9/1
- Inner Monologue: Embodied Reasoning through Planning with Language Models2022/7/1
- BEHAVIOR in Habitat 2.0: Simulator-Independent Logical Task Description for Benchmarking Embodied AI Agents2022/6/1
- Do As I Can, Not As I Say: Grounding Language in Robotic Affordances2022/4/1
- Multi-Robot Active Mapping via Neural Bipartite Graph Matching2022/3/1
- iGibson 2.0: Object-Centric Simulation for Robot Learning of Everyday Household Tasks2021/8/1
- BEHAVIOR: Benchmark for Everyday Household Activities in Virtual, Interactive, and Ecological Environments2021/8/1
- iGibson 1.0: a Simulation Environment for Interactive Tasks in Large Realistic Scenes2020/12/1
- ReLMoGen: Leveraging Motion Generation in Reinforcement Learning for Mobile Manipulation2020/8/1
- Probabilistic Visual Navigation with Bidirectional Image Prediction2020/3/1
- HRL4IN: Hierarchical Reinforcement Learning for Interactive Navigation with Mobile Manipulators2019/10/1
- Interactive Gibson Benchmark (iGibson 0.5): A Benchmark for Interactive Navigation in Cluttered Environments2019/10/1
- PoseRBPF: A Rao-Blackwellized Particle Filter for 6D Object Pose Tracking2019/5/1
- Deep Visual MPC-Policy Learning for Navigation2019/3/1
- A Behavioral Approach to Visual Navigation with Graph Localization Networks2019/3/1
- Gibson Env: Real-World Perception for Embodied Agents2018/8/1
- VUNet: Dynamic Scene View Synthesis for Traversability Estimation using an RGB Camera2018/6/1