Xiaoshuai Hao
収録論文 34本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OneVLA: A Unified Framework for Embodied Tasks2026/6/1
- FutureNav: Unified World-Action Modeling for Vision-and-Language Navigation2026/6/1
- Beyond Binary Success: A Diagnostic Meta-Evaluation Framework for Fine-Grained Manipulation2026/5/19
- Thinking in Text and Images: Interleaved Vision--Language Reasoning Traces for Long-Horizon Robot Manipulation2026/5/1
- Beyond Binary Success: A Diagnostic Meta-Evaluation Framework for Fine-Grained Manipulation2026/5/1
- Data-Asymmetric Latent Imagination and Reranking for 3D Robotic Imitation Learning2026/5/1
- Walk With Me: Long-Horizon Social Navigation for Human-Centric Outdoor Assistance2026/4/1
- Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation2026/4/1
- MeshMimic: Geometry-Aware Humanoid Motion Learning through 3D Scene Reconstruction2026/2/1
- DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving2026/2/1
- The RoboSense Challenge: Sense Anything, Navigate Anywhere, Adapt Across Platforms2026/1/1
- Vision-Language-Action Models for Autonomous Driving: Past, Present, and Future2025/12/1
- DSBench: A Comprehensive Benchmark for Evaluating External and In-Cabin Risks2025/11/1
- MiMo-Embodied: X-Embodied Foundation Model Technical Report2025/11/1
- RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation2025/11/1
- SocialNav-Map: Dynamic Mapping with Human Trajectory Prediction for Zero-Shot Social Navigation2025/11/1
- RoboAfford++: A Generative AI-Enhanced Dataset for Multimodal Affordance Learning in Robotic Manipulation and Navigation2025/11/1
- RoboOS-NeXT: A Unified Memory-based Framework for Lifelong, Scalable, and Robust Multi-Robot Collaboration2025/10/1
- Learning to Navigate Socially Through Proactive Risk Perception2025/10/1
- Team Xiaomi EV-AD VLA: Caption-Guided Retrieval System for Cross-Modal Drone Navigation -- Technical Report for IROS 2025 RoboSense Challenge Track 42025/10/1
- $NavA^3$: Understanding Any Instruction, Navigating Anywhere, Finding Anything2025/8/1
- RoboBrain 2.0 Technical Report2025/7/1
- Training-free Generation of Temporally Consistent Rewards from VLMs2025/7/1
- RoboOS: A Hierarchical Embodied Framework for Cross-Embodiment and Multi-Agent Collaboration2025/5/1
- VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation2025/5/1
- TLA: Tactile-Language-Action Model for Contact-Rich Manipulation2025/3/1
- AffordGrasp: In-Context Affordance Reasoning for Open-Vocabulary Task-Oriented Grasping in Clutter2025/3/1
- MapNav: A Novel Memory Representation via Annotated Semantic Maps for Vision-and-Language Navigation2025/2/1
- RoboBrain: A Unified Brain Model for Robotic Manipulation from Abstract to Concrete2025/2/1
- A Hierarchical Reinforcement Learning Framework for Multi-UAV Combat Using Leader-Follower Strategy2025/1/1
- MSC-Bench: Benchmarking and Analyzing Multi-Sensor Corruption for Driving Perception2025/1/1
- Is Your HD Map Constructor Reliable under Sensor Corruptions?2024/6/1
- The RoboDrive Challenge: Drive Anytime Anywhere in Any Condition2024/5/1
- What Foundation Models can Bring for Robot Learning in Manipulation : A Survey2024/4/1