Yu Qiao
収録論文 40本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ForceVLA2: Unleashing Hybrid Force-Position Control with Force Awareness for Contact-Rich Manipulation2026/3/1
- InternVLA-A1: Unifying Understanding, Generation and Action for Robotic Manipulation2026/1/1
- InternVLA-M1: A Spatially Guided Vision-Language-Action Framework for Generalist Robot Policy2025/10/1
- Grounding Actions in Camera Space: Observation-Centric Vision-Language-Action Policy2025/8/1
- Visual Embodied Brain: Let Multimodal Large Language Models See, Think, and Control in Spaces2025/6/1
- Dita: Scaling Diffusion Transformer for Generalist Vision-Language-Action Policy2025/3/1
- AgiBot World Colosseo: A Large-scale Manipulation Platform for Scalable and Intelligent Embodied Systems2025/3/1
- LimSim Series: An Autonomous Driving Simulation Platform for Validation and Enhancement2025/2/1
- ZOPP: A Framework of Zero-shot Offboard Panoptic Perception for Autonomous Driving2024/11/1
- Towards Synergistic, Generalized, and Efficient Dual-System for Robotic Manipulation2024/10/1
- Diffusion Transformer Policy2024/10/1
- DynamicCity: Large-Scale 4D Occupancy Generation from Dynamic Scenes2024/10/1
- Reasoning Multi-Agent Behavioral Topology for Interactive Autonomous Driving2024/9/1
- DriveArena: A Closed-loop Generative Simulation Platform for Autonomous Driving2024/8/1
- GRUtopia: Dream General Robots in a City at Scale2024/7/1
- Learning Manipulation by Predicting Interaction2024/6/1
- Continuously Learning, Adapting, and Improving: A Dual-Process Approach to Autonomous Driving2024/5/1
- RH20T-P: A Primitive-Level Robotic Dataset Towards Composable Generalization Agents2024/3/1
- LimSim++: A Closed-Loop Platform for Deploying Multimodal LLMs in Autonomous Driving2024/2/1
- Real-time Holistic Robot Pose Estimation with Unknown States2024/2/1
- Rethinking Mutual Information for Language Conditioned Skill Discovery on Imitation Learning2024/2/1
- RoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis2024/2/1
- RoboScript: Code Generation for Free-Form Manipulation Tasks across Real and Simulation2024/2/1
- Towards Knowledge-driven Autonomous Driving2023/12/1
- On the Road with GPT-4V(ision): Early Explorations of Visual-Language Model on Autonomous Driving2023/11/1
- Tree-Planner: Efficient Close-loop Task Planning with Large Language Models2023/10/1
- DiLu: A Knowledge-Driven Approach to Autonomous Driving with Large Language Models2023/9/1
- Drive Like a Human: Rethinking Autonomous Driving with Large Language Models2023/7/1
- LimSim: A Long-term Interactive Multi-scenario Traffic Simulator2023/7/1
- Instruct2Act: Mapping Multi-modality Instructions to Robotic Actions with Large Language Model2023/5/1
- EmbodiedGPT: Vision-Language Pre-Training via Embodied Chain of Thought2023/5/1
- Perception Imitation: Towards Synthesis-free Simulator for Autonomous Vehicles2023/4/1
- Rethinking Range View Representation for LiDAR Segmentation2023/3/1
- Planning-oriented Autonomous Driving2022/12/1
- Delving into the Devils of Bird's-eye-view Perception: A Review, Evaluation and Recipe2022/9/1
- Level 2 Autonomous Driving on a Single Device: Diving into the Devils of Openpilot2022/6/1
- Trajectory-guided Control Prediction for End-to-end Autonomous Driving: A Simple yet Strong Baseline2022/6/1
- PointCLIP: Point Cloud Understanding by CLIP2021/12/1
- Affordance Transfer Learning for Human-Object Interaction Detection2021/4/1
- Pose-Assisted Multi-Camera Collaboration for Active Object Tracking2020/1/1