Ye Li
収録論文 20本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ElegantVLA: Learning When to Think for Efficient Vision-Language-Action Models2026/5/1
- GE-Sim 2.0: A Roadmap Towards Comprehensive Closed-loop Video World Simulators for Robotic Manipulation2026/5/1
- Variable-Resolution Virtual Maps for Autonomous Exploration with Unmanned Surface Vehicles (USVs)2026/3/1
- RoboStream: Weaving Spatio-Temporal Reasoning with Memory in Vision-Language Models for Robotics2026/3/1
- Sparse ActionGen: Accelerating Diffusion Policy with Real-time Pruning2026/1/1
- The RoboSense Challenge: Sense Anything, Navigate Anywhere, Adapt Across Platforms2026/1/1
- Driving in Corner Case: A Real-World Adversarial Closed-Loop Evaluation Platform for End-to-End Autonomous Driving2025/12/1
- Unified Humanoid Fall-Safety Policy from a Few Demonstrations2025/11/1
- Design and Control of a Perching Drone Inspired by the Prey-Capturing Mechanism of Venus Flytrap2025/9/1
- A Fast Initialization Method for Neural Network Controllers: A Case Study of Image-based Visual Servoing Control for the multicopter Interception2025/9/1
- Spatial Policy: Guiding Visuomotor Robotic Manipulation with Spatial-Aware Modeling and Reasoning2025/8/1
- Block-wise Adaptive Caching for Accelerating Diffusion Policy2025/6/1
- RGBSQGrasp: Inferring Local Superquadric Primitives from Single RGB Image for Graspability-Aware Bin Picking2025/3/1
- Scalable Benchmarking and Robust Learning for Noise-Free Ego-Motion and 3D Reconstruction from Noisy Video2025/1/1
- From Perfect to Noisy World Simulation: Customizable Embodied Multi-modal Perturbations for SLAM Robustness Benchmarking2024/6/1
- Learning Shared RGB-D Fields: Unified Self-supervised Pre-training for Label-efficient LiDAR-Camera 3D Perception2024/5/1
- Is Your LiDAR Placement Optimized for 3D Scene Understanding?2024/3/1
- Customizable Perturbation Synthesis for Robust SLAM Benchmarking2024/2/1
- Influence of Camera-LiDAR Configuration on 3D Object Detection for Autonomous Driving2023/10/1
- AVM-SLAM: Semantic Visual SLAM with Multi-Sensor Fusion in a Bird's Eye View for Automated Valet Parking2023/9/1