Rongtao Xu
収録論文 20本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Invertible Neural Network Adapter for One-Step Flow Matching in Robot Manipulation2026/6/1
- SurveilNav: Collaborative Object Goal Navigation with Robot and Surveillance System2026/6/1
- VGP-Nav: Metric-Aware Visual Geometric Perception for Robot Navigation2026/6/1
- RePO-VLA: Recovery-Driven Policy Optimization for Vision-Language-Action Models2026/5/1
- DexJoCo: A Benchmark and Toolkit for Task-Oriented Dexterous Manipulation on MuJoCo2026/5/1
- A1: A Fully Transparent Open-Source, Adaptive and Efficient Truncated Vision-Language-Action Model2026/4/1
- AnySlot: Goal-Conditioned Vision-Language-Action Policies for Zero-Shot Slot-Level Placement2026/4/1
- ManipArena: Comprehensive Real-world Evaluation of Reasoning-Oriented Generalist Robot Manipulation2026/3/1
- HMR-1: Hierarchical Massage Robot with Vision-Language-Model for Embodied Healthcare2026/3/1
- GLaD: Geometric Latent Distillation for Vision-Language-Action Models2025/12/1
- ActiveVLN: Towards Active Exploration via Multi-Turn RL in Vision-and-Language Navigation2025/9/1
- $\mathcal{P}^3$: Toward Versatile Embodied Agents2025/8/1
- PhyBlock: A Progressive Benchmark for Physical Understanding and Planning via 3D Block Assembly2025/6/1
- RoBridge: A Hierarchical Architecture Bridging Cognition and Execution for General Robotic Manipulation2025/5/1
- A0: An Affordance-Aware Hierarchical Model for General Robotic Manipulation2025/4/1
- Multimodal Fusion and Vision-Language Models: A Survey for Robot Vision2025/4/1
- Constraint-Aware Zero-Shot Vision-Language Navigation in Continuous Environments2024/12/1
- InfiniteWorld: A Unified Scalable Simulation Framework for General Visual-Language Robot Interaction2024/12/1
- InstruGen: Automatic Instruction Generation for Vision-and-Language Navigation Via Large Multimodal Models2024/11/1
- NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation2024/2/1