Hang Xu
収録論文 28本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WAM-Diff2: Hierarchical AR-to-Diffusion Distillation for Highly Efficient Autonomous Driving VLA2026/8/1
- Decompose and Reorganize: Planning with Primitives and Visuomotor Policies Learned from Demonstrations2026/7/1
- Goal2Pixel: Grounding Goals to Pixels for Vision-Language Navigation2026/6/1
- Keypose Exploration: Efficient Automatic Trajectory Labelling and Cross-Embodiment Policy Transfer2026/6/1
- JoyAI-Image: Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation2026/5/5
- Shared Autonomy Assisted by Impedance-Driven Anisotropic Guidance Field2026/5/1
- JoyAI-RA 0.1: A Foundation Model for Robotic Autonomy2026/4/1
- AtomicVLA: Unlocking the Potential of Atomic Skill Learning in Robots2026/3/1
- Swimming Under Constraints: A Safe Reinforcement Learning Framework for Quadrupedal Bio-Inspired Propulsion2026/3/1
- BiKC+: Bimanual Hierarchical Imitation with Keypose-Conditioned Coordination-Aware Consistency Policies2026/1/1
- Percept-WAM: Perception-Enhanced World-Awareness-Action Model for Robust End-to-End Autonomous Driving2025/11/1
- RTFF: Random-to-Target Fabric Flattening Policy using Dual-Arm Manipulator2025/10/1
- Towards Proprioception-Aware Embodied Planning for Dual-Arm Humanoid Robots2025/10/1
- DualTHOR: A Dual-Arm Humanoid Simulation Platform for Contingency-Aware Planning2025/6/1
- SViP: Sequencing Bimanual Visuomotor Policies with Object-Centric Motion Primitives2025/6/1
- Online Competitive Information Gathering for Partially Observable Trajectory Games2025/6/1
- Unseen from Seen: Rewriting Observation-Instruction Using Foundation Models for Augmenting Vision-Language Navigation2025/3/1
- SparseGrasp: Robotic Grasping via 3D Semantic Gaussian Splatting from Sparse Multi-View RGB Images2024/12/1
- End-to-end Generative Spatial-Temporal Ultrasonic Odometry and Mapping Framework2024/12/1
- VidMan: Exploiting Implicit Dynamics from Video Diffusion Model for Effective Robot Manipulation2024/11/1
- PIVOT-R: Primitive-Driven Waypoint-Aware World Model for Robotic Manipulation2024/10/1
- BiKC: Keypose-Conditioned Consistency Policy for Bimanual Robotic Manipulation2024/6/1
- NavCoT: Boosting LLM-Based Vision-and-Language Navigation via Learning Disentangled Reasoning2024/3/1
- OpenOcc: Open Vocabulary 3D Scene Reconstruction via Occupancy Representation2024/3/1
- SUIT: Learning Significance-guided Information for 3D Temporal Detection2023/7/1
- ConQueR: Query Contrast Voxel-DETR for 3D Object Detection2022/12/1
- CO^3: Cooperative Unsupervised 3D Representation Learning for Autonomous Driving2022/6/1
- CODA: A Real-World Road Corner Case Dataset for Object Detection in Autonomous Driving2022/3/1