Han Zhao
収録論文 30本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Deltoris: Enabling Real-time VLA Inference in Embodied AI via Bit-level Sparsity and Speculative Inference2026/8/5
- Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories2026/7/1
- CapVector: Learning Transferable Capability Vectors in Parametric Space for Vision-Language-Action Models2026/5/1
- RoboMemArena: A Comprehensive and Challenging Robotic Memory Benchmark2026/5/1
- MMaDA-VLA: Large Diffusion Vision-Language-Action Model with Unified Multi-Modal Instruction and Generation2026/3/1
- Fast-dVLA: Accelerating Discrete Diffusion VLA to Real-Time Performance2026/3/1
- VAMPO: Policy Optimization for Improving Visual Dynamics in Video Action Models2026/3/1
- CRL-VLA: Continual Vision-Language-Action Learning2026/2/3
- Rethinking the Practicality of Vision-language-action Model: A Comprehensive Benchmark and An Improved Baseline2026/2/1
- FRAPPE: Infusing World Modeling into Generalist Policies via Multiple Future Representation Alignment2026/2/1
- CRL-VLA: Continual Vision-Language-Action Learning2026/2/1
- Embodied Robot Manipulation in the Era of Foundation Models: Planning and Learning Perspectives2025/12/1
- Unified Diffusion VLA: Vision-Language-Action Model via Joint Discrete Denoising Diffusion Process2025/11/1
- Spatial Forcing: Implicit Spatial Representation Alignment for Vision-language-action Model2025/10/1
- VLA^2: Empowering Vision-Language-Action Models with an Agentic Framework for Unseen Concept Manipulation2025/10/1
- Towards a Unified Understanding of Robot Manipulation: A Comprehensive Survey2025/10/1
- VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action Model2025/9/1
- ReconVLA: Reconstructive Vision-Language-Action Model as Effective Robot Perceiver2025/8/1
- CEED-VLA: Consistency Vision-Language-Action Model with Early-Exit Decoding2025/6/1
- RationalVLA: A Rational Vision-Language-Action Model with Dual System2025/6/1
- Unveiling the Potential of Vision-Language-Action Models with Open-Ended Multimodal Instructions2025/5/1
- ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning2025/5/1
- OpenHelix: A Short Survey, Empirical Analysis, and Open-Source Dual-System VLA Model for Robotic Manipulation2025/5/1
- PD-VLA: Accelerating Vision-Language-Action Model Integrated with Action Chunking via Parallel Decoding2025/3/1
- MoRE: Unlocking Scalability in Reinforcement Learning for Quadruped Vision-Language-Action Models2025/3/1
- VLAS: Vision-Language-Action Model With Speech Instructions For Customized Robot Manipulation2025/2/1
- QUART-Online: Latency-Free Large Multimodal Language Model for Quadruped Robot Learning2024/12/1
- GeRM: A Generalist Robotic Model with Mixture-of-experts for Quadruped Robot2024/3/1
- QUAR-VLA: Vision-Language-Action Model for Quadruped Robots2023/12/1
- Unlock Reliable Skill Inference for Quadruped Adaptive Behavior by Skill Graph2023/11/1