Zhixuan Liang
Alibaba Inc.
収録論文 28本 ・ フィジカルAI/ロボット学習
データ生成/VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Ego2Robot: 自己中心視点の人間データからのスケーラブルなロボットデータ合成データ生成/VLA2026/8/3
自己中心視点の人間の操作動画を、行動リターゲティングとロボットアームの視覚合成、品質キュレーションを経てロボット訓練データに変換するスケーラブルなパイプラインを提案し、大規模データでVLAモデルの汎化性能を向上させた。
- Ego2Robot: Scalable Robot Data Synthesis from Egocentric Human Data2026/8/1
- Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models2026/6/16
- AHA-WAM:Asynchronous Horizon-Adaptive World-Action Modeling with Observation-Guided Context Routing2026/6/1
- Planning-aligned Token Compression for Long-Context Autonomous Driving2026/6/1
- Qwen-RobotNav Technical Report: A Scalable Navigation Model Designed for an Agentic Navigation System2026/6/1
- Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models2026/6/1
- Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments2026/5/1
- HiVLA: A Visual-Grounded-Centric Hierarchical Embodied Manipulation System2026/4/1
- VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory2026/3/5
- R3DP: Real-Time 3D-Aware Policy for Embodied Manipulation2026/3/1
- UltraDexGrasp: Learning Universal Dexterous Grasping for Bimanual Robots with Synthetic Data2026/3/1
- From Passive Observer to Active Critic: Reinforcement Learning Elicits Process Reasoning for Robotic Manipulation2026/3/1
- VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory2026/3/1
- ST-BiBench: Benchmarking Multi-Stream Multimodal Coordination in Bimanual Embodied Tasks for MLLMs2026/2/1
- VER: Vision Expert Transformer for Robot Learning via Foundation Distillation and Dynamic Routing2025/10/1
- Expertise need not monopolize: Action-Specialized Mixture of Experts for Vision-Language-Action Learning2025/10/1
- Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies2025/8/1
- HyCodePolicy: Hybrid Language Controllers for Multimodal Monitoring and Decision in Embodied Agents2025/8/1
- Benchmarking Generalizable Bimanual Manipulation: RoboTwin Dual-Arm Collaboration Challenge at CVPR 2025 MEIS Workshop2025/6/1
- RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation2025/6/1
- RoboTwin: Dual-Arm Robot Benchmark with Generative Digital Twins2025/4/1
- DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation2024/11/1
- G3Flow: Generative 3D Semantic Flow for Pose-aware and Generalizable Object Manipulation2024/11/1
- RoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis2024/2/1
- RoboScript: Code Generation for Free-Form Manipulation Tasks across Real and Simulation2024/2/1
- SkillDiffuser: Interpretable Hierarchical Planning via Skill Abstractions in Diffusion-Based Task Execution2023/12/1
- Hierarchical Reinforcement Learning with Opponent Modeling for Distributed Multi-agent Cooperation2022/6/1