Bingbing Liu
Huawei Foundation Model Department
収録論文 17本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Robust-WAM: 生成事前学習と意味的予見を橋渡しするワールド・アクションモデルVLA2026/8/6
ロボット制御用のワールド・アクションモデルにおいて、VAE潜在空間の生成事前学習を保ちつつ、意味的潜在空間の頑健性を組み込む後処理手法を提案した。外観変化に頑健なアクション予測を実現する。
- Robust-WAM: Bridging Generative Pretraining and Semantic Foresight in World-Action Models2026/8/1
- Part-Level 3D Gaussian Vehicle Generation with Joint and Hinge Axis Estimation2026/4/1
- DualCoT-VLA: Visual-Linguistic Chain of Thought via Parallel Reasoning for Vision-Language-Action Models2026/3/1
- S-VAM: Shortcut Video-Action Model by Self-Distilling Geometric and Semantic Foresight2026/3/1
- UniScale: Unified Scale-Aware 3D Reconstruction for Multi-View Understanding via Prior Injection for Robotic Perception2026/2/1
- Prioritizing Perception-Guided Self-Supervision: A New Paradigm for Causal Modeling in End-to-End Autonomous Driving2025/11/1
- SQS: Enhancing Sparse Perception Models via Query-based Splatting in Autonomous Driving2025/9/1
- UnPose: Uncertainty-Guided Diffusion Priors for Zero-Shot Pose Estimation2025/8/1
- Pose Optimization for Autonomous Driving Datasets using Neural Rendering Models2025/4/1
- HIPPo: Harnessing Image-to-3D Priors for Model-free Zero-shot 6D Pose Estimation2025/2/1
- Occ-LLM: Enhancing Autonomous Driving with Occupancy-Based Large Language Models2025/2/1
- HUGSIM: A Real-Time, Photo-Realistic and Closed-Loop Simulator for Autonomous Driving2024/12/1
- VisionPAD: A Vision-Centric Pre-training Paradigm for Autonomous Driving2024/11/1
- PCGen: Point Cloud Generator for LiDAR Simulation2022/10/1
- (AF)2-S3Net: Attentive Feature Fusion with Adaptive Feature Selection for Sparse Semantic Segmentation Network2021/2/1
- Bidirectional Attention Network for Monocular Depth Estimation2020/9/1