Yingjie Cai
Huawei Foundation Model Department
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Robust-WAM: 生成事前学習と意味的予見を橋渡しするワールド・アクションモデルVLA2026/8/6
ロボット制御用のワールド・アクションモデルにおいて、VAE潜在空間の生成事前学習を保ちつつ、意味的潜在空間の頑健性を組み込む後処理手法を提案した。外観変化に頑健なアクション予測を実現する。
- Robust-WAM: Bridging Generative Pretraining and Semantic Foresight in World-Action Models2026/8/1
- S-VAM: Shortcut Video-Action Model by Self-Distilling Geometric and Semantic Foresight2026/3/1
- DualCoT-VLA: Visual-Linguistic Chain of Thought via Parallel Reasoning for Vision-Language-Action Models2026/3/1
- SQS: Enhancing Sparse Perception Models via Query-based Splatting in Autonomous Driving2025/9/1
- Occ-LLM: Enhancing Autonomous Driving with Occupancy-Based Large Language Models2025/2/1
- VisionPAD: A Vision-Centric Pre-training Paradigm for Autonomous Driving2024/11/1