Xianda Guo
Wuhan University
収録論文 16本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DreamWAM: RGB未来予測を超えた世界行動モデルVLA2026/8/5
世界行動モデル(WAM)の未来予測をRGBだけでなく、外観・動き・幾何・意味の複数視点で行う構造化世界モデルを提案し、ロボット操作タスクの成功率とロバスト性を向上させた。
- DreamWAM: Beyond RGB Future Prediction for World Action Models2026/8/1
- EA-Nav: Learning Safe Visual Navigation Policies with Embodiment Awareness2026/7/1
- SkillNav: Score-Level Skill Intervention for Zero-Shot Object Goal Navigation2026/7/1
- TrustVLA: Mechanism-Guided Inference-Time Defense Against Vision-Language-Action Backdoors2026/7/1
- GEM-Occ: From Visual Geometry Evidence to Embodied Semantic Occupancy Memory2026/7/1
- MotionVLA: Injecting Geometric Motion into Vision-Language-Action Model2026/6/1
- Humanoid-OmniOcc: Stereo-Based Full-View Occupancy Dataset for Embodied AI2026/6/1
- ReactSim-Bench: Benchmarking Reactive Behavior World Model Simulation in Autonomous Driving2026/6/1
- Bench2Drive-Robust: Benchmarking Closed-Loop Autonomous Driving under Deployment Perturbations2026/5/1
- R3DP: Real-Time 3D-Aware Policy for Embodied Manipulation2026/3/1
- UniVTAC: A Unified Simulation Platform for Visuo-Tactile Manipulation Data Generation, Learning, and Benchmarking2026/2/1
- DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving2025/5/1
- WMNav: Integrating Vision-Language Models into World Models for Object Goal Navigation2025/3/1
- AdvDiffuser: Generating Adversarial Safety-Critical Driving Scenarios via Guided Diffusion2024/10/1
- Instruct Large Language Models to Drive like Humans2024/6/1