Shunbo Zhou
Ola Dimensions
収録論文 15本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SG-WAM: テキスト接地と空間認識を備えた意味的ガイダンスによる世界行動モデルVLA2026/8/9
世界行動モデル(WAM)の将来ビデオ生成と行動予測を言語指示に整合させるため、VLMベースのプランナーで意味的先見を生成し、それを高レベルな意味的ガイダンスとして注入する手法を提案。シミュレーションと実世界で精度と指示追従性を実証。
- SG-WAM: Text-Grounded and Spatial-aware Semantic Guidance for World-Action Models2026/8/1
- HiL-ResRL: A Model-Agnostic Finetuning Adapter via Human-in-the-loop Residual Reinforcement Learning2026/6/1
- HyperSim: A Holistic Sim-To-Real Framework For Robust Robotic Manipulation2026/5/1
- ETP-R1: Evolving Topological Planning with Reinforcement Fine-tuning for Vision-Language Navigation in Continuous Environments2025/12/1
- Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies2025/8/27
- Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies2025/8/1
- Dynamic Mixture of Progressive Parameter-Efficient Expert Library for Lifelong Robot Learning2025/6/1
- PanopticSplatting: End-to-End Panoptic Gaussian Splatting2025/3/1
- ET-Plan-Bench: Embodied Task-level Planning Benchmark Towards Spatial-Temporal Cognition with Foundation Models2024/10/1
- PanopticRecon: Leverage Open-vocabulary Instance Segmentation for Zero-shot Panoptic Reconstruction2024/7/1
- SCALE: Self-Correcting Visual Navigation for Mobile Robots via Anti-Novelty Estimation2024/4/1
- NF-Atlas: Multi-Volume Neural Feature Fields for Large Scale LiDAR Mapping2023/4/1
- Coordinating Large-Scale Robot Networks with Motion and Communication Uncertainties for Logistics Applications2019/4/1
- SeqLPD: Sequence Matching Enhanced Loop-Closure Detection Based on Large-Scale Point Cloud Description for Self-Driving Vehicles2019/4/1