Quantao Yang
収録論文 11本 ・ フィジカルAI/ロボット学習
VLA/RLポストトレーニング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TEMPO: 視覚-言語-行動モデルのための意味・行動分離型RLポストトレーニングVLA/RLポストトレーニング2026/8/7
VLAモデルのRLポストトレーニングにおいて、視覚言語バックボーンを凍結し、意味投影層と行動エキスパートを異なる頻度で更新する二段階学習を提案。CALVINベンチマークと実機タスクで既存手法を上回る性能を達成した。
- TEMPO: Semantic-Action Decoupled RL Post-Training for Vision-Language-Action Models2026/8/1
- FUS3DMaps: Scalable and Accurate Open-Vocabulary Semantic Mapping by 3D Fusion of Voxel- and Instance-Level Layers2026/5/1
- Learning to Localize Reference Trajectories in Image-Space for Visual Navigation2026/2/1
- DIV-Nav: Open-Vocabulary Spatial Relationships for Multi-Object Navigation2025/10/1
- ViSA-Flow: Accelerating Robot Skill Learning via Large-Scale Video Semantic Action Flow2025/5/1
- Diffusion Trajectory-guided Policy for Long-horizon Robot Manipulation2025/2/1
- S$^2$-Diffusion: Generalizing from Instance-level to Category-level Skills in Robot Manipulation2025/2/1
- One Map to Find Them All: Real-time Open-Vocabulary Mapping for Zero-shot Multi-Object Navigation2024/9/1
- PRIME: Scaffolding Manipulation Tasks with Behavior Primitives for Data-Efficient Imitation Learning2024/3/1
- Transferring Knowledge for Reinforcement Learning in Contact-Rich Manipulation2022/10/1