Quan Vuong
収録論文 40本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SC3-Eval: Evaluating Robot Foundation Models via Self-Consistent Video Generation2026/6/1
- Open-H-Embodiment: A Large-Scale Dataset for Enabling Foundation Models in Medical Robotics2026/4/1
- ${\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities2026/4/1
- MEM: Multi-Scale Embodied Memory for Vision Language Action Models2026/3/1
- $\pi$, But Make It Fly: Physics-Guided Transfer of VLA Models to Aerial Manipulation2026/3/1
- $π^{*}_{0.6}$: a VLA That Learns From Experience2025/11/18
- $\pi^{*}_{0.6}$: a VLA That Learns From Experience2025/11/1
- Knowledge Insulating Vision-Language-Action Models: Train Fast, Run Fast, Generalize Better2025/5/1
- $\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization2025/4/1
- Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models2025/2/1
- FAST: Efficient Action Tokenization for Vision-Language-Action Models2025/1/1
- What's the Move? Hybrid Imitation Learning via Salient Points2024/12/1
- π0: A Vision-Language-Action Flow Model for General Robot Control2024/10/1
- RoVi-Aug: Robot and Viewpoint Augmentation for Cross-Embodiment Robot Learning2024/9/1
- Language-Driven 6-DoF Grasp Detection Using Negative Prompt Guidance2024/7/1
- OpenVLA: An Open-Source Vision-Language-Action Model2024/6/1
- Octo: An Open-Source Generalist Robot Policy2024/5/1
- Evaluating Real-World Robot Manipulation Policies in Simulation2024/5/1
- DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset2024/3/1
- Vid2Robot: End-to-end Video-conditioned Policy Learning with Cross-Attention Transformers2024/3/1
- RT-Sketch: Goal-Conditioned Imitation Learning from Hand-Drawn Sketches2024/3/1
- Mirage: Cross-Embodiment Zero-Shot Policy Transfer with Cross-Painting2024/2/1
- Pushing the Limits of Cross-Embodiment Learning for Manipulation and Navigation2024/2/1
- PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs2024/2/1
- Learning to Learn Faster from Human Feedback with Language Model Predictive Control2024/2/1
- AutoRT: Embodied Foundation Models for Large Scale Orchestration of Robotic Agents2024/1/1
- SARA-RT: Scaling up Robotics Transformers with Self-Adaptive Robust Attention2023/12/1
- RT-Trajectory: Robotic Task Generalization via Hindsight Trajectory Sketches2023/11/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Robotic Offline RL from Internet Videos via Value-Function Pre-Training2023/9/1
- Q-Transformer: Scalable Offline Reinforcement Learning via Autoregressive Q-Functions2023/9/1
- BridgeData V2: A Dataset for Robot Learning at Scale2023/8/1
- RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control2023/7/1
- Open-World Object Manipulation using Pre-trained Vision-Language Models2023/3/1
- PaLM-E: An Embodied Multimodal Language Model2023/3/1
- RT-1: Robotics Transformer for Real-World Control at Scale2022/12/1
- A Real2Sim2Real Method for Robust Object Grasping with Neural Surface Reconstruction2022/10/1
- Single RGB-D Camera Teleoperation for General Robotic Manipulation2021/6/1
- Machine Learning for Robotic Manipulation2021/1/1
- Supervised Policy Update for Deep Reinforcement Learning2018/5/1