Jiaming Liu
Peking University
収録論文 31本 ・ フィジカルAI/ロボット学習
ヒューマノイド/VLA/強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HAF: 階層的アクションフローとスペクトル潜在RLによる汎用VLAのヒューマノイド全身移動操作への適応ヒューマノイド/VLA/強化学習2026/8/17
汎用VLA基盤モデルをヒューマノイドの全身移動操作に適応させるための2部構成フレームワークHAFを提案。階層的なアクション生成とオンラインRLによるポリシー改善を実現する。
- Lift3D-VLA: Lifting VLA Models to 3D Geometry and Dynamics-Aware Manipulation2026/7/1
- Data Pyramid for Embodied Manipulation: A Survey2026/7/1
- TACO: TActile World Model as a Self-COrrector forScalable VLA Post-Training2026/7/1
- LaST-HD: Learning Latent Physical Reasoning from Scalable Human Data for Robot Manipulation2026/6/1
- MV-WAM: Manifold-Aware World Action Model with Value Augmentation2026/6/1
- HarmoWAM: Harmonizing Generalizable and Precise Manipulation via Adaptive World Action Models2026/5/1
- LaST-R1: Reinforcing Robotic Manipulation via Adaptive Physical Latent Reasoning2026/4/1
- Hi-WM: Human-in-the-World-Model for Scalable Robot Post-Training2026/4/1
- TwinRL: Digital Twin-Driven Reinforcement Learning for Real-World Robotic Manipulation2026/2/1
- LaST$_{0}$: Latent Spatio-Temporal Chain-of-Thought for Robotic Vision-Language-Action Model2026/1/1
- ManualVLA: A Unified VLA Model for Chain-of-Thought Manual Generation and Robotic Manipulation2025/12/1
- Video2Act: A Dual-System Video Diffusion Policy with Robotic Spatio-Motional Modeling2025/12/1
- RoboMIND 2.0: A Multimodal, Bimanual Mobile Manipulation Dataset for Generalizable Embodied Intelligence2025/12/1
- DualVLA: Building a Generalizable Embodied Agent via Partial Decoupling of Reasoning and Action2025/11/1
- Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain2025/10/1
- dVLA: Diffusion Vision-Language-Action Model with Multimodal Chain-of-Thought2025/9/1
- MLA: A Multisensory Language-Action Model for Multimodal Understanding and Forecasting in Robotic Manipulation2025/9/1
- WoW: Towards a World omniscient World model Through Embodied Interaction2025/9/1
- RwoR: Generating Robot Demonstrations from Human Hand Collection for Policy Learning without Robot2025/7/1
- AC-DiT: Adaptive Coordination Diffusion Transformer for Mobile Manipulation2025/7/1
- SpikePingpong: Spike Vision-based Fast-Slow Pingpong Robot System2025/6/1
- MinD: Learning A Dual-System World Model for Real-Time Planning and Implicit Risk Analysis2025/6/1
- Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning2025/6/1
- CrayonRobo: Object-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation2025/5/1
- HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model2025/3/1
- CordViP: Correspondence-based Visuomotor Policy for Dexterous Manipulation in Real-World2025/2/1
- RoboBrain: A Unified Brain Model for Robotic Manipulation from Abstract to Concrete2025/2/1
- RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation2024/12/1
- ManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation2023/12/1
- ImageManip: Image-based Robotic Manipulation with Affordance-guided Next View Selection2023/10/1