Xiaoqi Li
Peking University
収録論文 26本 ・ フィジカルAI/ロボット学習
操作プランニング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- データ合成と統合プランニングによるマニュアル基盤の家電操作のスケーリング操作プランニング2026/8/16
家電のマニュアルから部品接地・長期プランニング・閉ループ回復データを自動生成するパイプラインMAGEと、それを用いた大規模データセットUseAppliance、およびエンドツーエンドモデルAppliancePlanを提案し、実ロボットで有効性を実証した。
- An Intelligent-Cloud Edge Multimodal Interaction System for Robots2026/7/1
- LaST-HD: Learning Latent Physical Reasoning from Scalable Human Data for Robot Manipulation2026/6/1
- AT-VLA: Adaptive Tactile Injection for Enhanced Feedback Reaction in Vision-Language-Action Models2026/5/1
- BiPreManip: Learning Affordance-Based Bimanual Preparatory Manipulation through Anticipatory Collaboration2026/3/1
- AnchorVLA4D: an Anchor-Based Spatial-Temporal Vision-Language-Action Model for Robotic Manipulation2026/3/1
- Real2Edit2Real: Generating Robotic Demonstrations via a 3D Control Interface2025/12/1
- ManualVLA: A Unified VLA Model for Chain-of-Thought Manual Generation and Robotic Manipulation2025/12/1
- Imagine2Act: Leveraging Object-Action Motion Consistency from Imagined Goals for Robotic Manipulation2025/9/1
- RwoR: Generating Robot Demonstrations from Human Hand Collection for Policy Learning without Robot2025/7/1
- BiAssemble: Learning Collaborative Affordance for Bimanual Geometric Assembly2025/6/1
- Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning2025/6/1
- CrayonRobo: Object-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation2025/5/1
- SR3D: Unleashing Single-view 3D Reconstruction for Transparent and Specular Object Grasping2025/5/1
- HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model2025/3/1
- ManipGPT: Is Affordance Segmentation by Large Vision Models Enough for Articulated Object Manipulation?2024/12/1
- AIC MLLM: Autonomous Interactive Correction MLLM for Robust Robotic Manipulation2024/6/1
- Human-centered In-building Embodied Delivery Benchmark2024/6/1
- NaturalVLM: Leveraging Fine-grained Natural Language for Affordance-Guided Visual Manipulation2024/3/1
- ManipVQA: Injecting Robotic Affordance and Physically Grounded Information into Multi-Modal Large Language Models2024/3/1
- ManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation2023/12/1
- ImageManip: Image-based Robotic Manipulation with Affordance-guided Next View Selection2023/10/1
- RGBManip: Monocular Image-based Robotic Manipulation through Active Object Pose Estimation2023/10/1
- Find What You Want: Learning Demand-conditioned Object Attribute Space for Demand-driven Navigation2023/9/1
- Discuss Before Moving: Visual Language Navigation via Multi-expert Discussions2023/9/1
- AuthROS: Secure Data Sharing Among Robot Operating Systems Based on Ethereum2022/8/1