Mingyu Ding
収録論文 59本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DexVerse: A Modular Benchmark for Multi-Task, Multi-Embodiment Dexterous Manipulation2026/7/1
- RoboDojo: A Unified Sim-and-Real Benchmark for Comprehensive Evaluation of Generalist Robot Manipulation Policies2026/7/1
- Handroid: Bridging Dexterous Hand and Humanoid2026/7/1
- Current as Touch: Proprioceptive Contact Feedback for Compliant Dexterous Manipulation2026/7/1
- DenseReward: Dense Reward Learning via Failure Synthesis for Robotic Manipulation2026/7/1
- CoorDex: Coordinating Body and Hand Priors for Continuous Dexterous Humanoid Loco-Manipulation2026/6/1
- TempoVLA: Learning Speed-Controllable Vision-Language-Action Policies2026/6/1
- WatchAct: A Benchmark for Behavior-Grounded Robot Manipulation2026/6/1
- Learning Action Priors for Cross-embodiment Robot Manipulation2026/6/1
- AnyBody: Free-Form Whole-Body Humanoid Control from Arbitrary Keypoint Guidance2026/6/1
- DexCompose: Reusing Dexterous Policies for Multi-Task Manipulation with a Single Hand2026/6/1
- Accelerating Transformer-Based Monocular SLAM via Geometric Utility Scoring2026/4/1
- DIAL: Decoupling Intent and Action via Latent World Modeling for End-to-End VLA2026/3/31
- SldprtNet: A Large-Scale Multimodal Dataset for CAD Generation in Language-Driven 3D Design2026/3/1
- DIAL: Decoupling Intent and Action via Latent World Modeling for End-to-End VLA2026/3/1
- UniDex: A Robot Foundation Suite for Universal Dexterous Hand Control from Egocentric Human Videos2026/3/1
- LiLo-VLA: Compositional Long-Horizon Manipulation via Linked Object-Centric Policies2026/2/25
- LiLo-VLA: Compositional Long-Horizon Manipulation via Linked Object-Centric Policies2026/2/1
- When Vision Overrides Language: Evaluating and Mitigating Counterfactual Failures in VLAs2026/2/1
- One Hand to Rule Them All: Canonical Representations for Unified Dexterous Manipulation2026/2/1
- Robotic VLA Benefits from Joint Learning with Motion Image Diffusion2025/12/1
- Mixture of Horizons in Action Chunking2025/11/1
- Rethinking Intermediate Representation for VLM-based Robot Manipulation2025/11/1
- VER: Vision Expert Transformer for Robot Learning via Foundation Distillation and Dynamic Routing2025/10/1
- CollaBot: Vision-Language Guided Simultaneous Collaborative Manipulation2025/8/1
- Interleave-VLA: Enhancing Robot Manipulation with Interleaved Image-Text Instructions2025/5/1
- RoboTwin: Dual-Arm Robot Benchmark with Generative Digital Twins2025/4/1
- REMAC: Self-Reflective and Self-Evolving Multi-Agent Collaboration for Long-Horizon Robot Manipulation2025/3/1
- ReBot: Scaling Robot Learning with Real-to-Sim-to-Real Robotic Video Synthesis2025/3/1
- Physics-Aware Robotic Palletization with Online Masking Inference2025/2/1
- BOSS: Benchmark for Observation Space Shift in Long-Horizon Task2025/2/1
- GeoManip: Geometric Constraints as General Interfaces for Robot Manipulation2025/1/1
- Moto: Latent Motion Token as the Bridging Language for Learning Robot Manipulation from Videos2024/12/1
- DexH2R: Task-oriented Dexterous Manipulation from Human to Robots2024/11/1
- DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation2024/11/1
- GRAPE: Generalizing Robot Policy via Preference Alignment2024/11/1
- Language-Driven Policy Distillation for Cooperative Driving in Multi-Agent Reinforcement Learning2024/10/1
- P2 Explore: Efficient Exploration in Unknown Cluttered Environment with Floor Plan Prediction2024/9/1
- Towards Interactive and Learnable Cooperative Driving Automation: a Large Language Model-Driven Decision-Making Framework2024/9/1
- Embodiment-Agnostic Action Planning via Object-Part Scene Flow2024/9/1
- DSLO: Deep Sequence LiDAR Odometry Based on Inconsistent Spatio-temporal Propagation2024/9/1
- WOMD-Reasoning: A Large-Scale Dataset for Interaction Reasoning in Driving2024/7/1
- Sparse Diffusion Policy: A Sparse, Reusable, and Flexible Policy for Robot Learning2024/7/1
- DrPlanner: Diagnosis and Repair of Motion Planners for Automated Vehicles Using Large Language Models2024/3/1
- PhyGrasp: Generalizing Robotic Grasping with Physics-informed Large Multimodal Models2024/2/1
- RoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis2024/2/1
- RoboScript: Code Generation for Free-Form Manipulation Tasks across Real and Simulation2024/2/1
- EgoPlan-Bench: Benchmarking Multimodal Large Language Models for Human-Level Planning2023/12/1
- SkillDiffuser: Interpretable Hierarchical Planning via Skill Abstractions in Diffusion-Based Task Execution2023/12/1
- Human-oriented Representation Learning for Robotic Manipulation2023/10/1
- RSRD: A Road Surface Reconstruction Dataset and Benchmark for Safe and Comfortable Autonomous Driving2023/10/1
- Generalizable Long-Horizon Manipulations with Large Language Models2023/10/1
- Tree-Planner: Efficient Close-loop Task Planning with Large Language Models2023/10/1
- LanguageMPC: Large Language Models as Decision Makers for Autonomous Driving2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Physion++: Evaluating Physical Scene Understanding that Requires Online Inference of Different Physical Properties2023/6/1
- EmbodiedGPT: Vision-Language Pre-Training via Embodied Chain of Thought2023/5/1
- NeRF-Loc: Transformer-Based Object Localization Within Neural Radiance Fields2022/9/1
- ComPhy: Compositional Physical Reasoning of Objects and Events from Videos2022/5/1