Yue Wang
Guangdong Bifang Intelligent Control Technology Co., Ltd.
収録論文 202本 ・ フィジカルAI/ロボット学習
VLA/安全保証
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 異種ロボットのための校正済み予測安全:行動条件付きJEPAフレームワークとモデルベース安全シールドVLA/安全保証2026/8/18
視覚言語行動ポリシーに実行時保証を追加するため、行動条件付きJEPA世界モデルで候補行動のタスク進捗と物理リスクを予測し、モデルベース安全シールドでフィルタリングするパイプラインを提案した。
- SIMPLE: Simulation-Based Policy Learning and Evaluation for Humanoid Loco-manipulation2026/6/1
- APT: Action Expert Pretraining Improves Instruction Generalization of Vision-Language-Action Policies2026/6/1
- Duet: Dual-Robot Understanding via Efficient Teaching2026/6/1
- LadderMan: Learning Humanoid Perceptive Ladder Climbing2026/6/1
- Learning Asynchronous Upper-body Task-space Trajectory Tracking Policy for Humanoid Robots2026/6/1
- G2G: Exploiting Intra-Group Geometry for Inter-Group Pose Estimation2026/6/1
- RoboDream: Compositional World Models for Scalable Robot Data Synthesis2026/6/1
- VLAConf: Calibrated Task-Success Confidence for Vision-Language-Action Models2026/5/1
- Batched Differentiable Rigid Body Dynamics in PyTorch for GPU-Accelerated Robot Learning2026/5/1
- ReflectDrive-2: Reinforcement-Learning-Aligned Self-Editing for Discrete Diffusion Driving2026/5/1
- {\Psi}-Map: Panoptic Surface Integrated Mapping Enables Real2Sim Transfer2026/4/1
- Reference-Augmented Learning for Precise Tracking Policy of Tendon-Driven Continuum Robots2026/4/1
- Learning-Based Dynamics Modeling and Robust Control for Tendon-Driven Continuum Robots2026/4/1
- Fast-SegSim: Real-Time Open-Vocabulary Segmentation for Robotics in Simulation2026/4/1
- Emerging trends in Cislunar Space for Lunar Science Exploration and Space Robotics aiding Human Spaceflight Safety2026/3/1
- HumDex: Humanoid Dexterous Manipulation Made Easy2026/3/1
- MA-VLCM: A Vision Language Critic Model for Value Estimation of Policies in Multi-Agent Team Settings2026/3/1
- D-REX: Differentiable Real-to-Sim-to-Real Engine for Learning Dexterous Grasping2026/3/1
- IntentReact: Guiding Reactive Object-Centric Navigation via Topological Intent2026/3/1
- $\Psi_0$: An Open Foundation Model Towards Universal Humanoid Loco-Manipulation2026/3/1
- ICLR: In-Context Imitation Learning with Visual Reasoning2026/3/1
- Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models2026/3/1
- Concurrent Prehensile and Nonprehensile Manipulation: A Practical Approach to Multi-Stage Dexterous Tasks2026/3/1
- DreamPlan: Efficient Reinforcement Fine-Tuning of Vision-Language Planners via Video World Models2026/3/1
- Direction Matters: Learning Force Direction Enables Sim-to-Real Contact-Rich Manipulation2026/2/1
- Accelerating Structured Chain-of-Thought in Autonomous Vehicles2026/2/1
- Fiducial Exoskeletons: Image-Centric Robot State Estimation2026/1/1
- OpenNavMap: Multi-Session Appearance-Based Topometric Mapping for Scalable Visual Navigation2026/1/1
- Seeing to Act, Prompting to Specify: A Bayesian Factorization of Vision Language Action Policy2025/12/1
- CREPES-X: Hierarchical Bearing-Distance-Inertial Direct Cooperative Relative Pose Estimation System2025/12/1
- Mr. Virgil: Learning Multi-robot Visual-range Relative Localization2025/12/1
- PolaRiS: Scalable Real-to-Sim Evaluations for Generalist Robot Policies2025/12/1
- AnchorDream: Repurposing Video Diffusion for Embodiment-Aware Robot Data Synthesis2025/12/1
- ETP-R1: Evolving Topological Planning with Reinforcement Fine-tuning for Vision-Language Navigation in Continuous Environments2025/12/1
- Neural Ranging Inertial Odometry2025/12/1
- Robot Learning from a Physical World Model2025/11/1
- Discriminately Treating Motion Components Evolves Joint Depth and Ego-Motion Learning2025/11/1
- SeFA-Policy: Fast and Accurate Visuomotor Policy Learning with Selective Flow Alignment2025/11/1
- RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation2025/11/1
- SPARC: Spine with Prismatic and Revolute Compliance for Quadruped Robots2025/10/1
- Humanoid Everyday: A Comprehensive Robotic Dataset for Open-World Humanoid Manipulation2025/10/1
- ResMimic: From General Motion Tracking to Humanoid Whole-body Loco-Manipulation via Residual Learning2025/10/1
- Flexbee: A Grasping and Perching UAV Based on Soft Vector-Propulsion Nozzle2025/10/1
- BEV-ODOM2: Enhanced BEV-based Monocular Visual Odometry with PV-BEV Fusion and Dense Flow Supervision for Ground Robots2025/9/1
- High-Precision and High-Efficiency Trajectory Tracking for Excavators Based on Closed-Loop Dynamics2025/9/1
- Robot Learning from Any Images2025/9/1
- Discrete Diffusion for Reflective Vision-Language-Action Models in Autonomous Driving2025/9/1
- Toward Embodiment Equivariant Vision-Language-Action Policy2025/9/1
- RCM-ACT: Imitation Learning with Dynamic RCM Calibration for Autonomous Intraocular Foreign Body Removal2025/8/1
- Capsizing-Guided Trajectory Optimization for Autonomous Navigation with Rough Terrain2025/8/1
- Sensing, Social, and Motion Intelligence in Embodied Navigation: A Comprehensive Survey2025/8/1
- A Whole-Body Motion Imitation Framework from Human Data for Full-Size Humanoid Robot2025/8/1
- Generalized Advantage Estimation for Distributional Policy Gradients2025/7/1
- Real-time Terrain Analysis for Off-road Autonomous Vehicles2025/6/1
- SkillBlender: Towards Versatile Humanoid Whole-Body Loco-Manipulation via Skill Blending2025/6/1
- The MOTIF Hand: A Robotic Hand for Multimodal Observations with Thermal, Inertial, and Force Sensors2025/6/1
- ManipBench: Benchmarking Vision-Language Models for Low-Level Robot Manipulation2025/5/1
- HMCF: A Human-in-the-loop Multi-Robot Collaboration Framework Based on Large Language Models2025/5/1
- RoboVerse: Towards a Unified Platform, Dataset and Benchmark for Scalable and Generalizable Robot Learning2025/4/1
- Grounding 3D Object Affordance with Language Instructions, Visual Observations and Interactions2025/4/1
- Quattro: Transformer-Accelerated Iterative Linear Quadratic Regulator Framework for Fast Trajectory Optimization2025/4/1
- UnIRe: Unsupervised Instance Decomposition for Dynamic Urban Scene Reconstruction2025/4/1
- Domain-Conditioned Scene Graphs for State-Grounded Task Planning2025/4/1
- Efficient Alignment of Unconditioned Action Prior for Language-conditioned Pick and Place in Clutter2025/3/1
- Learning Personalized Driving Styles via Reinforcement Learning from Human Feedback2025/3/1
- Disambiguate Gripper State in Grasp-Based Tasks: Pseudo-Tactile as Feedback Enables Pure Simulation Learning2025/3/1
- UGNA-VPR: A Novel Training Paradigm for Visual Place Recognition Based on Uncertainty-Guided NeRF Augmentation2025/3/1
- PanopticSplatting: End-to-End Panoptic Gaussian Splatting2025/3/1
- M2UD: A Multi-model, Multi-scenario, Uneven-terrain Dataset for Ground Robot with Localization and Mapping Evaluation2025/3/1
- Natural Humanoid Robot Locomotion with Generative Motion Prior2025/3/1
- CNSv2: Probabilistic Correspondence Encoded Neural Image Servo2025/3/1
- BEV-DWPVO: BEV-based Differentiable Weighted Procrustes for Low Scale-drift Monocular Visual Odometry on Ground2025/2/1
- CarPlanner: Consistent Auto-regressive Trajectory Planning for Large-scale Reinforcement Learning in Autonomous Driving2025/2/1
- Compliance while resisting: a shear-thickening fluid controller for physical human-robot interaction2025/2/1
- SMART: Advancing Scalable Map Priors for Driving Topology Reasoning2025/2/1
- PhysBench: Benchmarking and Enhancing Vision-Language Models for Physical World Understanding2025/1/1
- Temporal Logic Guided Safe Navigation for Autonomous Vehicles2025/1/1
- Leverage Cross-Attention for End-to-End Open-Vocabulary Panoptic Reconstruction2025/1/1
- UniMM: A Unified Mixture Model Framework for Multi-Agent Simulation2025/1/1
- Extrapolated Urban View Synthesis Benchmark2024/12/1
- HUGSIM: A Real-Time, Photo-Realistic and Closed-Loop Simulator for Autonomous Driving2024/12/1
- Multi-cam Multi-map Visual Inertial Localization: System, Validation and Dataset2024/12/1
- LoRA3D: Low-Rank Self-Calibration of 3D Geometric Foundation Models2024/12/1
- Learning from Massive Human Videos for Universal Humanoid Pose Control2024/12/1
- BEV-ODOM: Reducing Scale Drift in Monocular Visual Odometry with BEV Representation2024/11/1
- LoGS: Visual Localization via Gaussian Splatting with Fewer Training Images2024/10/1
- LI-GS: Gaussian Splatting with LiDAR Incorporated for Accurate Large-Scale Reconstruction2024/9/1
- LiLoc: Lifelong Localization using Adaptive Submap Joining and Egocentric Factor Graph2024/9/1
- Safety Verification and Navigation for Autonomous Vehicles based on Signal Temporal Logic Constraints2024/9/1
- RING#: PR-by-PE Global Localization with Roto-translation Equivariant Gram Learning2024/9/1
- PanopticRecon: Leverage Open-vocabulary Instance Segmentation for Zero-shot Panoptic Reconstruction2024/7/1
- Pretraining-finetuning Framework for Efficient Co-design: A Case Study on Quadruped Robot Parkour2024/7/1
- RAM: Retrieval-Based Affordance Transfer for Generalizable Zero-Shot Robotic Manipulation2024/7/1
- Tokenize the World into Object-level Knowledge to Address Long-tail Events in Autonomous Driving2024/7/1
- A Superalignment Framework in Autonomous Driving with Large Language Models2024/6/1
- DistillNeRF: Perceiving 3D Scenes from Single-Glance Images by Distilling Neural Fields and Foundation Model Features2024/6/1
- Efficient Navigation of a Robotic Fish Swimming Across the Vortical Flow Field2024/5/1
- Memorize What Matters: Emergent Scene Decomposition from Multitraverse2024/5/1
- Towards Realistic Scene Generation with LiDAR Diffusion Models2024/4/1
- $\nu$-DBA: Neural Implicit Dense Bundle Adjustment Enables Image-Only Driving Scene Reconstruction2024/4/1
- Explicit Interaction for Fusion-Based Place Recognition2024/2/1
- Grasp, See, and Place: Efficient Unknown Object Rearrangement with Policy Structure Prior2024/2/1
- Driving Everywhere with Large Language Model Policy Adaptation2024/2/1
- NGEL-SLAM: Neural Implicit Representation-based Global Consistent Low-Latency SLAM System2023/11/1
- A Language Agent for Autonomous Driving2023/11/1
- A Two-stage Based Social Preference Recognition in Multi-Agent Autonomous Driving System2023/10/1
- GPT-Driver: Learning to Drive with GPT2023/10/1
- CNS: Correspondence Encoded Neural Image Servo Policy2023/9/1
- Sparse Waypoint Validity Checking for Self-Entanglement-Free Tethered Path Planning2023/8/1
- 3D Model-free Visual Localization System from Essential Matrix under Local Planar Motion2023/8/1
- An Efficient Multi-solution Solver for the Inverse Kinematics of 3-Section Constant-Curvature Robots2023/5/1
- Leveraging BEV Representation for 360-degree Visual Place Recognition2023/5/1
- A Hyper-network Based End-to-end Visual Servoing with Arbitrary Desired Poses2023/4/1
- NF-Atlas: Multi-Volume Neural Feature Fields for Large Scale LiDAR Mapping2023/4/1
- Learning adaptive manipulation of objects with revolute joint: A case study on varied cabinet doors opening2023/4/1
- Zero-shot Transfer Learning of Driving Policy via Socially Adversarial Traffic Flow2023/4/1
- Object-centric Inference for Language Conditioned Placement: A Foundation Model based Approach2023/4/1
- GOOD: General Optimization-based Fusion for 3D Object Detection via LiDAR-Camera Object Candidates2023/3/1
- Failure-aware Policy Learning for Self-assessable Robotics Tasks2023/2/1
- A Joint Modeling of Vision-Language-Action for Target-oriented Grasping in Clutter2023/2/1
- EMV-LIO: An Efficient Multiple Vision aided LiDAR-Inertial Odometry2023/2/1
- DAMS-LIO: A Degeneration-Aware and Modular Sensor-Fusion LiDAR-inertial Odometry2023/2/1
- A Survey on Global LiDAR Localization: Challenges, Advances and Open Problems2023/2/1
- Open-Set Object Detection Using Classification-free Object Proposal and Instance-level Contrastive Learning2022/11/1
- DeepRING: Learning Roto-translation Invariant Representation for LiDAR based Place Recognition2022/10/1
- RING++: Roto-translation Invariant Gram for Global Localization on a Sparse Scan Map2022/10/1
- C^2:Co-design of Robots via Concurrent Networks Coupling Online and Offline Reinforcement Learning2022/9/1
- A Robust and Constrained Multi-Agent Reinforcement Learning Electric Vehicle Rebalancing Method in AMoD Systems2022/9/1
- ViP3D: End-to-end Visual Trajectory Prediction via 3D Agent Queries2022/8/1
- Efficient Distance-Optimal Tethered Path Planning in Planar Environments: The Workspace Convexity2022/8/1
- FEJ-VIRO: A Consistent First-Estimate Jacobian Visual-Inertial-Ranging Odometry2022/7/1
- Towards Two-view 6D Object Pose Estimation: A Comparative Study on Fusion Strategy2022/7/1
- Efficient Search of the k Shortest Non-Homotopic Paths by Eliminating Non-k-Optimal Topologies2022/7/1
- VectorMapNet: End-to-end Vectorized HD Map Learning2022/6/1
- DPCN++: Differentiable Phase Correlation Network for Versatile Pose Registration2022/6/1
- Learning A Simulation-based Visual Policy for Real-world Peg In Unseen Holes2022/5/1
- Toward Consistent and Efficient Map-based Visual-inertial Localization: Theory Framework and Filter Design2022/4/1
- One RING to Rule Them All: Radon Sinogram for Place Recognition, Orientation and Translation Estimation2022/4/1
- Learning to Fill the Seam by Vision: Sub-millimeter Peg-in-hole on Unseen Shapes in Real World2022/4/1
- Map-based Visual-Inertial Localization: Consistency and Complexity2022/4/1
- Depth-Independent Depth Completion via Least Square Estimation2022/3/1
- A Visual Navigation Perspective for Category-Level Object Pose Estimation2022/3/1
- Translation Invariant Global Estimation of Heading Angle Using Sinogram of LiDAR Point Cloud2022/3/1
- DXQ-Net: Differentiable LiDAR-Camera Extrinsic Calibration Using Quality-aware Flow2022/3/1
- Tac3D: A Novel Vision-based Tactile Sensor for Measuring Forces Distribution and Estimating Friction Coefficient Distribution2022/2/1
- Bayesian Optimization Based Trustworthiness Model for Multi-robot Bounding Overwatch2022/1/1
- Trust-based Symbolic Motion Planning for Multi-robot Bounding Overwatch2022/1/1
- Electric Vehicle Automatic Charging System Based on Vision-force Fusion2021/10/1
- Object DGCNN: 3D Object Detection using Dynamic Graphs2021/10/1
- DETR3D: 3D Object Detection from Multi-view Images via 3D-to-2D Queries2021/10/1
- Socially-Aware Multi-Agent Following with 2D Laser Scans via Deep Reinforcement Learning and Potential Field2021/9/1
- Learning Interpretable BEV Based VIO without Deep Neural Networks2021/9/1
- Efficient Object Manipulation to an Arbitrary Goal Pose: Learning-based Anytime Prioritized Planning2021/9/1
- Anti-degenerated UWB-LiDAR Localization for Automatic Road Roller in Tunnel2021/9/1
- Domain Generalization for Vision-based Driving Trajectory Generation2021/9/1
- HiTMap: A Hierarchical Topological Map Representation for Navigation in Unknown Environments2021/9/1
- Learning Observation-Based Certifiable Safe Policy for Decentralized Multi-Robot Navigation2021/9/1
- A Right Invariant Extended Kalman Filter for Object based SLAM2021/9/1
- A Multi-Hypothesis Approach to Pose Ambiguity in Object-Based SLAM2021/8/1
- Improved Radar Localization on Lidar Maps Using Shared Embedding2021/6/1
- Learn to Differ: Sim2Real Small Defection Segmentation Network2021/3/1
- Kinematic Motion Retargeting via Neural Latent Optimization for Learning Sign Language2021/3/1
- Efficient learning of goal-oriented push-grasping synergy in clutter2021/3/1
- Collaborative Recognition of Feasible Region with Aerial and Ground Robots through DPCN2021/3/1
- Neural Motion Prediction for In-flight Uneven Object Catching2021/3/1
- Toward Consistent Drift-free Visual Inertial Localization on Keyframe Based Map2021/3/1
- Radar-to-Lidar: Heterogeneous Place Recognition via Joint Learning2021/2/1
- Robust localization for planar moving robot in changing environment: A perspective on density of correspondence and depth2020/11/1
- CORAL: Colored structural representation for bi-modal place recognition2020/11/1
- PREGAN: Pose Randomization and Estimation for Weakly Paired Image Style Translation2020/11/1
- Dynamic Movement Primitive based Motion Retargeting for Dual-Arm Sign Language Motions2020/11/1
- Improving Redundancy Availability: Dynamic Subtasks Modulation for Robots with Redundancy Insufficiency2020/11/1
- Learning World Transition Model for Socially Aware Robot Navigation2020/11/1
- DiSCO: Differentiable Scan Context with Orientation2020/10/1
- Improving the generalization of network based relative pose regression: dimension reduction as a regularizer2020/10/1
- Imitation Learning of Hierarchical Driving Model: from Continuous Intention to Continuous Trajectory2020/10/1
- Deep Samplable Observation Model for Global Localization and Kidnapping2020/9/1
- RaLL: End-to-end Radar Localization on Lidar Map Using Differentiable Measurement Model2020/9/1
- Deep Phase Correlation for End-to-End Heterogeneous Sensor Measurements Matching2020/8/1
- Collaborative Localization of Aerial and Ground Mobile Robots through Orthomosaic Map2020/7/1
- Pillar-based Object Detection for Autonomous Driving2020/7/1
- Radar-on-Lidar: metric radar localization on prior lidar maps2020/5/1
- Learning hierarchical behavior and motion planning for autonomous driving2020/5/1
- Globally optimal consensus maximization for robust visual inertial localization in point and line map2020/2/1
- Cellular Decomposition for Non-repetitive Coverage Task with Minimum Discontinuities2020/1/1
- Weakly-Supervised Road Affordances Inference and Learning in Scenes without Traffic Signs2019/11/1
- DeepGoal: Learning to Drive with driving intention from Human Control Demonstration2019/11/1
- Autonomous Driving using Safe Reinforcement Learning by Incorporating a Regret-based Human Lane-Changing Decision Model2019/10/1
- Towards navigation without precise localization: Weakly supervised learning of goal-directed navigation cost map2019/6/1
- 2-Entity RANSAC for robust visual localization in changing environment2019/3/1
- LiDAR-Camera Calibration under Arbitrary Configurations: Observability and Methods2019/3/1
- Communication constrained cloud-based long-term visual localization in real time2019/3/1
- Human-Robot Trust Integrated Task Allocation and Symbolic Motion planning for Heterogeneous Multi-robot Systems2018/10/1
- Target Transfer Q-Learning and Its Convergence Analysis2018/9/1
- Trust-based Multi-Robot Symbolic Motion Planning with a Human-in-the-Loop2018/8/1
- Multi-session Map Construction in Outdoor Dynamic Environment2018/7/1
- Laser map aided visual inertial localization in changing environment2018/3/1
- Bounded Policy Synthesis for POMDPs with Safe-Reachability Objectives2018/1/1
- LocNet: Global localization in 3D point clouds for mobile vehicles2017/12/1
- Parse Geometry from a Line: Monocular Depth Estimation with Partial Laser Observation2016/11/1
- Place classification with a graph regularized deep neural network model2015/6/1