Abhinav Valada
University of Freiburg
収録論文 138本 ・ フィジカルAI/ロボット学習
視覚的注意/ポリシー学習ケアロボット
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 行動から注意を学ぶ:ポリシー学習のための創発的視覚ボトルネック視覚的注意/ポリシー学習2026/8/13
行動教師信号のみから注目領域(ROI)を学習するSeekerを提案し、RGBクロップや点群フィルタリングの空間インターフェースとして利用。実機で成功率を大幅に向上させた。
- ケアロボットに関する人間中心の考察:介護者の視点の比較研究ケアロボット2026/8/3
米国、メキシコ、チリの介護者298人を対象に、4種類のケアロボット(物品搬送、ベッド移動補助、バイタルサイン監視、移動支援)に対する認識を混合手法で調査し、国を超えて概ね肯定的な評価が得られた一方、倫理的懸念(依存性、人間の監督、雇用への影響)も明らかにした。
- Human-Centered Reflections on Care Robots: A Comparative Study of Caregiver Perspectives2026/8/1
- Attention from Action, for Action: Emergent Visual Bottlenecks for Policy Learning2026/8/1
- One Hand Watches The Other: Dynamic Multi-Agent Cooperation for Sample-Efficient Bimanual Manipulation in Dynamic Environments2026/7/1
- Streaming Gaussian Encoding for 4D Panoptic Occupancy Tracking2026/6/1
- CoPark: Learning Reactive Parking via Self-Play2026/6/1
- Sensor Configuration Matters: A Systematic Evaluation of Multimodal SLAM on Quadruped Robots2026/6/1
- 3D Scene Graphs: Open Challenges and Future Directions2026/6/1
- AnchorD: Metric Grounding of Monocular Depth Using Factor Graphs2026/5/1
- Self-Supervised Online Robot-Agnostic Traversability Estimation for Open-World Environments2026/5/1
- Hyp2Former: Hierarchy-Aware Hyperbolic Embeddings for Open-Set Panoptic Segmentation2026/5/1
- Leveraging Previous-Traversal Point Cloud Map Priors for Camera-Based 3D Object Detection and Tracking2026/4/1
- Class-Incremental Motion Forecasting2026/3/1
- Effort-Based Criticality Metrics for Evaluating 3D Perception Errors in Autonomous Driving2026/3/1
- The Neural Compass: Probabilistic Relative Feature Fields for Robotic Search2026/3/1
- Sparse3DTrack: Monocular 3D Object Tracking Using Sparse Supervision2026/3/1
- Spectral Alignment in Forward-Backward Representations via Temporal Abstraction2026/3/1
- Relational Semantic Reasoning on 3D Scene Graphs for Open World Interactive Object Search2026/3/1
- LAD-Drive: Bridging Language and Trajectory with Action-Aware Diffusion Transformers2026/3/1
- SparTa: Sparse Graphical Task Models from a Handful of Demonstrations2026/2/1
- ParkDiffusion++: Ego Intention Conditioned Joint Multi-Agent Trajectory Prediction for Automated Parking using Diffusion Models2026/2/1
- Latent Gaussian Splatting for 4D Panoptic Occupancy Tracking2026/2/1
- Articulated 3D Scene Graphs for Open-World Mobile Manipulation2026/2/1
- Scaling Single Human Demonstrations for Imitation Learning using Generative Foundational Models2026/2/1
- ForecastOcc: Vision-based Semantic Occupancy Forecasting2026/2/1
- Online Estimation and Manipulation of Articulated Objects2026/1/1
- Hoi! - A Multimodal Dataset for Force-Grounded, Cross-View Articulated Manipulation2025/12/1
- Bridging Perspectives: Foundation Model Guided BEV Maps for 3D Object Detection and Tracking2025/10/1
- Preference-Based Long-Horizon Robotic Stacking with Multimodal Large Language Models2025/9/1
- Hyperspectral Adapter for Semantic Segmentation with Vision Foundation Models2025/9/1
- MSG: Multi-Stream Generative Policies for Sample-Efficient Robotic Manipulation2025/9/1
- Articulated Object Estimation in the Wild2025/9/1
- DiWA: Diffusion Policy Adaptation with World Models2025/8/1
- Dynamic Robot-Assisted Surgery with Hierarchical Class-Incremental Semantic Segmentation2025/8/1
- Designing for Difference: How Human Characteristics Shape Perceptions of Collaborative Robots2025/7/1
- cVLA: Towards Efficient Camera-Space VLAs2025/7/1
- Open-Set LiDAR Panoptic Segmentation Guided by Uncertainty-Aware Learning2025/6/1
- Visual Loop Closure Detection Through Deep Graph Consensus2025/5/1
- ParkDiffusion: Heterogeneous Multi-Agent Multi-Modal Trajectory Prediction for Automated Parking using Diffusion Models2025/5/1
- The Unreasonable Effectiveness of Discrete-Time Gaussian Process Mixtures for Robot Policy Learning2025/5/1
- MORE: Mobile Manipulation Rearrangement Through Grounded Language Reasoning2025/5/1
- Robotic Task Ambiguity Resolution via Natural Language Interaction2025/4/1
- Label-Efficient LiDAR Panoptic Segmentation2025/3/1
- OpenLex3D: A Tiered Evaluation Benchmark for Open-Vocabulary 3D Scene Representations2025/3/1
- Evidential Uncertainty Estimation for Multi-Modal Trajectory Prediction2025/3/1
- Learning Appearance and Motion Cues for Panoptic Tracking2025/3/1
- Collaborative Dynamic 3D Scene Graphs for Open-Vocabulary Urban Scene Understanding2025/3/1
- Multi-Scale Neighborhood Occupancy Masked Autoencoder for Self-Supervised Learning in LiDAR Point Clouds2025/2/1
- Task-Driven Co-Design of Mobile Manipulators2024/12/1
- The Bare Necessities: Designing Simple, Effective Open-Vocabulary Scene Graphs2024/12/1
- ROVER: A Multi-Season Dataset for Visual SLAM2024/12/1
- NeRF and Gaussian Splatting SLAM in the Wild2024/12/1
- Traffic and Safety Rule Compliance of Humans in Diverse Driving Situations2024/11/1
- Efficient Learning of Object Placement with Intra-Category Transfer2024/11/1
- Neural Fields in Robotics: A Survey2024/10/1
- Stochasticity in Motion: An Information-Theoretic Approach to Trajectory Prediction2024/10/1
- Whole-Body Teleoperation for Mobile Manipulation at Zero Added Cost2024/9/1
- Panoptic-Depth Forecasting2024/9/1
- Learning Robotic Manipulation Policies from Point Clouds with Conditional Flow Matching2024/9/1
- Motion Forecasting via Model-Based Risk Minimization2024/9/1
- Visual-Inertial SLAM for Unstructured Outdoor Environments: Benchmarking the Benefits and Computational Costs of Loop Closing2024/8/1
- Perception Matters: Enhancing Embodied AI with Uncertainty-Aware Semantic Segmentation2024/8/1
- The Art of Imitation: Learning Long-Horizon Manipulation Tasks from Few Demonstrations2024/7/1
- Learning Lane Graphs from Aerial Imagery Using Transformers2024/7/1
- Taxonomy-Aware Continual Semantic Segmentation in Hyperbolic Spaces for Open-World Perception2024/7/1
- LetsMap: Unsupervised Representation Learning for Semantic BEV Mapping2024/5/1
- A Good Foundation is Worth Many Labels: Label-Efficient Panoptic Segmentation2024/5/1
- Imagine2touch: Predictive Tactile Sensing for Robotic Manipulation using Efficient Low-Dimensional Signals2024/5/1
- Automatic Target-Less Camera-LiDAR Calibration From Motion and Deep Point Correspondences2024/4/1
- CenterArt: Joint Shape Reconstruction and 6-DoF Grasp Estimation of Articulated Objects2024/4/1
- Bayesian Optimization for Sample-Efficient Policy Improvement in Robotic Manipulation2024/3/1
- Hierarchical Open-Vocabulary 3D Scene Graphs for Language-Grounded Robot Navigation2024/3/1
- Language-Grounded Dynamic Scene Graphs for Interactive Object Search with Mobile Manipulation2024/3/1
- PseudoTouch: Efficiently Imaging the Surface Feel of Objects for Robotic Manipulation2024/3/1
- DITTO: Demonstration Imitation by Trajectory Transformation2024/3/1
- BEVCar: Camera-Radar Fusion for BEV Map and Object Segmentation2024/3/1
- Evaluation of a Smart Mobile Robotic System for Industrial Plant Inspection and Supervision2024/2/1
- CMRNext: Camera to LiDAR Matching in the Wild for Localization and Extrinsic Calibration2024/2/1
- Semantic Scene Segmentation for Robotics2024/1/1
- CenterGrasp: Object-Aware Implicit Representation Learning for Simultaneous Shape Reconstruction and 6-DoF Grasp Estimation2023/12/1
- Amodal Optical Flow2023/11/1
- Compositional Servoing by Recombining Demonstrations2023/10/1
- Few-Shot Panoptic Segmentation With Foundation Models2023/9/1
- Collaborative Dynamic 3D Scene Graphs for Automated Driving2023/9/1
- Multi-camera Bird's Eye View Perception for Autonomous Driving2023/9/1
- RaLF: Flow-based Global and Metric Radar Localization in LiDAR Maps2023/9/1
- Online Estimation of Articulated Objects with Factor Graphs using Vision and Proprioceptive Sensing2023/9/1
- A Smart Robotic System for Industrial Plant Supervision2023/8/1
- Learning Hierarchical Interactive Multi-Object Search for Mobile Manipulation2023/7/1
- Efficient Learning of Urban Driving Policies Using Bird's-Eye-View State Representations2023/5/1
- The Treachery of Images: Bayesian Scene Keypoints for Deep Policy Learning in Robotic Manipulation2023/5/1
- CoVIO: Online Continual Learning for Visual-Inertial Odometry2023/3/1
- CARTO: Category and Joint Agnostic Reconstruction of ARTiculated Objects2023/3/1
- CoDEPS: Online Continual Learning for Depth Estimation and Panoptic Segmentation2023/3/1
- INoD: Injected Noise Discriminator for Self-Supervised Representation Learning in Agricultural Fields2023/3/1
- SkyEye: Self-Supervised Bird's-Eye-View Semantic Mapping Using Monocular Frontal View Images2023/2/1
- Learning and Aggregating Lane Graphs for Urban Automated Driving2023/2/1
- Interactive Imitation Learning in Robotics: A Survey2022/11/1
- Active Particle Filter Networks: Efficient Active Localization in Continuous Action Spaces and Large Maps2022/9/1
- PADLoC: LiDAR-Based Deep Loop Closure Detection and Registration Using Panoptic Attention2022/9/1
- RobotIO: A Python Library for Robot Manipulation Experiments2022/7/1
- Fairness and Bias in Robot Learning2022/7/1
- N$^2$M$^2$: Learning Navigation for Arbitrary Mobile Manipulation Motions in Unseen and Dynamic Environments2022/6/1
- Learning Long-Horizon Robot Exploration Strategies for Multi-Object Search in Continuous Action Spaces2022/5/1
- Perceiving the Invisible: Proposal-Free Amodal Panoptic Segmentation2022/5/1
- Self-Supervised Learning of Multi-Object Keypoints for Robotic Manipulation2022/5/1
- 3D Multi-Object Tracking Using Graph Neural Networks with Cross-Edge Modality Attention2022/3/1
- Continual SLAM: Beyond Lifelong Simultaneous Localization and Mapping Through Continual Learning2022/3/1
- Amodal Panoptic Segmentation2022/2/1
- Doing Right by Not Doing Wrong in Human-Robot Collaboration2022/2/1
- 7th AI Driving Olympics: 1st Place Report for Panoptic Tracking2021/12/1
- Catch Me If You Hear Me: Audio-Visual Navigation in Complex Unmapped Environments with Moving Sounds2021/11/1
- Robot Skill Adaptation via Soft Actor-Critic Gaussian Mixture Models2021/11/1
- Correct Me if I am Wrong: Interactive Learning for Robotic Manipulation2021/10/1
- Panoptic nuScenes: A Large-Scale Benchmark for LiDAR Panoptic Segmentation and Tracking2021/9/1
- Unsupervised Domain Adaptation for LiDAR Panoptic Segmentation2021/9/1
- Bird's-Eye-View Panoptic Segmentation Using Monocular Frontal View Images2021/8/1
- Multi-Perspective Anomaly Detection2021/5/1
- LCDNet: Deep Loop Closure Detection and Point Cloud Registration for LiDAR SLAM2021/3/1
- There is More than Meets the Eye: Self-Supervised Multi-Object Detection and Tracking with Sound by Distilling Multimodal Knowledge2021/3/1
- EfficientLPS: Efficient LiDAR Panoptic Segmentation2021/2/1
- Learning Kinematic Feasibility for Mobile Manipulation through Deep Reinforcement Learning2021/1/1
- From Learning to Relearning: A Framework for Diminishing Bias in Social Robot Navigation2021/1/1
- Kineverse: A Symbolic Articulation Model Framework for Model-Agnostic Mobile Manipulation2020/12/1
- Robust Vision Challenge 2020 -- 1st Place Report for Panoptic Segmentation2020/8/1
- Dynamic Object Removal and Spatio-Temporal RGB-D Inpainting via Geometry-Aware Adversarial Learning2020/8/1
- EfficientPS: Efficient Panoptic Segmentation2020/4/1
- CMRNet++: Map and Camera Agnostic Monocular Visual Localization in LiDAR Maps2020/4/1
- MOPT: Multi-Object Panoptic Tracking2020/4/1
- Self-Supervised Visual Terrain Classification from Unsupervised Acoustic Feature Learning2019/12/1
- Vision-Based Autonomous UAV Navigation and Landing for Urban Search and Rescue2019/6/1
- Robot Localization in Floor Plans Using a Room Layout Edge Extraction Network2019/3/1
- Vision-based Autonomous Landing in Catastrophe-Struck Environments2018/9/1
- Multimodal Interaction-aware Motion Prediction for Autonomous Street Crossing2018/8/1
- VLocNet++: Deep Multitask Learning for Semantic Visual Localization and Odometry2018/4/1
- Deep Spatiotemporal Models for Robust Proprioceptive Terrain Classification2018/4/1
- Deep Auxiliary Learning for Visual Localization and Odometry2018/3/1