Dorsa Sadigh
Stanford University
収録論文 141本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 世界モデルを用いたQ学習強化学習2026/8/17
Q学習に世界モデルを組み合わせ、実データのみで学習しつつ想像上の軌道で探索を行うことで、サンプル効率と性能を向上させる手法を提案した。
- Cross-Embodiment Transfer via Behavior-Aligned Representations2026/7/30
- VIA: Visual Interface Agent for Robot Control2026/7/1
- Cross-Embodiment Transfer via Behavior-Aligned Representations2026/7/1
- EXPO-FT: Sample-Efficient Reinforcement Learning Finetuning for Vision-Language-Action Models2026/5/1
- Proximal State Nudging: Reducing Skill Atrophy from AI Assistance2026/5/1
- Will People Enjoy a Robot Trainer? A Case Study with Snoopie the Pacerbot2026/4/1
- HandelBot: Real-World Piano Playing via Fast Adaptation of Dexterous Robot Policies2026/3/1
- Grounding Robot Generalization in Training Data via Retrieval-Augmented VLMs2026/3/1
- Data Analogies Enable Efficient Cross-Embodiment Transfer2026/3/1
- DexDrummer: In-Hand, Contact-Rich, and Long-Horizon Dexterous Robot Drumming2026/3/1
- SteerVLA: Steering Vision-Language-Action Models in Long-Tail Driving Scenarios2026/2/1
- RoboCade: Gamifying Robot Data Collection2025/12/1
- Invariance Co-training for Robot Visual Generalization2025/12/1
- Robot-Powered Data Flywheels: Deploying Robots in the Wild for Continual Data Collection and Foundation Model Adaptation2025/11/1
- Data Retrieval with Importance Weights for Few-Shot Imitation Learning2025/9/1
- Scaffolding Dexterous Manipulation with Vision-Language Models2025/6/1
- Bridging Perception and Action: Spatially-Grounded Mid-Level Representations for Robot Generalization2025/6/1
- HoMeR: Learning In-the-Wild Mobile Manipulation via Hybrid Imitation and Whole-Body Control2025/6/1
- ProVox: Personalization and Proactive Planning for Situated Human-Robot Collaboration2025/6/1
- What Matters for Batch Online Reinforcement Learning in Robotics?2025/5/1
- Latent Diffusion Planning for Imitation Learning2025/4/1
- How to Train Your Robots? The Impact of Demonstration Modality on Imitation Learning2025/3/1
- A Taxonomy for Evaluating Generalist Robot Manipulation Policies2025/3/1
- Unified Video Action Model2025/3/1
- A Study of Perceived Safety for Soft Robotics in Caregiving Tasks2025/3/1
- Gemini Robotics: Bringing AI into the Physical World2025/3/1
- Efficiently Generating Expressive Quadruped Behaviors via Language-Guided Preference Learning2025/2/1
- Action-Free Reasoning for Policy Generalization2025/2/1
- Shared Autonomy for Proximal Teaching2025/2/1
- Robot Data Curation with Mutual Information Estimators2025/2/1
- Motion Tracks: A Unified Representation for Human-Robot Transfer in Few-Shot Imitation Learning2025/1/1
- What's the Move? Hybrid Imitation Learning via Salient Points2024/12/1
- RoboCrowd: Scaling Robot Data Collection through Crowdsourcing2024/11/1
- Vision Language Models are In-Context Value Learners2024/11/1
- Vocal Sandbox: Continual Learning and Adaptation for Situated Human-Robot Collaboration2024/11/1
- RT-Affordance: Affordances are Versatile Intermediate Representations for Robot Manipulation2024/11/1
- So You Think You Can Scale Up Autonomous Robot Data Collection?2024/11/1
- MotIF: Motion Instruction Fine-tuning2024/9/1
- Gen2Act: Human Video Generation in Novel Scenarios enables Generalizable Robot Manipulation2024/9/1
- Re-Mix: Optimizing Data Mixtures for Large Scale Imitation Learning2024/8/1
- FlowRetrieval: Flow-Guided Data Retrieval for Few-Shot Imitation Learning2024/8/1
- FLAIR: Feeding via Long-horizon AcquIsition of Realistic dishes2024/7/1
- OpenVLA: An Open-Source Vision-Language-Action Model2024/6/1
- Octo: An Open-Source Generalist Robot Policy2024/5/1
- VADER: Visual Affordance Detection and Error Recovery for Multi Robot Human Collaboration2024/5/1
- DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset2024/3/1
- Efficient Data Collection for Robotic Manipulation via Compositional Generalization2024/3/1
- Explore until Confident: Efficient Exploration for Embodied Question Answering2024/3/1
- RT-H: Action Hierarchies Using Language2024/3/1
- RT-Sketch: Goal-Conditioned Imitation Learning from Hand-Drawn Sketches2024/3/1
- Batch Active Learning of Reward Functions from Human Preferences2024/2/1
- Pushing the Limits of Cross-Embodiment Learning for Manipulation and Navigation2024/2/1
- Learning to Learn Faster from Human Feedback with Language Model Predictive Control2024/2/1
- Generative Expressive Robot Behaviors using Large Language Models2024/1/1
- SpatialVLM: Endowing Vision-Language Models with Spatial Reasoning Capabilities2024/1/1
- AutoRT: Embodied Foundation Models for Large Scale Orchestration of Robotic Agents2024/1/1
- Chain of Code: Reasoning with a Language Model-Augmented Code Emulator2023/12/1
- Distilling and Retrieving Generalizable Knowledge for Robot Manipulation via Language Corrections2023/11/1
- RoboCLIP: One Demonstration is Enough to Learn Robot Policies2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Physically Grounded Vision-Language Models for Robotic Manipulation2023/9/1
- Gesture-Informed Robot Assistance via Foundation Models2023/9/1
- Robots That Can See: Leveraging Human Pose for Trajectory Prediction2023/9/1
- Stabilize to Act: Learning to Coordinate for Bimanual Manipulation2023/9/1
- Learning Sequential Acquisition Policies for Robot-Assisted Feeding2023/9/1
- Large Language Models as General Pattern Machines2023/7/1
- Robots That Ask For Help: Uncertainty Alignment for Large Language Model Planners2023/7/1
- Polybot: Training One Policy Across Robots While Embracing Variability2023/7/1
- Toward Grounded Commonsense Reasoning2023/6/1
- HYDRA: Hybrid Robot Actions for Imitation Learning2023/6/1
- KITE: Keypoint-Conditioned Policies for Semantic Manipulation2023/6/1
- Language to Rewards for Robotic Skill Synthesis2023/6/1
- Generating Language Corrections for Teaching Physical Control Tasks2023/6/1
- Data Quality in Imitation Learning2023/6/1
- Behavior Retrieval: Few-Shot Imitation Learning by Querying Unlabeled Datasets2023/4/1
- Soy: An Efficient MILP Solver for Piecewise-Affine Systems2023/3/1
- Active Reward Learning from Online Preferences2023/2/1
- Language-Driven Representation Learning for Robotics2023/2/1
- "No, to the Right" -- Online Language Corrections for Robotic Manipulation via Shared Autonomy2023/1/1
- Few-Shot Preference Learning for Human-in-the-Loop RL2022/12/1
- Learning Bimanual Scooping Policies for Food Acquisition2022/11/1
- Learning Visuo-Haptic Skewering Strategies for Robot-Assisted Feeding2022/11/1
- Assistive Teaching of Motor Control Tasks to Humans2022/11/1
- Learning Tool Morphology for Contact-Rich Manipulation Tasks with Differentiable Simulation2022/11/1
- In-Mouth Robotic Bite Transfer with Visual and Haptic Sensing2022/11/1
- Eliciting Compatible Demonstrations for Multi-Human Imitation Learning2022/10/1
- Masked Imitation Learning: Discovering Environment-Invariant Modalities in Multimodal Demonstrations2022/9/1
- Leveraging Smooth Attention Prior for Multi-Agent Trajectory Prediction2022/3/1
- Weakly Supervised Correspondence Learning2022/3/1
- PLATO: Predicting Latent Affordances Through Object-Centric Play2022/3/1
- Learning from Imperfect Demonstrations via Adversarial Confidence Transfer2022/2/1
- LILA: Language-Informed Latent Actions2021/11/1
- Balancing Efficiency and Comfort in Robot-Assisted Bite Transfer2021/11/1
- Learning Reward Functions from Scale Feedback2021/10/1
- Confidence-Aware Imitation Learning from Demonstrations with Varying Optimality2021/10/1
- Partner-Aware Algorithms in Decentralized Cooperative Bandit Teams2021/10/1
- Learning Feasibility to Imitate Demonstrators with Different Dynamics2021/10/1
- From Machine Learning to Robotics: Challenges and Opportunities for Embodied Intelligence2021/10/1
- Influencing Towards Stable Multi-Agent Interactions2021/10/1
- Learning Multimodal Rewards from Rankings2021/9/1
- APReL: A Library for Active Preference-based Reward Learning Algorithms2021/8/1
- Cooperative Autonomous Vehicles that Sympathize with Human Drivers2021/7/1
- Social Coordination and Altruism in Autonomous Driving2021/7/1
- Learning Latent Actions to Control Assistive Robots2021/7/1
- Altruistic Maneuver Planning for Cooperative Autonomous Vehicles Using Multi-agent Advantage Actor-Critic2021/7/1
- Incentivizing Efficient Equilibria in Traffic Networks with Mixed Autonomy2021/6/1
- Learning Visually Guided Latent Actions for Assistive Teleoperation2021/5/1
- Learning Human Objectives from Sequences of Physical Corrections2021/4/1
- On the Critical Role of Conventions in Adaptive Human-AI Collaboration2021/4/1
- ELLA: Exploration through Learned Language Abstraction2021/3/1
- Learning from Imperfect Demonstrations from Agents with Varying Dynamics2021/3/1
- Transfer Reinforcement Learning across Homotopy Classes2021/2/1
- ROIAL: Region of Interest Active Learning for Characterizing Exoskeleton Gait Preference Landscapes2020/11/1
- Learning Latent Representations to Influence Multi-Agent Interaction2020/11/1
- Learning Adaptive Language Interfaces through Decomposition2020/10/1
- Multi-Agent Safe Planning with Gaussian Processes2020/8/1
- Reinforcement Learning based Control of Imitative Policies for Near-Accident Driving2020/7/1
- Learning User-Preferred Mappings for Intuitive Robot Control2020/7/1
- Learning Reward Functions from Diverse Sources of Human Feedback: Optimally Integrating Demonstrations and Preferences2020/6/1
- Formalizing and Guaranteeing* Human-Robot Interaction2020/6/1
- Dynamic Multi-Robot Task Allocation under Uncertainty and Temporal Constraints2020/5/1
- Active Preference-Based Gaussian Process Regression for Reward Learning2020/5/1
- Shared Autonomy with Learned Latent Actions2020/5/1
- When Humans Aren't Optimal: Robots that Collaborate with Risk-Aware Humans2020/1/1
- Learning from My Partner's Actions: Roles in Decentralized Robot Teams2019/10/1
- Asking Easy Questions: A User-Friendly Approach to Active Reward Learning2019/10/1
- Robots that Take Advantage of Human Trust2019/9/1
- Learning How to Dynamically Route Autonomous Vehicles on Shared Roads2019/9/1
- Controlling Assistive Robots with Learned Latent Actions2019/9/1
- Learning Reward Functions by Integrating Human Demonstrations and Preferences2019/6/1
- Deep Local Trajectory Replanning and Control for Robot Navigation2019/5/1
- The Green Choice: Learning and Influencing Human Decisions on Shared Roads2019/4/1
- Efficient and Safe Exploration in Deterministic Markov Decision Processes with Unknown Transition Models2019/4/1
- Unsupervised Visuomotor Control through Distributional Planning Networks2019/2/1
- Altruistic Autonomy: Beating Congestion on Shared Roads2018/10/1
- Efficient and Trustworthy Social Navigation Via Explicit and Implicit Robot-Human Communication2018/10/1
- Hierarchical Game-Theoretic Planning for Autonomous Vehicles2018/10/1
- Batch Active Preference-Based Learning of Reward Functions2018/10/1
- Maximizing Road Capacity Using Cars that Influence People2018/7/1
- Safe Control under Uncertainty2015/10/1