Jianye Hao
収録論文 38本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Embodied-R1.5: Evolving Physical Intelligence via Embodied Foundation Models2026/6/1
- ForceFlow: Learning to Feel and Act via Contact-Driven Flow Matching2026/5/1
- Global Prior Meets Local Consistency: Dual-Memory Augmented Vision-Language-Action Model for Efficient Robotic Manipulation2026/2/1
- ActionCodec: What Makes for Good Action Tokenizers2026/2/1
- More than A Point: Capturing Uncertainty with Adaptive Affordance Heatmaps for Spatial Grounding in Robotic Tasks2025/10/1
- Embodied Arena: A Comprehensive, Unified, and Evolving Evaluation Platform for Embodied AI2025/9/1
- OmniEVA: Embodied Versatile Planner via Task-Adaptive 3D-Grounded and Embodiment-aware Reasoning2025/9/1
- MUVLA: Learning to Explore Object Navigation via Map Understanding2025/9/1
- Embodied-R1: Reinforced Embodied Reasoning for General Robotic Manipulation2025/8/1
- AutoLayout: Closed-Loop Layout Synthesis via Slow-Fast Collaborative Reasoning2025/7/1
- STAR: Learning Diverse Robot Skill Abstractions through Rotation-Augmented Vector Quantization2025/6/1
- From Seeing to Doing: Bridging Reasoning and Decision for Robotic Manipulation2025/5/13
- Conditioning Matters: Training Diffusion Policies is Faster Than You Think2025/5/1
- From Seeing to Doing: Bridging Reasoning and Decision for Robotic Manipulation2025/5/1
- One Demo Is All It Takes: Planning Domain Derivation with LLMs from A Single Demonstration2025/5/1
- EmbodiedMAE: A Unified 3D Multi-Modal Representation for Robot Manipulation2025/5/1
- Few-Shot Vision-Language Action-Incremental Policy Learning2025/4/1
- AhaRobot: A Low-Cost Open-Source Bimanual Mobile Manipulator for Embodied AI2025/3/13
- Spatial-Temporal Graph Diffusion Policy with Kinematic Modeling for Bimanual Robotic Manipulation2025/3/1
- AhaRobot: A Low-Cost Open-Source Bimanual Mobile Manipulator for Embodied AI2025/3/1
- 3D-AffordanceLLM: Harnessing Large Language Models for Open-Vocabulary Affordance Detection in 3D Worlds2025/2/1
- Mem2Ego: Empowering Vision-Language Models with Global-to-Ego Memory for Long-Horizon Embodied Navigation2025/2/1
- 3D-MoE: A Mixture-of-Experts Multi-modal LLM for 3D Vision and Pose Diffusion via Rectified Flow2025/1/1
- SpatialCoT: Advancing Spatial Reasoning through Coordinate Alignment and Chain-of-Thought for Embodied Task Planning2025/1/1
- ET-Plan-Bench: Embodied Task-level Planning Benchmark Towards Spatial-Temporal Cognition with Foundation Models2024/10/1
- ROS-LLM: A ROS framework for embodied AI with task feedback and structured reasoning2024/6/1
- CleanDiffuser: An Easy-to-use Modularized Library for Diffusion Models in Decision Making2024/6/1
- iVideoGPT: Interactive VideoGPTs are Scalable World Models2024/5/1
- A Survey on Vision-Language-Action Models for Embodied AI2024/5/1
- Uni-RLHF: Universal Platform and Benchmark Suite for Reinforcement Learning with Diverse Human Feedback2024/2/1
- Enhancing Robotic Manipulation with AI Feedback from Multimodal Large Language Models2024/2/1
- ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles2023/6/1
- Transformer in Transformer as Backbone for Deep Reinforcement Learning2022/12/1
- RITA: Boost Driving Simulators with Realistic Interactive Traffic Flow2022/11/1
- EUCLID: Towards Efficient Unsupervised Reinforcement Learning with Multi-choice Dynamics Model2022/10/1
- SEIHAI: A Sample-efficient Hierarchical AI for the MineRL Competition2021/11/1
- Critic PI2: Master Continuous Planning via Policy Improvement with Path Integrals and Deep Actor-Critic Reinforcement Learning2020/11/1
- Triple-GAIL: A Multi-Modal Imitation Learning Framework with Generative Adversarial Nets2020/5/1