Siyuan Huang
BIGAI
収録論文 59本 ・ フィジカルAI/ロボット学習
歩行
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 不整地での脚式移動のための軌跡レベル自動カリキュラム学習歩行2026/8/17
不整地での脚式移動ポリシー学習において、地形マップから直接タスクを生成する軌跡レベルの自動カリキュラム学習フレームワークを提案し、成功率を大幅に向上させた。
- Towards Human-level Dexterous Teleoperation2026/7/1
- ACE-Ego-0: Unifying Egocentric Human and Robotic Data for VLA Pretraining2026/6/1
- AetheRock: An Arm-Worn Robot Teaching System for Force-Guided Vision-Tactile Learning2026/6/1
- EgoGuide: Egocentric Guidance for Efficient Robot-Free Demonstration Collection and Learning2026/6/1
- Test-time Adversarial Takeover: A Real-time Hijacking Interface against Robotic Diffusion Policies2026/6/1
- Hierarchical Advantage Weighting for Online RL Fine-Tuning of VLAs from Sparse Episode Outcomes2026/6/1
- LARA: Latent Action Representation Alignment for Vision-Language-Action Models2026/6/1
- DexJoCo: A Benchmark and Toolkit for Task-Oriented Dexterous Manipulation on MuJoCo2026/5/1
- OmniClone: Engineering a Robust, All-Rounder Whole-Body Humanoid Teleoperation System2026/3/1
- OmniXtreme: Breaking the Generality Barrier in High-Dynamic Humanoid Control2026/2/1
- OmniTrack: General Motion Tracking via Physics-Consistent Reference2026/2/1
- LessMimic: Long-Horizon Humanoid Interaction with Unified Distance Field Representations2026/2/1
- Simultaneous Tactile-Visual Perception for Learning Multimodal Robot Manipulation2025/12/1
- UniAct: Unified Motion Generation and Action Streaming for Humanoid Robots2025/12/1
- VacuumVLA: Boosting VLA Capabilities via a Unified Suction and Gripping Tool for Complex Robotic Manipulation2025/11/1
- SafeFall: Learning Protective Control for Humanoid Robots2025/11/1
- Learning Human-Humanoid Coordination for Collaborative Object Carrying2025/10/1
- VideoArtGS: Building Digital Twins of Articulated Objects from Monocular Video2025/9/1
- SceneWeaver: All-in-One 3D Scene Synthesis with an Extensible and Self-Reflective Agent2025/9/1
- Genie Envisioner: A Unified World Foundation Platform for Robotic Manipulation2025/8/1
- GWM: Towards Scalable Gaussian World Models for Robotic Manipulation2025/8/1
- Ag2x2: Robust Agent-Agnostic Visual Representations for Zero-Shot Bimanual Manipulation2025/7/1
- RoboCerebra: A Large-scale Benchmark for Long-horizon Robotic Manipulation Evaluation2025/6/1
- ControlVLA: Few-shot Object-centric Adaptation for Pre-trained Vision-Language-Action Models2025/6/1
- CLONE: Closed-Loop Whole-Body Humanoid Teleoperation for Long-Horizon Tasks2025/6/1
- Learning a Unified Policy for Position and Force Control in Legged Loco-Manipulation2025/5/1
- EWMBench: Evaluating Scene, Motion, and Semantic Quality in Embodied World Models2025/5/1
- EnerVerse-AC: Envisioning Embodied Environments with Action Condition2025/5/1
- CrayonRobo: Object-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation2025/5/1
- MetaScenes: Towards Automated Replica Creation for Real-world 3D Scans2025/5/1
- Taccel: Scaling Up Vision-based Tactile Robotics via High-performance GPU Simulation2025/4/1
- GROVE: A Generalized Reward for Learning Open-Vocabulary Physical Skill2025/4/1
- RoboVerse: Towards a Unified Platform, Dataset and Benchmark for Scalable and Generalizable Robot Learning2025/4/1
- Adversarial Data Collection: Human-Collaborative Perturbations for Efficient and Robust Robotic Imitation Learning2025/3/1
- ManipTrans: Efficient Dexterous Bimanual Manipulation Transfer via Residual Learning2025/3/1
- StyleLoco: Generative Adversarial Distillation for Natural Humanoid Robot Locomotion2025/3/1
- ArtGS: Building Interactable Replicas of Complex Articulated Objects via Gaussian Splatting2025/2/1
- EnerVerse: Envisioning Embodied Future Space for Robotics Manipulation2025/1/1
- Effective Tuning Strategies for Generalist Robot Manipulation Policies2024/10/1
- SYNERGAI: Perception Alignment for Human-Robot Collaboration2024/9/1
- UniAff: A Unified Representation of Affordances for Tool Usage and Articulation with Vision-Language Models2024/9/1
- Multi-modal Situated Reasoning in 3D Scenes2024/9/1
- SKT: Integrating State-Aware Keypoint Trajectories with Vision-Language Models for Robotic Garment Manipulation2024/9/1
- PhysPart: Physically Plausible Part Completion for Interactable Objects2024/8/1
- SlotLifter: Slot-guided Feature Lifting for Learning Object-centric Radiance Fields2024/8/1
- A3VLM: Actionable Articulation-Aware Vision Language Model2024/6/1
- Ag2Manip: Learning Novel Manipulation Skills with Agent-Agnostic Visual and Action Representations2024/4/1
- Closed-Loop Open-Vocabulary Mobile Manipulation with GPT-4V2024/4/1
- PhyScene: Physically Interactable 3D Scene Synthesis for Embodied AI2024/4/1
- ManipVQA: Injecting Robotic Affordance and Physically Grounded Information into Multi-Modal Large Language Models2024/3/1
- AnySkill: Learning Open-Vocabulary Physical Skill for Interactive Agents2024/3/1
- SceneVerse: Scaling 3D Vision-Language Learning for Grounded Scene Understanding2024/1/1
- An Embodied Generalist Agent in 3D World2023/11/18
- Grasp Multiple Objects with One Hand2023/10/1
- Bridging Zero-shot Object Navigation and Foundation Models through Pixel-Guided Navigation Skill2023/9/1
- Instruct2Act: Mapping Multi-modality Instructions to Robotic Actions with Large Language Model2023/5/1
- ARNOLD: A Benchmark for Language-Grounded Task Learning With Continuous States in Realistic 3D Scenes2023/4/1
- GenDexGrasp: Generalizable Dexterous Grasping2022/10/1