Zuxuan Wu
Fudan University
収録論文 26本 ・ フィジカルAI/ロボット学習
画像編集/ロボティクス
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HandEdit: 身体性を考慮した人間からロボットへの器用な手の画像編集のための統一ベンチマーク画像編集/ロボティクス2026/8/12
人間の手の画像を様々なロボットハンドに変換する大規模な画像編集データセットとベンチマークを構築し、既存の編集モデルの評価と身体性を考慮した編集モデルの発展を促進する。
- HandEdit: A Unified Benchmark for Egocentric Human-to-Robot Dexterous Hand Image Editing2026/8/1
- SegDiff: Segmented Trajectory Diffusion for Consistent and Adaptive Robot Manipulation2026/7/1
- EgoRecovery: Acquiring Failure Recovery Ability Through Human Recovery Demonstration2026/7/1
- Seeing Touch from Motion: A Unified Modality-Aware Visuo-Tactile Policy with Tactile Motion Correlation2026/6/1
- ActiveMimic: Egocentric Video Pretraining with Active Perception2026/6/1
- ThinkingVLA: Interleaved Vision and Language Reasoning for Robotic Manipulation2026/6/1
- Bench2Drive-Robust: Benchmarking Closed-Loop Autonomous Driving under Deployment Perturbations2026/5/1
- GuidedVLA: Specifying Task-Relevant Factors via Plug-and-Play Action Attention Specialization2026/5/1
- VLA-Pro: Cross-Task Procedural Memory Transfer for Vision-Language-Action Models2026/5/1
- Safety in Embodied AI: A Survey of Risks, Attacks, and Defenses2026/5/1
- HazardArena: Evaluating Semantic Safety in Vision-Language-Action Models2026/4/1
- HAD: Combining Hierarchical Diffusion with Metric-Decoupled RL for End-to-End Driving2026/4/1
- FRoM-W1: Towards General Humanoid Whole-Body Control with Language Instructions2026/1/1
- HiMoE-VLA: Hierarchical Mixture-of-Experts for Generalist Vision-Language-Action Policies2025/12/1
- Unify Robot Actions in Camera Frame2025/11/1
- RoboOmni: Proactive Robot Manipulation in Omni-modal Context2025/10/1
- Zero-Human Demonstration End-to-end Autonomous Driving with Trajectory Scorer2025/10/1
- Ask-to-Clarify: Resolving Instruction Ambiguity through Multi-turn Dialogue2025/9/1
- DriveSuprim: Towards Precise Trajectory Selection for End-to-End Planning2025/6/1
- Generalized Trajectory Scoring for End-to-end Multimodal Planning2025/6/1
- Hydra-NeXt: Robust Closed-Loop Driving with Open-Loop Training2025/3/1
- Human2Robot: Learning Robot Actions from Paired Human-Robot Videos2025/2/1
- VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks2024/12/1
- The Regretful Agent: Heuristic-Aided Navigation through Progress Estimation2019/3/1
- Self-Monitoring Navigation Agent via Auxiliary Progress Estimation2019/1/1