Zhi Wang
Tsinghua University
収録論文 18本 ・ フィジカルAI/ロボット学習
ワールドモデルVLA/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GeniWorld: 視覚的アクションによるロボット操作のための汎化可能なインタラクティブワールドモデルワールドモデル2026/8/6
事前学習済みビデオ生成モデルとURDFベースのレンダリングを組み合わせ、数値アクションを視覚的アクション表現に変換することで、未見環境へのロバストな汎化を実現するインタラクティブワールドモデルを提案した。
- ChainVLA: 統一実行状態による長期的操作のためのビジョン・言語・行動クエリの連鎖VLA/操作2026/8/3
長期的な操作タスクにおいて、過去の行動の結果と現在の動作を連鎖させる新しいVLAポリシーを提案。進行状況コンテキストとモーションテールを統合し、高い成功率を達成。
- GeniWorld: A Generalizable Interactive World Model for Robotic Manipulation via Visual Actions2026/8/1
- ChainVLA: Chaining Vision-Language-Action Queries through a Unified Execution State for Long-Horizon Manipulation2026/8/1
- Look Before You Leap: Distilling Tree Search into Action Evaluation for Frozen VLA Models2026/7/1
- ForceBand: Learning Forceful Manipulation with sEMG2026/6/1
- HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos2026/5/1
- ElegantVLA: Learning When to Think for Efficient Vision-Language-Action Models2026/5/1
- DuetHOI: Language-Guided Bimanual Hand--Object Motion Generation with Articulation Planning and Contact Refinement2026/3/1
- RoboStream: Weaving Spatio-Temporal Reasoning with Memory in Vision-Language Models for Robotics2026/3/1
- Proximal powered knee placement: a case study2026/2/1
- Sparse ActionGen: Accelerating Diffusion Policy with Real-time Pruning2026/1/1
- IGen: Scalable Data Generation for Robot Learning from Open-World Images2025/12/1
- VGGT-DP: Generalizable Robot Control via Vision Foundation Models2025/9/1
- Spatial Policy: Guiding Visuomotor Robotic Manipulation with Spatial-Aware Modeling and Reasoning2025/8/1
- Block-wise Adaptive Caching for Accelerating Diffusion Policy2025/6/1
- DoorBot: Closed-Loop Task Planning and Manipulation for Door Opening in the Wild with Haptic Feedback2025/4/1
- Rule-Based Reinforcement Learning for Efficient Robot Navigation with Space Reduction2021/4/1