Chaoyang Zhao
Institute of Automation, Chinese Academy of Sciences
収録論文 8本 ・ フィジカルAI/ロボット学習
VLA/タスク計画VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HarnessWAM: 世界行動モデルにおける予測と熟考の橋渡しVLA/タスク計画2026/8/10
世界行動モデル(WAM)の予測と実行のギャップを埋めるため、視覚言語モデルベースのタスクマネージャーとイベント駆動型の二重タイムスケールフィードバックループを備えたエージェントフレームワークを提案し、複雑なタスクの計画・実行・失敗回復を可能にした。
- Mind-VLA: 指示を考慮した空間表現アライメントによる視覚言語行動モデルVLA2026/8/5
言語指示で指定された対象物体の3D情報に基づいてVLAモデルの表現を整列させる手法を提案し、細かい操作や遮蔽タスクでの性能を大幅に向上させた。
- HarnessWAM: Bridging Prediction and Deliberation in World Action Models2026/8/1
- Mind-VLA: Instruction-Aware Spatial Representation Alignment for Vision-Language-Action Models2026/8/1
- E-TTS: A New Embodied Test-Time Scaling Framework for Robotic Manipulation2026/6/1
- UniBYD: A Unified Framework for Learning Robotic Manipulation Across Embodiments Beyond Imitation of Human Demonstrations2025/12/1
- LightPlanner: Unleashing the Reasoning Capabilities of Lightweight Large Language Models in Task Planning2025/3/1
- PhysVLM: Enabling Visual Language Models to Understand Robotic Physical Reachability2025/3/1