Guiyu Zhao
Institute of Automation, Chinese Academy of Sciences
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAナビゲーションVLA/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AtlasVLA: 視覚言語行動モデルのための持続的な世界・自我状態モデリングVLA2026/8/1
単眼カメラのみで長期的なタスクを遂行できるよう、視覚言語行動モデルに持続的な世界状態メモリと自我作業メモリを導入し、空間推論とタスク進行の追跡を可能にした。
- NavWM: 先読み計画のための統合ナビゲーションワールドモデルナビゲーション2026/6/1
ナビゲーションのための統合ワールドモデルを提案し、潜在世界トークンによる幾何・意味理解と、多様な行動予測による閉ループ計画を実現した。
- VeriSpace: 視覚言語行動モデルのための空間基盤型行動検証VLA/操作2026/6/1
VLAモデルのテスト時行動選択を改善するため、3D認識の行動検証器を提案し、候補行動の空間的関係と幾何学的妥当性を評価して信頼性を高めた。