Mingyang Wu
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VISTAv2: 屋内視覚言語ナビゲーションのための世界想像モデルVLA2025/12/1
過去の観測・行動候補・指示から未来の視点を生成し、オンライン価値マップとして計画に融合する世界モデルを提案。MP3DとRoboTHORで性能向上を実証。
- FORGE-Tree: 拡散強制と木探索による長期的ロボットマニピュレーションマニピュレーション2025/10/1
凍結したVLAエンコーダに拡散強制ヘッドとモンテカルロ木拡散を組み合わせ、軌道を局所的に修正しながら長期的な操作タスクの成功率を向上させる制御層を提案。
- VISTA: 視覚と言語によるナビゲーションのための生成的視覚想像VLA2025/5/1
拡散モデルを用いて言語指示に基づく未来の視覚イメージを生成し、現在の観測と整合させながら行動を決定するVLNフレームワークを提案。R2RとRoboTHORで最高性能を達成。