Minghua Luo
収録論文 7本 ・ フィジカルAI/ロボット学習
ナビゲーション探索VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ABot-N1: 汎用視覚言語ナビゲーション基盤モデルへの一歩ナビゲーション2026/7/1
視覚と言語を統合したナビゲーション基盤モデルABot-N1を提案。認知と制御を分離し、ピクセル目標と明示的な推論で汎用性・堅牢性・解釈性を両立する。
- 人間のように探索する:身体化エージェントのためのオンラインSGメモ構築による自律探索探索2026/4/21
本論文は、大規模視覚言語モデルを用いて意味的ナビゲーション可能性を抽出し、階層的なSGメモをオンラインで構築しながら探索を行うことで、効率的な環境探索を実現するフレームワークABot-Explorerを提案する。
- ABot-N0:多様な身体性ナビゲーションのためのVLA基盤モデルに関する技術報告VLA2026/2/1
5種類のナビゲーションタスクを統一的に扱うVLA基盤モデルABot-N0を提案し、大規模データセット構築と7ベンチマークでのSOTA達成、実環境での長期ミッションを可能にした。
- AstraNav-Memory: 長期記憶のための文脈圧縮ナビゲーション2025/12/1
画像中心の記憶を視覚的文脈圧縮で効率的に保持し、Qwen2.5-VLベースのナビゲーション方策と組み合わせて長期的な身体性ナビゲーションを実現した研究。
- NavForesee:階層的計画と二重時間軸ナビゲーション予測のための統合視覚言語ワールドモデルVLA2025/12/1
単一の視覚言語モデルで、言語指示の分解・進捗追跡による高レベル計画と、短期環境変化・長期マイルストーンの予測を同時に行い、屋内ナビゲーション性能を向上させた研究。
- SocialNav: 社会規範を考慮した具身ナビゲーションのための人間模倣基盤モデルナビゲーション2025/11/1
社会規範を理解し遵守するナビゲーションを実現するため、700万サンプルのデータセットと階層型「脳-行動」アーキテクチャ、強化学習手法SAFE-GRPOを組み合わせた基盤モデルを提案し、成功率と社会規範遵守率を大幅に向上させた。
- OmniNav:探索と視覚言語ナビゲーションを統合するフレームワークナビゲーション2025/9/1
指示・物体・地点ゴールナビゲーションとフロンティア探索を単一アーキテクチャで扱う統合ナビゲーションフレームワークを提案し、高速・低速モジュール連携で経路効率と汎化性能を向上させた。