Wei Guo
収録論文 8本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ABot-N1: 汎用視覚言語ナビゲーション基盤モデルへの一歩ナビゲーション2026/7/1
視覚と言語を統合したナビゲーション基盤モデルABot-N1を提案。認知と制御を分離し、ピクセル目標と明示的な推論で汎用性・堅牢性・解釈性を両立する。
- POINav: 実世界の視覚言語ナビゲーションにおける最終メートル到達のベンチマークと性能向上ナビゲーション2026/5/1
実世界のPOI(関心地点)ゴールナビゲーションのための初のクローズドループ評価ベンチマークPOINav-Benchを構築し、POI推論を行うBrainモジュールと連続ウェイポイント予測を行うActionモジュールからなるフレームワークを提案した。
- ABot-N0:多様な身体性ナビゲーションのためのVLA基盤モデルに関する技術報告VLA2026/2/1
5種類のナビゲーションタスクを統一的に扱うVLA基盤モデルABot-N0を提案し、大規模データセット構築と7ベンチマークでのSOTA達成、実環境での長期ミッションを可能にした。
- 屋内・屋外のギャップを埋める:最後の数メートルに向けた視覚中心の指示誘導型身体性ナビゲーションナビゲーション2026/2/1
正確な座標に頼らず、一人称視覚と指示のみで屋外から屋内へシームレスに移動する新しいナビゲーションタスクを提案し、画像ベースのプロンプトで意思決定する視覚中心フレームワークと初のオープンソースデータセットを構築した。
- RoboOS-NeXT:生涯学習・スケーラブル・堅牢なマルチロボット協調のための統合メモリフレームワーク群制御2025/10/1
空間・時間・身体性を統合した共有メモリSTEMを中核に、脳-小脳型の階層構造で異種ロボット群の生涯学習・動的タスク割当・障害復旧を実現するフレームワークを提案。
- OmniNav:探索と視覚言語ナビゲーションを統合するフレームワークナビゲーション2025/9/1
指示・物体・地点ゴールナビゲーションとフロンティア探索を単一アーキテクチャで扱う統合ナビゲーションフレームワークを提案し、高速・低速モジュール連携で経路効率と汎化性能を向上させた。
- RoboBrain 2.0 技術報告VLA2025/7/1
視覚と言語を統合し、実環境での知覚・推論・計画を担う具現化基盤モデルRoboBrain 2.0を提案。7Bと32Bの2種類で、空間理解や時系列意思決定タスクで高い性能を示す。
- PCF-Grasp: 点群補完を幾何特徴に変換して6自由度把持を強化マニピュレーション2025/4/1
単視点の不完全な点群を点群補完で完全形状に近づけ、その幾何特徴を把持ネットワークに組み込むことで、6自由度把持の精度と実機での実行可能性を高めた手法を提案。