Yanqing Zhu
収録論文 7本 ・ フィジカルAI/ロボット学習
ワールドモデルナビゲーションエージェントOSVLA/移動操作VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ABot-World-0: 単一デスクトップGPU上での無限インタラクティブワールドロールアウトワールドモデル2026/7/21
単一のデスクトップGPUでリアルタイムに長時間のインタラクティブなビデオ生成を実現するアクション条件付きワールドモデルを提案し、データ収集から推論最適化までを統合したシステムを構築した。
- ABot-N1: 汎用視覚言語ナビゲーション基盤モデルへの一歩ナビゲーション2026/7/1
視覚と言語を統合したナビゲーション基盤モデルABot-N1を提案。認知と制御を分離し、ピクセル目標と明示的な推論で汎用性・堅牢性・解釈性を両立する。
- ABot-AgentOS: 生涯マルチモーダルメモリを備えた汎用ロボットエージェントOSエージェントOS2026/7/1
低レベル制御の上に推論・記憶・ツール使用・検証・クロス実体実行を提供する汎用ロボットエージェントOSを提案し、実行可能なベンチマークと永続的なマルチモーダルグラフメモリを導入した。
- ABot-M0.5: 移動と操作を統合した世界行動モデルVLA/移動操作2026/7/1
移動操作ロボットのための世界行動モデルを提案し、時間粒度・行動空間・学習と推論の整合性を揃えることで、長期的なタスク実行の精度とロバスト性を向上させた。
- POINav: 実世界の視覚言語ナビゲーションにおける最終メートル到達のベンチマークと性能向上ナビゲーション2026/5/1
実世界のPOI(関心地点)ゴールナビゲーションのための初のクローズドループ評価ベンチマークPOINav-Benchを構築し、POI推論を行うBrainモジュールと連続ウェイポイント予測を行うActionモジュールからなるフレームワークを提案した。
- ABot-N0:多様な身体性ナビゲーションのためのVLA基盤モデルに関する技術報告VLA2026/2/1
5種類のナビゲーションタスクを統一的に扱うVLA基盤モデルABot-N0を提案し、大規模データセット構築と7ベンチマークでのSOTA達成、実環境での長期ミッションを可能にした。
- 屋内・屋外のギャップを埋める:最後の数メートルに向けた視覚中心の指示誘導型身体性ナビゲーションナビゲーション2026/2/1
正確な座標に頼らず、一人称視覚と指示のみで屋外から屋内へシームレスに移動する新しいナビゲーションタスクを提案し、画像ベースのプロンプトで意思決定する視覚中心フレームワークと初のオープンソースデータセットを構築した。