Shichao Xie
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 人間のように探索する:身体化エージェントのためのオンラインSGメモ構築による自律探索探索2026/4/21
本論文は、大規模視覚言語モデルを用いて意味的ナビゲーション可能性を抽出し、階層的なSGメモをオンラインで構築しながら探索を行うことで、効率的な環境探索を実現するフレームワークABot-Explorerを提案する。
- AsyncShield: 非同期クラウドベースVLAナビゲーションのためのプラグアンドプレイエッジアダプタナビゲーション2026/4/1
クラウド上のVLAモデルの遅延による空間的ずれを、物理的な白箱マッピングと強化学習で補正する非同期制御フレームワークを提案。
- ABot-N0:多様な身体性ナビゲーションのためのVLA基盤モデルに関する技術報告VLA2026/2/1
5種類のナビゲーションタスクを統一的に扱うVLA基盤モデルABot-N0を提案し、大規模データセット構築と7ベンチマークでのSOTA達成、実環境での長期ミッションを可能にした。
- MerNav: ゼロショット物体目標ナビゲーションのための高汎化メモリ・実行・レビューフレームワークナビゲーション2026/2/1
メモリ・実行・レビューの3モジュールからなるフレームワークを提案し、ゼロショット物体目標ナビゲーションにおいて成功率と汎化性能を両立させ、実機ヒューマノイドでも検証した。
- NavForesee:階層的計画と二重時間軸ナビゲーション予測のための統合視覚言語ワールドモデルVLA2025/12/1
単一の視覚言語モデルで、言語指示の分解・進捗追跡による高レベル計画と、短期環境変化・長期マイルストーンの予測を同時に行い、屋内ナビゲーション性能を向上させた研究。
- SocialNav: 社会規範を考慮した具身ナビゲーションのための人間模倣基盤モデルナビゲーション2025/11/1
社会規範を理解し遵守するナビゲーションを実現するため、700万サンプルのデータセットと階層型「脳-行動」アーキテクチャ、強化学習手法SAFE-GRPOを組み合わせた基盤モデルを提案し、成功率と社会規範遵守率を大幅に向上させた。
- OmniNav:探索と視覚言語ナビゲーションを統合するフレームワークナビゲーション2025/9/1
指示・物体・地点ゴールナビゲーションとフロンティア探索を単一アーキテクチャで扱う統合ナビゲーションフレームワークを提案し、高速・低速モジュール連携で経路効率と汎化性能を向上させた。
- JanusVLN: 二重暗黙メモリで意味と空間を分離する視覚言語ナビゲーションVLA2025/9/1
人間の左右脳のように意味理解と空間認知を別々の固定サイズの暗黙的ニューラルメモリで表現し、冗長な計算を抑えつつ効率的に視覚言語ナビゲーションを行うフレームワークを提案した。
- Monocular Vehicle Self-localization method based on Compact Semantic Map2018/5/1