Yanfen Shen
収録論文 7本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ABot-N1: 汎用視覚言語ナビゲーション基盤モデルへの一歩ナビゲーション2026/7/1
視覚と言語を統合したナビゲーション基盤モデルABot-N1を提案。認知と制御を分離し、ピクセル目標と明示的な推論で汎用性・堅牢性・解釈性を両立する。
- POINav: 実世界の視覚言語ナビゲーションにおける最終メートル到達のベンチマークと性能向上ナビゲーション2026/5/1
実世界のPOI(関心地点)ゴールナビゲーションのための初のクローズドループ評価ベンチマークPOINav-Benchを構築し、POI推論を行うBrainモジュールと連続ウェイポイント予測を行うActionモジュールからなるフレームワークを提案した。
- 人間のように探索する:身体化エージェントのためのオンラインSGメモ構築による自律探索探索2026/4/21
本論文は、大規模視覚言語モデルを用いて意味的ナビゲーション可能性を抽出し、階層的なSGメモをオンラインで構築しながら探索を行うことで、効率的な環境探索を実現するフレームワークABot-Explorerを提案する。
- AsyncShield: 非同期クラウドベースVLAナビゲーションのためのプラグアンドプレイエッジアダプタナビゲーション2026/4/1
クラウド上のVLAモデルの遅延による空間的ずれを、物理的な白箱マッピングと強化学習で補正する非同期制御フレームワークを提案。
- 屋内・屋外のギャップを埋める:最後の数メートルに向けた視覚中心の指示誘導型身体性ナビゲーションナビゲーション2026/2/1
正確な座標に頼らず、一人称視覚と指示のみで屋外から屋内へシームレスに移動する新しいナビゲーションタスクを提案し、画像ベースのプロンプトで意思決定する視覚中心フレームワークと初のオープンソースデータセットを構築した。
- ABot-N0:多様な身体性ナビゲーションのためのVLA基盤モデルに関する技術報告VLA2026/2/1
5種類のナビゲーションタスクを統一的に扱うVLA基盤モデルABot-N0を提案し、大規模データセット構築と7ベンチマークでのSOTA達成、実環境での長期ミッションを可能にした。
- SocialNav: 社会規範を考慮した具身ナビゲーションのための人間模倣基盤モデルナビゲーション2025/11/1
社会規範を理解し遵守するナビゲーションを実現するため、700万サンプルのデータセットと階層型「脳-行動」アーキテクチャ、強化学習手法SAFE-GRPOを組み合わせた基盤モデルを提案し、成功率と社会規範遵守率を大幅に向上させた。