論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/6 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ナビゲーション画像認識
一つのMLLM、一回の呼び出し:空間認識ウェイポイントによる効率的なゼロショット視覚言語ナビゲーション
連続環境での視覚言語ナビゲーション(VLN-CE)において、各意思決定ステップで単一の大規模モデルを一度だけ呼び出す効率的なゼロショットナビゲーションフレームワークO2C-Navを提案。訓練不要のウェイポイント生成器と抽象表現を用いてRGB画像上に候補ウェイポイントを可視化し、MLLMが選択した目標をFMMプランナーで衝突回避経路に変換する。
原題: One MLLM, One Call: Efficient Zero-Shot Vision-and-Language Navigation via Spatial-Aware Waypoints / Shiqi Pan, Qi Zheng, Hanqin Sun 他
日本語で読む → - 論文ナビゲーション/安全制御ロボティクス
OcclusionCBF: 隠れた動的障害物に対する安全なナビゲーションのためのバックアップ制御バリア関数
ロボットが遮蔽物の背後に隠れた動的障害物と衝突しないよう、到達可能な占有予測に基づくバックアップ制御バリア関数を拡張した安全フィルタを提案し、シミュレーションと実機で有効性を示した。
原題: OcclusionCBF: Backup Control Barrier Functions for Safe Navigation Among Hidden Dynamic Obstacles / Taekyung Kim, Hun Kuk Park, Renya Wada 他
日本語で読む → - 論文ナビゲーションロボティクス
自律ロボットナビゲーション失敗予測のための適応コスト考慮型機械学習:すべての誤りが等しいわけではない
ナビゲーション失敗の予測を、カテゴリの深刻度だけでなく速度や障害物距離などの物理的文脈を考慮したコスト関数で重み付けする適応的手法を提案し、シミュレーションと実データで高深刻度の再現率を向上させた。
原題: Adaptive Cost-Sensitive Machine Learning for Autonomous Robot Navigation Failure Prediction: When Not All Errors Are Equal / Rifa Ferzana
日本語で読む → - 論文ナビゲーションロボティクス
NavArena: 3Dガウススプラッティング再構成からの目標指向ナビゲーションベンチマークの自動構築
固定された3DGS再構成を、到達可能性や衝突判定、意味的目標を備えたナビゲーションベンチマークへ自動変換するフレームワークを提案し、2,000以上のシーンで2,220万の専門家軌道を生成して評価する。
原題: NavArena: Automated Construction of Goal-Oriented Navigation Benchmarks from 3D Gaussian Splatting Reconstructions / Junhui Wang, Wei Yang, Xinyao Li 他
日本語で読む → - 論文ナビゲーションロボティクス
密集・不確実な群衆中のロボットナビゲーションのための人-人・人-ロボット相互作用トランスフォーマー (H2INT)
群衆中のロボットナビゲーションにおいて、歩行者がロボットの存在に応じて動きを変えることを明示的にモデル化する強化学習フレームワークを提案。人-人・人-ロボット関係を階層的に符号化するトランスフォーマーと、応答性を段階的に低下させるカリキュラム学習により、安全性と頑健性を向上させた。
原題: Human-Human & Human-Robot Interaction Transformer (H2INT) for Robot Navigation in Dense and Uncertain Crowds / Ao Shen, Kaixi Chen, Shiwei Liu 他
日本語で読む → - 論文ナビゲーションロボティクス
共有鳥瞰図による空陸協調型視覚言語ナビゲーション
UAVとUGVが協調する空陸協調型VLNの初の訓練不要ベースラインを提案し、共有鳥瞰図を用いて協調動作を実現、成功率77%を達成した。
原題: Air-Ground Collaborative Vision-and-Language Navigation via Shared Bird's-Eye Maps / Shuning Zhang, Liang Li, Yunheng Wang 他
日本語で読む → - 論文ナビゲーションロボティクス
連続環境における視覚言語ナビゲーションの閉ループ強化学習のためのマクロ行動に基づくトポロジカルグラフの再考
VLN-CEタスクを階層的MDPとして再構成し、トポロジカルグラフ上のマクロ行動空間で強化学習を行うことで、サンプル効率と性能を向上させた。
原題: Revisiting Topological Graphs for Macro Action based Closed-loop Reinforcement Learning of Vision Language Navigation in Continuous Environment / Shuhao Ye, Sitong Mao, Yuxiang Cui 他
日本語で読む → - 論文農業ロボット/ナビゲーションロボティクス
地中海型温室における自律ナビゲーションのための斜面・地形補償適応制御アーキテクチャ
温室の多様な土壌・傾斜に対応するため、ペイロードとIMU計測に基づく適応フィードフォワード制御をMPC+PIカスケードに組み込み、軌道追従精度を向上させた。
原題: An Adaptive Control Architecture for Slope and Terrain Compensation in Autonomous Navigation in Mediterranean Greenhouses / Fernando Cañadas-Aránega, Dirk Wollherr, José L. Guzmán 他
日本語で読む → - 論文ナビゲーションロボティクス
屋外ロボットのための障害物対応自律巡回・ナビゲーション
屋外での長時間巡回を実現するため、RTK-GNSSとEKFによる高精度位置推定、カバレッジプランナの改良、行動木によるミッション管理を統合したROS 2アーキテクチャを提案し、シミュレーションと実機で93〜96%の巡回率を達成した。
原題: Obstacle-Aware Autonomous Coverage and Navigation for Outdoor Robots / Leonardo Gargani, Matteo Frosi, Matteo Matteucci
日本語で読む → - 論文3Dメモリ/動的環境/ナビゲーションロボティクス
HitMem: 動的環境のための階層的時間的3Dメモリとマルチモーダル文脈認識検索
動的環境で物体が移動した際のメモリと観測の矛盾を解決するため、階層的時間的3DメモリフレームワークHitMemを提案し、物体の再発見精度とタスク実行性能を向上させた。
原題: HitMem: Hierarchical Temporal 3D Memory with Multi-Modal Context-Aware Retrieval for Dynamic Environments / Ruijie Tang, Chenye Zou, Guoquan Wu 他
日本語で読む → - 論文ナビゲーションロボティクス
VerNav: 検証器優先の低遅延ビジョン・言語ナビゲーション
VLNタスクにおいて、各ステップの自己回帰生成を検証器による一括アクション検証に置き換え、不確実な場合のみ適応的生成器を使うことで、遅延を10倍以上削減しつつ競争力のある性能を達成するフレームワークを提案した。
原題: VerNav: Verifier-First Low-Latency Vision-and-Language Navigation / Zhixin Wang, Chengzheyi Yao, Leyuan Liu 他
日本語で読む → - 論文オフロードナビゲーション/危険特定ロボティクス
GAFT: 地理的アンカーによる微調整を用いた稀な失敗からの危険特定
オフロード走行中の高重心化や閉じ込めなどの稀な失敗事例から危険構造を特定するため、視覚基盤モデルを幾何学由来の事前情報で微調整する手法GAFTを提案した。
原題: GAFT: Geo-Anchored Fine-Tuning for Hazard Identification from Rare Failures / Yanran Xu, Chuanhang Qiu, Yue Wang 他
日本語で読む → - 論文ナビゲーションロボティクス
LightNav-0: 汎用身体性ナビゲーションのためのVLM空間知能の引き出し
事前学習済み視覚言語モデルの空間知能をナビゲーション制御に直接活用する、タスク非依存の汎用ナビゲーションモデルLightNav-0を提案。統一トークンインターフェースと残差VQアクショントークナイザにより、指示追従・物体探索・視覚追跡を単一モデルで実現する。
原題: LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation / Shaoan Wang, Aocheng Luo, Fei Huang 他
日本語で読む → - 論文ナビゲーションAI
基盤モデルを物理世界エージェントに組み込むことで長期的ナビゲーションの限界を押し広げる
VLMによる推論エージェントとナビゲーション基盤モデルを組み合わせたフレームワークNavMCPを提案し、長期的な探索タスクで高い性能を達成した。
原題: Scaffolding Foundation Models into Physical-World Agents Pushes the Frontier of Long-Horizon Navigation / Zixing Lei, Gengze Zhou, Xiong-Hui Chen 他
日本語で読む → - 論文マイクロロボット/ナビゲーションロボティクス
単平面透視を用いた無造影・自律ナビゲーションによる血管内マイクロロボットの制御
単平面X線透視のみを用いて、造影剤なしで血管内マイクロロボットを3次元自律ナビゲーションするデジタルツイン手法VISTAを提案し、ファントムと生体内で実証した。
原題: Contrast-Free Autonomous Navigation of Untethered Endovascular Microrobots Using Single-Plane Fluoroscopy / Husnu Halid Alabay, Tuan-Anh Le, Ping Wang 他
日本語で読む → - 論文視覚ナビゲーションロボティクス
CanonNav: カメラ幾何からナビゲーション行動を分離するクロスプラットフォーム視覚ナビゲーション
クロスプラットフォームのデモから視覚ナビゲーションを学習する際、カメラ幾何の影響を分離し、安全性と局所進行の補助監督を導入するフレームワークCanonNavを提案。RGBのみでRGB-D法を上回る性能を達成。
原題: CanonNav: Disentangling Navigation Behavior from Camera Geometry in Cross-Platform Visual Navigation / Dong-Wook Kim, Ji-Hoon Hwang, E-In Son 他
日本語で読む → - 論文VLM/ナビゲーション/ベンチマーク画像認識
GeoAgent: 身体化ナビゲーションによるVLMの地理的位置特定能力の評価
視覚言語モデル(VLM)の地理的位置特定能力を、静的画像ではなく身体化ナビゲーション環境で評価するベンチマークGeoAgentを提案した。エージェントがストリートビューを探索して位置を推定する過程で、VLMの性能やバイアスを分析している。
原題: GeoAgent: Evaluating VLM Geolocalization Through Embodied Navigation / Arka Mukherjee, Soham Roy, Kartikeya Trivedi 他
日本語で読む → - 論文ナビゲーションロボティクス
CGFM-Nav: 意味ガイド型生涯マルチモーダル具現化ナビゲーションのための認知グラフフィールドメモリ
視覚言語ナビゲーションのための、明示的な関係メモリと連続的な空間直感を組み合わせた永続的なマルチモーダルシーン表現を提案し、目標検索と探索ガイダンスを統合したフレームワークを構築した。
原題: CGFM-Nav: Cognitive Graph-Field Memory for Semantic-Guided Lifelong Multimodal Embodied Navigation / Yuxiang Xiao, Xibei Chen, Xin Zhou 他
日本語で読む → - 論文ナビゲーションロボティクス
Hydra: 離散潜在プランニングと連続フローマッチング実行を備えたナビゲーション世界行動モデル
世界モデルを用いたロボットナビゲーションのリアルタイム制御を実現するため、プランナーをモデル内部に統合し、離散潜在空間でのプランニングと連続軌道生成を組み合わせたHydraを提案した。
原題: Hydra: A Navigation World Action Model with Discrete Latent Planning and Continuous Flow-Matching Execution / Mohammad Nazeri, Alexandyr Card, Samira Huber 他
日本語で読む → - 論文ナビゲーションロボティクス
CAVE-NAV: VLMを用いた水中洞窟環境における自律3次元ナビゲーション
水中洞窟での自律ナビゲーションのために、視覚言語モデルと思考連鎖推論を用いて環境の手がかりから進行可能な方向を推定し、衝突回避を実現するフレームワークを提案した。
原題: CAVE-NAV: VLM-Based Autonomous 3D Navigation in Underwater Cave Environments / Zhenqi Wu, Yuanjie Lu, Yisheng Zhang 他
日本語で読む → - 論文ナビゲーションロボティクス
STEGNav: 時空間イベントグラフ推論によるマルチモーダル生涯物体ナビゲーション
従来のシーングラフを時空間イベントグラフに拡張し、VLMベースのエージェントが目標物体と探索フロンティアを統合的に推論する訓練不要のナビゲーションフレームワークを提案した。
原題: STEGNav: Spatio-Temporal Event Graph Reasoning for Multimodal Lifelong Object Navigation / Yang Chen, Zhenyu Huang, Wenbo Fu 他
日本語で読む → - 論文ナビゲーションロボティクス
大規模言語モデルを用いた空間意味推論によるUAV探索の効率化
UAVの物体探索タスクにおいて、LLMが自然言語指示と検出物体・空間文脈を意味推論し、高確率な探索領域を優先することでミッション時間を短縮するリアルタイムナビゲーションフレームワークを提案した。
原題: Spatial-Semantic Reasoning using Large Language Models for Efficient UAV Search Operations / Marin Maletic, Marijana Peti, Tamara Petrovic 他
日本語で読む → - 論文ナビゲーションロボティクス
森林での一年間:亜寒帯環境における自律ナビゲーションの課題分析
亜寒帯の森林で1年間にわたり移動ロボットを運用し、季節変化がオドメトリやSLAMなどのナビゲーション手法に与える影響を評価した。
原題: One year in a forest: Analyzing the challenges of autonomous navigation in subarctic environments / Matěj Boxan, Nicolas Lauzon, Veronica Vannini 他
日本語で読む → - 論文ナビゲーションロボティクス
RTNav: リアルタイムゼロショット物体ナビゲーションに向けて
未知環境での物体探索ナビゲーションにおいて、推論遅延を考慮したリアルタイム実行を可能にするアーキテクチャRTNavを提案し、従来手法より成功率を最大11%向上させた。
原題: RTNav: Towards Real-Time Zero-Shot Object Navigation / Easop Lee, Lingyu Zhang, Boyuan Chen
日本語で読む → - 論文ナビゲーションロボティクス
EgoNav: 学習されたウェイポイントと幾何学認識型ローカル制御を橋渡しする堅牢な屋内ナビゲーション
画像ゴールナビゲーションのための階層型システムで、学習済みウェイポイント予測を幾何学的安全性と方向整合性で補正し、適応型ローカルプランナーで実行する。シミュレーションと実機ヒューマノイドで成功率と経路効率を向上させた。
原題: EgoNav: Bridging Learned Waypoints and Geometry-Aware Local Control for Robust Indoor Navigation / Jing Wang, Shiqi Zhao, Hairong Qu 他
日本語で読む → - 論文ナビゲーションロボティクス
社会的ナビゲーションのためのアドバンテージ駆動型明示メモリ
ロボットのナビゲーション方策に、重要なイベントにつながる過去のステップを明示的に記憶する非パラメトリックメモリを導入し、シミュレーションから実環境への適応や稀な衝突などの失敗への対応を改善した。
原題: Advantage-Driven Explicit Memory for Social Navigation / Yeonsoo Park, Mattia Racca, Guillaume Bono 他
日本語で読む → - 論文ナビゲーションロボティクス
AGRO-Nav: 自律的なグラフベース果樹園ナビゲーション
果樹園の木の列からトポロジカルグラフを自動構築し、Dijkstra探索とTheta*経路で滑らかな経路を生成するナビゲーション手法を提案。実地試験でA*やTheta*より高精度かつ高速に走行できることを示した。
原題: AGRO-Nav: Autonomous Graph-based Orchard Navigation / Ho Young Yun, Jaemin Yu, Duksu Kim
日本語で読む → - 論文ナビゲーションロボティクス
VIP: 変分に基づく反復学習計画法によるロボットナビゲーション
ロボットの動作計画を無限次元の関数空間で直接更新する新しいフレームワークを提案し、計算コストを抑えつつ単体・群ロボットの効率的な計画を実現した。
原題: VIP: Variation-based Iterative-learning Planning for Robotic Navigation / Shuli Lv, Pengda Mao, Chen Min 他
日本語で読む → - 論文UAVナビゲーションロボティクス
RACO: 点検指向UAV視覚言語ナビゲーションのための信頼性を考慮した粗目標最適化
UAVの視覚言語ナビゲーションにおいて、点検用途では目標領域内で停止し、類似する偽目標を避ける必要があるが、既存の粗密ナビゲーションは粗目標の信頼性を考慮せず失敗する。本論文では、この問題を評価するベンチマークLG-UVIを導入し、粗目標を実行時仮説として扱い、物体レベルのアンカーで補正するRACOフレームワークを提案する。
原題: RACO: Reliability-Aware Coarse-Goal Optimization for Inspection-Oriented UAV Vision-Language Navigation / Sen Wang, Yiming Sun, Jiaxuan He 他
日本語で読む → - 論文ナビゲーションロボティクス
OptiSight:意味推論と幾何制御を橋渡しする身体化ナビゲーション
視覚言語モデルによる意味推論と視覚サーボによる幾何制御を組み合わせたハイブリッドな屋内ナビゲーション手法を提案。AI Habitatでのゼロショット実験で有効性を確認。
原題: OptiSight: Bridging Semantic Reasoning and Geometric Control for Embodied Navigation / Alperen Avan, Jordi Sanchez-Riera
日本語で読む →