論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ナビゲーションロボティクス
CoFL-S: 局所言語条件付きナビゲーションのための空間クエリ可能なセクターフローフィールド
ロボットの局所視野セクター上に言語条件付きのフローフィールドを予測し、連続軌道を生成する低レベル視覚言語行動フレームワークを提案。連続時間Habitatベンチマークで既存手法を上回り、実世界でも有効性を確認。
原題: CoFL-S: Spatially Queryable Sector Flow Fields for Local Language-Conditioned Navigation / Haokun Liu, Zhaoqi Ma, Yicheng Chen 他
日本語で読む → - 論文ナビゲーションロボティクス
EA-Nav: 身体性を考慮した安全な視覚ナビゲーションポリシーの学習
異なる身体性を持つエージェント間でのナビゲーション性能を向上させるため、模倣学習に基づく身体性認識フレームワークを提案し、身体形状を条件付けトークンとして導入して行動の曖昧性を低減し、軌道拡張で高リスクサンプルを生成して安全なナビゲーションを実現した。
原題: EA-Nav: Learning Safe Visual Navigation Policies with Embodiment Awareness / Jialu Zhang, Yong Du, Xianda Guo 他
日本語で読む → - 論文ナビゲーションロボティクス
視覚ナビゲーションのための適応的安全マージン学習
固定の安全マージンによる失敗を解決するため、拡散プランナーの提案をランク付けする文脈条件付き安全クリティックを提案し、シミュレーションで訓練した後、実ロボットに転移する。
原題: Learning Adaptive Safety Margins for Visual Navigation / Junyi Hu, Shuaihang Yuan, Geeta Chandra Raju Bethala 他
日本語で読む → - 論文ナビゲーションロボティクス
UWB測位とD* Lite経路計画に基づく視覚障害者向け屋内ナビゲーションシステム
UWB測位とD* Liteアルゴリズムを用いて、視覚障害者向けの屋内ナビゲーションシステムを提案し、動的障害物への迅速な経路再計画を実現した。
原題: An Indoor Navigation System for the Visually Impaired based on UWB Positioning and D* Lite Path Planning Algorithm / Thanh C. Vo, Dong LT. Tran, Huy HM. Le 他
日本語で読む → - 論文VLA/ナビゲーション画像認識
緑は進め、赤は止まれ:VLAナビゲーションポリシーのためのセマンティックセグメンテーションによる視覚的グラウンディング
VLAナビゲーションモデルの性能を、SegFormerによるセマンティックセグメンテーションで走行可能領域を緑、非走行可能領域を赤に色付けする視覚的グラウンディング手法を提案し、誤差を最大44%削減することを示した。
原題: Green for Go, Red for No: Visual Grounding via Semantic Segmentation for VLA Navigation Policies / Adrian Szvoren, Dimitrios Kanoulas, Nilufer Tuptuk
日本語で読む → - 論文ナビゲーションロボティクス
社会的ロボットナビゲーションのためのグラフ表現を用いた軌道学習
歩行者との社会的相互作用を考慮したナビゲーションを実現するため、グラフベースの補助ネットワークで群衆状態を符号化し、軌道レベルの学習目的で時間的ダイナミクスを捉える模倣学習フレームワークを提案した。
原題: Trajectory Learning with Graph Representations for Social Robot Navigation / Berke Kartal, Burcu Kilic, Yigit Yildirim 他
日本語で読む → - 論文UAVナビゲーションロボティクス
軽量安全強化学習によるエンドツーエンドUAVナビゲーション
UAVの自律ナビゲーションを安全に行うため、軽量ネットワークと制約付き強化学習を組み合わせたフレームワークを提案し、高密度環境での成功率と安全性を向上させた。
原題: Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation / Shenghui Zhang, YuXuan Gao, Songwei Zhao 他
日本語で読む → - 論文ナビゲーションロボティクス
群衆を進む:社会的力動学を組み込んだ非線形MPCによる人間配慮型ロボットナビゲーション
社会的力モデルを予測モデルに組み込んだ非線形MPCフレームワークを提案し、人間の動きを予測しながら社会的規範に沿ったナビゲーションを実現した。
原題: Navigating the Crowd: Non-linear MPC with Social Forces Dynamics for Human-Aware Robot Navigation / Stefano Trepella, Andrea Ostuni, Mauro Martini 他
日本語で読む → - 論文ナビゲーションロボティクス
HAM-VLN: 階層的エージェント記憶を活用したゼロショット視覚言語ナビゲーション
ロボットが未知環境で指示に従って移動する際、画像や地図の代わりにエージェント自身が書き込む永続的な世界グラフを記憶として使い、次の行動選択と同じLLM呼び出しで記憶も更新することで、長期的なナビゲーションの記憶・推論ボトルネックを解消した。追加のLLM呼び出しなしで文脈長を65%以上削減しつつ、複数のナビゲーションベンチマークで最高性能を達成した。
原題: HAM-VLN: Harnessing Hierarchical Agentic Memory for Zero-Shot Vision-and-Language Navigation / An Liu, Bingxi Liu, Hongyu Ding 他
日本語で読む → - 論文ナビゲーションロボティクス
HumAIN: 人間を考慮した暗黙的ソーシャルロボットナビゲーション
歩行や姿勢などの骨格情報を暗黙の社会的合図として捉え、知識蒸留により軽量モデルでリアルタイムに人間らしいナビゲーションを実現するフレームワークを提案した。
原題: HumAIN: Human-Aware Implicit Social Robot Navigation / Daeun Song, Nhat Le, Jeffrey Chen 他
日本語で読む → - 論文ナビゲーションロボティクス
RAVEN: 強化学習適応型可視グラフ計画による堅牢なヒューマノイドナビゲーションと衝突回避MPC
ヒューマノイドの動的環境でのナビゲーションにおいて、強化学習で可視グラフ計画の障害物膨張などのパラメータを適応させ、遅延やノイズに対する堅牢性を向上させる階層型RL-MPCフレームワークを提案した。
原題: RAVEN: Reinforcement-Adaptive Visibility-Graph Planning for Robust Humanoid Navigation with Collision-Free MPC / Ruochen Hou, Shiqi Wang, Beom Jun Kim 他
日本語で読む → - 論文ナビゲーションロボティクス
MAMMOTH: モダリティ欠損に頑健なオフロード移動のためのマルチモーダルエンドツーエンドポリシー
RGB、熱画像、3D点群、自己速度などのマルチモーダル観測を融合し、モダリティ欠損に頑健なオフロード自律ナビゲーションポリシーを提案した。拡散ポリシーを用いて物理的に妥当な軌道と走行可能性ヒューリスティックを学習する。
原題: MAMMOTH: A Multi-Modal End-to-End Policy for Off-Road Mobility Robust to Missing Modality / Ahaan Kotian, Shivani Subramanyan, Suresh Sundaram
日本語で読む → - 論文ナビゲーション画像認識
FlowDec: 時間的条件付きフロー修復による頑健な連続環境視覚言語ナビゲーション
連続環境での視覚言語ナビゲーション(VLN-CE)において、実世界の視覚劣化に対する頑健性を高めるため、時間的文脈を活用した画像修復フレームワークFlowDecを提案した。
原題: FlowDec: Temporal Conditional Flow Decorruptor for Robust Continuous Vision-Language Navigation / Yufei Zhang, Changhao Chen
日本語で読む → - 論文ナビゲーションロボティクス
自律ナビゲーションにおける注視誘導型能動知覚のための高速な人間の注意予測
液体ニューラルネットワークとMobileNetV3を用いた軽量な視線走査予測モデルGazeLNNを提案し、計算コストを99.4%削減しつつ最先端の精度を達成。さらに強化学習で訓練したカメラ制御ポリシーに統合し、実機ドローンでの自律ナビゲーションを実証した。
原題: Fast Human Attention Prediction for Fixation-guided Active Perception in Autonomous Navigation / Fatma Youssef Mohammed, Grzegorz Malczyk, Kostas Alexis
日本語で読む → - 論文ナビゲーションAI
自動対話拡張によるDialNavの性能向上
DialNavの訓練データ不足を解決するため、既存のVLNデータセットから自動で対話データを生成するパイプラインを提案し、大規模データセットRAINbowを構築。さらに、動的な対話ナビゲーションループに合わせた訓練手法とVLN知識を活用した位置推定モデルを導入し、成功率を大幅に向上させた。
原題: Advancing DialNav through Automatic Embodied Dialog Augmentation / Leekyeung Han, Sangwon Jung, Hyunji Min 他
日本語で読む → - 論文ナビゲーション画像認識
見て到達する:視野内UAVの精密視覚言語ナビゲーション
UAVの視覚言語ナビゲーションにおいて、目標が視野に入った後の精密な到達能力に焦点を当てた新しいタスクと、動的3D方向手がかりを用いたウェイポイント予測フレームワークを提案した。
原題: See-and-Reach: Precise Vision-Language Navigation for UAVs within the Field of View / Fanfu Xue, En Yu, Yantian Shen 他
日本語で読む → - 論文ナビゲーションAI
EvolveNav: ゼロショット物体目標ナビゲーションのための先行的内省と自己進化メモリ
ゼロショット物体目標ナビゲーションにおいて、過去の軌跡からルールを抽出し、探索前に結果を予測する自己進化フレームワークを提案し、成功率を向上させた。
原題: EvolveNav: Proactive Preflection and Self-Evolving Memory for Zero-Shot Object Goal Navigation / Qi Chai, Wenhao Shen, Nanjie Yao 他
日本語で読む → - 論文ナビゲーションロボティクス
NavWAM: 目標条件付き視覚ナビゲーションのためのナビゲーションワールドアクションモデル
将来の視覚予測と行動生成を統合した拡散トランスフォーマーポリシーを提案し、シミュレーション事前学習と実機適応により、計画ベースのワールドモデルより高い性能を実現した。
原題: NavWAM: A Navigation World Action Model for Goal-Conditioned Visual Navigation / Daichi Azuma, Taiki Miyanishi, Koya Sakamoto 他
日本語で読む → - 論文ナビゲーションロボティクス
IMUのみの外乱除去とジャーク拡張モデルを活用した自律型農業ロボットの頑健なナビゲーション
GNSSやLiDARなどのセンサが途切れる環境でも、ジャーク拡張EKFと適応型ノイズ調整によりロバストな自己位置推定を実現する農業ロボット向けナビゲーション手法を提案した。
原題: Resilient Navigation for Autonomous Farm Robots by Leveraging Jerk-Augmented Models with IMU-Only Disturbance Rejection / Batu Candan, Mohammed Atallah, Simone Servadio 他
日本語で読む → - 論文ナビゲーションロボティクス
SpaceVLN: オンライン空間認知記憶と推論を備えたゼロショット視覚言語ナビゲーションエージェント
連続環境での視覚言語ナビゲーションにおいて、空間構造を理解し指示に従うゼロショットエージェントを提案。空間認知記憶とタスク誘導型空間推論を導入し、探索領域を階層的に抽象化してナビゲーションを効率化する。
原題: SpaceVLN: A Zero-Shot Vision-and-Language Navigation Agent with Online Spatial Cognitive Memory and Reasoning / Yucheng Deng, Pingrui Lai, Xinhai Li 他
日本語で読む → - 論文ナビゲーションロボティクス
MinNav: 光学フローを用いた小型空中ロボットのミニマリスト航法
単眼カメラの光学フローと不確実性を用いて、事前知識なしに静的・動的障害物や未知形状の隙間を飛行する航法スタックを提案し、実機実験で70%の成功率を達成した。
原題: MinNav: Minimalist Navigation Using Optical Flow For Active Tiny Aerial Robots / Aniket Patil, Mandeep Singh, Uday Girish Maradana 他
日本語で読む → - 論文ナビゲーションAI
WorldFly: UAVナビゲーションのためのワールドモデル基盤の視覚言語行動モデル
UAVナビゲーションのための新しいVLAフレームワークで、将来の映像予測と行動を同時生成するデュアルブランチ結合フローマッチング機構を導入し、空間想像による意思決定を強化する。
原題: WorldFly: A World-Model-Based Vision-Language-Action Model for UAV Navigation / Shengtao Zheng, Kai Li, Weichen Zhang 他
日本語で読む → - 論文ナビゲーション画像認識
報酬が見合うときだけ質問する:コストを考慮したオープンエンド対話によるインスタンス目標ナビゲーション
インスタンス目標ナビゲーションにおいて、曖昧な指示を解決するためのオラクルへの質問コストを考慮し、情報利得に基づいて質問タイプと重みを学習し、効率的な対話ナビゲーションを実現する手法を提案した論文。
原題: Ask When It Pays: Cost-Aware Open-Ended Interaction for Instance Goal Navigation / Xunyi Zhao, Sihao Lin, Gengze Zhou 他
日本語で読む → - 論文ナビゲーション画像認識
EvoMemNav: ゼロショット具現化ナビゲーションのための自己進化型高精細メモリ
観測を細粒度で保持する視覚意味メモリグラフを構築し、予算制約付き粗密探索とサブタスク後のリフレクションによるメモリ更新で、ゼロショットの具現化ナビゲーション性能を向上させた。
原題: EvoMemNav: Efficient Self-Evolving Fine-Grained Memory for Zero-Shot Embodied Navigation / Zuhao Ge, Xiaosong Jia, Chao Wu 他
日本語で読む → - 論文ナビゲーションロボティクス
3Dアイソビスト世界モデル:都市の見えない幾何学とその創発的な都市横断シグネチャを明らかにする
都市を移動するエージェントのために、建物の見た目ではなく移動可能な空間(ネガティブスペース)を3Dアイソビストとして予測する世界モデルを提案した。マンハッタンとパリで訓練した単一モデルが、都市横断的な空間特徴を創発的に獲得することを発見した。
原題: A 3D Isovist World Model -- Revealing a City's Unseen Geometry and Its Emergent Cross-City Signature / Xuhui Lin, Stephen Law, Nanjiang Chen 他
日本語で読む → - 論文ナビゲーションロボティクス
ViTL: 時間論理ガイドによる視覚言語モデルを用いたゼロショット自然言語ナビゲーション
自然言語コマンドを時間論理式に変換し、視覚言語モデルで方向別スコアを生成することで、複数目標を順序付きで探索するゼロショット長期的ナビゲーションを実現した。
原題: ViTL: Temporal Logic-Guided Zero-Shot Natural Language Navigation via Vision-Language Models / Kaier Liang, Hengde Dai, Cristian-Ioan Vasile
日本語で読む → - 論文ナビゲーションロボティクス
HUMEMBR: 人間のルーチンを学習する予測的身体性ナビゲーション
人間の行動パターンを長期記憶として蓄積し、質問応答やルーチンに基づくナビゲーションを行うシステムを提案。実ロボットでの検証も行い、トークン数を抑えつつ長期的推論を改善した。
原題: HUMEMBR: Learning Human Routines for Predictive Embodied Navigation / Samira Huber, Klaas Pelzer, Duc M. Nguyen 他
日本語で読む → - 論文ナビゲーションロボティクス
LocalNav: フロンティアVLMと身体化RLの蒸留によるオンデバイス物体目標ナビゲーション
大規模VLMの空間推論能力を軽量な4BパラメータのローカルVLMに蒸留し、組み込みGPU上で低遅延な物体目標ナビゲーションを実現する手法を提案した。
原題: LocalNav: Distilling Frontier VLMs and Embodied RL for On-Device Object Goal Navigation / Nicolas Baumann, Liam Boyle, Pu Deng 他
日本語で読む → - 論文ナビゲーションロボティクス
SemGeoNav: 意味的推論と幾何学的計画による安全性誘導型視覚ナビゲーション手法
エンドツーエンドモデルの意味理解と幾何学的プランナーの安全性を統合した階層型視覚ナビゲーションフレームワークを提案し、実機の四足ロボットで性能を実証した。
原題: SemGeoNav:A Safety-Guided Visual Navigation Approach with Semantic Reasoning and Geometric Planning / Yu Liu, Zongyang Chen, Yan Guo 他
日本語で読む → - 論文ナビゲーションロボティクス
JPPD: 動的障害物回避のための微分可能な安全ガイダンスを備えた統合予測・計画拡散モデル
歩行者やサービスロボットが混在する共有空間での自律移動のために、予測と計画を単一の条件付き軌道生成問題として扱う拡散モデルを提案し、微分可能な安全ポテンシャルで衝突回避を実現した。
原題: JPPD: Joint Prediction_Planning Diffusion with Differentiable Safety Guidance for Dynamic Obstacle Avoidance in Intelligent Transportation Systems / Jiahao Wu, Shengwen Yu
日本語で読む →