論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ナビゲーションロボティクス
遅い脳、速いプランナー:遅延耐性を持つVLM拡張都市ナビゲーション
歩道ナビゲーションのプランナーが苦手な状況で、VLMを使って候補軌道を選び、遅延を補償する融合層で実時間制御を維持する手法を提案した。
原題: Slow Brain, Fast Planner: Latency-Resilient VLM-Augmented Urban Navigation / Zhenghao "Mark'' Peng, Honglin He, Quanyi Li 他
日本語で読む → - 論文ナビゲーションロボティクス
GNSS遮断環境向けベイズ学習強化ディープスムージング
GNSSが使えない環境でのナビゲーション精度を高めるため、ベイズ平滑化にトランスフォーマーによる学習を組み合わせた手法を提案し、クアッドローターのデータで精度向上を実証した。
原題: BLENDS: Bayesian Learning-Enhanced Deep Smoothing for GNSS-Denied Environments / Nadav Cohen, Itzik Klein
日本語で読む → - 論文ナビゲーションロボティクス
展開可能なソーシャルロボットナビゲーションのための視覚言語モデル:意味推論と低レベル制御の橋渡し
本論文は、ソーシャルロボットナビゲーションにおける視覚言語モデルの活用を概観し、高レベルの意味推論と低レベルの制御を統合するための構造化されたロードマップを提案している。
原題: Vision-Language Models for Deployable Social Robot Navigation: Bridging Semantic Reasoning and Low-Level Control / Runji Cai, Toshihiko Yamasaki, Ling Xiao
日本語で読む → - 論文ナビゲーションロボティクス
AllDayNav: 実世界強化学習による生涯ナビゲーション
動的環境での生涯ナビゲーションのために、明示的な地図やシーングラフを使わず、大規模モデルに強化学習でシーン動態を暗黙的に符号化し、自己進化するマルチモーダルメモリで長期動作を実現するフレームワークを提案した。
原題: AllDayNav: Lifelong Navigation via Real-World Reinforcement Learning / Hang Yin, Yinan Liang, Jiazhao Zhang 他
日本語で読む → - 論文ナビゲーションロボティクス
FloVerse: フロアプラン誘導によるマルチモーダルナビゲーション
フロアプランを用いた屋内ナビゲーションの新しいタスクを提案し、PointNav・ObjectNav・ImageNavを統合した大規模データセットと拡散モデルベースの模倣学習手法を開発した。
原題: FloVerse: Floor Plan-Guided Multi-Modal Navigation / Weiqi Huang, Shuangyi Dong, Jiaxin Li 他
日本語で読む → - 論文ナビゲーションロボティクス
ImagineUAV: 世界モデルと運動力学的計画による空中視覚言語ナビゲーション
UAVの視覚言語ナビゲーションにおいて、潜在ビデオ拡散モデルで未来の観測を想像し、そこから6自由度の動作を抽出して衝突回避軌道を計画するフレームワークを提案。
原題: ImagineUAV: Aerial Vision-Language Navigation via World-Action Modeling and Kinodynamic Planning / Xuchen Liu, Jiawei Huang, Shihao Xia 他
日本語で読む → - 論文ナビゲーションロボティクス
ViTL: 時間論理ガイドによる視覚言語モデルを用いたゼロショット自然言語ナビゲーション
自然言語コマンドを時間論理式に変換し、視覚言語モデルで方向別スコアを生成することで、複数目標を順序付きで探索するゼロショット長期的ナビゲーションを実現した。
原題: ViTL: Temporal Logic-Guided Zero-Shot Natural Language Navigation via Vision-Language Models / Kaier Liang, Hengde Dai, Cristian-Ioan Vasile
日本語で読む → - 論文ナビゲーションロボティクス
BIT-Nav: 脳に着想を得た軌跡記憶による身体化ナビゲーション
視覚言語モデルによるナビゲーションの性能限界はフレーム数ではなく表現方法にあるとし、軌跡の行動意図を圧縮した記憶トークンを追加するフレームワークを提案した。
原題: BIT-Nav: Brain-Inspired Trajectory Memory for Embodied Navigation / Rithvik Jonna, Aakash Gurram, Man Namgung 他
日本語で読む → - 論文UAVナビゲーションロボティクス
LNN-Fly: タイミング不一致に頑健な障害物回避のための連続時間UAVナビゲーション
LiDARベースのUAV障害物回避において、センサや制御のタイミングずれに頑健な連続時間ナビゲーションポリシーを提案し、シミュレーションと実機で有効性を示した。
原題: LNN-Fly: Continuous-Time UAV Navigation for Robust Obstacle Avoidance under Timing Mismatch / Yulin Huang, Shaojie Chen, Di Feng 他
日本語で読む → - 論文ナビゲーションロボティクス
HUMEMBR: 人間のルーチンを学習する予測的身体性ナビゲーション
人間の行動パターンを長期記憶として蓄積し、質問応答やルーチンに基づくナビゲーションを行うシステムを提案。実ロボットでの検証も行い、トークン数を抑えつつ長期的推論を改善した。
原題: HUMEMBR: Learning Human Routines for Predictive Embodied Navigation / Samira Huber, Klaas Pelzer, Duc M. Nguyen 他
日本語で読む → - 論文ナビゲーションロボティクス
GroundControl: 軌道一貫性のある不確実性推定による視覚言語エージェントのナビゲーション失敗の予測
視覚言語ナビゲーションエージェントの実行中に、軌道全体の一貫性に基づく不確実性スコアを計算し、失敗や非効率な行動を事前に予測する手法を提案した。
原題: GroundControl: Anticipating Navigation Failures in Vision-Language Agents via Trajectory-Consistent Uncertainty Estimates / Nastaran Darabi, Divake Kumar, Sina Tayebati 他
日本語で読む → - 論文ナビゲーションロボティクス
先読み:ナビゲーションに重要な手がかりに関する反復推論
事前学習済み視覚言語モデルを用いて、疎な言語指示からのナビゲーションにおいて、環境の手がかりを反復的に提案・批評することで、プラン依存の手がかりを発見し、移動計画を改善するフレームワークを提案した。
原題: Foresight: Iterative Reasoning About Clues that Matter for Navigation / Arthur Zhang, Carl Qi, Donne Su 他
日本語で読む → - 論文ナビゲーションロボティクス
オープンな視覚言語モデルを用いた空間QAとナビゲーションのためのバイナリ追跡
ロボットの軌跡の時間順序を利用し、クエリから特定した2つのアンカー地点間で二分探索を行うことで、空間質問応答の精度と速度を向上させるオープンソースのエージェントを提案した。
原題: Binary Tracking for Spatial QA and Navigation with Open Vision-Language Models / Dongbin Na, Chanwoo Kim, Soonbin Rho 他
日本語で読む → - 論文UAVナビゲーションロボティクス
野生動物の個体再識別のための自律UAVナビゲーション
野生動物の個体再識別に必要な画像を自律的に撮影するドローン航法システムを提案。検出と姿勢分類を用いて飛行を制御し、ゼブラ等での実証を行った。
原題: Autonomous UAV Navigation for Individual Wildlife Re-Identification / Claire Sun, Tanya Berger-Wolf, Jenna Kline
日本語で読む → - 論文ナビゲーションロボティクス
FlashNav: 20秒以内の超高速ロボットナビゲーションポリシー訓練
GPU中心のフレームワークで、レンジベースのロボットナビゲーションの強化学習ポリシーを20秒未満で訓練できることを示した論文。シミュレーションをナビゲーションMDPに合わせて簡略化し、GPU上で並列遷移を生成することで高速化を実現。
原題: FlashNav: Ultra-Fast Policy Training for Robot Navigation within 20 Seconds / Shanze Wang, Yiwei Qian, Xinming Zhang 他
日本語で読む → - 論文ナビゲーションロボティクス
EffiNav:深度と視覚言語を融合した効率的な物体目標ナビゲーション
未知環境での物体探索効率を高めるため、深度情報と視覚言語モデルを組み合わせたナビゲーション手法を提案し、シミュレーションと実機で検証した。
原題: EffiNav: Fusing Depth and Vision-Language for Efficient Object Goal Navigation / Zecheng Yin, Benedict Jun Ma
日本語で読む → - 論文ナビゲーションロボティクス
SidewalkBench: 都市歩道における視覚ナビゲーションのベンチマーク
都市歩道での視覚ナビゲーションを評価するための包括的なベンチマークを提案し、9つのモデルを様々なシナリオで評価した。
原題: SidewalkBench: Benchmarking Visual Navigation on Urban Sidewalks / Zhizheng Liu, Honglin He, Vivek Alumootil 他
日本語で読む → - 論文ナビゲーションロボティクス
CBF-CLFに基づくマルチゴールナビゲーションのための競合認識スイッチング
CBF-CLF-QP制御における安全制約と目標追従制約の競合を検出し、目標を切り替えることでデッドロックや遅延を減らす手法を提案した。
原題: Conflict-Aware Switching for CBF-CLF-Based Multi-Goal Navigation / Rohan Walia, Kevin Leahy
日本語で読む → - 論文ナビゲーションロボティクス
AgniNav: 構成駆動型クロスエンボディローカルナビゲーション
ロボットの衝突エンベロープを4パラメータで定義し、単眼画像から疑似レーザースキャンを生成するネットワークとプランナーを構成することで、再学習なしで車輪型・脚型・人型ロボットに適用可能なナビゲーション手法を提案した。
原題: AgniNav: Configuration-Driven Cross-Embodiment Local Planning for Robot Navigation / Tianhao Zang, Siwei Cheng, Haidong Huang 他
日本語で読む → - 論文UAVナビゲーションロボティクス
パイロットのように考える:高精度な長期間UAVナビゲーション
UAVエージェント向けに、多段階の指示と高密度な6自由度軌道を備えたベンチマークFLIGHTを導入し、低頻度の推論と高頻度の制御を分離する非同期アーキテクチャFLIGHT VLAを提案した。
原題: Think Like a Pilot: Fine-Grained Long-Horizon UAV Navigation / Xiangyi Zheng, Xiangyu Wang, Qinan Liao 他
日本語で読む → - 論文ナビゲーションロボティクス
AgenticDiffusion: 視覚ベースUAVナビゲーションのためのエージェント型拡散経路計画
言語指示と複数視点(前方視点と俯瞰視点)を組み合わせ、拡散モデルによる経路計画とNMPCを統合した屋内UAVナビゲーションフレームワークを提案。実環境で80%の成功率を達成。
原題: AgenticDiffusion: Agentic Diffusion-based Path Planning for Vision-Based UAV Navigation / Faryal Batool, Muhammad Ahsan Mustafa, Fawad Mehboob 他
日本語で読む → - 論文ナビゲーションロボティクス
グレア耐性ナビゲーションコストマップのための信頼性誘導型深度融合
反射床やガラス面などで生じるRGB-D深度計測の誤差を、深度信頼度を予測するネットワークと信頼性に基づく融合機構で補正し、偽の障害物を減らしてナビゲーションコストマップを頑健に構築する手法を提案した。
原題: Reliability-Guided Depth Fusion for Glare-Resilient Navigation Costmaps / Shang-En Tsai
日本語で読む → - 論文ナビゲーションロボティクス
意図を考慮したシーン表現による群衆中のロボット視覚ナビゲーション学習
群衆中のロボットナビゲーションにおいて、人間の意図と環境構造を考慮した視覚表現を用いた強化学習手法を提案し、シミュレーションと実環境で優れた性能を示した。
原題: Learning Robot Visual Navigation in Crowds via Intention-Aware Scene Representations / Han Bao, Bingyi Xia, Hanjing Ye 他
日本語で読む → - 論文ナビゲーションロボティクス
信頼性のあるナビゲーションのためのタスク認識環境拡張:遮蔽付き条件付き拡散モデル
部分観測下での軌道計画の信頼性を高めるため、環境に視覚マーカーを配置する問題を扱い、条件付き拡散モデルを用いてマーカー配置を生成する手法を提案した。
原題: Task-Aware Environment Augmentation for Reliable Navigation via Shielded Conditional Diffusion / Bharawee Phoompho, Gokul Puthumanaillam, Yan Miao 他
日本語で読む → - 論文制御/オフロードナビゲーションロボティクス
精度と効率のバランス:モデル予測制御のための適応的ダイナミクスオーケストレーション
モデル予測制御(MPC)におけるモデル精度と計算効率のトレードオフを解決するため、現在のナビゲーション状況に応じて適切なダイナミクスモデルを動的に選択するフレームワーク「Adaptive Dynamics Orchestration (ADO)」を提案した。実機実験で、固定の低遅延モデルより誤差を減らしつつ、最高精度モデルに近い精度を低コストで達成した。
原題: Balancing Accuracy and Efficiency: Adaptive Dynamics Orchestration for Model Predictive Control / Francesco Cancelliere, Aniket Datar, Giovanni Muscato 他
日本語で読む → - 論文ナビゲーションロボティクス
PolyMerge: ポリトープ被覆による3Dガウシアンスプラットの圧縮と、リソース制約下での安全なナビゲーションの実現
3Dガウシアンスプラットで表現されたシーンを、凸ポリトープの集合に変換して軽量化し、制御バリア関数と組み合わせることで、計算資源が限られたドローンでもリアルタイムに安全な経路計画を可能にする手法を提案した。
原題: PolyMerge: Compressing 3D Gaussian Splats with Polytope Coverings for Provably Safe Resource-Constrained Navigation / Jihoon Hong, Chih-Yuan Chiu, Sara Fridovich-Keil 他
日本語で読む → - 論文ナビゲーション画像認識
階層的3Dシーングラフ構築と信念に基づく計画による意味的ナビゲーション
未知環境での意味的ナビゲーションのため、オンラインで階層的3Dシーングラフを構築し、その上で信念に基づく計画を行うゼロショット手法を提案。長距離シナリオで成功率と経路効率を向上させた。
原題: Hierarchical 3D Scene Graph Construction and Belief-based Planning for Semantic Navigation / Bing Wu, Zuyao Chen, Changwen Chen
日本語で読む → - 論文ナビゲーションロボティクス
NavWM: 先読み計画のための統合ナビゲーションワールドモデル
ナビゲーションのための統合ワールドモデルを提案し、潜在世界トークンによる幾何・意味理解と、多様な行動予測による閉ループ計画を実現した。
原題: NavWM: A Unified Navigation World Model for Foresight-Driven Planning / Yanghong Mei, Longteng Guo, Ming-Ming Yu 他
日本語で読む → - 論文ナビゲーションロボティクス
SAFER-Nav: セグメンテーション認識ファインチューニングによる視覚ロボットナビゲーションの安全性向上
視覚ベースのナビゲーションモデルに障害物境界や自由空間構造を明示的に組み込むファインチューニング手法を提案し、衝突頻度を低減しつつ目標到達性能を維持する。
原題: SAFER-Nav: Enhancing Safety for Visual Robot Navigation via Segmentation-Aware Fine-Tuning / Geonyeong Ko, Giung Lee, Changjoo Nam
日本語で読む → - 論文ナビゲーションロボティクス
FLAP: 事前地図なし3DナビゲーションのためのFOV制約付き能動知覚計画
未知の3D環境でUAVを安全かつ効率的に飛行させるため、センサの視野(FOV)制約を軌道最適化に直接組み込んだ能動知覚計画フレームワークを提案する。
原題: FLAP: FOV-Constrained Active Perception Planning for Prior-Map-Free 3D Navigation / Mengke Zhang, Sitong Li, Tiancheng Lai 他
日本語で読む →