論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文物体ナビゲーションロボティクス
3DGSNav: アクティブ3Dガウシアンスプラッティングによる視覚言語モデルの物体ナビゲーション推論強化
3DガウシアンスプラッティングをVLMの永続メモリとして組み込み、自由視点レンダリングとCoTプロンプトでゼロショット物体ナビゲーションの空間推論を向上させるフレームワークを提案。
原題: 3DGSNav: Enhancing Vision-Language Model Reasoning for Object Navigation via Active 3D Gaussian Splatting / Wancai Zheng, Hao Chen, Xianlong Lu 他
日本語で読む → - 論文ナビゲーションロボティクス
NavDreamer: 動画生成モデルをゼロショット3Dナビゲータとして活用
動画生成モデルを言語指示とナビゲーション軌道のインターフェースとして用い、ゼロショットで3Dナビゲーションを実現するフレームワークを提案。
原題: NavDreamer: Video Models as Zero-Shot 3D Navigators / Xijie Huang, Weiqi Gai, Tianyue Wu 他
日本語で読む → - 論文物体ナビゲーションロボティクス
ユーザー中心物体ナビゲーション:個人の習慣を統合したパーソナライズド物体探索ベンチマーク
個人の物体配置習慣を組み込んだ物体ナビゲーションの新ベンチマークUcONを提案し、習慣検索モジュールで習慣を活用することで成功率が向上することを示した。
原題: User-Centric Object Navigation: A Benchmark with Integrated User Habits for Personalized Embodied Object Search / Hongcheng Wang, Jinyu Zhu, Hao Dong
日本語で読む → - 論文物体ナビゲーションロボティクス
Hydra-Nav: 適応的二重プロセス推論による物体ナビゲーション
VLMを用いた物体探索ナビゲーションにおいて、熟考型の遅い推論と反応型の速い実行を状況に応じて切り替える統合アーキテクチャを提案し、探索成功率と効率を大幅に改善した。
原題: Hydra-Nav: Object Navigation via Adaptive Dual-Process Reasoning / Zixuan Wang, Huang Fang, Shaoan Wang 他
日本語で読む → - 論文ナビゲーションロボティクス
USS-Nav: 軽量UAVのゼロショット物体ナビゲーションのための統合時空間意味シーングラフ
未知環境でUAVがゼロショットで物体を探索できるよう、空間接続グラフとオープン語彙の意味情報を統合した階層的シーングラフを逐次構築し、LLMによる大域目標決定と局所プランナを組み合わせた軽量ナビゲーション手法を提案した。
原題: USS-Nav: Unified Spatio-Semantic Scene Graph for Lightweight UAV Zero-Shot Object Navigation / Weiqi Gai, Yuman Gao, Yuan Zhou 他
日本語で読む → - 論文ナビゲーションロボティクス
ReasonNavi: 人間に着想を得たゼロショット身体性ナビゲーションのためのグローバル地図推論
トップダウン地図を部屋分割と候補ノードに離散化し、MLLMに多段階で推論させて指示に合う目標を選び、決定論的プランナで経路生成するゼロショットナビゲーション手法を提案。
原題: ReasonNavi: Human-Inspired Global Map Reasoning for Zero-Shot Embodied Navigation / Yuzhuo Ao, Anbang Wang, Yu-Wing Tai 他
日本語で読む → - 論文ナビゲーションロボティクス
RA-Nav: 予測不能な環境における空中ロボットのためのセマンティックセグメンテーションに基づくリスク認識ナビゲーションシステム
セマンティックセグメンテーションで障害物を分類し、突然動き出す障害物のリスクを推定して安全な経路を計画する空中ロボット向けナビゲーション手法を提案。
原題: RA-Nav: A Risk-Aware Navigation System Based on Semantic Segmentation for Aerial Robots in Unpredictable Environments / Ziyi Zong, Xin Dong, Jinwu Xiang 他
日本語で読む → - 論文UAVナビゲーション画像認識
再照明可能な3Dガウシアンスプラッティングによる森林でのゼロショットUAVナビゲーション
実世界データに基づくシミュレーションで、照明を編集可能な3Dガウシアンスプラッティングを用いて強化学習を行い、森林環境で最大10m/sのゼロショット自律飛行を実現した。
原題: Zero-Shot UAV Navigation in Forests via Relightable 3D Gaussian Splatting / Zinan Lv, Yeqian Qian, Chen Sang 他
日本語で読む → - 論文ナビゲーションロボティクス
入力アフィン系に対するナビゲーションのための合成可能なモデルフリー強化学習
各環境要素(目標や障害物)ごとに価値関数と最適方策を学習し、オンラインで合成することで、未知の非線形連続時間入力アフィン系において目標到達と衝突回避を実現するモデルフリー強化学習手法を提案。
原題: Composable Model-Free RL for Navigation with Input-Affine Systems / Xinhuan Sang, Abdelrahman Abdelgawad, Roberto Tron
日本語で読む → - 論文ナビゲーションロボティクス
看板を頼りに地図なしで移動するロボットの視覚的看板グラウンディング
実世界の看板の意味を3Dシーンに結びつける「看板グラウンディング」を定式化し、VLMに適した空間・意味表現SignSceneを提案。地図なしで看板のみを使ったSpotロボットのナビゲーションを実現した。
原題: SignScene: Visual Sign Grounding for Mapless Navigation / Nicky Zimmerman, Joel Loo, Benjamin Koh 他
日本語で読む → - 論文ナビゲーションロボティクス
不確実な環境における自律航行のためのリスク考慮型障害物回避アルゴリズム
動的障害物の確率的リスクマップとRRT*経路計画、Bスプライン軌道平滑化を組み合わせ、自律水上艇が安全かつ滑らかに航行できるリスク考慮型ナビゲーション手法を提案した。
原題: Risk-Aware Obstacle Avoidance Algorithm for Real-Time Applications / Ozan Kaya, Emir Cem Gezer, Roger Skjetne 他
日本語で読む → - 論文群集ナビゲーションロボティクス
Crowd-FM: 群集ナビゲーションのための条件付きフローマッチング生成軌道の学習に基づく最適選択
条件付きフローマッチングで衝突回避軌道を生成し、人間らしさを評価するスコア関数で最適な軌道を選択する群集ナビゲーション手法を提案。
原題: Crowd-FM: Learned Optimal Selection of Conditional Flow Matching-generated Trajectories for Crowd Navigation / Antareep Singha, Laksh Nanwani, Mathai Mathew P. 他
日本語で読む → - 論文VLAナビゲーションロボティクス
LongNav-R1: 長期的VLAナビゲーションのための適応的マルチターン強化学習
VLAモデルによる長期的ナビゲーションを、環境とのマルチターン対話として強化学習する枠組みを提案し、Horizon-Adaptive Policy Optimizationで時間的信用割当を改善、成功率を64.3%から73.0%に向上させた。
原題: LongNav-R1: Horizon-Adaptive Multi-Turn RL for Long-Horizon VLA Navigation / Yue Hu, Avery Xi, Qixin Xiao 他
日本語で読む → - 論文ソーシャルナビゲーションロボティクス
移動サービスロボットのためのペア単位の人間-人間インタラクション検出・認識フレームワーク
移動ロボットが人混みの中で安全に動くため、軽量な幾何・運動手がかりで相互作用する人物ペアを検出し、関係ネットワークで粗い相互作用の種類を分類する二段階手法を提案した。
原題: A Pairwise Human-Human Interaction Detection and Recognition Framework for Mobile Service Robots / Mengyu Liang, Iolanda Leite, Sarah Gillet
日本語で読む → - 論文ナビゲーションロボティクス
跳ぶべき時を学ぶオフロードナビゲーション
地形ごとの走行コストを速度の関数としてモデル化し、溝を跳び越えるなど速度に応じた安全な経路計画を実現した研究。
原題: Learning When to Jump for Off-road Navigation / Zhipeng Zhao, Taimeng Fu, Shaoshu Su 他
日本語で読む → - 論文ナビゲーションロボティクス
Sem-NaVAE: 生成的軌道事前分布による意味論誘導型屋外地図なしナビゲーション
CVAEで多様な軌道を生成し、軽量VLMのオープン語彙セグメンテーションで自然言語に基づき軌道を選択する、屋外地図なしナビゲーション手法を提案した。
原題: Sem-NaVAE: Semantically-Guided Outdoor Mapless Navigation via Generative Trajectory Priors / Gonzalo Olguín, Javier Ruiz-del-Solar
日本語で読む → - 論文ナビゲーションロボティクス
水中グライダーの長期自律運用に向けたオンライン航法計画
不確実性を考慮したオンライン計画を実機の水中グライダーに適用し、北海での約3ヶ月・1000kmの自律ミッションで従来手法より効率的な航法を実証した。
原題: Online Navigation Planning for Long-term Autonomous Operation of Underwater Gliders / Victor-Alexandru Darvariu, Charlotte Z. Reed, Jan Stratmann 他
日本語で読む → - 論文ナビゲーション画像認識
屋内・屋外のギャップを埋める:最後の数メートルに向けた視覚中心の指示誘導型身体性ナビゲーション
正確な座標に頼らず、一人称視覚と指示のみで屋外から屋内へシームレスに移動する新しいナビゲーションタスクを提案し、画像ベースのプロンプトで意思決定する視覚中心フレームワークと初のオープンソースデータセットを構築した。
原題: Bridging the Indoor-Outdoor Gap: Vision-Centric Instruction-Guided Embodied Navigation for the Last Meters / Yuxiang Zhao, Yirong Yang, Yanqing Zhu 他
日本語で読む → - 論文ナビゲーションロボティクス
記憶拡張カルマンフィルタによる連続ナビゲーションの誤差蓄積の緩和
UAVの視覚言語ナビゲーションにおける位置推定誤差の蓄積(状態ドリフト)を、カルマンフィルタに着想を得た記憶検索機構で補正するNeuroKalmanを提案し、TravelUAVベンチマークで有効性を示した。
原題: Mitigating Error Accumulation in Continuous Navigation via Memory-Augmented Kalman Filtering / Yin Tang, Jiawei Ma, Jinrui Zhang 他
日本語で読む → - 論文ナビゲーション画像認識
MerNav: ゼロショット物体目標ナビゲーションのための高汎化メモリ・実行・レビューフレームワーク
メモリ・実行・レビューの3モジュールからなるフレームワークを提案し、ゼロショット物体目標ナビゲーションにおいて成功率と汎化性能を両立させ、実機ヒューマノイドでも検証した。
原題: MerNav: A Highly Generalizable Memory-Execute-Review Framework for Zero-Shot Object Goal Navigation / Dekang Qi, Shuang Zeng, Xinyuan Chang 他
日本語で読む → - 論文視覚ナビゲーションロボティクス
ReaDy-Go: 動的障害物を伴う環境特化型視覚ナビゲーションのための実世界-シミュレーション動的3Dガウシアンスプラッティング
実環境を3Dガウシアンスプラッティングで再構成し、動く人間アバターを追加した写実的な動的シミュレーションを生成して、動的障害物に頑健な視覚ナビゲーション方策を学習する手法を提案した。
原題: ReaDy-Go: Real-to-Sim Dynamic 3D Gaussian Splatting Simulation for Environment-Specific Visual Navigation with Moving Obstacles / Seungyeon Yoo, Youngseok Jang, Dabin Kim 他
日本語で読む → - 論文ナビゲーションロボティクス
SuReNav: 過制約環境でのナビゲーションのためのスーパーピクセルグラフに基づく制約緩和
半静的環境での過制約プランニング問題に対し、スーパーピクセルグラフとグラフニューラルネットワークを用いて人間らしい安全で効率的なナビゲーションを実現する手法を提案し、四足歩行ロボットSpotで実世界都市ナビゲーションの有効性を示した。
原題: SuReNav: Superpixel Graph-based Constraint Relaxation for Navigation in Over-constrained Environments / Keonyoung Koh, Moonkyeong Jung, Samuel Seungsup Lee 他
日本語で読む → - 論文ナビゲーションロボティクス
CoReLIN: 制約ベース推論によるゼロショット生涯対話型ナビゲーション
LLMとシーングラフを用いて、移動ロボットが障害物を移動させ経路を切り開きながら連続的な物体配置タスクをこなす生涯対話型ナビゲーション手法を提案。
原題: CoReLIN: Constraint-based Reasoning for Zero-shot Lifelong Interactive Navigation / Apoorva Vashisth, Manav Kulshrestha, Pranav Bakshi 他
日本語で読む → - 論文ナビゲーション画像認識
LangMap: 人間検証済みの階層的オープンボキャブラリ目標ナビゲーションのベンチマーク
言語条件付き目標ナビゲーションのための、シーン・部屋・領域・インスタンスの4階層の目標を人間が検証した注釈でカバーする初の実世界3D屋内ナビゲーションベンチマークLangMapを提案し、RGBのみの強力なベースラインPlaNaVidも導入した。
原題: LangMap: A Human-Verified Benchmark for Hierarchical Open-Vocabulary Goal Navigation / Bo Miao, Weijia Liu, Jun Luo 他
日本語で読む → - 論文ソーシャルナビゲーションロボティクス
PISHYAR: 視覚障害者向けの社会的インテリジェントなスマート杖による屋内ソーシャルナビゲーションとマルチモーダルな人間-ロボットインタラクション
視覚障害者支援のため、社会的配慮のあるナビゲーションとマルチモーダル対話を統合したスマート杖を開発し、シミュレーションと実環境で約80%の精度を達成した。
原題: PISHYAR: A Socially Intelligent Smart Cane for Indoor Social Navigation and Multimodal Human-Robot Interaction for Visually Impaired People / Mahdi Haghighat Joo, Maryam Karimi Jafari, Alireza Taheri
日本語で読む → - 論文視覚ナビゲーションロボティクス
StepNav: 構造化軌道事前分布による効率的でマルチモーダルな視覚ナビゲーション
幾何認識の成功確率場から複数のナビゲーション経路候補を生成し、それを条件付きフローマッチングの事前分布として使うことで、安全で効率的な視覚ナビゲーション軌道を少ないステップで生成する手法を提案。
原題: StepNav: Structured Trajectory Priors for Efficient and Multimodal Visual Navigation / Xubo Luo, Aodi Wu, Haodong Han 他
日本語で読む → - 論文ソーシャルナビゲーションロボティクス
障害物からエチケットへ:VLMに基づく経路選択によるロボットのソーシャルナビゲーション
幾何学的な経路計画に微調整した視覚言語モデルによる社会的文脈の推論を組み合わせ、人間の活動や社会規範に配慮した経路をリアルタイムで選ぶロボットナビゲーション手法を提案した。
原題: From Obstacles to Etiquette: Robot Social Navigation with VLM-Informed Path Selection / Zilin Fang, Anxing Xiao, David Hsu 他
日本語で読む → - 論文ナビゲーションロボティクス
OVerSeeC: 衛星画像と自然言語からのオープンボキャブラリ・コストマップ生成
衛星画像と自然言語の指示から、LLMとオープンボキャブラリ・セグメンテーションを組み合わせて、未知の地形やミッション固有の走行ルールに対応した実行可能なコストマップをゼロショットで生成するフレームワーク。
原題: OVerSeeC: Open-Vocabulary Costmap Generation from Satellite Images and Natural Language / Rwik Rana, Jesse Quattrociocchi, Dongmyeong Lee 他
日本語で読む → - 論文ナビゲーションロボティクス
LAMP: ロボットナビゲーションのための暗黙的言語マップ
言語指示に従うロボットナビゲーションにおいて、言語特徴を暗黙的なニューラル場として学習し、粗いグラフ計画と勾配ベースの微調整を組み合わせて大規模環境でも高精度な経路生成を可能にした手法。
原題: LAMP: Implicit Language Map for Robot Navigation / Sibaek Lee, Hyeonwoo Yu, Giseop Kim 他
日本語で読む → - 論文視覚ナビゲーションロボティクス
画像空間での参照軌道位置推定による視覚ナビゲーション
参照RGB軌道をロボットの現在の視界に位置合わせすることで、カメラキャリブレーションやロボット固有の学習なしに、機体に依存しない画像空間ガイダンスを提供する視覚ナビゲーションモデルLoTISを提案。
原題: Learning to Localize Reference Trajectories in Image-Space for Visual Navigation / Finn Lukas Busch, Matti Vahs, Quantao Yang 他
日本語で読む →