論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2025/12/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文自律ナビゲーションロボティクス
YOLOP知覚とLyapunov制御を統合した自律移動ロボットのトラックナビゲーション
YOLOPによるマルチタスク視覚知覚とLyapunov安定性に基づく追従制御を組み合わせ、非ホロノミックな差動駆動移動ロボットがトラック上をリアルタイムで自律走行できるフレームワークを提案し、実機実験で有効性を検証した。
原題: Integrated YOLOP Perception and Lyapunov-based Control for Autonomous Mobile Robot Navigation on Track / Mo Chen
日本語で読む → - 論文ナビゲーションロボティクス
Khalasi: 渦流場における水上ビークルの省エネナビゲーション
局所的な流速計測のみを用いた強化学習により、渦流場を航行する自律水上ビークルの省エネ経路を学習する手法を提案し、既存手法比で30〜50%の省エネを達成した。
原題: Khalasi: Energy-Efficient Navigation for Surface Vehicles in Vortical Flow Fields / Rushiraj Gadhvi, Sandeep Manjanna
日本語で読む → - 論文ナビゲーションロボティクス
Bench-Push:移動ロボットの押し動作に基づくナビゲーションとマニピュレーションのベンチマーク
移動ロボットが物体を押して動かすタスク(迷路突破、氷海域航行、箱配送、エリア清掃)を統一的に評価する初のベンチマークを提案し、効率・相互作用・部分達成度の新指標とベースライン評価を提供。
原題: Bench-Push: Benchmarking Pushing-based Navigation and Manipulation Tasks for Mobile Robots / Ninghan Zhong, Steven Caro, Megnath Ramesh 他
日本語で読む → - 論文ナビゲーションロボティクス
RANGER: 単眼カメラによるゼロショット意味的ナビゲーションのための視覚的文脈適応フレームワーク
単眼カメラのみで動作し、短い動画から環境の文脈を学習して任意の物体を探索できるゼロショット・オープンボキャブラリなナビゲーション手法を提案。
原題: RANGER: A Monocular Zero-Shot Semantic Navigation Framework through Visual Contextual Adaptation / Ming-Ming Yu, Yi Chen, Börje F. Karlsson 他
日本語で読む → - 論文安全ナビゲーションロボティクス
動的環境における安全なロボットナビゲーションのための動的対数ガウス過程制御バリア関数
対数変換したガウス過程回帰で制御バリア関数をオンライン構築し、障害物の動きを先読みして動的環境でも安全にロボットを誘導する手法を提案した。
原題: Dynamic Log-Gaussian Process Control Barrier Function for Safe Robotic Navigation in Dynamic Environments / Xin Yin, Chenyang Liang, Yanning Guo 他
日本語で読む → - 論文ナビゲーションロボティクス
シュレーディンガーのナビゲーター:ゼロショット物体ナビゲーションのための未来集合の想像
軌道条件付き3D世界モデルで複数の未来を想像し、不確実性を考慮してゼロショット物体ナビゲーションを行う手法を提案。
原題: Schr\"odinger's Navigator: Imagining an Ensemble of Futures for Zero-Shot Object Navigation / Yu He, Da Huang, Zhenyang Liu 他
日本語で読む → - 論文ナビゲーションロボティクス
LoGoPlanner: メートル法に基づく視覚幾何と自己位置推定を統合したナビゲーション方策
絶対スケールの視覚幾何バックボーンを微調整し、周囲形状の再構成と暗黙的状態推定を組み合わせることで、外部キャリブレーション不要のエンドツーエンド移動ロボットナビゲーションを実現した。
原題: LoGoPlanner: Localization Grounded Navigation Policy with Metric-aware Visual Geometry / Jiaqi Peng, Wenzhe Cai, Yuqiang Yang 他
日本語で読む → - 論文空中ナビゲーション画像認識
履歴強化型二段階Transformerによる空中視覚言語ナビゲーション
大規模都市環境でのUAVナビゲーションにおいて、粗い目標位置予測と細かい視覚分析を組み合わせた二段階Transformerと履歴グリッドマップを提案し、CityNavデータセットで性能を向上させた。
原題: History-Enhanced Two-Stage Transformer for Aerial Vision-and-Language Navigation / Xichen Ding, Jianzhe Gao, Cong Pan 他
日本語で読む → - 論文ナビゲーション画像認識
SocialNav-MoE: 社会規範に配慮したナビゲーションのための強化学習ファインチューニングを用いたMixture-of-Experts視覚言語モデル
小型VLMとMixture-of-Expertsを組み合わせ、強化学習ファインチューニングと意味的類似度報酬で社会的に配慮したナビゲーションを効率的に実現した。
原題: SocialNav-MoE: A Mixture-of-Experts Vision Language Model for Socially Compliant Navigation with Reinforcement Fine-Tuning / Tomohito Kawabata, Xinyu Zhang, Ling Xiao
日本語で読む → - 論文ナビゲーションロボティクス
HAVEN: 階層型敵対者認識可視性ナビゲーションとカバー活用のための深層トランスフォーマーQネットワーク
部分的に観測可能な環境での自律ナビゲーションのため、深層トランスフォーマーQネットワークでサブゴールを選択し、可視性を考慮した候補生成と低レベル制御を組み合わせる階層型フレームワークを提案。2Dシミュレーションと3D Unity-ROS環境で有効性を検証。
原題: HAVEN: Hierarchical Adversary-aware Visibility-Enabled Navigation with Cover Utilization using Deep Transformer Q-Networks / Mihir Chauhan, Damon Conover, Aniket Bera
日本語で読む → - 論文自律ナビゲーションロボティクス
走行可能性を考慮したM4ロボットの自律ナビゲーション
LiDARとCNNで地形の走行しやすさを推定し、エネルギー効率の良い経路を計画するM4ロボット向けナビゲーション手法を提案した。
原題: Traversability Aware Autonomous Navigation for Multi-Modal Mobility Morphobot (M4) / Hrigved Mahesh Suryawanshi
日本語で読む → - 論文ナビゲーションロボティクス
VLD: 強化学習ナビゲーションのための視覚言語ゴール距離
インターネット規模の動画で自己教師あり学習した目標までの距離予測器と、シミュレーションで訓練した強化学習方策を組み合わせ、画像・テキスト両方のゴール指定に対応するナビゲーション手法を提案。
原題: VLD: Visual Language Goal Distance for Reinforcement Learning Navigation / Lazar Milikic, Manthan Patel, Jonas Frey
日本語で読む → - 論文ナビゲーションロボティクス
UrbanNav: ウェブ規模の人間軌跡から学ぶ言語誘導型都市ナビゲーション
ウェブ上の街歩き動画1500時間以上と300万組の指示・軌跡・ランドマークデータを用い、自由な言語指示に従って実都市を移動する具現化エージェントを訓練するフレームワークを提案した。
原題: UrbanNav: Learning Language-Guided Urban Navigation from Web-Scale Human Trajectories / Yanghong Mei, Yirong Yang, Longteng Guo 他
日本語で読む → - 論文ナビゲーションロボティクス
AstraNav-Memory: 長期記憶のための文脈圧縮
画像中心の記憶を視覚的文脈圧縮で効率的に保持し、Qwen2.5-VLベースのナビゲーション方策と組み合わせて長期的な身体性ナビゲーションを実現した研究。
原題: AstraNav-Memory: Contexts Compression for Long Memory / Botao Ren, Junjun Hu, Xinda Xue 他
日本語で読む → - 論文視覚ナビゲーションロボティクス
YOPO-Nav: 一度の動画から3DGSグラフを用いた視覚ナビゲーション
環境探索の一人称動画を3Dガウシアンスプラッティングのグラフに変換し、ロボットが地図なしで映像を手がかりに経路を再現できる視覚ナビゲーション手法を提案。
原題: YOPO-Nav: Visual Navigation using 3DGS Graphs from One-Pass Videos / Ryan Meegan, Adam D'Souza, Bryan Bo Cao 他
日本語で読む → - 論文ナビゲーションロボティクス
EmbodiedDiffusion:異種ロボットナビゲーションのための走行可能性誘導型視覚拡散モデル
RGB画像から走行可能性マップと軌道を同時に生成する拡散ベースの枠組みを提案し、プランナー不要で異種ロボットへの迅速な適応を実現した。
原題: EmbodiedDiffusion: End-to-End Traversability-Guided Visual Diffusion for Heterogeneous Robot Navigation / Iana Zhura, Sausar Karaf, Faryal Batool 他
日本語で読む → - 論文ナビゲーションロボティクス
GuideNav: 視覚障碍者向け視覚のみのロボットナビゲーション支援システムのユーザー参加型開発
盲導犬利用者や訓練士へのインタビュー調査に基づき、LiDARを使わず視覚情報のみで教示経路を自律走行するナビ支援システムを開発し、屋外での実証と利用者評価を行った。
原題: GuideNav: User-Informed Development of a Vision-Only Robotic Navigation Assistant For Blind Travelers / Hochul Hwang, Soowan Yang, Jahir Sadik Monon 他
日本語で読む → - 論文ソーシャルナビゲーションロボティクス
ソーシャルナビゲーションにおける人間のロボット評価の少数ショット推論
大規模言語モデル(LLM)の少数ショット学習能力を活用し、ソーシャルナビゲーションタスクにおいてロボットがユーザーの性能認識を予測する手法を提案。SEAN TOGETHERデータセットを拡張し、従来の教師あり学習より少ないラベルで同等以上の性能を達成。
原題: Few-Shot Inference of Human Perceptions of Robot Performance in Social Navigation Scenarios / Qiping Zhang, Nathan Tsoi, Mofeed Nagib 他
日本語で読む → - 論文ナビゲーションロボティクス
外乱に頑健なUSVナビゲーションのための分布ロバスト強化学習
異分散な観測ノイズに悩む無人水上艇の航法に対し、分布ロバスト最適化と暗黙的分位点ネットワークを統合したDRIQNを提案し、最悪ケース性能を改善した。
原題: Perturbation-mitigated USV Navigation with Distributionally Robust Reinforcement Learning / Zhaofan Zhang, Minghao Yang, Sihong Xie 他
日本語で読む → - 論文ナビゲーションロボティクス
非ホロノミック車両のための屋外環境におけるカバレッジナビゲーションシステム
非ホロノミックロボットが屋外環境でエリアを漏れなく走行するためのカバレッジナビゲーションシステムを開発し、動的障害物への回避・復帰行動を組み込み、シミュレーションと実環境で約90%のカバレッジ率を達成した。
原題: Sistema de navegaci\'on de cobertura para veh\'iculos no holon\'omicos en ambientes de exterior / Michelle Valenzuela, Francisco Leiva, Javier Ruiz-del-Solar
日本語で読む → - 論文ナビゲーションロボティクス
VL-LN Bench:能動的対話による長期的目標指向ナビゲーションに向けて
対話を通じて曖昧な指示を解決しながら特定物体を探索する新しいナビゲーションタスクIIGNと、そのための大規模ベンチマークVL-LN Benchを提案した。
原題: VL-LN Bench: Towards Long-horizon Goal-oriented Navigation with Active Dialogs / Wensi Huang, Shaohao Zhu, Meng Wei 他
日本語で読む → - 論文ナビゲーション/MPCロボティクス
雑然環境における非ホロノミックロボットナビゲーションのための多方向安全矩形回廊ベースMPC
非ホロノミックロボットの雑然環境ナビゲーションのため、自由空間を矩形凸領域で表現する多方向安全回廊アルゴリズムとバリア関数制約を統合した逐次MPCフレームワークを提案し、静的・動的障害物回避と速度直接生成を実現した。
原題: Multi-directional Safe Rectangle Corridor-Based MPC for Nonholonomic Robots Navigation in Cluttered Environment / Yinsong Qu, Yunxiang Li, Shanlin Zhong
日本語で読む → - 論文ナビゲーションロボティクス
LIDAR観測に基づく地上ロボットの自律ナビゲーションのための世界モデル
DreamerV3にMLP-VAEを組み合わせた世界モデルで高次元LIDAR入力を圧縮し、TurtleBot3のナビゲーションでモデルフリー手法より高成功率・高速収束を達成した。
原題: World Models for Autonomous Navigation of Terrestrial Robots from LIDAR Observations / Raul Steinmetz, Fabio Demo Rosa, Victor Augusto Kich 他
日本語で読む → - 論文ナビゲーションロボティクス
E-Navi: リソース制約下のUAV向け環境適応型ナビゲーション
環境の複雑さを定量化し、地図解像度と実行頻度を動的に調整することで、計算資源が限られたUAVでも適応的に飛行できるナビゲーションシステムを提案した。
原題: E-Navi: Environmental Adaptive Navigation for UAVs on Resource Constrained Platforms / Boyang Li, Zhongpeng Jin, Shuai Zhao 他
日本語で読む → - 論文ナビゲーションロボティクス
未知の湾曲管状構造物における自律UAVナビゲーションのためのカリキュラム強化学習
LiDARと視覚による局所観測のみを用い、カリキュラム学習で徐々に複雑な湾曲管に適応する強化学習方策を提案し、中心線情報を持つ従来手法を上回る汎化性能を示した。
原題: Curriculum-Based Reinforcement Learning for Autonomous UAV Navigation in Unknown Curved Tubular Conduit / Zamirddine Mari, Jérôme Pasquet, Julien Seinturier
日本語で読む → - 論文ナビゲーションロボティクス
言語条件付き地図予測による遮蔽空間の高速ナビゲーション
副操縦士の指示を活用し、遮蔽領域の予測地図と指示に基づくサブゴールを生成することで、安全かつ迅速なナビゲーションを実現する手法を提案。
原題: Fast Navigation Through Occluded Spaces via Language-Conditioned Map Prediction / Rahul Moorthy Mahesh, Oguzhan Goktug Poyrazoglu, Yukang Cao 他
日本語で読む → - 論文物体目標ナビゲーションロボティクス
FOM-Nav: フロンティア物体マップによる物体目標ナビゲーション
未知環境で目標物体を効率的に探索するため、空間フロンティアと物体情報を統合した地図と視覚言語モデルを組み合わせたナビゲーション手法を提案し、実機でも有効性を示した。
原題: FOM-Nav: Frontier-Object Maps for Object Goal Navigation / Thomas Chabal, Shizhe Chen, Jean Ponce 他
日本語で読む → - 論文協調ナビゲーションロボティクス
UrbanV2X: 都市部における協調ナビゲーションのためのマルチセンサ車両インフラデータセット
香港のC-V2Xテストベッドで車両と路側インフラから収集したマルチセンサデータセットを構築し、協調ナビゲーションアルゴリズムのベンチマークを実施した。
原題: UrbanV2X: A Multisensory Vehicle-Infrastructure Dataset for Cooperative Navigation in Urban Areas / Qijun Qin, Ziqi Zhang, Yihan Zhong 他
日本語で読む → - 論文ナビゲーションロボティクス
3D空間における長期的視覚生成とナビゲーションのための航空世界モデル
UAVのナビゲーション向けに、過去のフレームと行動から将来の視覚観測を予測する世界モデルANWMを提案し、候補軌道を意味的妥当性で評価することで大規模3D環境での自律飛行性能を向上させた。
原題: Aerial World Model for Long-horizon Visual Generation and Navigation in 3D Space / Weichen Zhang, Peizhi Tang, Xin Zeng 他
日本語で読む → - 論文ナビゲーションロボティクス
ImagineNav++: シーン想像を通じて視覚言語モデルを身体化ナビゲータとして促す
RGB/RGB-D画像のみを用い、視覚言語モデルが将来の視点画像を想像して最適な視点を選ぶことで、地図なしで物体探索などの視覚ナビゲーションを実現するフレームワーク。
原題: ImagineNav++: Prompting Vision-Language Models as Embodied Navigator through Scene Imagination / Teng Wang, Xinxin Zhao, Wenzhe Cai 他
日本語で読む →