論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文視覚場所認識画像認識
外洋から密閉キャビンへ:海事認識とキャビン点検のためのクロスシーン視覚場所認識ProteusVPR
船舶環境での視覚場所認識の課題に対し、2段階の検索・精密化フレームワークProteusVPRを提案し、新しい船舶搭載データセットXHZで精度を大幅に向上させた。
原題: From Open Waters to Enclosed Cabins: ProteusVPR for Cross-Scene Visual Place Recognition in Maritime Perception and Cabin Inspection / Zexi Chen, Zitai Huang, Qiwen Gu 他
日本語で読む → - 論文自己位置推定ロボティクス
キネマティック自転車モデルの空間表現における不確実性の解析
車両の運動学モデルにおける不確実性を扱い、タイヤ変位と操舵角の不確実性下での共分散行列の時間発展をテイラー級数を用いて閉形式で導出し、モンテカルロシミュレーションと比較してその精度を検証した。
原題: Analyzing Uncertainty in the Spatial Representation of the Kinematic Bicycle Model / Shafayat Abrar, M. Zaeem Baig, Shahir Ul Islam Anzal 他
日本語で読む → - 論文多ロボット操作/計画ロボティクス
LAMP: 混雑環境における多ロボット協調のための長期的適応操作計画
多ロボット操作の長期的計画を、生成モデルと古典的計画法を組み合わせたフレームワークLAMPで解決。A*と遅延探索に基づく2つのアルゴリズムを提案し、高密度環境での複雑なタスクを従来手法より解けることを示した。
原題: LAMP: Long-Horizon Adaptive Manipulation Planning for Multi-Robot Collaboration in Cluttered Space / Shuai Zhou, Yorai Shaoul, Jiaoyang Li
日本語で読む → - 論文HRI/グループ協調ロボティクス
いつ手助けしましょうか?グループ人間-ロボット協調におけるプロアクティブ性の効果について
ペア参加者がヒューマノイドロボットと脱出ゲームを行う実験で、ロボットが呼ばれた時だけ反応するリアクティブモデルと、常時聞いて自発的に貢献するプロアクティブモデルを比較し、相互作用頻度や成功率、参加者の評価に与える影響を調べた。
原題: When May I Help You? On The Effect of Proactivity on Group Human-Robot Collaboration / Thomas Vitry, Vanessa Maeder, Kieran von Valeburg 他
日本語で読む → - 論文V2X/エッジクラウド協調画像認識
CABLE: V2Xシステム向けクラウド支援・帯域効率的なLMMベース符号化
エッジとクラウド間の通信量を削減するため、前フレームのセグメンテーション結果を利用して関心領域を絞り込み、その領域のみをクラウドに送信するフレームワークを提案した。
原題: CABLE: Cloud-Assisted Bandwidth-efficient LMM-based Encoding for V2X Systems / Haohua Que, Zhipeng Bao, Qianyi Wu 他
日本語で読む → - 論文歩行ロボティクス
SCAN-Planner: 経路誘導型長距離四足歩行ナビゲーションのための空間衝突認識ローカルプランナー
四足ロボットの長距離ナビゲーション向けに、ヨー角を考慮したツインシリンダーフットプリントと投影A*探索を用いた空間衝突認識ローカルプランニングフレームワークを提案し、狭い通路や3D非構造環境での安全で効率的な移動を実現した。
原題: SCAN-Planner: Spatial Collision-Aware Local Planning for Route-Guided Long-Range Quadruped Navigation / Han Zheng, Zhe Chen, Yiwen Fu 他
日本語で読む → - 論文群制御ロボティクス
SPACE: 群知能フェロモン場による適応的衝突回避探索
多数のロボット群による未知環境探索で、混雑時の衝突を減らしつつ効率的な探索を実現するため、蟻の採餌行動に着想を得た分散協調手法SPACEを提案した。実建物のフロアプランで最大256台の群れを評価し、衝突率を大幅に低減しつつ探索時間はほぼ同等であることを示した。
原題: SPACE: Swarm Pheromone Fields for Adaptive Collision-Aware Exploration / Haohua Que, Haojia Gao, Mingkai Liu 他
日本語で読む → - 論文SLAMロボティクス
PL-LIT: 点・線特徴と熱画像マッピングを用いたLiDAR-慣性-熱SLAM
熱画像の課題を解決するため、点・線特徴抽出と光度校正を組み合わせたLiDAR-慣性-熱SLAMシステムを提案し、長距離熱赤外データセットで最先端性能を達成した。
原題: PL-LIT: A LiDAR-Inertial-Thermal SLAM Using Point-Line Features and Thermographic Mapping / Jiawei Xia, Yixiao Feng, Yongliang Shi 他
日本語で読む → - 論文自動運転/デジタルツインロボティクス
クエリ駆動型通信効率の高い自動運転向けデジタルツイン設計
自動運転のデジタルツイン構築において、冗長なデータ同期を避けるため、シミュレーション結果に基づいて必要な環境データを能動的に要求するクエリ駆動型アーキテクチャを提案し、通信効率と位置精度を改善した。
原題: A Query-Driven Communication-Efficient Digital Twins Design for Autonomous Driving / Nuocheng Yang, Longyu Zhou, Sihua Wang 他
日本語で読む → - 論文ヒューマン・ロボットインタラクションロボティクス
失敗回復を超えて:ロボットシステムのための関与を考慮したヒューマン・イン・ザ・ループ・フレームワーク
ロボットが失敗時だけでなく、ユーザーの関与を維持するように能動的にインタラクションを計画する、関与を考慮したMPCフレームワークを提案した。
原題: Beyond Failure Recovery: An Engagement-Aware Human-in-the-loop Framework for Robotic Systems / Jiaying Fang, Joyce Yang, Zhanxin Wu 他
日本語で読む → - 論文車両制御ロボティクス
未来へのドリフト:高遅延車両システムにおける経路追従ドリフトの安定化
生産車両のアクチュエータ遅延や機械的結合に対応する予測器と制御則を設計し、内燃機関搭載の量産スポーツカーで円形・8の字ドリフトを安定して実現した。
原題: Drifting in the Future: Stabilizing Path Following Drifting on High-Latency Vehicle Systems / Frederik Werner, Till Heintzenberg, Markus Lienkamp 他
日本語で読む → - 論文自動運転シミュレーションロボティクス
認識を考慮した因果確率フレームワークによる自動運転の閉ループシミュレーション
理想的なセンシングを仮定した従来のシミュレーションでは認識アルゴリズムの欠陥が見逃されるため、実際の認識挙動を模擬した因果確率モデルをシミュレーションツールチェーンに組み込み、霧や雨などの物理的条件に起因する認識エラーを注入して安全性評価を行う手法を提案した。
原題: A Causal Probabilistic Framework for Perception-Informed Closed-Loop Simulation of Autonomous Driving / Zhennan Fei, Rickard Johansson, Mikael Andersson 他
日本語で読む → - 論文全身制御/耐故障/脚式移動マニピュレーションロボティクス
FT-WBC: 脚式移動マニピュレーションのための耐故障全身制御の学習
脚式移動マニピュレータのアクチュエータ故障時に、全身の安定性とアームの可動域を両立する耐故障制御フレームワークFT-WBCを提案した。故障推定器と姿勢適応モジュールにより、故障を予測し姿勢計画を適応させることで、シミュレーションと実機で生存率と可動域を向上させた。
原題: FT-WBC: Learning Fault-Tolerant Whole-Body Control for Legged Loco-Manipulation / Yudong Zhong, Pengfei Mai, Sikai Guo 他
日本語で読む → - 論文VLA/操作ロボティクス
SSI-Policy: 視覚言語ロボット操作のための構造化シーンインターフェース学習
RGB画像のみから深度特徴・言語接地オブジェクト配置・指示条件付き2D動作軌跡を統合する構造化シーンインターフェース(SSI)を導入し、少数デモで高精度な操作を実現するフレームワークを提案した。
原題: SSI-Policy: Learning Structured Scene Interfaces for Vision-Language Robotic Manipulation / Kaijun Wang, Zikai Ouyang, Xuping Wu 他
日本語で読む → - 論文VLAロボティクス
WALL-WM: イベント接合部での世界行動モデリングの彫刻
WALL-WMは、ビデオ行動学習をチャンク中心の最適化からイベント基盤の視覚言語行動事前学習へと移行させ、意味的に一貫した行動イベントを学習の原子単位として使用する世界行動モデルです。
原題: WALL-WM: Carving World Action Modeling at the Event Joints / Shalfun Li, Victor Yao, Charles Yang 他
日本語で読む → - 論文視覚慣性オドメトリロボティクス
BEVIO: 月面昼夜航法のための効率的な鳥瞰図ベース疎更新視覚慣性オドメトリ
月面探査車向けに、視覚更新頻度が極端に低い状況でも頑健な視覚慣性オドメトリを実現するため、鳥瞰図ベースの画像マッチング手法を提案し、昼夜の自己照明条件下での性能を実機実験で検証した。
原題: BEVIO: Efficient Bird's-Eye-View based Sparse-Update Visual-Inertial Odometry for Lunar Day-Night Navigation / Mohit Singh, Shehryar Khattak, Ashish Goel 他
日本語で読む → - 論文データセット標準ロボティクス
FAIR^2 Drones: 分野横断型ドローン野生動物データセットのためのAI対応標準規格
生態学、ロボティクス、コンピュータビジョンの分野横断で再利用可能なドローン野生動物データセットの標準規格を提案し、メタデータとアノテーション仕様を統一する。
原題: FAIR^2 Drones: An AI-Ready Standard for Cross-Domain Wildlife Drone Datasets / Jenna Kline, Kilian Meier, Vandita Shukla 他
日本語で読む → - 論文セマンティックシーン補完画像認識
LiDARセマンティックシーン補完のための簡単な性能向上策の探求
既存のセグメンタによる疑似ラベルと可視性情報を入力に追加するだけで、LiDARセマンティックシーン補完の性能が大幅に向上することを示した論文。
原題: Exploring Easy Boosts for Lidar Semantic Scene Completion / Tetiana Martyniuk, Jonathan Seele, Alexandre Boulch 他
日本語で読む → - 論文動作計画/転移学習ロボティクス
ゼロショット転移学習によるロボット操作タスクのためのサンプル効率的な低レベル動作計画
複雑なロボット操作タスク向けに、転移学習でiCEMパラメータを単純タスクから転送し、報酬再設計も組み合わせて成功率を最大23%向上させるフレームワークを提案。実機でも検証した。
原題: Sample-efficient Low-level Motion Planning for Robotic Manipulation Tasks via Zero-shot Transfer Learning / Yuanzhi He, Victor Romero-Cano, José J. Patiño 他
日本語で読む → - 論文VLA/ヒューマノイド移動ロボティクス
WOLF-VLA: 全身ヒューマノイド最適移動のための視覚言語行動学習フレームワーク
全身最適制御による動作生成と大規模マルチモーダルデータセットを統合し、自然言語指示から直接ヒューマノイドの移動ポリシーを生成するVLAモデルを訓練する新しいフレームワークを提案した。
原題: WOLF-VLA: Whole-Body Humanoid Optimal Locomotion Framework for Vision-Language-Action Learning / Melya Boukheddimi, Omar Adjali, Daniel Sontag 他
日本語で読む → - 論文群制御ロボティクス
木構造上の最適移動問題の困難性について
木構造上のマルチエージェント経路探索(MAPF)とペブル移動問題の複雑性を解明し、距離・メイクスパン・フロータイムの各目的関数に対してNP困難であることを証明した論文。
原題: On the Hardness of Optimal Motion on Trees / Tzvika Geft
日本語で読む → - 論文ナビゲーションロボティクス
GUIDE: 目標初期化による方向理解を用いたエンドツーエンド視覚ナビゲーション
脚式ロボットのナビゲーションにおいて、目標をエピソード開始時に一度だけ与え、外部からの目標更新なしに内部の空間記憶と方向認識だけで動作するエンドツーエンドの強化学習フレームワークGUIDEを提案した。
原題: GUIDE: Goal-Initialized Directional Understanding for End-to-End Visual Navigation / Liang Wang, Jin Jin, KanZhong Yao 他
日本語で読む → - 論文組立/プランニングロボティクス
意味と物理的実行の橋渡し:多対ロボット組立のための神経記号的枠組み
多対ロボット組立における空間干渉と接触不確実性を解決するため、LLMと記号的推論を組み合わせた階層的枠組みを提案し、実機で90%の成功率を達成した。
原題: Bridging Semantics and Physical Execution: A Neuro-Symbolic Framework for Multi-Pair Robotic Assembly / Xinyi Li, Aiguo Song, Linhu Wei 他
日本語で読む → - 論文VLA評価/sim2realロボティクス
VLA評価のためのシミュレーションと実世界の相関を改善する実践的レシピ
シミュレーションと実世界の評価結果の相関を体系的に分析し、VLAポリシーの評価や改善にシミュレーションを効果的に活用するための指針を提供する研究。
原題: A Practical Recipe Towards Improving Sim-and-Real Correlation for VLA Evaluation / Shuo Wang, Hanyuan Xu, Yingdong Hu 他
日本語で読む → - 論文VLAロボティクス
フロー制御:シンプルなリアルタイム入力による視覚言語行動モデルの操縦
キーボードなどの簡単な入力で、再学習なしにVLAモデルの行動をリアルタイムに操縦する手法を提案。ユーザーの意図を反映しつつ、高品質な行動を生成できる。
原題: Flow Control: Steering Vision-Language-Action Models with Simple Real-Time Inputs / Jonathan C. Kao, Jason Chan, Andy Wang
日本語で読む → - 論文物体再配置ロボティクス
不確実性ガイドによるLLM支援を活用した棄権対応の個人化物体再配置
家庭環境での物体再配置において、置くべき場所の予測だけでなく、置くべきでない場合の判断も重要です。本研究では、軽量な個人化埋め込みモデルと選択的な大規模言語モデル支援を組み合わせたハイブリッドフレームワークAPOLLOを提案し、不確実性推定に基づいて曖昧な決定のみLLMを呼び出すことで、効率性・プライバシー・推論能力のバランスを実現しました。
原題: Abstention-Aware Personalized Object Rearrangement via Uncertainty-Guided LLM Assistance / Sam Collin, Ali Ayub
日本語で読む → - 論文自動駐車/軌道計画/LLMロボティクス
ParkingTransformer: LLM強化による自動駐車のためのエンドツーエンド軌道計画
本論文は、マルチビュー知覚と大規模言語モデル(LLM)のシーン理解能力を組み合わせ、軌道クエリとLLMの暗黙状態特徴を利用して、高密度BEV表現を必要とせずに計画軌道を直接出力する自動駐車フレームワークを提案する。3D位置エンコーディングと固定ウィンドウストリーミング機構を導入し、空間認識と時間処理効率を向上させ、粗密デコード戦略で軌道精度を高める。CARLAシミュレータと実車実験で有効性を検証した。
原題: ParkingTransformer: LLM-Enhanced End-to-End Trajectory Planning for Autonomous Parking / Hauteng Wu, Xu Li, Dong Kong 他
日本語で読む → - 論文データセット/知覚ロボティクス
バイキングヒルデータセット:森林シーンにおける検出とセグメンテーションのためのLiDAR・レーダー・カメラデータセット
森林環境で動作するロボットの知覚研究用に、4Dイメージングレーダー、LiDAR、カメラを搭載した移動ロボットで収集したマルチセンサーデータセットを構築し、樹木の3Dバウンディングボックス注釈とセグメンテーションのベースライン結果を提供した。
原題: Viking Hill Dataset: A Lidar-Radar-Camera Dataset for Detection and Segmentation in Forest Scenes / Vladimír Kubelka, Oleksandr Kotlyar, Unal Artan 他
日本語で読む → - 論文世界モデル/ポリシー評価画像認識
StressDream: ビデオ世界モデルを操縦して堅牢なポリシー評価と改善を実現
拡散ベースのビデオ世界モデルにおいて、推論時に指定された高影響かつ妥当な未来(例:タスク失敗)へ想像を誘導する手法を提案し、ポリシーの堅牢な評価と改善を可能にした。
原題: StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement / Junwon Seo, Sushant Veer, Ran Tian 他
日本語で読む → - 論文ナビゲーションロボティクス
MVP-Nav: 多層価値マップによる物理認識ナビゲーション
RGB画像のみを用いたゼロショット物体ゴールナビゲーションにおいて、3D基盤モデルで2Dセマンティクスを3D境界ボックスに投影して物理占有を再構成し、セマンティック優先度と幾何を統合した多層価値マップで物理的に安全な経路計画を行う手法を提案。
原題: MVP-Nav: Multi-layer Value Map Planner Navigator / Wenyuan Xie, Shaokai Wu, Yijin Zhou 他
日本語で読む →