論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLN/農業ナビゲーションロボティクス
農業用視覚言語ナビゲーションのための走行可能性推定アラーム
農業シーンでのVLN-CEにおいて、カメラ画像の走行可能性を推定し、予測行動と矛盾する場合に警報を出すTEAモジュールを提案し、AgriVLNに統合して性能を向上させた。
原題: TEA-AgriVLN: Traversability Estimation Alarm for Agricultural Vision-and-Language Navigation / Xiaobei Zhao, Xingqi Lyu, Xin Chen 他
日本語で読む → - 論文衝突回避ロボティクス
GPU高速化ポリゴン符号付き距離関数によるリアルタイム衝突回避
凸多角形ロボットと障害物境界間の幾何学的に正確な符号付き距離関数をGPUで並列計算し、モデル予測制御に組み込んでリアルタイム衝突回避を実現した。
原題: GPU-Accelerated Polygonal Signed Distance Functions for Real-Time Collision Avoidance / Taekwon Ga, Jongeun Choi
日本語で読む → - 論文遠隔操作ロボティクス
人間レベルの巧みな遠隔操作を目指して
手と物体の同時追跡制御を用いて、人間の操作意図を学習済みの接触実行にマッピングし、物体の回転や長時間の道具使用など7つの難易度の高い遠隔操作タスクで高い成功率を達成した。
原題: Towards Human-level Dexterous Teleoperation / Puhao Li, Zeyuan Chen, Yingying Wu 他
日本語で読む → - 論文HRI/全身動作生成ロボティクス
ゾウ型ソフトトランク動作の全身意味-動作接地:軽量フローマッチングによる実現
多様な全身表現が可能なゾウ型ソフトトランクロボットに対し、大規模言語モデルの応答を全身動作に変換する軽量フローマッチング手法を提案し、接地精度と推論速度を改善した。
原題: Whole-Body Semantic-to-Actuation Grounding of Elephant-Inspired Soft-Trunk Motion via Lightweight Flow Matching / Tingcong Liu, Tongshun Chen, Siyi Ma 他
日本語で読む → - 論文手術支援/AR画像認識
X-GuideAR: 透視ガイド中の放射線被曝を低減する拡張現実フレームワーク
整形外科手術のスクリュー留置時にX線撮影回数を減らすため、合成X線プレビューで適切な撮影角度を事前に示すARガイドシステムを提案し、S2AIスクリュー留置でX線回数を62.3%削減した。
原題: X-GuideAR: An Augmented Reality Framework to Mitigate Radiation Exposure during Fluoroscopic Guidance / Mingxu Liu, Zixuan Liu, Ruchen Cai 他
日本語で読む → - 論文VLAロボティクス
Reflex: ストリーミング推論によるリアルタイムVLA制御
フローマッチング型VLAモデルのリアルタイム推論を可能にするフレームワークを提案。タイムステップ不変性を利用し、キャッシュ更新を効率化して高速化を実現した。
原題: Reflex: Real-Time VLA Control through Streaming Inference / Yuanchun Guo, Bingyan Liu
日本語で読む → - 論文3Dシーン理解画像認識
孤立したオブジェクトを超えて:3Dシーングラフ解析による関係認識型オープンボキャブラリシーン理解
3Dシーングラフを用いてオブジェクト間の関係を推論し、オープンボキャブラリの3Dシーン理解を向上させるフレームワークRelGraphOVを提案。
原題: Beyond Isolated Objects: Relationship-aware Open Vocabulary Scene Understanding via 3D Scene Graph Analysis / Xianhao Chen, Jiarui Hu, Yuanbo Yang 他
日本語で読む → - 論文ナビゲーションロボティクス
必要なときに考える:RLポリシーを用いた社会的ナビゲーションのための条件付きVLM推論
ロボットの社会的ナビゲーションにおいて、RLポリシーの高速性とVLMの意味理解を動的に切り替えるハイブリッドアーキテクチャHUMAを提案し、ベンチマークで性能向上を実証した。
原題: Think When It Matters: Conditional VLM Reasoning for Social Navigation with RL Policies / Ali Ahmadi, Hamed Rahimi, Adrien Jacquet Cretides 他
日本語で読む → - 論文ロボットポリシー学習ロボティクス
PAC-DP: PACベイズ拡散ポリシー学習
拡散ポリシーの訓練にPACベイズ理論に基づく正則化を導入し、ロボット操作タスクでの性能を向上させる手法を提案した論文。
原題: PAC-DP: PAC-Bayesian Diffusion Policy Learning / Mohammad Hasan Yeganegi, Dian Yu, Andrea Del Prete 他
日本語で読む → - 論文マニピュレーションロボティクス
EDAR: ロボット操作のための環境依存行動表現の学習
ロボット操作において、行動トークンを実行可能な制御構造と環境条件付きの視覚的結果に基づいて表現する手法を提案し、長期的な操作タスクでのポリシー学習を改善した。
原題: EDAR: Learning Environment-Dependent Action Representations for Robotic Manipulation / Yuecheng Xu, Tong Yang, Jingkai Jia 他
日本語で読む → - 論文操作学習ロボティクス
HiFi-UMI: 高忠実度UMIデータのみから展開可能な操作ポリシーを学習する
ロボットフリーのUMIデータ収集システムの忠実度を高めることで、実ロボットデータを使わずに直接展開可能な操作ポリシーを学習できることを示した論文。
原題: HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone / Simple AI, :, Yuteng Wei 他
日本語で読む → - 論文群制御ロボティクス
分散モデルベース拡散によるスケーラブルなマルチロボット軌道最適化
マルチロボットの軌道最適化を、サーバーと各ロボットが協調する分散拡散プロセスで解く手法を提案し、複雑なタスクを高速に解決できることを示した。
原題: Distributed Model-Based Diffusion For Scalable Multi-Robot Trajectory Optimization / Haejoon Lee, Xinyi Wang, Taekyung Kim 他
日本語で読む → - 論文ワールドモデル画像認識
エネルギーガイダンスだけで十分か?駆動ワールドモデルのための学習不要なノルム注入
駆動ワールドモデルの制御可能性を、拡散バックボーンの再学習なしにサンプリング時のエネルギー関数注入で実現できるかを検証した論文。軌道計画をエネルギーガイダンスで操舵できるが、映像生成との結合が課題と判明。
原題: Is Energy Guidance All You Need? Training-Free Norm Injection for Driving World Models / Xiyan Su, Frank Diermeyer, Markus Lienkamp
日本語で読む → - 論文動作計画ロボティクス
漸近パレート最適性を備えた多目的キノダイナミック動作計画
キノダイナミック制約下の多目的動作計画問題に対し、SSTアルゴリズムを拡張し、局所パレート最適ノードの代表集合を保持する統一フレームワークを提案。辞書式最適化、制約付き最適化、パレートフロント近似の3つのアルゴリズムを提供し、完全性と最適性を理論保証する。
原題: Multi-Objective Kinodynamic Motion Planning with Asymptotic Pareto Optimality / Yusif Razzaq, Anne Theurkauf, Nisar Ahmed 他
日本語で読む → - 論文安全制御ロボティクス
ランダム有限集合上のリスク認識信念制御バリア関数
未知・動的な環境で移動物体の数が変動する中、ノイズを含む不完全な観測から安全性を保証する制御手法を提案。粒子フィルタで信念を表現し、リスクを考慮したバリア関数で安全集合の不変性を確保する。
原題: Risk-Aware Belief Control Barrier Functions over Random Finite Sets / Shaohang Han, Gang Chen, Yixi Cai 他
日本語で読む → - 論文強化学習/ナビゲーションロボティクス
動的障害物環境での安全飛行のための予測リスク誘導強化学習
クアッドローターの動的環境での安全航行のため、将来の衝突リスクを予測するリスクマップを強化学習で自己予測させ、視覚ポリシーを誘導する手法を提案。シミュレーションから実機へのゼロショット転送に成功。
原題: Anticipatory Risk-Guided Reinforcement Learning for Safe Flight Through Dynamic Clutter / Yuchao Mei, Guohao Zhang, Luxia Ai 他
日本語で読む → - 論文安全強化学習ロボティクス
安全強化学習における効率的探索のための方向性制約
安全強化学習の性能と安全性のトレードオフを改善するため、制約境界に近づく動作のみに制約を適用する方向性制約を導入したATACOMフレームワークの拡張手法を提案した。
原題: Directional Constraints for Efficient Exploration in Safe Reinforcement Learning / Paolo Magliano, Puze Liu, Jan Peters 他
日本語で読む → - 論文VLAロボティクス
DC-WAM: 動的焦点型視覚監視と推論によるワールド・アクションモデル
ロボットの行動選択に重要な視覚ダイナミクスに焦点を当て、RGBビデオ予測の監視と推論を再設計したワールド・アクションモデルを提案した。
原題: DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models / Haoyuan Ji, Lingxiang Fan, Shang Su 他
日本語で読む → - 論文自動運転/計画ロボティクス
最善を望み、最悪に備える:自動運転のための遮蔽を考慮した偶発事象計画
自動運転車のための、隠れた交通参加者による衝突を保証的に回避する遮蔽対応の軌道計画フレームワークを提案した。
原題: Hope for the Best, Prepare for the Worst: Occlusion-Aware Contingency Planning for Autonomous Vehicles / Truls Nyberg, Anna Gautier, Jana Tumova
日本語で読む → - 論文マニピュレーションロボティクス
点付随意味論を超えて:汎用操作のためのオブジェクト中心意味場
物体点群から機能部品の意味埋め込みを連続的に読み出すオブジェクト中心の意味場を提案し、操作ポリシーの条件付けに利用して性能を向上させた。
原題: Beyond Point-Attached Semantics: Object-Centric Semantic Fields for Generalizable Manipulation / Zheng Sun, Lerong Zhang, Zhihao Li 他
日本語で読む → - 論文群制御ロボティクス
音響による身体化された人ロボットインタラクション:空間データの物理化のためのAcoustoBotsを用いたMARLアプローチ
TurtleBot3に超音波フェーズドアレイを搭載し、粒子を浮遊させて高さで都市データを表現する移動型データ物理化プラットフォームを提案し、MADDPGによる衝突回避ナビゲーションと音響制御で安定した浮遊を実現した。
原題: Embodied Human-Robot Interaction via Acoustics: A MARL Approach with AcoustoBots for Spatial Data Physicalization / Shiqi Liu, Narsimlu Kemsaram, Prateek Mittal 他
日本語で読む → - 論文視覚位置認識ロボティクス
軌道アンカー最適化による過信熱画像視覚位置認識:ゼロリークOOD監査と誘拐ロボット復旧
熱画像ベースの視覚位置認識における過信的な誤マッチング問題に対し、軌道アンカー最適化(TAO)を提案し、並列仮説をバッチSE(2)プロクラステス整列に圧縮してリアルタイム性を保ちつつ、OODや未マップ環境での誤ループ候補を効率的にフィルタリングする。
原題: Trajectory-Anchor Optimization for Overconfident Thermal Visual Place Recognition: Zero-Leakage OOD Auditing and Kidnapped-Robot Recovery / Zhiyuan Lu, Kanji Tanaka
日本語で読む → - 論文歩行ロボティクス
停止して判断する:マッピング不要の四足点検のための遅延を考慮した自己受容的ナビゲーション基本動作
四足ロボットの階段頂上検出における制御ループの遅延がオーバーシュートを引き起こす問題を分析し、連続登攀ではなく「停止して判断する」リズムを提案して、オーバーシュートをほぼゼロに抑えた。
原題: Stop to Decide: Latency-Aware Proprioceptive Navigation Primitives for Mapping-Free Quadruped Inspection / Hanting Suo, Haonan Yan, Liang Wang 他
日本語で読む → - 論文SLAM/データセットロボティクス
Mag4D-SLAMデータセット:位置推定とマッピングのための反復走行マルチモーダル4D地磁気データセット
屋外大規模SLAM研究用に、LiDAR・カメラ・IMU・磁気センサ・GNSSを同期した18km以上の地磁気データセットを構築し、昼夜・往復走行での磁場再現性や位置識別性を解析した。
原題: Mag4D-SLAM Dataset: A Repeated-Traversal Multi-Modal 4D Geomagnetic Dataset for Localization and Mapping / Bibhutibhusan Nayak, Hyoseok Ju, Giseop Kim
日本語で読む → - 論文動作計画ロボティクス
環境制約を活用した動作生成
ロボットの動作計画において、環境との意図的な接触を利用して次元削減と計算複雑性の低減を図る「環境制約活用」アプローチを提案し、RRTベースのプランナーでその有効性を実証した。
原題: Motion Generation With Environmental Constraints / Előd Páll, Oliver Brock
日本語で読む → - 論文模倣学習ロボティクス
ユーザー主導の模倣学習:軌道とインピーダンスの学習手法
単一のデモンストレーションから軌道とインピーダンスをリアルタイムに学習し、コンプライアンスと精度を両立するロボットの模倣学習手法を提案した。
原題: User-Driven Learning from Demonstration: A Trajectory and Impedance Learning Method / Zi-Qi Yang, Mehrdad R. Kermani
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
WCM: 汎用ヒューマンロボットインタラクションのための世界認知モデル
ロボットが物理タスクでユーザーと対話的に協調できるよう、知覚・推論・制御・記憶を分離したSLAKアーキテクチャと非同期ランタイムを備えた人間中心の具現化エージェントWCMを提案。ユーザーが対話で教示でき、教示からCoT監督を生成してモデルを継続改善する。
原題: WCM: World-Cognition Model for Generalizable Human-Robot Interaction / Yuzhen Chen, KC Zhou
日本語で読む → - 論文制御ロボティクス
クワッドローター制御のための高レベル空間Dubins航空機基準平滑化と低レベル幾何追従
Dubins航空機モデルによる高レベル基準平滑化と幾何追従コントローラを組み合わせ、横方向制約のある経路追従を実現する手法を提案。
原題: High-level spatial Dubins airplane-based reference smoothing with low-level geometric tracking for quadrotor control / Mogens Plessen
日本語で読む → - 論文群制御機械学習
無信号交差点における自動運転のためのコンパクトな潜在協調
無信号交差点での自動運転車両の協調を、中央エージェントが生成するコンパクトな潜在表現(プロトプラン)と各車両のローカル制御を組み合わせた階層型強化学習で実現し、衝突回避と移動時間短縮を達成した。
原題: Compact Latent Coordination for Autonomous Vehicles at Unsignalized Intersections / Gil Lifshits, Igal Bilik, Gilad Katz
日本語で読む → - 論文3D再構成画像認識
ImprovedVBGS: リアルタイム連続変分ベイズガウススプラッティング
オンザフライ再構成を高速化するため、空間的に切り詰めた変分推論と改良した再割り当てを導入し、VBGSの遅延を大幅に削減した。
原題: ImprovedVBGS: Real-time Continual Variational Bayes Gaussian Splatting / Damani Mguni-Coker
日本語で読む →