論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文自動運転/動作計画ロボティクス
学習された軌道プリミティブと確率的安全性評価を用いたリスク認識型動作計画
RBFネットワークで学習した軌道プリミティブと確率的衝突リスク評価を組み合わせ、都市部の自動運転における安全で効率的な動作計画を実現するフレームワークを提案した。
原題: Risk-Aware Motion Planning with Learned Trajectory Primitives and Probabilistic Safety Assessment / Marc Kaufeld, Dian Zhuang, Johannes Betz
日本語で読む → - 論文UAV設計最適化cs.CE
マルチロータUAVの多分野物理ベースMDO:離散COTS選定のための決定論的フレームワーク
マルチロータUAVの設計を物理ベースの多分野最適化で同時解決し、市販部品への離散マッピングを行うAeroEvalエンジンを提案・検証した。
原題: Multi-Domain Physics-Based MDO of Multirotor UAVs: A Deterministic Framework for Discrete COTS Sizing / Akshay Gupta Burela, P. B. Sujit
日本語で読む → - 論文運転行動ロボティクス
防御的運転が運転安全性を高める仕組み:運転シミュレータを用いた防御的運転行動の研究
運転シミュレータ実験により、防御的運転行動の特徴と安全性への影響を分析し、高い防御能力を持つドライバーは早期回避行動や適切な速度・操舵によりリスクを低減することを示した。
原題: How defensive driving enhances driving safety: A driving simulator study on drivers' defensive driving behaviors / Xinzheng Wu, Junyi Chen, Shaolingfeng Ye 他
日本語で読む → - 論文ワールドモデル検証ロボティクス
夢を信じる前に検証せよ:ワールドモデルシミュレータの許容性
ロボティクスで使われるワールドモデル(WM)の信頼性を評価する枠組みを提案。視覚的忠実度だけでなく、行動への応答を検証する許容性ラダー(L0-L4)を定義し、自動運転の例で視覚品質と行動追従が逆転することを示した。
原題: Validate the Dream Before You Trust Its Verdict: Admissibility for World-Model Simulators / Christian Oefinger, Finn Rasmus Schäfer, Korbinian Moller 他
日本語で読む → - 論文データセットロボティクス
SinD 2.0:信号交差点におけるSOTIF指向の安全検証のための意味的リスク注釈付きマルチシティUAVデータセット
本論文は、複数都市の信号交差点を対象としたドローン撮影による大規模データセットSinD 2.0を紹介し、安全検証に必要な意味的リスク注釈と高密度の危険事象を提供する。
原題: SinD 2.0: A Multi-City UAV Dataset with Semantic Risk Annotations for SOTIF-Oriented Safety Validation at Signalized Intersections / Yunwei Li, Shengjie Fu, Chunrong Chen 他
日本語で読む → - 論文組込みAI/セグメンテーション画像認識
RGB-Dカメラを用いた組込みデバイス上のアフォーダンスセグメンテーションのパレート最適フロントの充填
ウェアラブルロボット向けに、RGB-Dカメラの深度情報を小型深層ネットワークに統合するためのハードウェア認識型ニューラルアーキテクチャ探索と専用ファインチューニング手法を提案し、実時間性能とエネルギー効率を両立するパレート最適解を生成する。
原題: Filling the Pareto-Optimal Front for Affordance Segmentation on Embedded Devices Using RGB-D Cameras / Edoardo Ragusa, Giovanni Paolo Canuti, Simone Lugani 他
日本語で読む → - 論文3次元再構成ロボティクス
VIDAR: 幾何基盤モデルによる視覚慣性密位置合わせと再構成
単眼基盤モデルの密な幾何予測に、視覚慣性オドメトリをメトリックアンカーとして組み合わせ、スケール安定な密再構成を実現するフレームワークを提案した。
原題: VIDAR: Visual-Inertial Dense Alignment and Reconstruction via a Geometric Foundation Model / Diyari Mohammed Salih, Lingxiang Hu, Naima AitOufroukh-Mammar 他
日本語で読む → - 論文ナビゲーションロボティクス
全方位における身体化推論のためのEAGOR
360度カメラを用いた身体化エージェントの方向推論を、球面調和関数によるベイズ推定として定式化し、学習不要でカメラ回転に不変な方向推定を実現するフレームワークを提案した。
原題: EAGOR: Embodied Reasoning in Omni-direction / Shriram Damodaran, Soumyaratna Debnath, Yan Wu 他
日本語で読む → - 論文位置推定ロボティクス
不確実性から決定論へ:レイマッチングを介さない粗密段階的ビジュアルフロアプラン位置推定
本論文は、画像とフロアプランを用いた屋内位置推定において、従来のレイマッチングを介さず、粗密段階的アプローチで多峰性の位置分布を扱う手法を提案している。粗段階では画像条件付き拡散モデルで候補位置を生成し、密段階では局所的な残差を推定して高精度な位置を決定する。
原題: From Uncertainty to Determinism: Coarse-to-Fine Visual Floorplan Localization without Ray Matching / Shiyong Meng, Bolei Chen, Ping Zhong 他
日本語で読む → - 論文自動運転/モーションプランニング/ベンチマークロボティクス
シフト&ドリフト:汎用性と堅牢性を備えた自動運転モーションプランニングのためのゼロショットベンチマーク
自動運転のモーションプランナーが、未見の都市環境や実行時の摂動に対してどの程度汎化・堅牢かを評価するための新しいベンチマーク「Shift & Drift」を提案した論文。
原題: Shift & Drift: A Zero-Shot Benchmark for Generalizable and Robust Autonomous Driving Motion Planning / Alessandro Canevaro, Hang Yu, Julian Schmidt 他
日本語で読む → - 論文適応制御/フレキシブル関節ロボティクス
不確かな関節剛性を持つモータ位置制御型フレキシブル関節ロボットの適応制御
関節剛性が不確かで変動するフレキシブル関節ロボットに対し、非線形なトルク-たわみ関係を推定する適応制御手法を提案し、実験で有効性を示した。
原題: Adaptive Control of Motor-Position-Controlled Flexible Joint Robots with Uncertain Joint Stiffness / Annika Kirner, Grazia Zambella, Igor Kovacevic 他
日本語で読む → - 論文医療ロボティクスロボティクス
分離型手順実行による自律血管内介入のエキスパート戦略学習
血管内介入の自律化に向け、高次戦略決定と低次手順実行を分離した強化学習フレームワークを提案し、シミュレーションと実機で高い成功率と効率性を実証した。
原題: Learning Expert Strategy for Autonomous Robotic Endovascular Intervention via Decoupled Procedural Execution / Yanxi Chen, Tianliang Yao, Shaolong Tang 他
日本語で読む → - 論文HRIロボティクス
技術的指標からユーザー知覚へ:物体検出と把持のためのマルチモーダル人機相互作用システムのユーザー研究
物体検出と把持を行うマルチモーダルHRIシステムの改良版が、ユーザー知覚に有意な差をもたらすかを24人の被験者実験で検証した。改良版は70.83%の参加者に好まれ、知覚速度・信頼性・能力・流暢さの評価が有意に向上した。
原題: From Technical Metrics to User Perception: A User Study of a Multimodal Human-Robot Interaction System for Object Detection and Grasping / Jian Song, Tian Zi, Shen Guanting
日本語で読む → - 論文マニピュレーションロボティクス
SAGP: 粗いゾーンVLM推論による意味的アフォーダンス誘導型把持計画
幾何学的な把持計画に意味的推論を組み合わせ、物体の点群を粗い領域に分割してVLMで評価し、タスクに適した把持候補を再ランキングする訓練不要のパイプラインを提案した。
原題: SAGP: Semantic Affordance-Guided Grasp Planning via Coarse-Zone VLM Reasoning / Muhayy Ud Din, Irfan Hussain
日本語で読む → - 論文行動計画ロボティクス
複雑な行動計画のための生成的部分的に指定された有限状態機械アプローチ
動的環境で動作するロボットの行動計画のために、有限状態機械の構造を利用した生成的ニューロシンボリックアーキテクチャ(GPSFSM)を提案し、ROS2上で実装・評価した。
原題: A Generative Partially Specified Finite State Machine Approach to Complex Behaviour Planning / Kalana Ratnayake, Michael Pritchard, David Hinwood 他
日本語で読む → - 論文VLA/ポストトレーニングロボティクス
HELP: ロールアウト分割による人間効率的な大規模ロボットポストトレーニング
VLAモデルのポストトレーニングにおいて、2人の専門オペレータが12台のロボットを同時監視し、ロールアウトを自動分割する手法を提案し、人間の労力あたりのポリシー改善とタスクスループットを最大化する。
原題: HELP: Human-Efficient Large-Scale Robot Post-Training with Rollout Segmentation / Shaopeng Zhai, Qi Zhang, Tianyi Zhang 他
日本語で読む → - 論文VLA画像認識
Traj-VLN: 自己回帰軌道生成によるピクセル空間でのインタラクション学習
連続環境における視覚言語ナビゲーション(VLN-CE)において、大規模言語モデルを微調整し、言語指示と過去の観測から2Dピクセル座標の軌道を自己回帰的に生成することで、深度情報を使わずにナビゲーション行動を学習する手法を提案した。
原題: Traj-VLN: Learning Pixel-Space Interaction via Autoregressive Trajectory Generation / Changfei Fu, Guangcheng Chen, Aoxiang Gu 他
日本語で読む → - 論文経路計画ロボティクス
グラフ探索とモデル予測制御の統合による自動運転車の滑らかで効率的な経路計画
グラフ探索で得た粗い経路を利用して凸な横方向安全回廊を構築し、その中でMPCにより経路を滑らかに最適化する経路計画手法を提案した。
原題: Integrated Graph Search and Model Predictive Control for Smooth and Efficient Path Planning in Autonomous Vehicles / Duc-Tien Bui, Ngoc Thinh Nguyen, Hung Duy Nguyen 他
日本語で読む → - 論文状態推定ロボティクス
時間に迷う?未知の測定遅延を伴う支援慣性航法における連続対称性と識別可能性
慣性航法システムにおいて、センサ測定の未知の時間遅延が状態推定に与える影響を分析し、軌道の形状によって遅延と航法状態の一意な推定が可能かどうかが決まることを、ガリレイ群を用いて特徴付けた論文。
原題: Lost in Time? Continuous Symmetry and Identifiability in Aided Inertial Navigation with Unknown Measurement Delays / Jonathan Kelly, Phone Thiha Kyaw, Mattew Giamou
日本語で読む → - 論文VLAロボティクス
Enfold: 世界モデルの想像力を予測表現に折り畳み、超効率的な身体制御を実現
生成モデルが未来を構築する過程で得られる中間計算を、現在の視覚と言語指示のみから予測される表現に転移させる手法を提案。推論時に生成器を実行せずに行動予測が可能となり、遅延を大幅削減。
原題: Enfold: Folding World Model Imagination into Predictive Representations for Ultra-Efficient Embodied Control / Weili Zeng, Yitong Xing, Fulong Liu 他
日本語で読む → - 論文VLA/不確実性/操作ロボティクス
FabriVLA: 軽量視覚言語行動モデルと共形アクションチャンク不確実性
軽量なVLAモデルFabriVLAを提案し、Meta-World MT50で90%の成功率を達成。さらに、共形予測を用いてアクションの不確実性を定量化するJCAC法を導入し、実行前のリスク評価を可能にした。
原題: FabriVLA: A Lightweight Vision-Language-Action Model with Conformal Action Chunk Uncertainty / Shiyuan Yang, Borong Zhang, Jizheng Zhang 他
日本語で読む → - 論文VLA/安全制御ロボティクス
ActFovea: 時空間的な視覚-行動整合性によるVLAポリシーの実行時保護
VLAポリシーを再学習せずに実行時の外乱を検出・緩和するプラグアンドプレイの保護フレームワークを提案。視覚と行動の整合性を監視し、回復不能な場合は安全に失敗させる。
原題: ActFovea: Runtime Safeguarding for VLA Policies via Spatiotemporal Visual-Action Consistency / Wenda Yu, Tianshi Wang, Fengling Li 他
日本語で読む → - 論文世界モデル機械学習
時間中心化SIGRegによるマルチタスク世界モデル学習の改善:分析から手法へ
マルチタスク世界モデル学習で表現崩壊を防ぐSIGRegがタスク間の分離を圧縮する問題を発見し、潜在変数の周辺分布ではなく時間中心化残差に適用する手法を提案。LIBEROベンチマークで成功率を大幅に向上させた。
原題: Temporally Centered SIGReg Improves Multi-Task LeWorldModel Learning: From Analysis to Method / Chang Liu, Fei Suo, Yanzhou Jin 他
日本語で読む → - 論文歩行ロボティクス
脚式ロボットの進歩、課題、そして機会
ヒューマノイドや四足ロボットの現状をハードウェア、移動、自律性、データ、応用の観点から評価し、普及に向けた課題と将来展望を論じたレビュー論文。
原題: Advances, challenges, and opportunities for legged robots / Jonas Frey, Matías Mattamala, Hae-Won Park 他
日本語で読む → - 論文視点計画ロボティクス
葉表面再構成のための後退水平型次善視点プランナー
移動制約下で葉表面の3次元再構成精度を高めるため、点群の重心に対する情報利得を基に視点の有用性を評価し、将来視点を考慮した後退水平型の次善視点計画手法を提案した。
原題: Receding-Horizon Next-Best-View Planner for Autonomous Leaf Surface Reconstruction / Arif Ahmed, Sajal K. Das, Parikshit Maini
日本語で読む → - 論文模倣学習ロボティクス
時間的ポリシー:実演学習のための履歴初期化アクション生成
拡散モデルやフローマッチングの代わりに、ロボットの最近の履歴から生成フローを初期化する時間的結合輸送問題としてアクション生成を定式化し、輸送コストを削減して高速な推論を実現する新しい生成フレームワークを提案した。
原題: Temporal Policy: History-Initialized Action Generation for Robotic Learning from Demonstration / Dylan Miller, Martin Jagersand
日本語で読む → - 論文制御ロボティクス
冗長マルチリンク・ハイブリッドケーブル駆動パラレルロボットの反復学習に基づくリアクティブアプローチによる三空間運用制御
ケーブル駆動パラレルロボットの冗長性と制約を扱うため、リアクティブ制御と反復学習制御を組み合わせた三空間制御フレームワークを提案し、実時間での軌道追従と制約充足を実現した。
原題: Tri-Space Operational Control of Redundant Multilink and Hybrid Cable-Driven Parallel Robots Using an Iterative-Learning based Reactive Approach / Dipankar Bhattacharya, Yin Pok Chan, Siqi Shang 他
日本語で読む → - 論文意味通信/協調ロボティクスロボティクス
ロボットが意味を交換するとき:協調ロボティクスのための目標指向型意味通信デモ
ロボットとエッジ間で画像を意味圧縮して伝送し、3Dマッピングと意味マップ生成を行うデモシステムを構築した。
原題: When Robots Exchange Meaning: A Demo of Goal-Oriented Semantic Communications for Collaborative Robotics / Peizheng Li, Xinyi Lin, Sajida Gufran 他
日本語で読む → - 論文ドローン制御ロボティクス
ロードセルを用いたマルチローターの直接ロータ推力センシングと外乱抑制のためのフィードバック制御
ロードセルでロータの推力を直接計測し、高速フィードバック制御で目標推力を正確に追従させることで、突風や地面効果などの外乱を迅速に抑制する新しい手法を提案・実証した論文。
原題: Direct Rotor Thrust Sensing and Feedback Control for Disturbance Rejection of Multirotors Using Load-cells / Peter Böhm, Michael Brünig, Peyman Z. Moghadam 他
日本語で読む → - 論文エージェントAI/実行時検証AI
HALO: 局所的な義務に基づく異種応答の安全な実行許可
エージェントAIの応答を構成要素ごとに検証し、前提条件が満たされた要素のみを実行するランタイムプロトコルを提案。全体拒否を避けつつ安全性を確保する。
原題: HALO: Heterogeneous Admission through Localized Obligations for Safe Agentic Execution / Taewoo Park, Kyeonghyun Yoo, Kiseok Kim 他
日本語で読む →