論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/15 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA画像認識
EgoPathBench:視覚言語モデルのゼロショット一人称視点ウェイポイント意思決定の評価
一人称視点の画像と目標から経路を選ぶ能力を測る5タスクのベンチマークを提案し、既存の視覚言語モデルが完全な経路計画を苦手とすることを示した。
原題: EgoPathBench: Evaluating Zero-Shot Egocentric Waypoint Decision-Making in Vision-Language Models / Yang Zhao, Zhuo Chen, Xubo Yang
日本語で読む → - 論文ロボットビジョン画像認識
知識転移パラメータは学習可能か?効率的なロボットビジョンのためのLePoKet
知識継承を順伝播に組み込み、転移パラメータを子ネットワークと同時最適化するLePoKetを提案し、CIFARやオプティカルフロー推定で精度向上を実証した。
原題: Can Knowledge Transfer Parameters Be Learned? LePoKet for Efficient Robotic Vision / Yanick C. Tchenko, Felix Mohr, Hicham Hadj-Abdelkader 他
日本語で読む → - 論文画像フォレンジック画像認識
MoE-JEPA:意味事前知識と高周波痕跡を統合した合成画像フォレンジック
JEPAの世界モデルを事前知識として活用し、Residual Mixture-of-Expertsとノイズストリームを組み合わせて、圧縮やSNS経由でも頑健にディープフェイクを検出する手法を提案。
原題: Unifying Semantic Priors and High-Frequency Traces: Enhancing V-JEPA with Mixture-of-Experts for Robust Synthetic Image Forensics / Simone Teglia, Irene Amerini
日本語で読む → - 論文SLAM/マッピングロボティクス
音響・光学イメージングを用いたマルチセッション・マルチモーダル海底マッピング
複数回の調査で得たソナーとカメラのデータを因子グラフ最適化で統合し、位置ずれを補正して高精度な海底地図を作成する手法を提案した。
原題: Multi-Session Multimodal Underwater Mapping with Acoustic and Optical Imaging / Precious Philip-Ifabiyi, Valerio Franchi, Fausto Ferreira 他
日本語で読む → - 論文システム同定ロボティクス
水中ロボットのシステム同定のための最適励起軌道
ベジェ曲線で軌道をパラメータ化し、動的制約と安全制約を満たしつつデータ品質を最大化する最適励起軌道を設計し、水中ロボットの動的パラメータを最小二乗法で同定する手法を提案。水槽実験で未知軌道の速度予測により有効性を検証。
原題: Optimal Excitation Trajectories for System Identification of Underwater Vehicles / Fotis Panetsos, Kostas J. Kyriakopoulos
日本語で読む → - 論文ハイブリッド制御/安全性検証ロボティクス
ハイブリッド系のためのハミルトン・ヤコビ到達可能性:安全性保証付き統一目標駆動制御
連続・離散が混在するハイブリッド系にHJ到達可能性解析を拡張し、安全集合の計算と、安全性を保ちつつ目標到達も保証する制御則の設計手法を提案した。
原題: Hamilton-Jacobi Reachability for Hybrid Systems: Unified Goal-Driven Control with Safety Guarantees / Javier Borquez, Shuang Peng, Somil Bansal
日本語で読む → - 論文経路計画ロボティクス
Map2Route: 意味地図上の構成的言語指示に基づく経路計画ベンチマーク
意味地図上で複雑な言語指示から経路を計画するベンチマークMap2Routeと、コード実行と検証を組み合わせた手法Grounding2Routeを提案した。
原題: Map2Route: Benchmarking Compositional Language-Grounded Route Planning over Semantic Maps / Muyi Bao, Hang Xu, Jingfan Tang 他
日本語で読む → - 論文VLAロボティクス
RAF-VLA: 未来表現との整合によるエンドツーエンド自動運転
将来フレームの表現を直接教師信号として方策の内部表現を整列させることで、未来生成を伴わずに自動運転VLAの計画性能を高める手法を提案。
原題: RAF-VLA: Representation Alignment with the Future for End-to-End Autonomous Driving / Dogun Kim, Yongjae Lee, Joonhee Lim 他
日本語で読む → - 論文VLAロボティクス
TEMPO: 動的ロボットマニピュレーションのための時間的文脈学習
事前学習済みVLAモデルに動きの要約と固有受容感覚の履歴を追加し、動的マニピュレーションにおける運動の曖昧さと状態のエイリアシングを解決する手法を提案。
原題: TEMPO: Learning Temporal Context for Dynamic Robot Manipulation / Zhenyang Feng, Jimin Heo, Erik B. Sudderth 他
日本語で読む → - 論文ワールドモデル画像認識
Zing-0.5: リアルタイムな操作とテキスト制御で遊べる世界生成へ
キーボード操作とテキスト指示を同時に受け付け、リアルタイムで生成される世界を探索・操作できる5Bの自己回帰型ワールドモデルを提案。
原題: Zing-0.5: Toward Playable Worlds with Real-Time Joint Action and Text Control / Mingyang Chen, Shengdong Chen, Xiaoxiao Fu 他
日本語で読む → - 論文産業部品認識画像認識
CALIPER: 視覚的に類似した産業部品をメトリック情報で認識するモデルフリー手法
RGB-D動画と少数の実画像からクラスごとの外観サポートと実寸プロファイルを構築し、外観が紛らわしい場合にサイズ情報を融合して、視覚的に類似した産業部品をモデル更新なしで高精度に認識するフレームワーク。
原題: CALIPER: Metric-Grounded Model-Free Recognition of Visually Similar Industrial Parts / Alankrit Gupta, Chenxi Tao, Seung-Kyum Choi
日本語で読む → - 論文マニピュレーションロボティクス
分散型オブジェクト中心制御によるマルチヒューマノイドの協調ピックアップと運搬
各ヒューマノイドが共有物体上の局所的な把持領域を担当し、分散型オブジェクト中心制御で協調的なピックアップと運搬を実現する手法を提案。単一ロボットでの学習が協調設定に転移し、実機でも動作することを示した。
原題: Learning Multi-Humanoid Pickup and Transport via Decentralized Object-Centric Control / Bikram Pandit, Mohitvishnu S. Gadde, Aayam Kumar Shrestha 他
日本語で読む → - 論文スキル発見機械学習
拡散モデルによる多様で再利用可能な運動スキルの発見
拡散モデルで状態分布のエントロピー勾配を推定し、高次元ヒューマノイド制御において多様で再利用可能な運動スキルを獲得する手法を提案。
原題: DSD: Learning Diverse and Reusable Motor Skills via Diffusion Skill Discovery / Sun Woo Kim, Xue Bin Peng
日本語で読む → - 論文群制御ロボティクス
位置情報不要のガウス過程回帰によるロボット群の空間場モデリング
位置情報システムなしでロボット群が空間場をモデル化するため、各ロボットが局所センシングと通信のみで共通座標系を形成しつつ事後分布を推定するLU-GPRを提案した。
原題: Gaussian Processes for Modelling Spatial Fields with Robot Swarms / Guillermo Legarda Herranz, Gianpiero Francesca, Mauro Birattari
日本語で読む → - 論文組立計画ロボティクス
CADベースの関係学習と幾何記号計画によるロボット組立
不完全なCADデータから点群で幾何関係を学習し、記号計画と可視性レイキャストでロボット分解順序を効率的に生成する手法を提案。
原題: CAD-Based Relation Learning and Geometric-Symbolic Planning for Robotic Assembly / Fabian Harlacher, Christian Friedrich
日本語で読む → - 論文変化検出ロボティクス
シーン分解によるオンライン幾何変化検出
LiDARやRGB-Dセンサを用いて、環境をシーンに分解しサブマップ間の比較でオンラインに幾何変化を検出するフレームワークCDSDを提案した。
原題: Online Geometric Change Detection via Scene Decomposition / David Thorne, Samuel Jia Cong Chua, Nakul Joshi 他
日本語で読む → - 論文群制御cs.MA
一度のキャリブレーションでどんなチームでも飛行可能:残差補正に基づく低忠実度訓練による協調ドローン群制御
高忠実度シミュレータでの強化学習を不要にし、低忠実度シミュレータを1機のキャリブレーション飛行で補正して、チーム規模に依存しない協調ドローン群ポリシーを訓練する手法を提案。
原題: Calibrate Once, Fly Any Team: Residual-Grounded Low-Fidelity Training for Cooperative Drone Swarms / Maxim Mednikov, Oren Gal
日本語で読む → - 論文異常検知画像認識
RoboVAD: ロボットアーム操作動画における異常検知のための大規模クロスドメイン評価ベンチマーク
ロボットアーム操作動画の異常検知を、未見のタスクや異常タイプを含むクロスドメイン設定で評価する大規模ベンチマークを構築し、既存手法と新手法を比較した。
原題: RoboVAD: A Large Cross-Domain Evaluation Benchmark for Anomaly Detection in Robotic Arm Manipulation Videos / Alexandru-Bogdan Dura, Sebastian Balmus, Radu Tudor Ionescu
日本語で読む → - 論文転移学習ロボティクス
Fleet-To-Lab: モデル融合による月面ローバのスリップ推定のための転移学習フレームワーク
過去の月面ローバの固有感覚データを活用し、地球と月のドメインギャップを埋める転移学習フレームワークを提案。複数の異種専門モデルを群知能アルゴリズムAcoMergeで融合し、スリップ推定精度を向上させた。
原題: Fleet-To-Lab: A Transfer Learning Framework For Lunar Rover Slippage Estimation Via Model Fusion / Riccardo Viviano, Saki Omi, Andrej Orsula 他
日本語で読む → - 論文機構設計ロボティクス
過拘束空間リンク機構の柔軟体モデリング・運動学同定・組立精度
過拘束な単ループリンク機構を柔軟マルチボディとしてモデル化し、3Dプリント試作機で組立精度を検証した。構造コンプライアンスにより理想形状へ自己組立する傾向を明らかにした。
原題: Flexible-body Modeling, Kinematic Identification, and Assembly Accuracy of Overconstrained Spatial Linkages / Daniel Huczala, Michael Pieber, Johannes Gerstmayr 他
日本語で読む → - 論文ランタイム検証ロボティクス
予測型Varanus:CSP適合性監視と予測的LTLランタイム検証の融合
CSPモデルによる適合性チェックと予測的LTLランタイム検証を組み合わせ、ロボットシステムの違反を事前に検出する二段階パイプラインを提案し、原子力貯蔵施設点検ローバーで有効性を示した。
原題: Predictive Varanus: Combining CSP Conformance Monitoring with Predictive LTL Runtime Verification / Angelo Ferrando, Matt Luckcuck, Pedro Ribeiro
日本語で読む → - 論文群制御AI
CoAdapt: LLMによるIIoTロボット群の適応的協調知覚フレームワーク
LLMをランタイム融合コントローラとして用い、ロボット群の空間配置とネットワーク状態に応じて融合参加ロボットと融合アルゴリズムを動的に選択する協調知覚フレームワークを提案。通信コストを38%削減しつつ検出精度を維持。
原題: CoAdapt: An LLM-based Framework for Adaptive Collaborative Perception in IIoT Robotic Swarms / Houssam Hajj Hassan, Antonia Maria Masucci, Lynda Zitoune 他
日本語で読む → - 論文マニピュレーションロボティクス
プリミティブ誘導サンプリングベースMPCによる多指巧み操作
低次元の操作プリミティブでサンプリングを誘導し、関節レベルの残差を同時最適化するサンプリングベースMPCを提案し、実機Allegroハンドで物体の連続回転や把持・再配向・運搬を実現した。
原題: Primitive-Informed Sampling-Based MPC for Multi-Fingered Dexterous Manipulation / Emek Barış Küçüktabak, Karankumar Patel, Jinda Cui 他
日本語で読む → - 論文VLA画像認識
LG-VLN: LangGraph状態オーケストレーションによるゼロショット視覚言語ナビゲーション
単眼カメラのみで未知環境をナビゲートするゼロショットVLNフレームワークを提案し、LangGraphで状態遷移を管理することでR2R-CEで21.3%の成功率を達成した。
原題: LG-VLN: A Zero-Shot Vision-and-Language Navigation Framework with LangGraph State Orchestration / Jianhe Zhao, Yanhua Qiu, Zhiyu Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
LieSpline-DP: 滑らかなロボットマニピュレーションのためのリー群Bスプライン拡散ポリシー
拡散ポリシーの軌道をSE(3)上のBスプラインで表現し、チャンク間で境界制御姿勢を共有することでC²連続性を保証し、滑らかで成功率の高いマニピュレーションを実現した。
原題: LieSpline-DP: Lie-Group B-Spline Diffusion Policy for Smooth Robot Manipulation / Erxuan Xie, Bang Liu, Pingyun Nie 他
日本語で読む → - 論文VLA画像認識
GRAVA: 自動運転のための接地推論から行動への表現と学習
自動運転VLAモデルにおいて、推論を物理的な場面証拠に接地させ、実行可能な行動と結びつけるGRAフレームワークを提案し、NAVSIMベンチマークで最先端性能を達成した。
原題: GRAVA: Grounded Reasoning-to-Action Representation and Learning for Autonomous Driving / Xiao Liu, Haoyu Li, Jianghao Leng 他
日本語で読む → - 論文VLAロボティクス
C²Nav: ゼロショット視覚言語ナビゲーションのための比較ベース意思決定
VLMに制御器が生成した候補を比較させることで、幾何学的判断や不可逆な決定をロボット側に残す訓練不要のナビゲーションフレームワークを提案。
原題: C$^2$Nav: Compare Before You Commit for Zero-Shot Vision-and-Language Navigation / Runtian Zheng, Congpeng Zhang, Ying Liu
日本語で読む → - 論文VLAロボティクス
IMPACT-VLA: 視覚言語行動ポリシーのための反事実軌道による相互作用対応マルチモーダル伝播帰属
VLAポリシーにおいて、各モダリティがタスク成功に寄与する実行段階を明らかにするため、反事実的な再実行に基づく帰属手法を提案し、LIBEROタスクで有効性を示した。
原題: IMPACT-VLA: Interaction-aware Multimodal Propagation Attribution via Counterfactual Trajectories for Vision-Language-Action Policies / Jinwoong Kim, Sangjin Park
日本語で読む → - 論文マルチロボット安全制御ロボティクス
マルチロボットCBF安全フィルタの厳密な実行可能性認定と最適な責任配分
複数ロボットのCBF安全フィルタが実行不可能になる原因を厳密に特定する認定手法を開発し、共有安全制約を最適配分することで実行不可能な制御ステップを約50%から6.2%に削減した。
原題: Exact Feasibility Certification and Optimal Responsibility Allocation for Multi-Robot CBF Safety Filters / Chandan Kumar Sah, Jishnu Keshavan
日本語で読む → - 論文マニピュレーションロボティクス
MPCを足場にした実世界強化学習による巧みな操作
サンプリングベースMPCを足場として実機の巧みなハンド操作を強化学習し、短時間で高成功率と高速回転を実現した。
原題: Real-World Reinforcement Learning with MPC Scaffolding for Dexterous Manipulation / Emek Barış Küçüktabak, Karankumar Patel, Zhaodong Yang 他
日本語で読む →