論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
RoboTALES: タスク整合的なシミュレート未来による推論誘導型ロボットポリシーの学習
事前学習済みビデオ生成モデルをロボット制御に活用する際、想像した未来がタスク意図からずれたり、行動条件付けが不確実になる問題を解決するため、階層的LLMプランナーとVLM批評家を用いてタスク整合的な未来を生成し、ロボットポリシーを学習する単一フレームワークを提案した。
原題: RoboTALES: Learning Reasoning-Guided Robot Policies via Task-Aligned Simulated Futures / Hanan Gani, Tejal Kulkarni, Madhoolika Chodavarapu 他
日本語で読む → - 論文フィールドロボティクス/登攀ロボットロボティクス
STEMbot: 植物の葉陰を移動するためのコンプライアントロボット
植物の葉の裏や茎にいる害虫を早期発見するため、植物の葉陰を自律移動できる小型の登攀ロボットSTEMbotを開発した。幾何学的SLAMとセマンティックマップを統合し、枝分かれした茎も移動可能な経路計画を実現している。
原題: STEMbot: A Compliant Robot for Under-Canopy Plant Navigation / Zachary Charlick, Nilay Roy Choudhury, Haoyu Ma 他
日本語で読む → - 論文ガバナンスAI
フィジカルAIガバナンス:ライフサイクル全体にわたる理論から実践へ
フィジカルAI(実世界で動作するAI)特有のガバナンス課題を整理し、研究から実装までの5段階ライフサイクルに沿った具体的なガバナンス実践方法を提案したサーベイ論文。
原題: Physical AI Governance: From Theory to Practice Across Life Cycle / Wang Yang, Shaobo Wang, Hongxuan Liu 他
日本語で読む → - 論文群制御ロボティクス
複雑環境におけるニューラル加速を用いた協調捕捉戦略「アンブッシュ」
複数の遅い追跡者が速い逃避者を複雑な環境で効率的に捕捉するために、待ち伏せ戦略をパラメータ化し、ハイブリッドMCTSとニューラル加速で最適化する手法を提案した。
原題: AMBUSH: Collaborative Capture in Complex Environments with Neural Acceleration / Junfeng Chen, YinHang Luo, Xinyi Wang 他
日本語で読む → - 論文自己位置推定ロボティクス
不確実性を考慮した速度補正による車両自己位置推定:Evidential Mambaを用いたアプローチ
GNSSが使えない環境での車両自己位置推定のドリフトを補正するため、車載センサデータから仮想速度センサを学習し、不確実性を考慮してIMUのドリフトを補正する手法を提案した。
原題: Uncertainty-Aware Velocity Correction for Proprioceptive Vehicle Localization using Evidential Mamba / Abinav Kalyanasundaram, Karthikeyan Chandra Sekaran, Wolfgang Utschick 他
日本語で読む → - 論文HRI/XRHCI
拡張現実を媒介層とする人とロボットのチームにおける状況的ヒューマンコントロール
XRを人とロボットの協調における状況的制御の媒介層と捉え、看護支援や多腕遠隔操作などのシナリオから設計次元を導出する研究。
原題: Extended Reality as a Mediation Layer for Situated Human Control in Human-Robot Teaming / Jens Grubert, John Dudley, Eyal Ofek 他
日本語で読む → - 論文エッジAI/画像処理画像認識
MiLSD: リソース制約デバイス向けマイクロ線分検出器
MCUレベルのメモリ制約下で高精度な線分検出を実現するため、サブメガバイト予算で動作する検出器MiLSDを提案し、出力表現や量子化の影響を系統的に評価した。
原題: MiLSD: A Micro Line-Segment Detector for Resource-Constrained Devices / Parsa Hassani Shariat Panahi, Amir Hossein Jalilvand, M. Hassan Najafi
日本語で読む → - 論文制御・共分散ステアリングロボティクス
分布の曖昧さを考慮した非線形共分散ステアリングのための近似相対エントロピー制約
非線形システムの共分散ステアリングにおいて、真の分布とガウス近似の乖離を相対エントロピーで定量化し、リスク感応指標の上界を導出して逐次凸計画法で解く手法を提案した。宇宙機の軌道遷移問題で実証した。
原題: Approximate Relative Entropy Constraints for Nonlinear Covariance Steering Under Distribution Ambiguity / Trevor N. Wolf, Jay W. McMahon
日本語で読む → - 論文自動運転レースロボティクス
階層的最適化と学習ベース制御を用いた自動運転レースにおける安全な追い越し
自動運転レースの追い越しにおいて、操縦選択と安全保証を分離した階層フレームワークを提案し、強化学習でCBFの減衰パラメータを適応させることで、安全性を保ちつつ追い越し性能を向上させた。
原題: Safe Overtaking for Autonomous Racing Using Hierarchical Optimization and Learning-Based Control / Hassan Jardali, Kai Yin, Lantao Liu
日本語で読む → - 論文マニピュレーションロボティクス
TACTIC: 触覚と視覚に基づく接触中心制御による全身マニピュレーション
全身マニピュレーションのための、RGB-D、分散触覚、2D近接表現を組み合わせた接触中心のハイブリッド予測モデルと、接触ヤコビアンを用いたサンプリングベースMPCを提案する。
原題: TACTIC: Tactile and Vision Conditioned Contact-Centric Control for Whole-Arm Manipulation / Rishabh Madan, Angchen Xie, Samantha Saak 他
日本語で読む → - 論文カメラキャリブレーションロボティクス
観測品質が重要: 失敗指向解析による頑健なマルチ魚眼カメラキャリブレーション
マルチ魚眼カメラのキャリブレーション失敗の主因が内部パラメータ初期化にあることを解析し、それを踏まえたデータ構築フレームワークCO-Calibを提案。成功率を68.1%から99.3%に向上させた。
原題: Observation Quality Matters: Robust Multi-Fisheye Calibration via Failure-Oriented Analysis / Peize Liu, Zhe Tong, Chen Feng 他
日本語で読む → - 論文ROS 2 / ミドルウェアロボティクス
ROS 2ミドルウェアの三次元:空間・時間・状態の構造的限界
ROS 2のミドルウェア(DDSやZenoh)の構造的限界を、空間・時間・状態の3次元で分析する枠組みを提案し、既存研究を体系的に整理したサーベイ論文。
原題: The Three Dimensions of ROS 2 Middleware / Sanghoon Lee, Taehun Kim, Angelo Corsaro 他
日本語で読む → - 論文マニピュレーションロボティクス
PriGo: テスト時プリミティブガイダンスによる拡散・フローポリシーの適応的ロボット操作
模倣学習ベースの拡散・フローポリシーがタスクや環境の変化に弱い問題を解決するため、観測からプリミティブ分布を予測し、推論時に生成動作を意味的に一貫した方向へ洗練する軽量モジュールを提案。再学習不要で既存ポリシーに統合でき、複数ベンチマークで頑健性と汎化性を向上させた。
原題: PriGo: Test-Time Primitive Guidance to Diffusion and Flow Policies for Adaptive Robotic Manipulation / Zezeng Li, Enda Xiang, Thuy Tran 他
日本語で読む → - 論文探索計画ロボティクス
未知の複数部屋環境における多物体探索のためのインターリーブPOMDP計画
未知の家庭環境での多物体探索を、高レベルPOUCTプランナーと低レベル動作プランナーを交互に動作させるPOMDPアルゴリズムで解決し、衝突回数やナビゲーションステップを大幅に削減した。
原題: Interleaved POMDP Planning for Multi-Object Search in Unknown Multi-Room Household Environments / Ruochu Yang, Ziyi Xia, Huibo Zhang 他
日本語で読む → - 論文自動運転/軌道計画ロボティクス
IoT対応自動運転のための大規模言語モデル強化型微分可能軌道計画
自動運転の軌道計画において、大規模言語モデルを用いた意味的特徴抽出と微分可能最適化を組み合わせ、複雑な長尾相互作用や制約整合性の問題を解決するフレームワークを提案した。
原題: Large Language Model Enhanced Differentiable Trajectory Planning for IoT-Enabled Autonomous Driving / Shihao Zhang, Jing Yang, Ziyu Song 他
日本語で読む → - 論文マニピュレーションロボティクス
ヒューマノイドロボットNICOにおけるシミュレーションから実機への転移の最適化
シミュレーションと実機のギャップによる位置誤差を補正するため、キャリブレーションと視覚フィードバックを組み合わせた把持パイプラインを提案し、NICOロボットでのテーブル上物体把持成功率を向上させた。
原題: Optimization of sim-to-real transfer in the humanoid robot NICO / Juraj Gavura, Igor Farkaš
日本語で読む → - 論文自動運転/安全性検証/デジタルツインロボティクス
自動運転安全性検証のためのリスク場強化クローズドループデジタルツインフレームワーク
実世界の交通状態と仮想再構築を連携させ、リスク場を用いて高リスクシナリオを生成・評価することで、自動運転の安全性検証を効率化するデジタルツインフレームワークを提案した。
原題: A Risk-Field Enhanced Closed-Loop Digital Twin Framework for Autonomous Driving Safety Validation / Yongzhi Liu
日本語で読む → - 論文ナビゲーションロボティクス
AutoPath: 人間のデモなしで安全なナビゲーションを実現する転移可能な目標条件付き確率的経路事前分布の学習
ロボットナビゲーションにおいて、障害物を回避する複数の経路をサンプリングできる確率的経路事前分布を学習し、異なるロボットプラットフォーム間で再学習なしに転移可能な安全な経路生成を実現した。
原題: AutoPath: Learning Transferable Goal-Conditioned Stochastic Path Prior for Safe Navigation Without Human Demonstrations / Ziyang Zhang, Boyang Zhou, Zesong Yang 他
日本語で読む → - 論文操作学習/強化学習/Sim-to-Realロボティクス
ゼロショットSim-to-Real転送を備えたマルチタスクブロック押し操作のための単一拡散ポリシーコントローラ
強化学習を用いて、複数の形状のブロックを押すマルチタスク操作を単一の拡散ポリシーで学習し、実世界へゼロショット転送できることを示した論文。
原題: A Single Diffusion-Policy Controller for Multi-Task Block Pushing with Zero-Shot Sim-to-Real Transfer / Haitong Ma, Haldun Balim, Yang Hu 他
日本語で読む → - 論文VLA/長期メモリ/操作ロボティクス
NativeMEM: 長期ホライズンのロボット操作のためのネイティブメモリ圧縮
事前学習済みVLAモデルが高頻度更新で長い視覚履歴を保持できるように、VLA自身の視覚エンコーダを再利用して各フレームを単一トークンに圧縮するメモリ圧縮方式を提案。外部メモリや新規モジュール不要で、シミュレーション成功率を32.4%から84.0%に向上させた。
原題: NativeMEM: Native Memory Compression for Long-Horizon Robotic Manipulation / Ziye Wang, Modi Shi, Chaojun Ni 他
日本語で読む → - 論文位置推定ロボティクス
オドメトリとスパース距離サンプリングを組み合わせた動的屋内環境における生涯位置推定
動的な屋内環境で、オドメトリと少数の距離サンプルを用いてロボットの位置を頑健に推定する生涯位置推定フレームワークを提案した。
原題: Lifelong Localization in Dynamic Indoor Environments Combining Odometry with Sparse Distance Sampling / Michael M. Bilevich, Tomer Buber, Dan Halperin
日本語で読む → - 論文移動操作ロボティクス
一つのデモから世界を学ぶ:オープンワールド移動操作のための合成データエンジン
1つの人間デモから合成データを生成し、オープンワールドの移動操作ポリシーを学習する手法WANDAを提案。
原題: Worlds in One Demo: A Synthetic Data Engine for Learning Open-World Mobile Manipulation / Lingxiao Guo, Huanyu Li, Guanya Shi
日本語で読む → - 論文位置認識ロボティクス
G-PROBE: 3D点群のためのクロスFOV位置認識と確信度結合型ローカライゼーション
限定的または非対称な視野角(FOV)でも動作する、学習不要のグローバル位置認識フレームワークG-PROBEを提案。仮想センサ分解と確信度マップを用いて、6自由度の姿勢推定までを統合する。
原題: G-PROBE: Cross-FOV Place Recognition and Certainty-Coupled Localization for 3D Point Clouds / Jinseop Lee
日本語で読む → - 論文UAV制御ロボティクス
UAVの安全な機動へのマルチモーダルな人間意図の仲介モデル
音声やGUIなどの人間の入力指示を直接コマンドとして扱わず、制約付きの機動要求として解釈・検証・実行するパイプラインを提案し、地形や機体間距離などの安全制約を満たすUAVの安全な機動を実現する。
原題: A Model for Mediating Multi-Modal Human Intent into Safe Maneuvers for UAVs / Sofia Nelson, Dalal Alrajeh, Pedro Antonio Alarcon Granadeno 他
日本語で読む → - 論文マニピュレーションロボティクス
衝突ベースの遅延探索による高速マルチマニピュレータ計画
複数マニピュレータの動作計画を高速化するため、遅延評価と事前計算を組み合わせた新しいアルゴリズムCBLSを提案した。
原題: Conflict-Based Lazy Search for Fast Multi-Manipulator Planning / Dongliang Zheng, Zhipeng Wang, Siqi Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
AutoSpeed: 注釈不要の段階適応型動作速度学習によるロボット操作
操作タスクの各段階の難易度に応じて動作速度と予測時間を適応させる学習フレームワークを提案し、注釈なしで速度を調整し、タスク実行時間を短縮し成功率を向上させる。
原題: AutoSpeed: Annotation-Free Stage-Adaptive Motion Speed Learning for Robot Manipulation / Qingda Hu, Ziheng Qiu, Jieru Zhao 他
日本語で読む → - 論文最適化/分散推定ロボティクス
行列リー群上の分散因子グラフ最適化のための適応ソルバー学習
分散因子グラフ最適化のための学習型フレームワークDeepCORDを提案し、リーマン最適化器を展開して自己教師ありでソルバーパラメータを適応的に調整する。実データでのSE(3)ポーズグラフ最適化とSL(4)サブマップ整列で既存手法より低い目的値を達成した。
原題: Learning Adaptive Solvers for Distributed Factor Graph Optimization on Matrix Lie Groups / Jaeho Shin, Maani Ghaffari, Yulun Tian
日本語で読む → - 論文グリッパロボティクス
形状適応・均一力分布・自己ロック機能を備えたハイブリッド剛軟ロボットグリッパ
低コストの膜式空気圧アクチュエータと3Dプリント製ラチェット機構を組み合わせたハイブリッド剛軟グリッパを提案し、形状適応、均一な力分布、エネルギー不要の自己ロックを実現した。実験では最大4200gの把持能力と消費エネルギー50%削減を達成した。
原題: Hybrid Rigid-Soft Robotic Gripper with Shape Adaptation, Uniform Force Distribution, and Self-Locking Capabilities / Xi Chen, Yun Wang, Lichao Yang 他
日本語で読む → - 論文セキュリティcs.CR
LVLM搭載ロボットシステムに対する過剰思考誘発型スローダウン攻撃
ロボットに搭載された大規模視覚言語モデル(LVLM)の過剰思考(長い推論)を悪意あるシーンテキストで誘発し、意思決定を遅延させる攻撃手法を提案・検証した論文。
原題: Overthink-Triggered Slowdown Attacks on LVLM-Based Robotic Systems / Qiang Han, Jie Wu, Bo Chen
日本語で読む → - 論文VLAロボティクス
DLAM: 時間的制約を伴う分布型潜在アクション
本論文は、ロボットの行動データ不足を補うため、行動ラベルなしのビデオから潜在アクションを学習する新しいモデルDLAMを提案する。各遷移を対角ガウス分布として表現し、時間的整合性を保ちながら再構成誤差の伝播を抑えることで、ロボットポリシー学習の性能を向上させる。
原題: DLAM: Distributional Latent Actions with Temporal Constraints / Zuojin Tang, Feifan Luo, Haoyun Liu 他
日本語で読む →