論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文LiDAR超解像画像認識
自動運転向けLiDAR超解像の深層学習サーベイ
自動運転向けLiDAR超解像の深層学習手法を初めて体系的に調査し、CNN・モデルベース展開・暗黙表現・Transformer/Mambaの4分類で整理したサーベイ論文。
原題: A Comprehensive Survey on Deep Learning-Based LiDAR Super-Resolution for Autonomous Driving / June Moh Goo, Zichao Zeng, Jan Boehm
日本語で読む → - 論文把持ロボティクス
ゼロショットシーン再構成とロボット把持のための微分可能逆グラフィックス
単一のRGBD画像とバウンディングボックスから、物理的に整合性のあるシーンパラメータを推定し、ゼロショットでシーン再構成とロボット把持を実現する微分可能ニューログラフィックスモデルを提案。
原題: Differentiable Inverse Graphics for Zero-shot Scene Reconstruction and Robot Grasping / Octavio Arriaga, Proneet Sharma, Jichen Guo 他
日本語で読む → - 論文UAV捜索ロボティクス
UAV捜索における統計幾何学的縮退:物理情報を考慮した非対称フィルタリング手法
災害後のUAVによる生存者捜索で問題となる非対称な測距バイアスに対し、非対称Huber拡張カルマンフィルタと能動センシングを組み合わせて対処する手法を提案した。
原題: Statistical-Geometric Degeneracy in UAV Search: A Physics-Aware Asymmetric Filtering Approach / Zhiyuan Ren, Yudong Fang, Tao Zhang 他
日本語で読む → - 論文歩行ロボティクス
教師なし学習による四足ロボットの多様なスキル発見
直交混合エキスパートと複数識別器で報酬ハッキングを抑え、四足ロボットに多様な歩容スキルを効率的に獲得させる手法を提案。
原題: Diverse Skill Discovery for Quadruped Robots via Unsupervised Learning / Ruopeng Cui, Yifei Bi, Haojie Luo 他
日本語で読む → - 論文異常検知ロボティクス
自律点検のための世界モデルによる失敗分類と異常検知
世界モデルとConformal Predictionを組み合わせ、点検タスクの成功・既知の失敗・異常(分布外)を人間より早くリアルタイムに分類する枠組みを提案し、Spot上で90%以上の精度を実証した。
原題: World Model Failure Classification and Anomaly Detection for Autonomous Inspection / Michelle Ho, Muhammad Fadhil Ginting, Isaac R. Ward 他
日本語で読む → - 論文状態推定ロボティクス
移動ロボット軌道追跡のためのベイズ予測手法の比較
複数ロボットの追跡問題に対して、カルマンフィルタ系と粒子フィルタ系のベイズ推定・予測手法を、推定誤差・計算コスト・非ガウスノイズへの頑健性の観点から比較評価した。
原題: A Comparison of Bayesian Prediction Techniques for Mobile Robot Trajectory Tracking / Jose Luis Peralta-Cabezas, Miguel Torres-Torriti, Marcelo Guarini-Hermann
日本語で読む → - 論文VLAロボティクス
IG-RFT:長期的ロボット操作におけるVLAモデルのための対話誘導強化学習フレームワーク
流れベースのVLAモデルを対象に、対話状態に応じて探索を調整する強化学習とハイブリッド報酬を組み合わせ、長期タスクでの成功率を大幅に向上させた。
原題: IG-RFT: An Interaction-Guided RL Framework for VLA Models in Long-Horizon Robotic Manipulation / Zhian Su, Weijie Kong, Haonan Dong 他
日本語で読む → - 論文人間-ロボット協調機械学習
オフポリシー評価による人間-ロボット協調のための強化学習の定式化
実環境や人間のフィードバックなしに、記録済みの対話データのみを用いてオフポリシー評価で状態表現と報酬関数を選択する強化学習フレームワークを提案し、Lunar LanderとNASA-MATB-IIで検証した。
原題: Formulating Reinforcement Learning for Human-Robot Collaboration through Off-Policy Evaluation / Saurav Singh, Rodney Sanchez, Alexander Ororbia 他
日本語で読む → - 論文マニピュレーションロボティクス
ActionReasoning: LLMによる3D空間でのロボット動作推論とブロック積み上げ
LLMの物理的知識をマルチエージェント構成で活用し、ブロック積み上げタスクにおいて物理的に整合した動作計画を生成するフレームワークを提案した。
原題: ActionReasoning: Robot Action Reasoning in 3D Space with LLM for Robotic Brick Stacking / Guangming Wang, Qizhen Ying, Yixiong Jing 他
日本語で読む → - 論文言語説明・自動運転AI
X-Blocks:自動運転車の自然言語説明における言語的構成要素
自動運転車の説明文を文脈・統語・語彙の3階層で分析する枠組みX-Blocksを提案し、LLMアンサンブルで説明を32カテゴリに分類するRACEを開発した。
原題: X-Blocks: Linguistic Building Blocks of Natural Language Explanations for Automated Vehicles / Ashkan Y. Zadeh, Xiaomeng Li, Andry Rakotonirainy 他
日本語で読む → - 論文マニピュレーションロボティクス
RoboSolver: ロボットアーム問題を解くためのマルチエージェントLLMフレームワーク
LLMとVLMを組み合わせたマルチエージェントフレームワークで、テキストや画像からロボットアームの順運動学・逆運動学・速度・加速度計算、3Dシミュレーション、動作制御を自動実行する。
原題: RoboSolver: A Multi-Agent Large Language Model Framework for Solving Robotic Arm Problems / Hamid Khabazi, Ali F. Meghdari, Alireza Taheri
日本語で読む → - 論文ナビゲーションロボティクス
SanD-Planner: Bスプライン空間でのサンプル効率の良い拡散プランナーによる堅牢なローカルナビゲーション
深度画像からの模倣学習をBスプライン空間で行う拡散ベースのローカルプランナーを提案し、わずか500エピソードの訓練で高 clutter環境でのナビゲーションを実現した。
原題: SanD-Planner: Sample-Efficient Diffusion Planner in B-Spline Space for Robust Local Navigation / Jincheng Wang, Lingfan Bao, Tong Yang 他
日本語で読む → - 論文sim2realロボティクス
DynaRetarget: サンプリングベース軌道最適化による動的実行可能なモーションリターゲティング
人間の動作をヒューマノイドの制御ポリシーに転写するパイプラインを提案し、サンプリングベース軌道最適化で運動学的軌道を動的に実行可能な動作へと精錬する。
原題: DynaRetarget: Dynamically-Feasible Retargeting using Sampling-Based Trajectory Optimization / Victor Dhedin, Ilyass Taouil, Shafeef Omar 他
日本語で読む → - 論文安全・HRIロボティクス
エネルギー基準の傷害保護データベース:ブタ代替試料を用いた手と指のせん断接触閾値の包含
ブタ代替試料による衝突実験データを再評価し、垂直衝突だけでなくせん断接触も含めたエネルギー閾値を幾何形状・接触タイプ別に整備した、初のエネルギー基準傷害保護データベースを構築した。
原題: Energy-Based Injury Protection Database: Including Shearing Contact Thresholds for Hand and Finger Using Porcine Surrogates / Robin Jeanne Kirschner, Anna Huber, Carina M. Micheler 他
日本語で読む → - 論文軌道最適化ロボティクス
SURE: 軌道最適化による安全な不確実性対応ロボット環境インタラクション
接触タイミングの不確実性を考慮し、複数の軌道分岐と再統合を可能にする軌道最適化フレームワークを提案。カートポールと卵キャッチの実験で成功率を大幅に改善。
原題: SURE: Safe Uncertainty-Aware Robot-Environment Interaction using Trajectory Optimization / Zhuocheng Zhang, Haizhou Zhao, Xudong Sun 他
日本語で読む → - 論文経路計画ロボティクス
QUBO問題としてのマルチエージェント経路計画
複数車両の経路選択を、経路の有用性と重複ペナルティを符号化したQUBO問題として定式化し、都市規模の実験でカバレッジと重複のトレードオフを解析した。
原題: Multi-Agent Route Planning as a QUBO Problem / Renáta Rusnáková, Martin Chovanec, Juraj Gazda
日本語で読む → - 論文マニピュレーションロボティクス
制約付きサンプリングと強化学習を組み合わせたロボットマニピュレーション
接触の多い環境での非把持マニピュレーション方策の学習において、接触構造を考慮した制約付き状態サンプリングによるリセット戦略とカリキュラム学習を組み合わせ、目標条件付き強化学習の性能を向上させる手法を提案した。
原題: Combined Constrained Sampling and Reinforcement Learning for Robotic Manipulation / Marc Toussaint, Cornelius V. Braun, Armand Jordana 他
日本語で読む → - 論文軌道最適化ロボティクス
ロボティクスにおける大域最適化への合意形成ベース最適化(CBO)の導入
ロボットの軌道最適化に、緩やかな仮定の下で大域的最適解への収束が保証される合意形成ベース最適化(CBO)を導入し、既存手法より低コストを達成できることを示した。
原題: Consensus-based optimization (CBO): Towards Global Optimality in Robotics / Xudong Sun, Armand Jordana, Massimo Fornasier 他
日本語で読む → - 論文VLAロボティクス
AutoFly: 実環境でのUAV自律ナビゲーションのための視覚-言語-行動モデル
RGB入力から擬似深度特徴を抽出するエンコーダと二段階学習を組み合わせ、粗い指示のみでUAVが自律的に経路計画と障害物回避を行うVLAモデルを提案し、自律行動に焦点を当てた新データセットも構築した。
原題: AutoFly: Vision-Language-Action Model for UAV Autonomous Navigation in the Wild / Xiaolou Sun, Wufei Si, Wenhui Ni 他
日本語で読む → - 論文sim2realロボティクス
RAPT: シミュレーションから実機へのヒューマノイド展開におけるモデル予測型OOD検出と故障診断
シミュレーションで学習した制御方策が実機展開時に分布外状態に陥るのを防ぐため、50Hzで動作する自己教師ありの異常検知モニタを提案し、故障の時期と箇所を特定するとともにLLMによるゼロショット故障原因分類を実現した。
原題: RAPT: Model-Predictive Out-of-Distribution Detection and Failure Diagnosis for Sim-to-Real Humanoid Deployment / Humphrey Munn, Brendan Tidd, Peter Bohm 他
日本語で読む → - 論文VLAロボティクス
自然言語コマンドの物体グラウンディングのための関係シーングラフ
3Dシーングラフに空間関係を追加することで、LLMが自然言語コマンドから対象物体を正しく特定できるかを検証した研究。
原題: Relational Scene Graphs for Object Grounding of Natural Language Commands / Julia Kuhn, Francesco Verdoja, Tsvetomila Mihaylova 他
日本語で読む → - 論文マニピュレーションロボティクス
ABPolicy: リアルタイムで滑らかなロボットマニピュレーションのための非同期Bスプラインフローポリシー
Bスプライン制御点空間で動作する非同期フローマッチングポリシーを提案し、チャンク内の滑らかさとチャンク間の連続性を両立させて、動的環境下でもリアルタイムかつ滑らかなマニピュレーションを実現した。
原題: ABPolicy: Asynchronous B-Spline Flow Policy for Real-Time and Smooth Robotic Manipulation / Fan Yang, Peiguang Jing, Kaihua Qu 他
日本語で読む → - 論文プランニングロボティクス
Vec-QMDP: 実時間自動運転のためのCPU上でのベクトル化POMDPプランニング
CPUのSIMDアーキテクチャに合わせてPOMDP探索を再設計し、データ指向設計と階層的並列化により最大1073倍の高速化を達成、ミリ秒レイテンシで自動運転の不確実性下プランニングを実現した。
原題: Vec-QMDP: Vectorized POMDP Planning on CPUs for Real-Time Autonomous Driving / Xuanjin Jin, Yanxin Dong, Bin Sun 他
日本語で読む → - 論文社会的支援ロボット画像認識
PovNet+:社会的支援ロボットが複数の日常生活動作を学習・支援するための深層学習アーキテクチャ
日常生活動作(ADL)をマルチモーダルに認識し、未知の動作や異常な動作も検知して、支援ロボットが自発的に介入できる深層学習アーキテクチャを提案した。
原題: PovNet+: A Deep Learning Architecture for Socially Assistive Robots to Learn and Assist with Multiple Activities of Daily Living / Fraser Robinson, Souren Pashangpour, Matthew Lisondra 他
日本語で読む → - 論文テレオペレーションロボティクス
失敗を考慮した両腕テレオペレーションのための保守的価値誘導支援
成功・失敗のオフラインデータから保守的価値学習で成功率を推定し、両腕テレオペレーション中に触覚支援として失敗回避の動きを誘導する枠組みを提案した。
原題: Failure-Aware Bimanual Teleoperation via Conservative Value Guided Assistance / Peng Zhou, Zhongxuan Li, Jinsong Wu 他
日本語で読む → - 論文制御ロボティクス
四輪独立駆動・独立操舵ロボットのロバスト軌道追従のためのLyapunovベースPI型制御:設計と実験的検証
四輪独立駆動・操舵ロボットの軌道追従のため、Lyapunov安定性解析に基づくPI型制御器を設計し、実機実験でPI制御やスライディングモード制御と比較して有効性とロバスト性を示した。
原題: Lyapunov-Based PI-Like Control for Robust Trajectory Tracking of a Four-Wheel Independently Driven and Steered Robot: Design and Experimental Validation / Branimir Ćaran, Vladimir Milić, Marko Švaco 他
日本語で読む → - 論文4D再構成画像認識
マルチスケール動態を持つガウス系列による単眼カジュアル動画からの4D再構成
物体から粒子レベルまでのマルチスケールな動きの規則性を利用し、単眼のカジュアル動画から動的な3Dガウス表現を構築して高精度な4D再構成を実現した研究。
原題: Gaussian Sequences with Multi-Scale Dynamics for 4D Reconstruction from Monocular Casual Videos / Can Li, Jie Gu, Jingmin Chen 他
日本語で読む → - 論文VLAロボティクス
ST-BiBench:双腕身体性タスクにおけるマルチストリーム・マルチモーダル協調のMLLMベンチマーク
双腕ロボットの身体性タスクを対象に、マルチモーダル大規模言語モデルの時空間的なマルチストリーム協調能力を評価する多層ベンチマークST-BiBenchを提案し、30以上のモデルを評価して高次推論と細粒度実行の乖離を明らかにした。
原題: ST-BiBench: Benchmarking Multi-Stream Multimodal Coordination in Bimanual Embodied Tasks for MLLMs / Xin Wu, Zhixuan Liang, Yue Ma 他
日本語で読む → - 論文VLA画像認識
VLANeXt:強いVLAモデルを構築するためのレシピ
VLA設計空間を統一フレームワークで再検討し、12の知見をまとめた実践的レシピと、LIBEROなどでSOTAを上回るモデルVLANeXtを提案した論文。
原題: VLANeXt: Recipes for Building Strong VLA Models / Xiao-Ming Wu, Bin Fan, Kang Liao 他
日本語で読む → - 論文SLAMロボティクス
一貫性を改善したLiDAR慣性バンドル調整
平面・エッジ特徴をステレオ投影で表現し、FEJ付きMAP推定でLiDAR慣性BAの一貫性を高め、オドメトリに適用した研究。
原題: A Consistency-Improved LiDAR-Inertial Bundle Adjustment / Xinran Li, Shuaikang Zheng, Pengcheng Zheng 他
日本語で読む →