論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/19 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文世界モデル画像認識
CausalWM:身体性世界モデルのための因果連鎖推論
未来の映像予測の前に明示的な因果連鎖推論を行う16Bの身体性世界モデルを提案し、大規模動画事前学習・因果CoT中間学習・多目的RL事後学習の3段階で訓練して複数のベンチマークで最高性能を達成した。
原題: CausalWM: Causal Chain-of-Thought Reasoning for Embodied World Model / Ziming Xu, Shuang Liang, Ruobing Han 他
日本語で読む → - 論文マニピュレーション制御
接触を伴うマニピュレーションにおける失敗検出と回復のためのタスク認識型動的運動プリミティブ
DMPによる軌道生成とQDAによる段階分類を統合し、ペグインホール組立での接触起因の失敗を検出してスパイラル探索で回復するフレームワークを提案。
原題: Task aware Dynamic Movement Primitives for failure detection and recovery in contact rich manipulation / Bhavnashri A, Sobia Shafi, Krishnapuram Himavarshini 他
日本語で読む → - 論文ナビゲーションロボティクス
親愛なるLLaVA、運転して:閉ループロボット制御のための深度認識視覚言語エージェント
事前学習済み視覚言語モデルを、ラベル付き軌道データなしで微分可能な幾何学的コスト場に基づいて微調整し、ステレオ深度から衝突のない経路を生成するナビゲーション手法を提案。
原題: "Dear LLaVA, Please Drive": A Depth-Aware Vision-Language Agent for Closed-Loop Robotic Control / Sebastian Berger, Katharina Winter, Fabian B. Flohr
日本語で読む → - 論文ソフトロボティクスロボティクス
Embodied Snap:タコに着想を得た分散型リーチ・アタッチと速度制限付きソフトアーム
タコの腕の動きに着想を得て、遅いサーボによる予備負荷と急速な弾性解放を分離する制御器を提案し、ソフトアームが腱駆動の速度限界を超えて対象に吸着できることを実機で示した。
原題: Embodied Snap: Octopus-Inspired Distributed Reach-and-Attach with a Speed-Limited Soft Arm / Linxin Hou, Zhihang Qin, Heyang Zou 他
日本語で読む → - 論文マニピュレーションロボティクス
部分観測下での言語誘導物体検索のための選択的コミットメント
言語指示に基づく物体検索において、情報収集・把持・棄権の判断を統合する閉ループ枠組みを提案し、シミュレーションと実機で有効性を示した。
原題: Selective Commitment for Language-Guided Object Retrieval under Partial Observability / Wonhee Koh, Sushil Samuel Dinesh, Hansol Ko 他
日本語で読む → - 論文sim2realロボティクス
DiagGen: ロボットシミュレーションのためのシミュレーションベース診断による変形可能アセットのエージェント生成
1枚の画像から変形可能なシミュレーション用アセットを生成し、物理シミュレータで診断・修復するエージェントフレームワークを提案。
原題: DiagGen: Agentic Generation of Deformable Assets with Sim-based Diagnostics for Robotic Simulation / Guanxiong Chen, Yiduo Qu, Qianjun Xia 他
日本語で読む → - 論文経路計画ロボティクス
MIRA-PRM: 移動型ガスセンシング検査のためのミッション情報を活用した再利用可能ロードマップ計画
順序付きサンプリング位置への到達信頼性を高めるため、ミッション情報を組み込んだ確率的ロードマップ計画手法を提案し、シミュレーションで高い成功率と局所修復による効率化を示した。
原題: MIRA-PRM: Mission-Informed Reusable Roadmap Planning for Mobile Gas-Sensing Inspection / Gongsen Wang, Siyuan Wang, Xinyuan Wang 他
日本語で読む → - 論文位置合わせ/ゼロショット画像認識
ZIL: ゼロショット画像-LiDAR位置合わせ
画像とLiDAR点群の位置合わせを、追加学習なしで行う初の基盤モデルZILを提案。カメラ内部パラメータとLiDAR原点の正規化により、未見環境でも高精度にカメラ姿勢を推定できる。
原題: ZIL: Zero-shot Image-to-LiDAR Registration / Zijun Li, Xiaotian Sun, Xuelun Shen 他
日本語で読む → - 論文水中ロボティクスロボティクス
AquaCap: コードを方策とする学習不要の水中エンボディドエージェント
大規模学習データ不要で、コード生成により水中ロボットの自律航行とマニピュレーションを実現するフレームワークを提案し、実機ROVで把持・運搬を実証した。
原題: AquaCap: A Training-Free Underwater Embodied Agent with Code-as-Policy / Xiaoshi Li, Yule Xu, Chunghiu Kong 他
日本語で読む → - 論文強化学習機械学習
強化学習における計算効率の良い安全な探索
ガウス過程より軽量なNadaraya-Watson推定量を用いて、制約付きMDPを安全に探索・最適化するアルゴリズムCoLSafe-MDPを提案し、グリッド環境と火星地形データで評価した。
原題: Computationally efficient safe exploration in reinforcement learning / Shreeram Murali, Shankar A. Deka, Dominik Baumann
日本語で読む → - 論文経路計画ロボティクス
ロボットナビゲーションのための最小障害物移動計画へのホライズン分割アプローチ
衝突のない経路が存在しない場合に、可動障害物を移動させて目標地点への経路を計画する問題を扱い、NP困難性を示すとともに、計算負荷を抑えつつ最適解に近い近似解法を提案した。
原題: A Horizon-slicing Approach to Minimum Obstacle Displacement Planning for Robot Navigation / Antony Thomas, Giulio Ferro, Fulvio Mastrogiovanni 他
日本語で読む → - 論文経路計画ロボティクス
常識に基づく経路計画:抽象的な指示からの推論
LLMとVLMを常識知識として活用し、環境の各領域の潜在的な考慮事項を推論してランク付けすることで、抽象的な指示に従いつつ常識に沿った経路を生成する計画手法CoRSを提案。
原題: Commonsense-Grounded Path Planning from Abstract Instructions / Masafumi Endo, Kohei Honda, Ryo Yonetani
日本語で読む → - 論文群制御画像認識
汎用的協調知能:レジリエントなマルチエージェント生態系のための認知アーキテクチャ
マルチエージェント無人システムの協調知能に関する研究を、5次元の分類軸と3つの認知的相乗条件で統合的に整理し、V2X・ドローン・物流・スマートシティへの応用と安全性・プライバシー・有用性の課題を展望したレビュー。
原題: General Collaborative Intelligence: Architecting Cognition for Resilient Multi-Agent Ecosystems / Lei Zhang, Chun Ye, Le Yang 他
日本語で読む → - 論文壁面登攀ロボットロボティクス
受動的双安定吸盤を用いた高ペイロード壁面登攀ロボット
壁に押し付けずに吸着できる受動的双安定吸盤とトラック機構を組み合わせ、垂直・逆さま・横向きに登攀でき、自重の2.25倍の荷物を牽引できる壁面移動ロボットを開発した。
原題: A High-Payload Wall-Climbing Robot Using Passive Bistable Suction Cups / Andrew Nguyen, Mingyuan Li, Daniel Bruder
日本語で読む → - 論文社会ナビゲーションロボティクス
PopNavShift: 歩行者集団の行動変化に対する社会ナビゲーションのストレステスト
歩行者の行動分布を人為的に変化させるシミュレーション枠組みを構築し、代表的な社会ナビゲーション手法の性能が歩行者負担とロボット移動時間のどちらで評価するかによって順位が逆転しうることを示した。
原題: PopNavShift: Stress-Testing Social Navigation under Behavioral Population Shift / Kaizhen Tan, Diyu Zheng, Tim Guangyu Wu 他
日本語で読む → - 論文3D基盤モデル/SLAM画像認識
適応的世界記憶3D基盤モデル:スケーラブルな3Dマッピング・自己位置推定・レンダリング
Transformerベースのゲート付き更新と時空間調整を組み合わせた適応的世界記憶機構により、長期記憶・大規模マッピング・ガウシアンレンダリングを単一モデルで統合した3D基盤モデルを提案。
原題: Adaptive World Memory 3D Foundation Model for Scalable 3D Mapping, Localization, and Rendering / Tianchen Deng, Guole Shen, Yilin Shen 他
日本語で読む → - 論文能動的再構成画像認識
2D GauSS-MI: 視覚と幾何の品質を両立する効率的な能動的シーン再構成
2Dガウシアンスプラッティングに基づき、相互情報量を用いた視点選択で視覚・幾何品質と計算効率を両立する能動的再構成フレームワークを提案。
原題: 2D GauSS-MI: Efficient Active Scene Reconstruction with Balanced Visual and Geometric Quality / Yuhan Xie, Jia Pan
日本語で読む → - 論文VIO初期化ロボティクス
直線特徴と消失点を活用した頑健な非構造化単眼視覚慣性初期化
3D構造の再構成を行わず、追跡した2D直線特徴の幾何制約を直接利用して、退化運動下でも高精度な単眼VIOの初期化を実現する手法を提案した。
原題: Robust Structureless Monocular Visual Inertial Initialization Exploiting Line Features and Vanishing Points / Junwan Choi, Woongrae Jo, Dong-Uk Seo 他
日本語で読む → - 論文歩行ロボティクス
SABER: 脚式移動のための注意ベース意味的アフォーダンス学習
地形の形状だけでなく「接触してよいか」という意味情報も考慮し、壊れやすい物を避けて歩く強化学習ポリシーを提案。Unitree B2で実機検証した。
原題: SABER: Learning Attention-based Semantic Affordance for Legged Locomotion / Hari Prasanth Palanivelu, Samuel Sze, Kennard Garrison Johannes 他
日本語で読む → - 論文空地協調ロボティクス
VIRGA: 仮想エージェントを介したリーマン幾何学による能動センシング空地協調
ジンバル搭載LiDARでUAVを観測しながら動的障害物を避ける空地協調のため、双方向LiDAR観測をリーマン場に変換し仮想エージェントの弾性フィードバックで統合する枠組みを提案。倉庫タスクと洞窟ストレステストで安全性と観測維持を実証。
原題: VIRGA: Virtual-Agent-Intermediated Riemannian Geometry for Active-Sensing Air-Ground Coordination / Fenghe Guo, Runjie Shen, Chenyang Sun 他
日本語で読む → - 論文歩行ロボティクス
いつヨタヨタ歩くべきか:低摩擦面上での二足歩行の胴体安定化に関する比較研究
ペンギンのよちよち歩きに着想を得て、低摩擦面での二足歩行において、胴体の横方向の動きと重心位置が歩行性能に与える影響をシミュレーションと実機で比較した研究。
原題: When to Waddle: A Comparative Study of Bipedal Torso-Stabilization on Low-Friction Surfaces / Naomi Oke, Ben Gu, George Ortiz 他
日本語で読む → - 論文HRIミドルウェアロボティクス
OpenRoIS: ロボットと仮想エージェント向けRoISフレームワークを実装したコミュニティ主導のオープンソースミドルウェア
OMG標準のRobotic Interaction Service (RoIS) 2.0を実装し、ハードウェア非依存のHRIアプリ開発を可能にするオープンソースミドルウェアを提案。TypeScript/C#/Python SDKやROS 2対応を提供する。
原題: OpenRoIS: A Community-Driven Open-Source Middleware Implementing the Robotic Interaction Service (RoIS) Framework for Physical Robots and Virtual Agents / Sebastian Carrera Villalobos, Christopher Nolan Arellano, Arne Hitzmann 他
日本語で読む → - 論文VLAロボティクス
GALA: 幾何情報を考慮した潜在行動モデリングによるマルチ身体VLA事前学習
エンドエフェクタの3D幾何運動を統合した潜在行動表現を提案し、多様な身体のデータから細粒度の動作を捉えるVLAモデル事前学習を実現した。
原題: GALA: Geometry-Aware Latent Action Modeling for Vision-Language-Action Model Pretraining across Embodiments / Yichen Liu, Puzhen Yuan, Xiang Zhu 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
個々の特性を考慮した支援型ヒューマンロボットインタラクションにおけるエンゲージメントと侵入性の理解
支援ロボットの介入頻度とパーソナリティ特性がユーザーのエンゲージメントや侵入感に与える影響を実験で調査し、個々の特性に合わせたロボット行動の調整が重要であることを示した。
原題: Understanding Engagement and Intrusiveness in Assistive Human-Robot Interaction Using Individual Traits / Valerio Bo, Lavinia Hriscu, Alberto Sanfeliu 他
日本語で読む → - 論文マニピュレーションロボティクス
GPU並列モード評価による接触リッチ動作計画
接触モード列をGPUで並列評価し貪欲に拡張するCoMETを提案し、平面押し操作や双腕非把持マニピュレーションで従来手法と同等以上の性能を示した。
原題: Contact-Rich Motion Planning via GPU-Parallel Mode Evaluation / Jiayun Li, Georgia Chalvatzaki
日本語で読む → - 論文世界モデルロボティクス
サンドイッチ残差:世界モデルのパラメータ効率的なテスト時適応
事前学習済み世界モデルを凍結し、予測器周辺に小さな残差補正のみをオンライン学習させることで、テスト時適応をパラメータ効率的に実現する手法を提案。
原題: Sandwich-Residuals: Parameter-Efficient Test-time Adaptation of World Models / Krishnam Soni, Aditya Sehgal, Vedant Dave 他
日本語で読む → - 論文歩行ロボティクス
FootQuery: 予測接地位置に基づく深度履歴検索による知覚型ヒューマノイド歩行
各足の次回接地位置予測を用いて過去の深度フレームから必要な地形情報を検索し、複雑地形を歩行するヒューマノイド制御を実現した研究。
原題: FootQuery: Future-Touchdown-Guided Retrieval from Depth History for Perceptive Humanoid Locomotion / Tao Dong, Jia Yu, Yuxuan Fan 他
日本語で読む → - 論文ランキング学習制御
ランキング学習におけるWSTL式の表現力
重み付き信号時相論理(WSTL)をランキング学習のスコア関数として使う際の理論的正当性を検証し、ランク実現可能性とランク容量の概念を定式化した。
原題: Expressive Power of WSTL Formulas for Learning to Rank / Ruya Karagulle, Gustavo A. Cardona, Necmiye Ozay 他
日本語で読む → - 論文キネステティック教示ロボティクス
性能最適化されたキネステティック教示のための統合動的力ガイダンスフレームワーク
協働ロボットのキネステティック教示において、可変アドミタンス制御と仮想力で操作性能を保ちながらユーザーを良い姿勢へ導くオンライン力ガイダンス手法を提案し、作業効率の向上を実証した。
原題: A Unified Dynamic Force Guidance Framework for Performance-Optimized Kinesthetic Teaching / Chunxin Li, Jianhua Wu, Zhenhua Xiong 他
日本語で読む → - 論文マニピュレーションロボティクス
接触の多いマニピュレーションにおける強化学習のためのポテンシャル場行動表現
人工ポテンシャル場のパラメータを強化学習で調整し、接触の多いペグ挿入タスクを安定かつ高成功率で実行する手法を提案。
原題: Potential-Field Action Representation for Reinforcement Learning in Contact-Rich Manipulation / Xinyu Liu, Gökhan Solak, Arash Ajoudani
日本語で読む →