論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御ロボティクス
PRoID: マルチロボット探索と中継における情報伝達率の予測
複数ロボットが未知環境を探索し情報を基地局へ届ける際、各ロボットがいつ探索をやめて中継すべきかを、学習した地図予測とチーム状況に基づき動的に判断する基準PRoIDを提案。故障リスクを考慮した拡張版も導入し、実データで固定スケジュール方式より高い性能を示した。
原題: PRoID: Predicted Rate of Information Delivery in Multi-Robot Exploration and Relaying / Seungchan Kim, Seungjae Baek, Micah Corah 他
日本語で読む → - 論文自動運転/ベンチマークロボティクス
V2X-QA:自動運転におけるエゴ・インフラ・協調視点を横断するマルチモーダル大規模言語モデルの総合推論データセットとベンチマーク
自動運転向けMLLMの評価を、車両・インフラ・協調の3視点に分離したプロトコルで行う実世界データセットとベンチマークを構築し、視点依存性や協調推論の課題を明らかにした。
原題: V2X-QA: A Comprehensive Reasoning Dataset and Benchmark for Multimodal Large Language Models in Autonomous Driving Across Ego, Infrastructure, and Cooperative Views / Junwei You, Pei Li, Zhuoyu Jiang 他
日本語で読む → - 論文エージェントガバナンスロボティクス
具現化エージェントの活用:ポリシー制約実行のためのランタイムガバナンス
エージェントの認知と実行監視を分離し、ポリシー検査やロールバック等を行う専用ランタイム層を導入して、実行中の安全性を確保する枠組みを提案した。シミュレーションで高い介入成功率と回復成功率を実証した。
原題: Harnessing Embodied Agents: Runtime Governance for Policy-Constrained Execution / Xue Qin, Simin Luan, John See 他
日本語で読む → - 論文自動運転/VLA画像認識
UniDriveVLA:自動運転のための理解・知覚・行動計画の統合
自動運転向けのVLAモデルにおいて、空間知覚と意味推論の競合を解消するため、Mixture-of-Transformersによる専門家分離を導入した統合モデルUniDriveVLAを提案し、nuScenesとBench2Driveで最先端性能を達成した。
原題: UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving / Yongkang Li, Lijun Zhou, Sixu Yan 他
日本語で読む → - 論文操作ロボティクス
Veo-Act: 最先端ビデオモデルはどこまで汎用ロボット操作を前進させられるか?
ビデオ生成モデルVeo-3を高次プランナーとして使い、低次実行にはVLAポリシーを用いる階層的フレームワークVeo-Actを提案し、操作性能を向上させた。
原題: Veo-Act: How Far Can Frontier Video Models Advance Generalizable Robot Manipulation? / Zhongru Zhang, Chenghan Yang, Qingzhou Lu 他
日本語で読む → - 論文協調自動運転ロボティクス
SwarmDrive: 遅延制約のある協調自動運転のための意味的V2V連携
近隣車両が小型言語モデルで意図を共有し、不確実性が高い時のみイベント駆動で合意形成するV2V協調フレームワークを提案し、交差点の遮蔽シナリオで成功率と遅延を改善した。
原題: SwarmDrive: Semantic V2V Coordination for Latency-Constrained Cooperative Autonomous Driving / Anjie Qiu, Donglin Wang, Zexin Fang 他
日本語で読む → - 論文SLAMロボティクス
PanoAir: クロスタイム実世界UAVデータセットを用いたパノラマ視覚慣性SLAM
UAVの複雑な環境での正確な姿勢推定を目指し、パノラマカメラを用いたVI-SLAMフレームワークと、多様な飛行条件をカバーする実世界データセットを提案した。
原題: PanoAir: A Panoramic Visual-Inertial SLAM with Cross-Time Real-World UAV Dataset / Yiyang Wu, Xiaohu Zhang, Yanjin Du 他
日本語で読む → - 論文VLA/サーベイロボティクス
ロボティクスにおける視覚-言語-行動モデル:データセット、ベンチマーク、データエンジンの調査
視覚-言語-行動(VLA)モデルの進歩はデータ基盤に依存するとし、データセット、ベンチマーク、データエンジンの3つの柱に沿ってデータ中心の分析を行い、今後の課題を整理したサーベイ論文。
原題: Vision-Language-Action in Robotics: A Survey of Datasets, Benchmarks, and Data Engines / Ziyao Wang, Bingying Wang, Hanrong Zhang 他
日本語で読む → - 論文人間参加型CPS/エージェントAIAI
エージェント型ドライビングコーチ:エージェント型AIを活用した人間参加型サイバーフィジカルシステムの堅牢性と決定性
大規模言語モデルを用いたエージェント型AIを人間参加型のサイバーフィジカルシステムに適用する際の非決定性問題に対し、リアクターモデルに基づくアプローチを提案し、ドライビングコーチの事例で評価した。
原題: Agentic Driving Coach: Robustness and Determinism of Agentic AI-Powered Human-in-the-Loop Cyber-Physical Systems / Deeksha Prahlad, Daniel Fan, Hokeun Kim
日本語で読む → - 論文VLA/操作ロボティクス
CodeGraphVLP: コードによる計画とセマンティックグラフ状態を組み合わせた非マルコフ型視覚言語行動モデル
長期的なロボット操作タスクにおいて、セマンティックグラフ状態とコードベースのプランナーを組み合わせ、視覚言語行動モデルの実行を支援する階層的フレームワークを提案した。
原題: CodeGraphVLP: Code-as-Planner Meets Semantic-Graph State for Non-Markovian Vision-Language-Action Models / Khoa Vo, Sieu Tran, Taisei Hanyu 他
日本語で読む → - 論文運動計画ロボティクス
未知非線形ダイナミクス下での予測到達可能性に基づく階層的運動計画と制御
未知の非線形システムに対して、区分的アフィンモデルと到達制御理論を用いた階層的計画・制御フレームワークを提案し、オンラインで運動生成を行う。
原題: Hierarchical Motion Planning and Control under Unknown Nonlinear Dynamics via Predicted Reachability / Zhiquan Zhang, Melkior Ornik
日本語で読む → - 論文群制御ロボティクス
対話強化型長期間協調視覚言語ナビゲーション DeCoNav
複数ロボットが対話で情報交換し、動的にタスクを再割り当て・再計画しながら長期間の協調ナビゲーションを行う枠組みを提案し、ベンチマークで成功率を大幅に向上させた。
原題: DeCoNav: Dialog enhanced Long-Horizon Collaborative Vision-Language Navigation / Sunyao Zhou, Yunzi Wu, Tianhang Wang 他
日本語で読む → - 論文触覚ロボティクス
視覚と触覚のクロスモーダル物体知覚
ロボット操作における物体の物理特性推定を改善するため、視覚と触覚の情報をベイズ推論で統合するクロスモーダル潜在フィルタを提案した。実機実験で不確実性下での推定効率と頑健性が向上することを示した。
原題: Cross-Modal Visuo-Tactile Object Perception / Anirvan Dutta, Simone Tasciotti, Claudia Cusseddu 他
日本語で読む → - 論文ソフトロボティクス/適応機構ロボティクス
ZipFold: スケーラブルな適応ロボットのためのモジュール式アクチュエータ
3Dプリントされた柔軟なストリップを折りたたみ・ジッパー状に結合して、コンパクトで柔軟な状態と拡張された準剛体状態を切り替えられるアクチュエータを提案し、4モジュールの適応歩行ロボットで実証した。
原題: ZipFold: Modular Actuators for Scaleable Adaptive Robots / Niklas Hagemann, Daniela Rus
日本語で読む → - 論文モバイルマニピュレーション/HRIロボティクス
ExpressMM: 人間とロボットのインタラクションにおける表現豊かなモバイル操作行動
本論文では、モバイルマニピュレータが人間と協調作業中に意図を表現するためのフレームワークExpressMMを提案し、視覚言語モデルと視覚言語行動ポリシーを統合して、中断可能な対話を実現した。
原題: ExpressMM: Expressive Mobile Manipulation Behaviors in Human-Robot Interactions / Souren Pashangpour, Haitong Wang, Matthew Lisondra 他
日本語で読む → - 論文マニピュレーションロボティクス
VADF: 視覚適応型拡散ポリシーフレームワークによる効率的なロボット操作
拡散ポリシーの学習収束の遅さと推論タイムアウト問題を解決するため、訓練時のサンプル難易度に応じた重み付けと、推論時の視覚に基づくタスク分割により、収束ステップ数を削減し早期成功率を向上させるフレームワークを提案した。
原題: VADF: Vision-Adaptive Diffusion Policy Framework for Efficient Robotic Manipulation / Xinglei Yu, Zhenyang Liu, Shufeng Nan 他
日本語で読む → - 論文SLAMロボティクス
コンパクトなキーフレーム最適化によるマルチエージェントガウススプラッティングSLAM
マルチエージェントSLAMにおいて、3Dガウス表現の通信負荷を削減するため、冗長なガウスを除去する圧縮ステップと、中央集権的なループ閉じ込み計算を導入し、データ転送量を最大95%削減するフレームワークを提案した。
原題: Compact Keyframe-Optimized Multi-Agent Gaussian Splatting SLAM / Monica M. Q. Li, Pierre-Yves Lajoie, Jialiang Liu 他
日本語で読む → - 論文歩行ロボティクス
受動的身体ダイナミクスを活用したモデルベース強化学習による高性能二足歩行ロボットの歩容生成
バネなどの受動要素を持つ二足ロボットのモデルをシミュレータで構築し、モデルベース深層強化学習により歩行・走行を生成。受動要素により安定したリミットサイクルが形成され、ロバストでエネルギー効率の高い歩容が獲得できることを示した。
原題: Model-Based Reinforcement Learning Exploits Passive Body Dynamics for High-Performance Biped Robot Locomotion / Tomoya Kamimura, Haruka Washiyama, Akihito Sano
日本語で読む → - 論文強化学習/水中ロボットロボティクス
自律サンゴ礁モニタリングのための文脈型マルチタスク強化学習
水中ロボットの不確実な動的環境下での制御を、文脈型マルチタスク強化学習を用いて学習し、サンゴ礁監視タスクの汎用性と堅牢性を向上させる手法を提案・評価した。
原題: Contextual Multi-Task Reinforcement Learning for Autonomous Reef Monitoring / Melvin Laux, Yi-Ling Liu, Rina Alo 他
日本語で読む → - 論文安全制御/強化学習制御
敵対的強化学習による最大ロバスト制御バリア関数の合成と展開
一般の非線形システムに対して、動的計画法とQ関数を用いた新しいロバスト制御バリア関数を提案し、敵対的強化学習で合成・展開する手法を導入した。
原題: Synthesis and Deployment of Maximal Robust Control Barrier Functions through Adversarial Reinforcement Learning / Donggeon David Oh, Duy P. Nguyen, Haimin Hu 他
日本語で読む → - 論文パノプティックセグメンテーションロボティクス
LiPS: リソース制約のあるロボティクスのための軽量パノプティックセグメンテーション
リソース制約のあるロボット向けに、計算量を大幅に削減しつつ高精度なパノプティックセグメンテーションを実現する軽量モデルLiPSを提案した。
原題: LiPS: Lightweight Panoptic Segmentation for Resource-Constrained Robotics / Calvin Galagain, Martyna Poreba, François Goulette 他
日本語で読む → - 論文SLAMロボティクス
SLAMのための意味的関係生成によるロバストなグラフマッチング
RGB-Dデータから検出した物体と構造要素(部屋や壁面)との関係をモデル化し、幾何検証前に候補対応を絞り込むことで、対称な環境でも頑健なグラフマッチングを実現する手法を提案した。
原題: Robust Graph Matching through Semantic Relationship Generation for SLAM / David Perez-Saura, Jose Andres Millan-Romera, Miguel Fernandez-Cortizas 他
日本語で読む → - 論文安全制御ロボティクス
階層的二次計画法で解く制御バリア関数による安全な物理的ヒューマンロボットインタラクション
物理的ヒューマンロボットインタラクションにおける安全性を確保するため、制御バリア関数を階層的二次計画法で解く枠組みを提案し、実機冗長ロボットで実験検証した。
原題: Control Barrier Functions Solved with Hierarchical Quadratic Programming for Safe Physical Human-Robot Interaction / Rui Luo, Jonas Mariager Jakobsen, Wesley Roozing 他
日本語で読む → - 論文ヒューマノイド/模倣学習/世界モデルロボティクス
UniT: 人間からヒューマノイドへのポリシー学習と世界モデリングのための統一物理言語に向けて
人間の映像データを活用してヒューマノイドロボットの学習を行うため、視覚的アンカリングに基づく統一潜在アクショントークナイザー(UniT)を提案し、異なる身体構造間のギャップを埋める。
原題: UniT: Toward a Unified Physical Language for Human-to-Humanoid Policy Learning and World Modeling / Boyu Chen, Yi Chen, Lu Qiu 他
日本語で読む → - 論文ナビゲーションロボティクス
NaviFormer: ナビゲーション問題を全体的に解決するTransformer型深層強化学習モデル
経路計画を高レベル(経由点の順序)と低レベル(衝突回避の軌道)に分けず、Transformerベースの深層強化学習で同時に解くモデルを提案した。実験で精度と計算速度の優位性を示した。
原題: NaviFormer: A Deep Reinforcement Learning Transformer-like Model to Holistically Solve the Navigation Problem / Daniel Fuertes, Andrea Cavallaro, Carlos R. del-Blanco 他
日本語で読む → - 論文群制御ロボティクス
姿勢が重要:飛行中のマルチロータUAV放射パターン学習による通信可用性モデリングの向上
キャリブレーション飛行データから異種クアッドコプターUAVのアンテナ放射パターンを学習し、観測された結合利得から各UAVのパターンを分離する手法を提案。実データで4.56dBのRMS誤差を達成し、ペイロード変更時の迅速な再較正を可能にする。
原題: Orientation Matters: Learning Radiation Patterns of Multi-Rotor UAVs In-Flight to Enhance Communication Availability Modeling / Martin Zoula, Daniel Bonilla Licea, Jan Faigl 他
日本語で読む → - 論文制御理論math.OC
ハイブリッド力学系のモデル予測制御
ハイブリッド力学系に対するモデル予測制御(MPC)を定式化し、集合への漸近安定性の十分条件を提供した論文。
原題: Model Predictive Control of Hybrid Dynamical Systems / Ricardo G. Sanfelice, Berk Altin
日本語で読む → - 論文マニピュレーションロボティクス
スパースな分類ガイダンスからの巧みな把持学習
物体とタスクに応じた把持計画を、密なポーズや接触点の指定なしに、タクソノミー(分類)ベースのスパースな指示から学習する二段階フレームワークGRITを提案。実世界実験で制御可能性も示した。
原題: Learning Dexterous Grasping from Sparse Taxonomy Guidance / Juhan Park, Taerim Yoon, Seungmin Kim 他
日本語で読む → - 論文VLA/タスク計画ロボティクス
Ro-SLM: ロボットのタスク計画と動作コード生成のためのオンボード小型言語モデル
クラウドや高性能計算機に依存せず、UAVなどの小型ロボットに搭載可能な小型言語モデル(SLM)を、LLMの知識蒸留と報酬関数によるファインチューニングで実用レベルに引き上げるフレームワークRo-SLMを提案した。
原題: Ro-SLM: Onboard Small Language Models for Robot Task Planning and Operation Code Generation / Wenhao Wang, Yanyan Li, Long Jiao 他
日本語で読む → - 論文自動運転画像認識
LMGenDrive: マルチモーダル理解と生成的ワールドモデルを統合したエンドツーエンド運転
本論文は、LLMベースのマルチモーダル理解と生成的ワールドモデルを統合した初のエンドツーエンド自動運転フレームワークLMGenDriveを提案し、将来の運転ビデオと制御信号を同時生成することで、長尾・オープンワールドシナリオへの一般化を向上させる。
原題: LMGenDrive: Bridging Multimodal Understanding and Generative World Modeling for End-to-End Driving / Hao Shao, Letian Wang, Yang Zhou 他
日本語で読む →