論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文不確実性推定/自律性ゲーティングロボティクス
信頼度ゲート型ロボット自律性:不確実性は実際にいつ役立つのか?
ロボットの自律行動とフォールバックの切り替えに使う不確実性指標の有効性を、ランク相関やブートストラップ検定で評価し、ベースモデルの能力が一定以上でないと不確実性は役立たないことを示した。
原題: Confidence-Gated Robot Autonomy: When Does Uncertainty Actually Help? / Johannes A. Gaus, Jhon P. F. Charaja, Daniel Haeufle
日本語で読む → - 論文自動運転ロボティクス
Bench2Drive-Robust:展開時の摂動下でのクローズドループ自動運転のベンチマーク
実環境展開で生じるシステムレベルの摂動(カメラストリーム障害、自己位置推定誤差、計算遅延)がクローズドループのエンドツーエンド自動運転性能に与える影響を評価する、初のデバイス中心のロバストネスベンチマークを提案した。
原題: Bench2Drive-Robust: Benchmarking Closed-Loop Autonomous Driving under Deployment Perturbations / Zhiyuan Zhang, Zhenghao Jin, Yanlun Peng 他
日本語で読む → - 論文視点計画ロボティクス
運動不確実性を考慮した移動物体再構成のための次善視点計画
移動物体の能動的3次元再構成において、物体の運動不確実性を考慮した次善視点計画フレームワークを提案。ノイズを含む位置計測から物体状態を予測し、予測信念に基づいて視点を評価することで、再構成の完全性を向上させる。
原題: Motion-Uncertainty-Aware Next-Best-View Planning for Moving Object Reconstruction / Karen Li, Mattia Mantovani, Robert J. Wood 他
日本語で読む → - 論文ベンチマーク/VLA/記憶ロボティクス
RoboMemArena:ロボット記憶のための包括的で挑戦的なベンチマーク
ロボットの長期タスクにおける記憶能力を評価するため、26タスク・平均1000ステップ超の大規模ベンチマークRoboMemArenaを構築し、VLMによるサブタスク生成と実世界評価を備えた。さらに、記憶管理と予測符号化を統合したVLAモデルPrediMemを提案し、既存手法を上回る性能を示した。
原題: RoboMemArena: A Comprehensive and Challenging Robotic Memory Benchmark / Huashuo Lei, Wenxuan Song, Huarui Zhang 他
日本語で読む → - 論文強化学習/時間論理ロボティクス
時間論理のための価値関数:最適方策と安全フィルタ
時間論理仕様に対する価値関数の最適性と方策の最適性の微妙な関係を解明し、非マルコフ方策を用いて病理を回避する最適方策を構築するとともに、Q関数を複雑な時間論理仕様の安全フィルタとして利用する方法を示した論文。
原題: Value Functions for Temporal Logic: Optimal Policies and Safety Filters / Oswin So, William Sharpless, Sylvia Herbert 他
日本語で読む → - 論文SLAMロボティクス
MAGS-SLAM: 単眼マルチエージェント・ガウススプラッティングSLAMによる幾何・光度整合的な再構成
RGBカメラのみを用いた複数エージェントによる3DガウススプラッティングSLAMを提案し、各エージェントが局所サブマップを構築して圧縮情報を交換することで、深度センサなしで協調的な高品質3D再構成を実現した。
原題: MAGS-SLAM: Monocular Multi-Agent Gaussian Splatting SLAM for Geometrically and Photometrically Consistent Reconstruction / Zhihao Cao, Qi Shao, Shuhao Zhai 他
日本語で読む → - 論文セグメンテーションロボティクス
Trinity: 合成データを活用した非構造化屋外環境のクラス非依存地形・セマンティックセグメンテーションの統合
本論文は、屋外環境での移動ロボットの地形理解を目的に、クラス固有のセマンティックセグメンテーションとクラス非依存の地形セグメンテーションを単一のトランスフォーマーネットワークで統合する手法を提案する。合成データセットと実データセットを導入し、ロボット非依存の視覚的地形事前知識を学習する。
原題: Trinity: Unifying Class-Agnostic Terrain and Semantic Segmentation for Unstructured Outdoor Environments by Leveraging Synthetic Data / Marcus G Müller, Wout Boerdijk, Maximilian Durner 他
日本語で読む → - 論文VLAロボティクス
VEGA: 空間認識型視覚言語行動モデルのための視覚エンコーダ接地整列
VLAモデルの視覚エンコーダ出力を、3D空間認識を持つDINOv2-FiT3Dの特徴に直接整列させることで、空間認識能力を向上させる軽量なフレームワークを提案。推論時には追加コストなしで性能が向上する。
原題: VEGA: Visual Encoder Grounding Alignment for Spatially-Aware Vision-Language-Action Models / Hao Wang, Xiaobao Wei, Jingyang He 他
日本語で読む → - 論文VLAロボティクス
RePO-VLA: 回復駆動型ポリシー最適化による視覚言語行動モデル
成功軌跡のみの模倣学習では実行時のずれに対処できないため、失敗軌跡を活用して回復行動を学習するフレームワークを提案。成功・回復・失敗の軌跡に役割を割り当て、価値関数で進捗を評価し、ポリシーを改善する。
原題: RePO-VLA: Recovery-Driven Policy Optimization for Vision-Language-Action Models / Weijia Liufu, Xiaoyu Guo, Ruiyi Chen 他
日本語で読む → - 論文具身AI/ベンチマークロボティクス
RobotEQ: 具身AIにおける受動的知能から能動的知能への移行
ロボットが明示的な指示なしに社会的規範を理解し遵守できるかを評価する、能動的知能のための最初のベンチマークRobotEQを提案した論文。
原題: RobotEQ: Transitioning from Passive Intelligence to Active Intelligence in Embodied AI / Kuofei Fang, Xinyi Che, Haomin Ouyang 他
日本語で読む → - 論文自動運転画像認識
DeepSight: 潜在状態予測による長期的世界モデリングを用いたエンドツーエンド自動運転
自動運転のための世界モデルを提案し、BEV空間で将来フレームの潜在意味特徴を並列予測することで長期的な状態予測を行い、さらに適応的なテキスト推論で長尾シナリオの性能を向上させ、閉ループベンチマークでSOTAを達成した。
原題: DeepSight: Long-Horizon World Modeling via Latent States Prediction for End-to-End Autonomous Driving / Lingjun Zhang, Changjie Wu, Linzhe Shi 他
日本語で読む → - 論文遠隔運転HCI
ネットワークを介した運転:遅延と映像劣化下での性能と作業負荷
遠隔運転におけるネットワーク遅延と映像品質の影響を、ドライビングシミュレータ実験で評価した論文。遅延とビットレートが作業負荷と性能に与える影響を、生理指標を含む多角的な測定で分析している。
原題: Driving Through the Network: Performance and Workload Under Latency and Video Impairment / Ines Trautmannsheimer, Ahmed Azab, Frank Diermeyer
日本語で読む → - 論文共有自律/遠隔操作ロボティクス
インピーダンス駆動の異方性誘導場による共有自律支援
ロボットの意図を人間に物理的・直感的に伝えるため、インピーダンス制御に着想を得た誘導場を共有自律制御に組み込み、タスク性能と協調性を向上させた。
原題: Shared Autonomy Assisted by Impedance-Driven Anisotropic Guidance Field / Sihan Chen, Hang Xu, Yupu Lu 他
日本語で読む → - 論文動作計画ロボティクス
終端状態が重要:終端コストと学習された不確実性を用いた信念状態コスト空間でのキノダイナミックプランニング
ロボットの動作計画において、終端状態の質(目標到達の信頼性など)を明示的に最適化する終端コストを導入し、漸近最適性を保証しつつ、信念空間での不確実性を考慮したプランナーKiTeを提案した。
原題: Terminal Matters: Kinodynamic Planning with a Terminal Cost and Learned Uncertainty in Belief State-Cost Space / Zhuoyun Zhong, Seyedali Golestaneh, Constantinos Chamzas
日本語で読む → - 論文誘導制御制御
入力制約付き真比例航法による迎撃時間制御
目標迎撃時間を制御する非線形誘導則を提案。制御入力の上限を明示的に考慮しつつ、真比例航法を基盤にスライディングモード制御で時間制約付き迎撃を実現する。
原題: Bounded-Input True Proportional Navigation for Impact-Time Control / Lohitvel Gopikannan, Shashi Ranjan Kumar, Abhinav Sinha
日本語で読む → - 論文VLA/ロボット学習ロボティクス
フローマッチングVLAにおける保守的SFTによる基盤能力の保持
フローマッチング型VLAモデルのファインチューニング時に生じる破壊的忘却を防ぐため、モデルの信頼度に応じて学習信号を動的にスケーリングする保守的教師あり学習(ConSFT)を提案し、LIBEROやRoboTwinベンチマークで既存手法を上回る性能を確認した。
原題: Preserving Foundational Capabilities in Flow-Matching VLAs through Conservative SFT / Tianyi Zhang, Shaopeng Zhai, Haoran Zhang 他
日本語で読む → - 論文自動運転/協調運転/ベンチマークロボティクス
MDrive: エンドツーエンドマルチエージェントシステムのための閉ループ協調運転ベンチマーク
V2X通信を用いた協調運転の評価を閉ループで行うベンチマークMDriveを提案し、マルチエージェントシステムの利点と課題を明らかにした。
原題: MDrive: Benchmarking Closed-Loop Cooperative Driving for End-to-End Multi-agent Systems / Marco Coscoy, Zewei Zhou, Seth Z. Zhao 他
日本語で読む → - 論文ウェアラブルセンサロボティクス
オンライン逐次学習に基づくカスタムリストバンドによる関節角度推定
カスタムリストバンドとオンライン逐次学習を用いて手首関節角度を推定するシステムを提案。データ収集中にモデルを学習し、異なる装着条件や被験者間のデータドリフトに適応する。
原題: Joint Angle Estimation with Customized Wristband Based on Online Incremental Learning / Shuo Wang, Xiaobin Chen, Xiaoming Tao
日本語で読む → - 論文VLA/意思決定ロボティクス
VLA-ATTC: 相対アクション批評モデルによるVLAモデルの適応的テスト時計算
VLAモデルに不確実性に基づく「認知クラッチ」を導入し、複雑な状況でのみ推論フェーズへ切り替える適応的テスト時計算フレームワークを提案。相対比較で最適アクションを選ぶ批評モデルにより、LIBERO-LONGでSOTAの失敗率を50%以上削減した。
原題: VLA-ATTC: Adaptive Test-Time Compute for VLA Models with Relative Action Critic Model / Wenhao Li, Xiu Su, Yichao Cao 他
日本語で読む → - 論文自動運転ロボティクス
シュタインズ・ゲート・ドライブ:構造化された未来に対する意味的安全性調停による遅延分離型LLMプランニング
クラウド上のLLM運転エージェントの推論遅延を補うため、未来予測を事前に選択し、安全契約が有効な間だけ再利用する遅延分離型のプランナー・ランタイムアーキテクチャを提案した。
原題: Steins;Gate Drive: Semantic Safety Arbitration over Structured Futures for Latency-Decoupled LLM Planning / Anjie Qiu, Hans D. Schotten
日本語で読む → - 論文自動運転画像認識
固定閾値とドメイン固有ベンチマークを超えた自動運転の説明可能なマルチタスク分類
自動運転のシーン理解におけるマルチタスク分類で、固定閾値の限界を指摘し、適応的閾値選択によりF1スコアを改善する手法を提案。また、運転判断とその理由を人手で注釈した新データセットIUST-XAI-ADを導入した。
原題: Beyond Fixed Thresholds and Domain-Specific Benchmarks for Explainable Multi-Task Classification in Autonomous Vehicles / Maryam Sadat Hosseini Azad, Shahriar Baradaran Shokouhi
日本語で読む → - 論文群制御ロボティクス
最適化され運動学的に実現可能なマルチエージェント動作計画
マルチエージェント動作計画問題に対して、初期解を生成し、その後最適制御問題を解いて解を改善する二段階手法を提案した。トラクタートレーラーシステムで評価し、CBSがPBSより優れていることを示した。
原題: Optimized and kinematically feasible multi-agent motion planning / Anja Hellander, Kristoffer Bergman, Daniel Axehill
日本語で読む → - 論文人間と物体のインタラクション生成ロボティクス
MaMi-HOI:大域的な運動学と局所的な幾何学の調和による人間と物体のインタラクション生成
人間と物体のインタラクション生成において、拡散モデルの深層化で物体の幾何学情報が失われる「幾何学的忘却」問題を発見し、それを補正するアダプタと運動学的調和アダプタを備えた階層的フレームワークを提案した。
原題: MaMi-HOI: Harmonizing Global Kinematics and Local Geometry for Human-Object Interaction Generation / Hao Wang, Shiqi Wang, Qi Liu
日本語で読む → - 論文歩行ロボティクス
内在ダイナミクスヘッドによる四足歩行の動力学認識型制御
四足歩行ロボットの制御ポリシーに、状態からトルクへの動力学を学習するヘッドを併設し、その予測性に基づく報酬でより効率的で滑らかな歩行を実現する訓練フレームワークを提案した。シミュレーションと実機で効果を検証し、トルク効率や動作率などの改善を確認した。
原題: Dynamics Aware Quadrupedal Locomotion via Intrinsic Dynamics Head / Aman Arora, Nalini Ratha
日本語で読む → - 論文システムアーキテクチャロボティクス
Jiao: 混合臨界性ロボティクスにおける隔離とカスタマイゼーションの橋渡し
安全制御とユーザーアプリを共有マルチコアで統合する際、エンドユーザーがシステム知識なしにロボットを変更できるよう、ハードウェア隔離とパラメータ同期を組み合わせたアーキテクチャを提案し、ジッタを大幅に削減した。
原題: Jiao: Bridging Isolation and Customization in Mixed Criticality Robotics / James Yen, Zhibai Huang, Zhixiang Wei 他
日本語で読む → - 論文sim2realロボティクス
ゼロショットSim-to-Realロボット学習:リアクティブキャッチングにおける巧みな操作の研究
ドメインランダム化の新しい手法DRISを提案し、複数のランダム化インスタンスを同時に扱うことでロボットのポリシーを強化し、ゼロショットでの実機転送を実現した。
原題: Zero-Shot Sim-to-Real Robot Learning: A Dexterous Manipulation Study on Reactive Catching / Kejia Ren, Gaotian Wang, Andrew S. Morgan 他
日本語で読む → - 論文安全性ロボティクス
TAIL-Safe: 模倣学習ポリシーのためのタスク非依存な安全監視
模倣学習ポリシーが安全に動作できる状態の集合を学習し、逸脱時に回復動作を行う安全監視手法を提案した論文。
原題: TAIL-Safe: Task-Agnostic Safety Monitoring for Imitation Learning Policies / Riad Ahmed, Momotaz Begum
日本語で読む → - 論文マニピュレーションロボティクス
OHP-RL: ロボット操作の強化学習におけるオンライン人間選好をガイドとして活用
人間の介入を選好情報として捉え、状態依存のゲートで適応的に学習を導く強化学習フレームワークを提案し、実機ロボットの接触を伴う操作タスクで有効性を示した。
原題: OHP-RL: Online Human Preference as Guidance in Reinforcement Learning for Robot Manipulation / Yunyang Mo, Jian Li, Qiwei Wu 他
日本語で読む → - 論文自動運転/制御ロボティクス
連続時間残差学習による車両のロバスト経路追従:ICODE-MPPIアプローチ
モデル予測経路積分(MPPI)制御の性能を向上させるため、未モデル化の残差ダイナミクスを学習・補償するICODE-MPPIフレームワークを提案。高忠実度シミュレーションで横追従誤差を最大69%削減し、制御チャタリングも抑制した。
原題: Robust Path Tracking for Vehicles via Continuous-Time Residual Learning: An ICODE-MPPI Approach / Shugen Song, Wenjie Mei, Chengyan Zhao
日本語で読む → - 論文プラズマ制御ロボティクス
任意センサーサブセットによる動的プラズマ形状制御
トカマクのプラズマ形状制御を強化学習で行い、センサー故障に頑健で動的な形状追従を実現した。
原題: Dynamic Plasma Shape Control with Arbitrary Sensor Subsets / D. Sorokin, M. Stokolesov, A. Granovskiy 他
日本語で読む →