論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文自動運転/世界モデルロボティクス
Discrete-WAM: 世界モデルとポリシー学習のための統一離散ビジョン・アクショントークン編集
自動運転向けに、視覚観測・未来状態・高次決定・自車行動を共通の離散トークン空間で表現し、世界モデルとポリシーを統合学習するフレームワークを提案した。
原題: Discrete-WAM: Unified Discrete Vision-Action Token Editing for World-Policy Learning / Ziyang Yao, Haochen Liu, Yuncheng Jiang 他
日本語で読む → - 論文信頼性/説明可能性ロボティクス
実因果性を用いたサイバーフィジカルシステムの障害説明
本論文は、実際の因果関係の枠組みを用いて、自律走行車などのサイバーフィジカルシステムの予期せぬ障害を説明する手法を提案する。理論的ギャップを埋め、説明の最適性と導出効率を優先する2つの実用的アルゴリズムを提示し、ニューラルネットワーク制御の自動車で実証する。
原題: Explaining Failures of Cyber-Physical Systems with Actual Causality / Khen Elimelech, Tom Yaacov, David A. Kelly 他
日本語で読む → - 論文物理モデル統合/予測制御
物理知識を組み込んだリカレント状態空間ニューラルネットワークによる多段階予測
物理モデルの不完全さを補うため、リカレント構造を持つ状態空間ニューラルネットワークを提案し、多段階予測の精度と訓練安定性を向上させた。
原題: Physics-Guided Recurrent State-Space Neural Networks for Multi-Step Prediction / Ruiyuan Li, Ajay Seth, Manon Kok
日本語で読む → - 論文計画/LLM/シミュレーションロボティクス
PerceptTwin: 反復LLM計画と検証のための意味的シーン再構築
ロボットの知覚スタックが生成する意味的シーン表現から、対話型シミュレーションを自動構築するパイプラインを提案。LLMプランナーの計画検証・改善に活用し、成功率を平均約39%向上させた。
原題: PerceptTwin: Semantic Scene Reconstruction for Iterative LLM Planning and Verification / Charlie Gauthier, Sacha Morin, Liam Paull
日本語で読む → - 論文群制御ロボティクス
アドホックな操縦から反復可能なパターンへ:DroneLetsによる緊急サービスのドローン協働の構造化
緊急サービスにおけるドローン協働のアドホックな実践を、フィールド調査とインタビューから導出した44の相互作用パターンと10のメタパターンに基づき、反復可能なプロセスとして形式化する設計アーティファクト「DroneLets」を提案した論文。
原題: From Ad Hoc Pilots to Repeatable Patterns: Structuring Drone Collaboration in Emergency Services with DroneLets / Dzmitry Katsiuba, Samuel Brander, Mateusz Dolata 他
日本語で読む → - 論文自動運転/強化学習ロボティクス
自動運転の高速道路走行のための安全強化学習:安全性と効率性を両立する統合フレームワーク
高速道路自動運転向けに、安全距離・報酬機械・混合専門家を統合した安全強化学習フレームワークを提案し、CARLAシミュレーションで安全性と効率性の向上を実証した。
原題: Safe Reinforcement Learning of Autonomous Highway Driving: A Unified Framework for Safety and Efficiency / Chufei Yan, Zhihao Cui, Yiyan Lv 他
日本語で読む → - 論文模倣学習ロボティクス
RE4: 操作モードを用いた物体インタラクションの模倣の変換認識
物体操作タスクの模倣学習において、解釈可能性を保ちつつ性能を向上させるため、操作モードを考慮したデモンストレーションの検索・変換・再計画・実行からなるRE4フレームワークを提案した。
原題: RE4: Transformation-aware Imitation of Object Interactions Using Manipulation Modes / Arsh Chawla, Rahul Shome
日本語で読む → - 論文歩行ロボティクス
ヒューマノイド知覚歩行のための地形符号化におけるグローバル・ローカル注意分解
ヒューマノイドの強化学習歩行において、広域の地形把握と正確な足場選択を分離するため、粗密エンコーダと注意機構を組み合わせたGLADを提案し、実機で頑健な歩行を実現した。
原題: Global-Local Attention Decomposition for Terrain Encoding in Humanoid Perceptive Locomotion / Shengcheng Fu, Yang Zhang, Zhanxiang Cao 他
日本語で読む → - 論文探査ロボット/情報計画ロボティクス
He3-Seeker: 月面ヘリウム3分布マッピングのためのロボット情報計画
月面のヘリウム3資源を高精度にマッピングするため、能動的ロボット探査手法He3-Seekerを提案。多点掘削・サンプリング・その場分析に基づき、ロボット情報計画(RIP)で自律航法と能動センシングを導く。シミュレーションで高速かつ高忠実なマッピングを実証した。
原題: He3-Seeker: Robotic Information Planning for Lunar Helium-3 Distribution Mapping / Dong Li, Yujie Zheng, Chengdeng Cao 他
日本語で読む → - 論文強化学習/制御ロボティクス
生成的強化学習を安定したロボット制御へ導く
拡散・フローベースの生成的方策を学習し、その確率的な潜在変数サンプリングを決定的な潜在アクターに置き換えることで、探索と制御を分離し、安定かつ高精度なロボット制御を実現するフレームワークを提案した。
原題: Steering Generative Reinforcement Learning into Stable Robotic Controller / Yixuan Wang, Shutong Ding, Ke Hu 他
日本語で読む → - 論文敵対的攻撃/手術ロボティクスロボティクス
手術ロボットタスクにおける学習済みポリシーへの敵対的攻撃
手術ロボットの学習ベースのポリシーが敵対的攻撃に対して脆弱であることを示し、視覚的摂動による動作妨害や誘導攻撃を提案・評価した。
原題: Adversarial Attacks on Learned Policies for Surgical Robotic Tasks / Shutong Jin, Ziyang Chen, Preethi Satish 他
日本語で読む → - 論文全身動作追跡ロボティクス
VENOM: 多様な身体を持つロボットの全身動作追跡のための汎用埋め込みネットワーク
複数のヒューマノイドロボットに対して、上半身と下半身を分離せずに全身の動作を追跡できるGPTベースのモデルを提案し、シミュレーションでその性能を評価した。
原題: VENOM: Versatile Embodied Network for Omni-bodied Motion tracking / Siddharth Padmanabhan, Kazuki Miyazawa, Takato Horii
日本語で読む → - 論文両腕操作ロボティクス
JOIN: 対向・推論・ナビゲーションによるアンカー把持条件付き両腕支援操作のための結合
車椅子搭載のアンカーアームと、呼び出された移動マニピュレータが協調して両腕作業を行うシステムを提案し、視覚言語モデルと幾何学的手法で結合問題を解決した。
原題: JOIN: Anchor-Grasp-Conditioned Joining via Opposition, Inference, and Navigation for Bimanual Assistive Manipulation / Drake Moore, Matt Cheng, Xiang Zhi Tan 他
日本語で読む → - 論文模倣学習/拡散ポリシーロボティクス
セット教師付き拡散ポリシー:修正を通じたアクションチャンク拡散の学習
ロボットの望ましくない動作と人間の修正動作のペアを利用し、拡散ポリシーを望ましいアクションチャンクのセットに整列させる新しい学習フレームワークを提案。
原題: Set-Supervised Diffusion Policy: Learning Action-Chunking Diffusion through Corrections / Zhaoting Li, Gang Chen, Javier Alonso-Mora 他
日本語で読む → - 論文群制御ロボティクス
選択的コスト推定を用いた可変バンドルサイズのマルチエージェントリアクティブタスク割り当て
マルチロボットのタスク割り当てにおいて、計算コストの高い経路計画を全候補に適用せず、低精度ヒューリスティックで候補を絞り込み、有望なものだけに高精度計画を行う2段階のバンドル生成手法を提案した。
原題: Varying Bundle Size Reactive Multi-Task Assignment using Selective Cost Estimation for Multi-Agent Systems / Niklas Dahlquist, Shridhar Velhal, George Nikolakopoulos
日本語で読む → - 論文地図メンテナンスロボティクス
MTD-Map: 混合遷移分布による単一ステージの長期LiDAR地図メンテナンスフレームワーク
動的物体除去と変化検出を単一フレームワークで統合し、混合遷移分布モデルを用いて占有遷移の方向と持続時間を符号化することで、長期LiDAR地図を効率的にメンテナンスする手法を提案した。
原題: MTD-Map: Single-Stage Long-Term LiDAR Map Maintenance Framework via Mixture Transition Distribution / TaeYoung Kim, Gilhwan Kang, Tae Ihn Kim 他
日本語で読む → - 論文自動運転ロボティクス
LUNA-AD: 自動運転のための軽量不確実性認識言語モデルと生涯学習
自動運転向けに、不確実性を考慮した意思決定と生涯学習を備えた軽量な言語モデルを提案し、nuPlanベンチマークで高い成功率と低遅延を実現した。
原題: LUNA-AD: Lightweight Uncertainty-Aware Language Model with Lifelong Learning for Autonomous Driving / Ruoyu Yao, Pei Liu, Ruiguo Zhong 他
日本語で読む → - 論文HRIロボティクス
ロボットの外見よりも役割が重要:教育用HRIにおけるタスク文脈が信頼に与える影響
教育用ロボットの外見とタスクの種類が信頼に与える影響を調べ、タスクの種類が信頼に強く影響し、外見は有意でないことを示した。
原題: What Robots Do Matters More Than What They Look Like: Task Context Shapes Trust in Educational HRI / Anna-Maria Velentza, Konstantina Nikou, Anne-Gwenn Bosser 他
日本語で読む → - 論文物理シミュレーション画像認識
解像度に不変な適応的体積力学特性フィールド
3Dオブジェクトのヤング率やポアソン比などの力学特性を、入力形状に応じて適応的なボクセル構造で高解像度に推定する手法を提案。従来法より16倍高い解像度で、より正確かつ効率的にシミュレーション用アセットを生成できる。
原題: Adaptive Volumetric Mechanical Property Fields Invariant to Resolution / Rishit Dagli, Donglai Xiang, Vismay Modi 他
日本語で読む → - 論文ドライバーモニタリングロボティクス
リスクを考慮した選択的マルチモーダルドライバーモニタリング:ドライバー状態のワールドモデリングを用いて
自動運転車のドライバーモニタリングにおいて、軽量なRGB-生理信号モデルと学習されたゲートを用いて、高速予測と安全介入のための棄却を選択するコスト考慮型フレームワークを提案した。
原題: Risk-Aware Selective Multimodal Driver Monitoring with Driver-State World Modeling / Daosheng Qiu, Haozhuang Chi, Hao Su 他
日本語で読む → - 論文幾何学学習機械学習
トークンは群の要素:行列リー群上のリー代数アテンション
アテンションのトークンを行列リー群の要素として扱い、相対姿勢のリー代数ノルムをスコアに用いる新しいアテンション機構を提案した論文。
原題: The Token Is a Group Element: On Lie-Algebra Attention over Matrix Lie Groups / Przemyslaw Musialski
日本語で読む → - 論文群制御AI
MultiUAV-Plat: LLM指向のマルチUAV協調タスク計画のためのプラットフォーム、ベンチマーク、フレームワーク
マルチUAV協調タスク計画を評価するためのLLMエージェント向けシミュレーションプラットフォームとベンチマークを構築し、専用エージェントフレームワークAgent4Droneを提案して性能を実証した。
原題: MultiUAV-Plat: An LLM-Oriented Platform, Benchmark and Framework for Multi-UAV Collaborative Task Planning / Sheng Zhang, Qinglin Li, Yuechao Zang 他
日本語で読む → - 論文マニピュレーションロボティクス
ロボット操作の堅牢性:基礎と最前線
ロボット操作における堅牢性の定義を明確化し、確率論的・制御理論的観点から定式化、各モジュールでの実現機構を整理し、評価方法と将来課題を論じたサーベイ論文。
原題: Robustness of Robotic Manipulation: Foundations and Frontiers / Yifei Dong, Zhanyi Sun, Lujie Yang 他
日本語で読む → - 論文VLA/安全性解析画像認識
自動運転の危険検出における視覚言語モデルのタスク整合安定性解析
CLIPベースの視覚言語モデルについて、画像劣化時の埋め込みドリフトと危険スコアの変動の関係を調べ、劣化の種類によっては埋め込み変化が小さくても危険検出が不安定になることを示した。
原題: Task-Aligned Stability Analysis of Vision-Language Models for Autonomous Driving Hazard Detection / Everett Richards
日本語で読む → - 論文群制御ロボティクス
モデルベース制御とマルチエージェント強化学習の融合による協調チーム戦略
マルチエージェント強化学習とモデル予測制御を組み合わせ、安全で動的に実現可能な協調行動を学習する枠組みを提案。追跡回避シナリオやドローンとローバーの異種協調タスクで有効性を実証した。
原題: Merging model-based control with multi-agent reinforcement learning for multi-agent cooperative teaming strategies / Christian Llanes, Spencer W. Jensen, Samuel Coogan
日本語で読む → - 論文SLAMロボティクス
ロボットに「わからない」を教える:不確実性を考慮したSLAMのためのSENTINEL
低コスト2D LiDARの測定不良を検出するため、幾何学的スキャン統計とRGB-Dカメラとのクロスモーダル深度整合性を用いて、スキャンごとの信頼度スコアを計算し、不良スキャンを拒否する訓練不要のフレームワークSENTINELを提案した。
原題: Teaching Robots to Say 'I Don't Know' : SENTINEL for Uncertainty-Aware SLAM / Abhishek S, Badrikanath Praharaj, Sreeram MV
日本語で読む → - 論文pHRI/生理計測ロボティクス
環境条件が異なる接触を伴う物理的ヒューマンロボットインタラクションにおけるマルチモーダル生理評価
接触を伴う作業中の物理的ヒューマンロボットインタラクションにおいて、温度・騒音・照度の異なる18条件で生理信号を計測し、作業成績は安定する一方で温度上昇時に自律神経負荷が増加する補償メカニズムを発見した論文。
原題: Multimodal Physiological Assessment of Contact-Rich Physical Human-Robot Interaction Under Varying Environmental Conditions / Yanyi Chen, Xi Wang, Min Deng
日本語で読む → - 論文生成モデル/制約付き生成機械学習
PolyFlow: 制約埋め込みと射影不要更新による安全かつ効率的な多面体制約フローマッチング
フローベース生成モデルを安全重視の物理システムに適用するため、多面体制約を直接モデルに組み込み、射影不要の離散時間フローで厳密な制約充足を実現するフレームワークを提案した。
原題: PolyFlow: Safe and Efficient Polytope-Constrained Flow Matching with Constraint Embedding and Projection-free Update / Jianming Ma, Qiyue Yang, Yang Zhang 他
日本語で読む → - 論文生成モデル画像認識
幾何学的整合によるテキスト画像蒸留における初期ノイズ感度の回復
テキスト画像生成の蒸留において、初期ノイズへの感度が失われる問題を特定し、ヤコビアン・ベクトル積を整合させることで感度を回復するフレームワークGADを提案した。
原題: Restoring Initial Noise Sensitivity in Text-to-Image Distillation via Geometric Alignment / Huayang Huang, Ruoyu Wang, Jinhui Zhao 他
日本語で読む → - 論文評価ベンチマークロボティクス
RobotValues: 人間の価値観が衝突する家庭用ロボットの評価
家庭用ロボットのプランナーを、人間の価値観が衝突する1万のシナリオで評価するベンチマークを提案し、既存のVLMが価値観の優先順位を適切に切り替えられないことを示した。
原題: RobotValues: Evaluating Household Robots When Human Values Conflict / Jongwook Han, Hyeongjin Kim, Yohan Jo
日本語で読む →