論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/18 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御cs.MA
群分散計画を用いた並列生涯MAPFの理論的枠組み
生涯マルチエージェント経路探索問題において、RHCRの準最適性を理論的に証明し、それを基にエージェントをグループに分割して並列計画するGD-RHCRを提案し、性能を検証した。
原題: A Theoretical Framework for Parallel Lifelong MAPF Using Group Decentralized Planning / Alex DeWeese, Jiaoyang Li, Guannan Qu
日本語で読む → - 論文VLA/安全保証ロボティクス
異種ロボットのための校正済み予測安全:行動条件付きJEPAフレームワークとモデルベース安全シールド
視覚言語行動ポリシーに実行時保証を追加するため、行動条件付きJEPA世界モデルで候補行動のタスク進捗と物理リスクを予測し、モデルベース安全シールドでフィルタリングするパイプラインを提案した。
原題: Calibrated Predictive Safety for Heterogeneous Robots: An Action-Conditioned JEPA Framework with Model-Based Safety Shields / Kaiming Zhong, Tianhua Liu, Yue Wang
日本語で読む → - 論文ナビゲーションロボティクス
確率的保証付きオンライン確率的最短路ナビゲーションのためのオラクルとしてのダイクストラ法
ダイクストラ法が確率的遷移下でも正確な計画エンジンとして機能する条件を示し、それを利用したオンライン学習アルゴリズムDORAを提案。動的障害物との接触確率を予算内に抑えつつ、計算量を大幅に削減する。
原題: Dijkstra as an Oracle for Online Stochastic Shortest Path Navigation with Provable Guarantees / Mansur M. Arief, Ali Akarma, Ahmad Alfan Alfian Irfan
日本語で読む → - 論文マニピュレーションロボティクス
BATONを落とすな:エージェント的サブタスク探索と遷移認識メモリによる長期的ロボット操作
長期的なロボット操作タスクを、VLAモデルを凍結しLLMエージェントがサブタスク単位で探索・記憶することで、コストを加算的にし、遷移条件を明示して失敗を単一ステージに帰属させる手法BATONを提案。
原題: Don't Drop the BATON: Long-Horizon Robot Manipulation via Agentic Subtask Exploration and Transition-aware Memory / Bingxin Xu, Yuzhang Shang, Emilio Ferrara
日本語で読む → - 論文ナビゲーション/計画ロボティクス
車輪脚ロボットの複雑地形におけるロボット身体認識トラバーサルリスクグラフ計画
車輪脚ロボットの複雑地形ナビゲーションのため、ロボットの向きと車体形状を考慮したリスクグラフ計画手法を提案し、シミュレーションと実機で成功率を向上させた。
原題: Robot-Body-Aware Traversal Risk Graph Planning for Wheeled-Legged Robots in Complex Terrain / Zhiqiao Guo, Bichi Zhang, Sören Schwertfeger
日本語で読む → - 論文車両位置推定画像認識
路側レーダーとコネクテッド車両センシングを用いたマルチオブザーバ車両位置推定のケーススタディ
路側レーダーとLiDAR搭載コネクテッド車両の物体検出を統合する車両位置推定フレームワークを提案し、ヘルシンキの実データで評価した。
原題: Multi-Observer Vehicle Localization Case Study with Roadside Radar and Connected Vehicle Sensing / Aleksi Pippuri, Nilusha Jayawickrama, Risto Ojala
日本語で読む → - 論文世界モデル/計画機械学習
SCALE: 正しい幾何学におけるJEPA計画のための状態校正潜在埋め込み
エンドツーエンドの世界モデルLeWMの潜在表現に、タスク関連状態空間との距離整合性を持たせることで、計画性能を向上させる手法SCALEを提案した。
原題: SCALE: State-Calibrated Latent Embeddings for JEPA Planning in the Right Geometry / Jiaming Hu, Yan Zheng, Tian Wang
日本語で読む → - 論文群制御制御
センシング範囲制約下での剛性を考慮したフォーメーション追従:単一の制御バリア関数制約による実現
非線形ダイナミクスを持つ異種マルチロボットシステムにおいて、センシング範囲制約下でフォーメーション追従と剛性維持を単一のCBF制約で統合する分散制御フレームワークを提案した。
原題: Rigidity-Aware Formation Tracking under Sensing Range Constraints via Single Control Barrier Function Constraint / S. Saharsh, Pushpak Jagtap
日本語で読む → - 論文地理参照/ポーズグラフ最適化ロボティクス
マーカー制約付きポーズグラフ補正によるGNSS非依存環境でのクロスプラットフォーム地理参照
GNSSが使えない環境で、カモフラージュ対応のマーカーを視覚アンカーとして用い、LiDARオドメトリとRTAB-Mapの再構成を共通座標系に地理参照するフレームワークを提案。マーカー制約付きポーズグラフ最適化によりドリフトを大幅に低減した。
原題: Marker-Constrained Pose-Graph Correction for Cross-Platform Georeferencing in GNSS-Denied Environments / Marco Giberna, Jose Luis Sanchez Lopez, Holger Voos
日本語で読む → - 論文評価ベンチマーク機械学習
CaliBench: ビデオ世界モデルの確率的ダイナミクスは物理的に較正されているか?
ビデオ世界モデルの生成結果が物理現象の不確実性を正しく再現しているかを評価するベンチマークCaliBenchを提案し、複数のモデルで較正のずれを検出した。
原題: CaliBench: Are the Stochastic Dynamics of Video World Models Physically Calibrated? / Jonathan Sadeghi, Jenny Seidenschwarz, Jesse Allardice 他
日本語で読む → - 論文自動運転/データセット分析ロボティクス
シナリオ特性化:軌跡データセット全体の安全性評価のためのモジュール型ツールキット
運転シナリオの軌跡データセットを自動的に分析・特性化するオープンソースのフレームワークを提案し、データセットに依存しないモジュール構成で安全性評価を可能にする。
原題: ScenarioCharacterization: A Modular Toolkit for Characterizing Safety across Trajectory Datasets / Ingrid Navarro, Yutong Duan, Jonathan Francis 他
日本語で読む → - 論文世界モデル/3Dシーン理解画像認識
GaussianDWM++: 言語基盤の3Dガウス駆動世界モデルによる統一的なシーン理解・編集・マルチモーダル生成
3Dガウス表現に視覚言語特徴を蒸留し、シーン理解・言語推論・4D編集・マルチモーダル生成を単一フレームワークで統合した駆動世界モデルを提案した。
原題: GaussianDWM++: Language-Grounded 3D Gaussian Driving World Model for Unified Scene Understanding, Editing, and Multi-Modal Generation / Tianchen Deng, Xuefeng Chen, Shuang Wu 他
日本語で読む → - 論文異常検知cs.CR
デジタルツイン劣化:時間的不整合によるサイバー物理攻撃の検出
デジタルツインと物理システム間の時間的不整合を監視し、サイバー物理攻撃を検出するフレームワークを提案。正常動作のみで学習した予測モデルと密度モデル、逐次変化検出を用いて攻撃を高精度に検出する。
原題: Digital Twin Degradation: Detecting Cyber Physical Attacks via Temporal Inconsistencies / Konstantinos E. Kampourakis, Vasileios Gkioulos, Sokratis Katsikas
日本語で読む → - 論文テレオペレーション/触覚ロボティクス
ViHaTeleop: 器用な操作学習のための低コスト・軽量な視覚-触覚テレオペレーションシステム
低コストで軽量な視覚-触覚テレオペレーションシステムを開発し、触覚フィードバックが接触が重要なタスクの成功率を向上させることを実証した。
原題: ViHaTeleop: A Low-Cost, Lightweight Visual-Haptic Teleoperation System for Dexterous Manipulation Learning / Fucai Zhu, Yanhou Lai, Paul Maestre 他
日本語で読む → - 論文マニピュレーションロボティクス
アーム認識型誘導による器用な把持生成:アーム非依存把持モデルの活用
事前学習済みのアーム非依存把持モデルを推論時にアーム情報と環境情報で誘導し、アーム制約を考慮した器用な把持を高確率で生成するフレームワークを提案した。
原題: Arm-Aware Guided Dexterous Grasp Generation with Arm-Agnostic Grasp Models / Yongyi Jia, Yongpeng Jiang, Kangchen Lv 他
日本語で読む → - 論文ガス源位置推定ロボティクス
物理依存性に基づく逐次推論による深層確率的屋内ガス源位置推定
移動ロボットのスパースでノイズの多い測定からガス源の位置を推定する深層確率フレームワークを提案。風と濃度場の物理的依存性を逐次条件付き推論に組み込み、精度と効率を向上させた。
原題: Deep Probabilistic Indoor Gas Source Localization via Physical Dependency-Guided Sequential Inference / Seunghwan Kim, Hyungjin Kim, Junhee Lee 他
日本語で読む → - 論文具現化エージェント/自己進化ロボティクス
Zetta ζ: 自己進化する物理知能のための効率的な閉ループ具現化ハーネス
ロボットの実行中にコードベースの批評家と回復スキルをオンラインで進化させる閉ループハーネスを提案し、LIBERO-ProとRoboCasaで高い成功率と高速化を達成した。
原題: Zetta $ζ$: An Efficient Closed-Loop Embodied Harness for Self-Evolving Physical Intelligence / Xin Ding, Liang Mi, Mingzhe Huang 他
日本語で読む → - 論文圧縮機械学習
UniTAC: 重み付き歪み尺度による普遍的なタスク認識圧縮
タスクに応じて再学習不要で動作を切り替えられる単一の画像圧縮コーデックを提案。タスクを成分ごとの重要度ベクトルで抽象化し、エンコーダ・デコーダを条件付けすることで、汎用からタスク特化までを一つのモデルで実現する。
原題: UniTAC: Universal Task-Aware Compression via Weighted Distortion Measures / Homa Esfahanizadeh, Matin Mortaheb, Jinfeng Du 他
日本語で読む → - 論文身体性ロボティクスロボティクス
身体化パーセプトロン表現に基づく神経・筋肉ネットワークの共設計
身体をニューラルネットワークとして捉える理論的枠組み「Embodied Perceptron」を提案し、筋骨格ロボットの制御器と筋肉配置を同時最適化することで、単一ニューロン制御でも安定性と学習効率が向上することを示した。
原題: Co-design of Neural and Muscle Network based on Embodied Perceptron Representation / Siyuan Tao, Yoichi Masuda, Hiroyuki Nabae 他
日本語で読む → - 論文VLAロボティクス
τ0-VLA: 世界モデル誘導のテスト時計算を備えた階層型ロボット基盤モデル
長期的なロボット操作タスクを、高レベル方策がサブタスク生成時にテスト時計算を追加で行える階層型VLAモデルを提案し、実データで性能向上を実証した。
原題: $τ_0$-VLA: a Hierarchical Robot Foundation Model with World-Model-Guided Test-Time Computation / Xiaowei Cai, Yunuo Cai, Bingao Chen 他
日本語で読む → - 論文強化学習/ヒューマノイドロボティクス
RoboStriker: 自律型ヒューマノイドボクシングのための潜在空間戦略ゲーム
ヒューマノイドボクシングを2プレイヤーの潜在空間ゼロサムマルコフゲームとして定式化し、戦略的探索と物理的実現性の矛盾を解決する階層的フレームワークを提案した。
原題: RoboStriker: Latent-Space Strategic Games for Autonomous Humanoid Boxing / Kangning Yin, Kaige Liu, Zhe Cao 他
日本語で読む → - 論文HRIHCI
多元的人間ロボット相互作用:多様なコミュニティとのロボット相互作用の設計
多様なユーザーとの相互作用を考慮した社会ロボット設計の枠組み「多元的HRI」を提案し、包括的で適応的、倫理的な相互作用を目指す。
原題: Pluralistic Human-Robot Interaction: Designing for Robot Interaction with Diverse Communities / Raj Korpan
日本語で読む → - 論文VLAロボティクス
NebulaVLA: ロボット操作のためのガイドアクションを備えた二周波数視覚言語行動モデル
高レベルの意味推論と低レベルのアクション制御を分離した非同期二周波数アーキテクチャを提案し、異種ロボット間のギャップを埋める統一表現と滑らかな動作を実現するガイドアクションアルゴリズムを導入した。
原題: NebulaVLA: A Dual-Frequency Vision-Language-Action Model With Guide Action for Robotic Manipulation / Cong Zhao, Shuai Tian, Xu Zhang 他
日本語で読む → - 論文評価フレームワークAI
DeepInsight II: ベンチマークからロボットへの一つのトレース
物理AIスタックの評価を統一的に行うフレームワークを拡張し、ナビゲーションと操作のベンチマーク再現、全身制御のシミュレーションから実機への一貫した評価、そしてシステム間のハンドオフラベルと修復可能性の検証を行った。
原題: DeepInsight II: One Trace from Benchmark to Robot / Siyi Li, Yuchen Kang, Wuliang Wang 他
日本語で読む → - 論文VLAAI
HaReCAP: 習慣的行動に基づく再帰的大規模言語モデルエージェントの接地
長期的な身体性タスクにおいて、LLMエージェントの葉ノードでの行動接地の冗長性を減らすため、成功軌跡から頻出の葉決定を抽出してオフラインでルール化し、実行時に安全な場合のみLLM呼び出しをスキップするHaReCAPを提案した。
原題: HaReCAP: Habitual-action Grounding for Recursive Large Language Model Agents / Shen Liu, Zhenguo Xu, Shaopu Wang 他
日本語で読む → - 論文データセット/ベンチマークロボティクス
HiPHI: 高精度な人体動作と物体インタラクションのための大規模ベンチマーク
本論文は、600時間以上の高精度な全身動作と物体インタラクションを収録した大規模データセットHiPHIを構築し、動作多様性やインタラクションの接地性を評価するベンチマークを提案した。
原題: HiPHI: A Large-Scale Benchmark for High-Precision Human Motion and Object-Interaction / Jiahao Ji, Ji Ma, Runhan Zhang 他
日本語で読む → - 論文ソーシャルロボットHCI
感情ループを閉じる:マルチモーダルな話者・聞き手の感情ダイナミクスを考慮した共感型ソーシャルロボット
ユーザーの発話内容だけでなく、対話中の感情の動的な変化にも応答する共感型ロボットを提案。Misty IIロボットに実装し、話者と聞き手の感情状態を追跡して応答生成に活用するシステムを評価した。
原題: Closing the Affective Loop: Multimodal Speaker-Listener Emotion-Dynamics-Aware Empathetic Social Robots / Zi Haur Pang, Casey Kennington, Tatsuya Kawahara
日本語で読む → - 論文ヒューマノイド/VLA/強化学習ロボティクス
HAF: 階層的アクションフローとスペクトル潜在RLによる汎用VLAのヒューマノイド全身移動操作への適応
汎用VLA基盤モデルをヒューマノイドの全身移動操作に適応させるための2部構成フレームワークHAFを提案。階層的なアクション生成とオンラインRLによるポリシー改善を実現する。
原題: HAF: Adapting Generalist VLAs to Humanoid Whole-Body Loco-manipulation via Hierarchical Action Flow and Spectral Latent RL / Langzhe Gu, Chengkai Hou, Meng Li 他
日本語で読む → - 論文視点計画ロボティクス
円筒空洞のロボット点検のための観測制約付き関節空間視点最適化
円筒空洞の底部を観測するためのロボットカメラ視点を、可視性・運動学・衝突制約を満たしつつ関節空間で最適化する完全自律手法を提案した。
原題: Observation-Constrained Joint-Space Viewpoint Optimization for Robotic Inspection of Cylindrical Cavities / Yuezhong Wang, Rongshen Yin, Bichi Zhang 他
日本語で読む → - 論文セキュリティロボティクス
基盤モデル搭載身体化エージェントのセキュリティ:攻撃面、攻撃、防御、評価
基盤モデルを使う身体化エージェントのセキュリティを、信頼境界を中心に整理したサーベイ論文。システムを5層・12の攻撃面に分け、58件の攻撃と61件の防御を分析し、研究の偏りを明らかにした。
原題: Security of Foundation-Model-Powered Embodied Agents: Attack Surfaces, Attacks, Defenses, and Evaluation / Jiawei Liu, Jiacheng Guo, Tian Zhang 他
日本語で読む →