論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
G0.5: ロボットの推論と行動のための単一自己回帰ストリーム
単一のトランスフォーマーデコーダが推論トークンと行動トークンを同一の目的で生成する、事前学習済み自己回帰VLAモデルG0.5を提案。異なるロボットの行動を共有語彙に変換するトークナイザーや、チェーン・オブ・ソート、視覚メモリを導入し、複数のベンチマークでSOTAを達成。
原題: G0.5: One Autoregressive Stream for Robot Reasoning and Action / Yicheng Liu, Zibin Dong, Baijun Ye 他
日本語で読む → - 論文マニピュレーションロボティクス
GORDON: グラフベースのオブジェクト中心報酬による長期的操作タスクの分解
ビデオデモからオブジェクト中心のグラフ表現を学習し、密な報酬を生成することで、長期的な操作タスクを自動的にサブタスクに分解して学習する手法を提案した。
原題: GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation / Andrea Protopapa, Davide Buoso, Francesca Pistilli 他
日本語で読む → - 論文群制御ロボティクス
局所通信によるスケーラブルなマルチエージェント迷路探索
未知の迷路状環境を複数エージェントが局所通信のみで協調して探索・到達する分散アルゴリズムを提案し、完全性と最適性を理論的に保証した。
原題: Scalable Multi-Agent Maze Traversal with Local Communication / Julian Rau, Jahir Argote-Gerald, Grace McFassel 他
日本語で読む → - 論文動作計画ロボティクス
RIT*: コスト適応型最適動作計画のためのリーマン情報木
ユークリッド距離の代わりにリーマン距離を用いた情報探索木を構築し、衝突フィードバックから障害物近接コスト場を学習する手法を提案。高次元・異方性環境で既存手法より低コストな経路を生成する。
原題: RIT*: Riemannian Informed Trees for Cost-Adaptive Optimal Motion Planning / Muhayy Ud Din, Ahmed Nadar, Jan Rosell 他
日本語で読む → - 論文オフロード移動ロボティクス
VertiAKD: 垂直に困難な地形における適応型オフロード運動力学
異なる車両と未知の地形に対して、限られたデータから運動力学モデルを転移・適応させる統一フレームワークを提案し、予測誤差を大幅に削減した。
原題: VertiAKD: Adaptive Off-Road Kinodynamics on Vertically Challenging Terrain / Tong Xu, Chenhui Pan, Francesco Cancelliere 他
日本語で読む → - 論文安全制御制御
入力制約付き劣駆動線形システムのためのロバスト安全フィルタリング
未知外乱下の入力制約付き劣駆動線形システムに対し、外乱オブザーバとロバスト高次制御バリア関数を用いて安全フィルタリングを行う手法を提案し、二輪倒立ロボットのシミュレーションで有効性を示した。
原題: Robust Safety Filtering for Input-Constrained Underactuated Linear Systems / Muhamad Rausyan Fikri
日本語で読む → - 論文ナビゲーションロボティクス
AECNav: 効率的なゼロショットオープンボキャブラリ物体ナビゲーションのための能動的証拠統合
ゼロショット物体ナビゲーションを証拠駆動の認識から意思決定への問題として再構成し、共有エンコーディングとクラスタレベルの信念統合、情報利得に基づく能動的探索により、高精度かつ低遅延なナビゲーションを実現した。
原題: AECNav: Active Evidence Consolidation for Efficient Zero-Shot Open-Vocabulary Object Navigation / Guanlin Liu, Shaobin Ling, Renyuan Liu 他
日本語で読む → - 論文遠隔操作ロボティクス
Teleopit: 全身ヒューマノイド遠隔操作システム
VR信号から全身・手・頭部の動作をヒューマノイドにマッピングする遠隔操作システムを提案し、実機でのデモ収集とポリシー学習で高い成功率を達成した。
原題: Teleopit: A Full-Embodiment Humanoid Teleoperation System / Bingqian Wu, Zicheng Xu, Xianghui Fan 他
日本語で読む → - 論文VLAロボティクス
SG-WAM: テキスト接地と空間認識を備えた意味的ガイダンスによるワールドアクションモデル
ロボット操作のためのワールドアクションモデルに、VLMを意味プランナーとして用いてテキスト指示に基づく意味的先見を注入し、将来ビデオ生成と行動予測の指示追従精度を向上させる手法を提案した。
原題: SG-WAM: Text-Grounded and Spatial-aware Semantic Guidance for World-Action Models / Junjie He, Junfeng Li, Zhide Zhong 他
日本語で読む → - 論文ナビゲーションロボティクス
PathCover: 点群に対するランダム反復空間分割による経路に沿った高速凸分解
点群データから直接、障害物のない凸ポリトープ列を高速に生成する新しいフレームワークを提案し、実時間での移動ロボットの軌道計画を可能にした。
原題: PathCover: A Fast Convex Decomposition along a Path via Randomized Iterative Space Partitioning (RISP) on Point Clouds / Kunal S. Narkhede, Abhijeet M. Kulkarni, Guoquan Huang 他
日本語で読む → - 論文計画・検証ロボティクス
スイッチングポリシーによるMDP上の制約付きsc-LTL計画の最適化
マルコフ決定過程上で、安全性制約を満たしつつ目的を最大化する最適ポリシーを合成する問題を扱い、スイッチングポリシーが最適解となることを示し、線形計画法で解けるようにした。
原題: Optimal Constrained sc-LTL Planning in MDPs via Switching Policies / Zetong Xuan, Yu Wang
日本語で読む → - 論文シミュレーション評価ロボティクス
WorldSimProbe: 身体的操作のための行動条件付きワールドモデルにおけるシミュレータ忠実度の診断
行動条件付きワールドモデル(ACWM)が物理シミュレータとして忠実に機能するかを検証するための評価手法「WorldSimProbe」を提案し、複数のベンチマークで既存モデルの欠陥を明らかにした。
原題: WorldSimProbe: Diagnosing Simulator Faithfulness in Action-Conditioned World Models for Embodied Manipulation / Peterson Co, Sicheng Hu, Chunxuan Jiao 他
日本語で読む → - 論文オドメトリ推定ロボティクス
TRACE: 不確実な接触条件下での脚式ロボットのための学習型固有受容オドメトリ
脚式ロボットのためのエンドツーエンドの学習型オドメトリ推定器を提案し、接触状態が不確実な状況でも頑健に動作するよう、足認識クロスアテンションと物理に基づく補助損失を導入した。
原題: TRACE: Learned Proprioceptive Odometry for Legged Robots under Unreliable Contact Conditions / Taehyeon Kong, Woojin Kim, Jemin Hwangbo
日本語で読む → - 論文歩行ロボティクス
自己衝突回避を考慮した狭所移動ヒューマノイドの全身動作計画
狭い環境でのヒューマノイド移動のため、到達可能な剛体ボリューム上で経路計画を行い、衝突回避を統合した3段階の全身計画フレームワークを提案。生成した計画を残差強化学習で追従し、Unitree G1で検証した。
原題: Whole-Body Planning for Humanoids Navigating Confined Spaces via Self-Collision Avoidance References / Carlos Gonzalez, Luis Sentis
日本語で読む → - 論文モデル予測制御math.OC
並列シナリオツリーMPCのためのレーキ・コンプレスRiccati再帰
シナリオツリー型モデル予測制御の求解を、レーキ・コンプレス法による木縮約で並列化し、O(log N)のスパンで正確に解く新しいアルゴリズムを提案した。
原題: Rake-Compress Riccati Recursions for Parallel Scenario-Tree Model Predictive Control / João Sousa-Pinto
日本語で読む → - 論文マニピュレーションロボティクス
自動生成デモからの自己教師あり学習による視覚ロボット操作
ロボットが目標姿勢周辺で自動生成したデモデータを用いて、手首カメラ画像から相対的な位置補正を学習する自己教師あり手法を提案。シミュレーションと実機で評価し、物体把持成功率を報告している。
原題: Self Supervised Learning from Automatically Generated Demonstrations for Visual Robotic Manipulation / Andres Rivas, Anselmo R. Cukla, Rodrigo S. Guerra 他
日本語で読む → - 論文群制御cs.MA
段階的更新による大規模長期計画:生涯MAPFのためのスケーラブルな手法
生涯マルチエージェント経路探索(LMAPF)において、数千エージェントを1秒未満で調整しつつ、複数ステップ先を見据えた計画を可能にする新しいプランナーPUSHを提案した。PIBT、RHCR、TPの利点を組み合わせ、一般のマップでスケーラブルな長期計画を実現する。
原題: Scalable Long-Horizon Planning with Staggered Updates for Lifelong MAPF / Vaibhav Sanjay, Jiaoyang Li
日本語で読む → - 論文状態推定ロボティクス
状態推定器が迷走したとき:スペクトル解析による推定器故障の検出
速度推定値の周波数領域パワー分布を解析することで、状態推定器の故障をセンサ非依存で検出する手法を提案。実飛行データで3種類のオドメトリの故障を51-58%の検出率で捉えた。
原題: When Your State Estimator Has Lost The Plot: Detecting Estimator Failures Via Spectral Analysis / Christian Lanegger, Helen Oleynikova, Roland Siegwart 他
日本語で読む → - 論文VLAロボティクス
視覚言語行動モデルは自己受容状態をどう使うべきか
VLAモデルにおけるロボットの自己受容状態の入力方法(テキスト、プレフィックス、直接入力など)と履歴長が性能に与える影響を、制御実験で体系的に比較し、設計原則を導出した論文。
原題: How Should Vision-Language-Action Models Use Proprioceptive State? / Yiren Zhao, Ziyang Chen, Ziyang Rao 他
日本語で読む → - 論文ナビゲーションロボティクス
SAIN: 能動的対話による構造認識型インタラクティブナビゲーション
曖昧な指示に対して能動的質問で解消する移動ロボットのナビゲーション手法を提案。対話の回答を永続的な空間・物体記憶に変換し、ゼロショットで目標探索を実現。
原題: SAIN: Structure-Aware Interactive Navigation with Active Dialogue Grounding for Mobile Robot / Yuhao Cao, Xiao Liu, Yang Xie 他
日本語で読む → - 論文群制御cs.CR
UAV群に対する剛体コバートGNSSスプーフィング:構造的盲点、その検出限界、および絶対アンカー防御
UAV群の相対幾何学に基づくGNSSスプーフィング検出には、共通の並進移動(剛体シフト)が検出不能となる構造的盲点があることを示し、外部アンカーを用いた検出限界の理論式と位置復元手法を提案した。
原題: Rigid-Covert GNSS Spoofing of UAV Swarms: A Structural Blind Spot, Its Detection Limit, and Absolute-Anchor Defenses / Minseok Park, Joon Soo Yoo
日本語で読む → - 論文群制御ロボティクス
強化学習によるタスク指向のフォーメーション決定:攻撃群の追い込み
複数ロボットが攻撃群を追い込むタスクにおいて、フォーメーション形状を低次元パラメータで表現し、強化学習でそのパラメータを最適化することで、機動性の不利を補いながら未知の攻撃戦略に対応する手法を提案した。
原題: Task-Oriented Formation Decision via Reinforcement Learning: Herding an Attacking Swarm / Zhaozong Wang, Guibin Sun, Jinyong Chen 他
日本語で読む → - 論文ドローンロボティクス
環境アンカリングによる安定接触作業のためのグリッパ付きティルトローターUAV
環境にアンカリングして安定した作業プラットフォームに変身する、グリッパ付きティルトローターUAVを提案・試作し、実機飛行試験で位置ドリフトを95%以上削減できることを実証した。
原題: A Tilt-Rotor UAV with a Gripper for Stable Contact-Based Tasks via Environmental Anchoring / Joshua Taylor, Nursultan Imanberdiyev, Wei-Yun Yau 他
日本語で読む → - 論文全身操作ロボティクス
RoboReact: 生成された自己中心視点動画からのエージェント的スキル蒸留による全身操作の汎用化
単一の自己中心視点RGB-D観察から全身ヒューマノイド操作スキルを自動合成するフレームワークを提案。生成動画から幾何学を保つキーフレームを抽出し、物体中心の再接地とVLMによる洗練ループで実機実行のギャップを埋める。
原題: RoboReact: Agentic Skill Distillation from Generated Egocentric Videos for Generalizable Whole-Body Manipulation / Shuliang He, Shuai Wang, Bo Yue 他
日本語で読む → - 論文空中ロボット/音響知覚ロボティクス
身体化された受動空力音響知覚による空中ロボット間の相対センシングと追跡
飛行音を利用して、GPSや通信を使わずにドローンが他のドローンを追跡する受動的な音響知覚フレームワーク「SonicFly」を提案し、屋外実験で有効性を実証した。
原題: Embodied Passive Aeroacoustic Perception Enables Relative Sensing and Pursuit Between Aerial Robots / Yanbaihui Liu, Ravi Prakash, Li-Yu Lo 他
日本語で読む → - 論文物体検出ロボティクス
自動車レーダーにおけるマイクロドップラー特徴を用いた衝突前物体検出のためのアンカーベースAIアプローチ
自動車レーダーの高解像度データとマイクロドップラー特徴を活用し、アンカーベースのAIモデルで衝突前の物体検出精度を向上させる手法を提案した。
原題: Anchor-Based AI Approach for Pre-Crash Object Detection Utilizing Micro-Doppler Signatures in Automotive Radar / Patrick Zaumseil, Rainer Engert, Dagmar Steinhauser 他
日本語で読む → - 論文ロボットポリシー評価ロボティクス
XPolicyLab: ロボットポリシー評価と展開のための統一標準・オープンエコシステム
ロボットポリシーの評価と展開を統一する標準規格とオープンエコシステムを提案し、N個のポリシーとM個の環境の接続コストをO(NM)からO(N+M)に削減した。
原題: XPolicyLab: A Unified Standard and Open Ecosystem for Robot Policy Evaluation and Deployment / XPolicyLab Community, Tianxing Chen, Yue Chen 他
日本語で読む → - 論文ナビゲーションロボティクス
CrossTracer: VLAモデルの推論とトレース残差適応によるクロスエンボディメントナビゲーション
ロボットの種類に応じた移動制約を考慮したナビゲーション経路を生成するため、VLAモデルと適応的残差補正を組み合わせた階層的フレームワークを提案した。
原題: CrossTracer: Cross-Embodiment Navigation via VLA Model Reasoning and Trace Residuals Adapting / Yao Wang, Siyuan Wang, Zhirui Sun 他
日本語で読む → - 論文ナビゲーションAI
CoNav-UAV: スタッケルベルグ学習による協調的二重高度空中ナビゲーション
高高度と低高度の2台のUAVをスタッケルベルグゲームとして協調させ、視覚と言語のみで目標探索と接近を行う空中ナビゲーション手法を提案した。
原題: CoNav-UAV: Cooperative Dual-Altitude Aerial Navigation via Stackelberg Learning / Junru Song, Wenhao Zhang, Yang Yang 他
日本語で読む → - 論文VLA/世界モデルロボティクス
JEPA-WAM: 共同埋め込み世界モデリングによる視覚-言語-行動ポリシーの学習
事前学習済みV-JEPA空間に基づく潜在世界モデルを構築し、遷移予測と行動生成を共有予測器で結合することで、効率的かつ高精度なロボット制御を実現した。
原題: JEPA-WAM: Learning Vision-Language-Action Policies with Joint-Embedding World Modeling / Yihan Lin, Jiawei He, Shifeng Bao 他
日本語で読む →