論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
TiPToP: 計画を行うモジュラーなオープン語彙ロボットマニピュレーションシステム
事前学習済み基盤モデルとGPU加速タスク・モーションプランナを組み合わせ、RGB画像と言語から直接ロボット操作を計画・実行するモジュラーシステムを提案。訓練データ不要でVLAを上回る成功率と速度を達成。
原題: TiPToP: A Modular Open-Vocabulary Robot Manipulation System That Plans / William Shen, Nishanth Kumar, Sahit Chintalapudi 他
日本語で読む → - 論文運動予測画像認識
クラス増分型運動予測
カメラ画像から新たな物体クラスが逐次追加される状況で将来軌道を予測する初のエンドツーエンド枠組みを提案し、既知クラスの性能を保ちつつ新規クラスに適応できることを示した。
原題: Class-Incremental Motion Forecasting / Nicolas Schischka, Nikhil Gosala, B Ravi Kiran 他
日本語で読む → - 論文状態推定ロボティクス
塩化行列を用いたハイブリッドシステムの経路積分粒子フィルタリング
接触を伴うハイブリッドシステムの状態推定を、塩化行列で不確実性伝播を扱う経路積分粒子フィルタで行う手法を提案した。
原題: Path Integral Particle Filtering for Hybrid Systems via Saltation Matrices / Karthik Shaji, Sreeranj Jayadevan, Bo Yuan 他
日本語で読む → - 論文VLAロボティクス
ニューラル暗黙アクションフィールド:視覚-言語-行動モデルのための離散ウェイポイントから連続関数へ
VLAモデルの行動表現を離散ウェイポイントから連続時間の行動関数へ再定式化し、任意の時間分解能で滑らかな制御を可能にした手法を提案。
原題: Neural Implicit Action Fields: From Discrete Waypoints to Continuous Functions for Vision-Language-Action Models / Haoyun Liu, Jianzhuang Zhao, Xinyuan Chang 他
日本語で読む → - 論文手術AI画像認識
手術ビデオからの時間的マッピングを実現する視覚言語モデルとプラットフォーム
手術ビデオから外科医の行動を時間的にマッピングする視覚言語モデル「Halsted」と、外科医が自身の手術を自動マッピングできるウェブプラットフォームを開発した。
原題: A vision-language model and platform for temporally mapping surgery from video / Dani Kiyasseh
日本語で読む → - 論文探査/USVロボティクス
無人水上艇による自律探査のための可変解像度仮想地図
無人水上艇の自律探査において、GNSS劣化や計算資源の制約に対応するため、適応的四分木を用いた可変解像度の仮想地図を提案し、地図不確実性の表現と探査計画の効率を向上させた。
原題: Variable-Resolution Virtual Maps for Autonomous Exploration with Unmanned Surface Vehicles (USVs) / Ye Li, Yewei Huang, Wenlong GaoZhang 他
日本語で読む → - 論文HDマップ構築ロボティクス
MapGCLR: オンラインベクターHDマップ構築のための地理空間的コントラスト学習
重複するBEV特徴グリッド間の地理空間的一貫性をコントラスト損失で強制し、半教師あり学習によりオンラインHDマップ構築の性能を向上させた研究。
原題: MapGCLR: Geospatial Contrastive Learning of Representations for Online Vectorized HD Map Construction / Jonas Merkert, Alexander Blumberg, Jan-Hendrik Pauls 他
日本語で読む → - 論文自律ナビゲーションロボティクス
TinyNav:マイコン上でリアルタイム自律ナビゲーションを実現するエンドツーエンドTinyML
ESP32マイコン上で動作する23kパラメータの量子化2D CNNを用い、深度データから操舵・スロットル指令を予測するリアルタイム自律ナビゲーションシステムを実現した。
原題: TinyNav: End-to-End TinyML for Real-Time Autonomous Navigation on Microcontrollers / Pooria Roy, Nourhan Jadallah. Tomer Lapid, Shahzaib Ahmad 他
日本語で読む → - 論文VLAロボティクス
FASTER: リアルタイムフローVLAの再考
フロー型VLAの反応遅延を分析し、Horizon-Aware Scheduleで直近動作のデノイズを1ステップに短縮してリアルタイム応答性を大幅に改善した手法を提案。
原題: FASTER: Rethinking Real-Time Flow VLAs / Yuxiang Lu, Zhe Liu, Xianzhe Fan 他
日本語で読む → - 論文歩行ロボティクス
強化学習への古典的バランス制御原理の埋め込みによる人型ロボットの回復動作
強化学習にキャプチャポイントや重心状態などの古典的バランス指標を報酬設計に組み込み、単一ポリシーで外乱回復から立ち上がりまでを実現する手法を提案した。
原題: Embedding Classical Balance Control Principles in Reinforcement Learning for Humanoid Recovery / Nehar Poddar, Stephen McCrory, Luigi Penco 他
日本語で読む → - 論文制御理論math.OC
ギブス変分原理によるセンサベース制御の基本原理限界
部分観測下のフィードバック制御における最小期待コストの下界を、ギブス変分原理を用いて導出し、自己無撞着な改良により厳密な数値限界を計算する手法を提案した。
原題: Fundamental Limits for Sensor-Based Control via the Gibbs Variational Principle / Vincent Pacelli, Evangelos A. Theodorou
日本語で読む → - 論文ロボット学習/VLA画像認識
S-VAM: 幾何学的・意味的先読みの自己蒸留によるショートカット動画行動モデル
動画行動モデル(VAM)の推論速度と先読み精度のトレードオフを解決するため、単一パスで幾何・意味表現を予測するショートカットモデルS-VAMを提案。多段階拡散の生成事前知識を一段階推論に凝縮する自己蒸留戦略を導入し、シミュレーションと実世界で高性能を実証した。
原題: S-VAM: Shortcut Video-Action Model by Self-Distilling Geometric and Semantic Foresight / Haodong Yan, Zhide Zhong, Jiaguan Zhu 他
日本語で読む → - 論文ナビゲーションロボティクス
NavThinker: 社会的ナビゲーションにおける結合予測と計画のための行動条件付きワールドモデル
ロボットの行動に応じて将来のシーンと歩行者動態を予測する行動条件付きワールドモデルを強化学習と組み合わせ、社会的ナビゲーションの性能を向上させた。
原題: NavThinker: Action-Conditioned World Models for Coupled Prediction and Planning in Social Navigation / Tianshuai Hu, Zeying Gong, Lingdong Kong 他
日本語で読む → - 論文3D知覚/ラベルノイズ画像認識
信頼できないボクセルを信頼できるか?ラベルノイズ下での3Dセマンティック占有予測の探求
3D占有予測におけるラベルノイズ問題を体系的に調査する初のベンチマークOccNLを構築し、時間的記憶と構造的親和性を活用したノイズ耐性フレームワークDPR-Occを提案した。
原題: Can we Trust Unreliable Voxels? Exploring 3D Semantic Occupancy Prediction under Label Noise / Wenxin Li, Kunyu Peng, Di Wen 他
日本語で読む → - 論文シーン理解ロボティクス
OGScene3D: シーン理解のための漸進的オープンボキャブラリ3Dガウシアンシーングラフマッピング
ロボットが環境を漸進的に探索しながら、オープンボキャブラリの3Dセマンティックマップとシーングラフを構築するシステムを提案した。
原題: OGScene3D: Incremental Open-Vocabulary 3D Gaussian Scene Graph Mapping for Scene Understanding / Siting Zhu, Ziyun Lu, Guangming Wang 他
日本語で読む → - 論文群制御math.OC
解析的KKT縮約と収縮型MPCによる計算効率の高い密度駆動最適制御
マルチエージェント群を目標の空間分布へ効率的に誘導する密度駆動最適制御(D2OC)を、予測ホライズンに対して線形スケールする解析的縮約と収縮型リアプノフ制約で高速化・安定化した。
原題: Computationally Efficient Density-Driven Optimal Control via Analytical KKT Reduction and Contractive MPC / Julian Martinez, Kooktae Lee
日本語で読む → - 論文歩行ロボティクス
効率的で多用途な四足スケーティング:強化学習とベイズ最適化による最適な共同設計
受動車輪を備えた四足ロボットのスケーティング動作を、ハードウェア設計と制御を共同で最適化する手法を提案。ベイズ最適化で設計を探索し、強化学習で制御ポリシーを訓練し、ホッケーストップや自己整列などの多様な動作を実現した。
原題: Efficient and Versatile Quadrupedal Skating: Optimal Co-design via Reinforcement Learning and Bayesian Optimization / Hanwen Wang, Zhenlong Fang, Josiah Hanna 他
日本語で読む → - 論文ナビゲーションロボティクス
安全なロボットナビゲーションのためのハードウェア高速化ベイズ推論による高速な信頼度考慮型人間予測
GPUで並列化したベイズ推論により、人間の将来軌道を粒子として高周波(125Hz)で予測し、複数人環境での安全なロボットナビゲーションを実現した。
原題: Fast Confidence-Aware Human Prediction via Hardware-accelerated Bayesian Inference for Safe Robot Navigation / Michael Lu, Minh Bui, Xubo Lyu 他
日本語で読む → - 論文ソフトロボティクス/制御ロボティクス
視覚学習による潜在表現を用いたソフト連続体ロボットの高精度オープンループ制御
ソフト連続体ロボットのオープンループ制御を、ビデオから学習した潜在力学モデルを用いて実現し、カメラフィードバックなしで画像指定のウェイポイント追跡を可能にした。
原題: Accurate Open-Loop Control of a Soft Continuum Robot Through Visually Learned Latent Representations / Henrik Krauss, Johann Licher, Naoya Takeishi 他
日本語で読む → - 論文安全制御/部分観測ロボティクス
部分観測下の安全臨界制御:到達回避POMDPと信念空間制御の融合
信念空間で目標到達・情報収集・安全を分離する階層型制御アーキテクチャを提案し、リアルタイムな二次計画法で解くことで、非ガウス信念でも安全とタスク成功率を向上させた。
原題: Safety-critical Control Under Partial Observability: Reach-Avoid POMDP meets Belief Space Control / Matti Vahs, Joris Verhagen, Jana Tumova
日本語で読む → - 論文歩行ロボティクス
リプシッツ制約付きポリシーによるヒューマノイドのタスク指定コンプライアンス境界
ヒューマノイドの強化学習において、タスク空間の剛性上限をポリシーのヤコビアンに対する状態依存のリプシッツ制約としてマッピングする異方性リプシッツ制約付きポリシー(ALCP)を提案し、歩行安定性と衝撃耐性を向上させた。
原題: Task-Specified Compliance Bounds for Humanoids via Lipschitz-Constrained Policies / Zewen He, Yoshihiko Nakamura
日本語で読む → - 論文最適制御math.OC
数値最適制御における構造的グローバル探索のための特徴化占有測度
数値最適制御とHJB部分解を有限次元の主双対インターフェースで結合する特徴化占有測度(FOM)を提案し、次元の呪縛を状態空間から相互結合トポロジーへ移す枠組みを示した。
原題: Featurized Occupation Measures for Structured Global Search in Numerical Optimal Control / Qi Wei, Jianfeng Tao, Haoyang Tan 他
日本語で読む → - 論文sim2realロボティクス
Sim2Sea: 混雑水域における船舶航行のためのシミュレーションから実世界へのポリシー転移
混雑した海域での自律航行を実現するため、GPU並列シミュレータと速度障害物ガイド付き行動マスキングを備えたポリシーを開発し、シミュレーションのみで訓練したポリシーを実船にゼロショット転移させた。
原題: Sim2Sea: Sim-to-Real Policy Transfer for Maritime Vessel Navigation in Congested Waters / Xinyu Cui, Xuanfa Jin, Xue Yan 他
日本語で読む → - 論文強化学習/遊泳ロボットロボティクス
拘束下での遊泳:四足生物模倣推進のための安全強化学習フレームワーク
四足ロボットの遊泳を、推力を最大化しつつ不安定化力を最小化する制約付き最適化問題として定式化し、PID調整ラグランジュ乗数を用いた安全強化学習手法ACPPO-PIDを提案。模倣学習と実機曳航試験で初期化・調整し、自由遊泳への転移を実証した。
原題: Swimming Under Constraints: A Safe Reinforcement Learning Framework for Quadrupedal Bio-Inspired Propulsion / Xinyu Cui, Fei Han, Hang Xu 他
日本語で読む → - 論文手術ロボットロボティクス
ArthroCut: 人工膝関節置換術におけるロボット骨切除のための自律方策学習
膝関節形成術ロボットを支援的実行から文脈認識型の動作生成へと向上させる、自律方策学習フレームワークArthroCutを提案する。術前CT/MRと術中RGB-D映像・ロボット状態を統合したマルチモーダルデータセットで視覚言語モデルを微調整し、安全制約付きデコードで解釈可能な動作文法を生成する。ベンチ実験で86%の成功率を達成した。
原題: ArthroCut: Autonomous Policy Learning for Robotic Bone Resection in Knee Arthroplasty / Xu Lu, Yiling Zhang, Wenquan Cheng 他
日本語で読む → - 論文自律エージェントロボティクス
PEPA: 個性を持つ持続的自律型身体性エージェント
性格特性を内在的な目標生成の原理として用い、三層認知アーキテクチャにより四足歩行ロボットが外部指示なしに自律的に目標を生成・実行するフレームワークを提案。
原題: PEPA: a Persistently Autonomous Embodied Agent with Personalities / Kaige Liu, Yang Li, Lijun Zhu 他
日本語で読む → - 論文VLA画像認識
TagaVLM: 視覚言語ナビゲーションのためのトポロジー認識型グローバル行動推論
VLMの自己注意機構に空間トポロジー構造を直接注入し、グローバルな行動推論を可能にすることで、視覚言語ナビゲーションの性能を向上させたフレームワーク。
原題: TagaVLM: Topology-Aware Global Action Reasoning for Vision-Language Navigation / Jiaxing Liu, Zexi Zhang, Xiaoyan Li 他
日本語で読む → - 論文経路計画ロボティクス
緩和連続性を伴う分枝価格法による移動目標車両経路問題の最適解
移動する目標を複数エージェントで迎撃する経路問題に対し、移動目標に特化した優越基準を用いた厳密解法を提案し、従来法より大幅に高速に最適解を求めた。
原題: Optimal Solutions for the Moving Target Vehicle Routing Problem via Branch-and-Price with Relaxed Continuity / Anoop Bhat, Geordan Gutow, Zhongqiang Ren 他
日本語で読む → - 論文群制御ロボティクス
特徴のない環境におけるロバストな協調自己位置推定:DCL、StCL、CCL、CI、標準CLの比較研究
GPSの使えない環境で複数ロボットが協調して位置推定する5手法をROS上で実装し、モンテカルロシミュレーションで精度と一貫性のトレードオフを比較評価した。
原題: Robust Cooperative Localization in Featureless Environments: A Comparative Study of DCL, StCL, CCL, CI, and Standard-CL / Nivand Khosravi, Rodrigo Ventura, Meysam Basiri
日本語で読む → - 論文経路計画ロボティクス
LLMはロボット経路計画の最適性を証明できるか?研究レベルのアルゴリズム検証ベンチマーク
ロボット経路計画アルゴリズムの近似比証明をLLMに評価させる初のベンチマークを構築し、最新モデルでも完全な証明は困難だが、タスク固有の補題を与えると推論品質が大きく向上することを示した。
原題: Can LLMs Prove Robotic Path Planning Optimality? A Benchmark for Research-Level Algorithm Verification / Zhengbang Yang, Md. Tasin Tazwar, Minghan Wei 他
日本語で読む →