論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文自動運転画像認識
CLAP: 対比学習による潜在空間プロンプト最適化を用いたエンドツーエンド自動運転
凍結したVLAモデルに、道路ブロックごとのソフトプロンプトをクラウドソーシングデータから最適化し、V2X通信で取得することで、長尾の困難なシナリオでの性能を向上させる適応フレームワークを提案。
原題: CLAP: Contrastive Latent-space Prompt Optimization for End-to-end Autonomous Driving / Ruiyang Zhu, Yuehan He, Boyuan Zheng 他
日本語で読む → - 論文スケジューリングロボティクス
RED: 環境変動下でのロボット推論のための適応型リアルタイムDAGスケジューリング
動的環境で変化するタスク構造に適応しつつ、リアルタイム制約を保証するロボット向けDAGスケジューリングフレームワークREDを提案した。
原題: RED: Adaptive Real-Time DAG Scheduling for Robotic Inference under Environmental Dynamics / Zexin Li, Tao Ren, Johnathan Liu 他
日本語で読む → - 論文自動運転ロボティクス
自己対戦とスケールを超えて:自動運転の汎化のための行動ベンチマーク
大規模強化学習で訓練された自動運転ポリシーを標準ベンチマークで評価するための包括的なテストスイート「BehaviorBench」を提案する。
原題: Beyond Self-Play and Scale: A Behavior Benchmark for Generalization in Autonomous Driving / Aron Distelzweig, Faris Janjoš, Andreas Look 他
日本語で読む → - 論文自動運転シミュレーションcs.MA
SceneFactory: GPU高速化による物理ベース車両ダイナミクスを備えたマルチエージェント運転シミュレータ
NVIDIA Isaac Sim/Isaac Lab上に、GPUベクトル化された物理ベースのマルチエージェント運転シミュレータを構築し、Waymoデータセットの道路をUSD世界に変換して多数のシナリオを並列実行、物理精度とスループットの両立を実現した。
原題: SceneFactory: GPU-Accelerated Multi-Agent Driving Simulation with Physics-Based Vehicle Dynamics / Yicheng Zhu, Yang Chen, Tao Li 他
日本語で読む → - 論文VLA/マイクロロボット/両腕操作ロボティクス
Mag-VLA: 両腕磁気駆動マイクロロボット操作のための視覚言語行動モデル
磁気駆動マイクロロボットを両腕ロボットで操作するための視覚言語行動モデルを提案し、位相認識とアクションチャンキングにより高精度な操作を実現した。
原題: Mag-VLA: Vision-Language-Action Model for Bimanual Magnetically Actuated Microrobot Manipulation / Yongchen Wang, Kangyi Lu, Lan Wei 他
日本語で読む → - 論文自動運転/説明可能AIロボティクス
信頼性と説明可能性を備えたAI知覚モデルへ:概念からプロトタイプ車両への展開
自動運転の3D知覚モデルに、説明可能性・不確実性推定・ロバスト性を統合し、実車両でリアルタイムに可視化するシステムを構築した論文。
原題: Towards Trustworthy and Explainable AI for Perception Models: From Concept to Prototype Vehicle Deployment / Till Beemelmanns, Shayan Sharifi, Manas Mehrotra 他
日本語で読む → - 論文触覚ロボティクス
TacO: 物体操作のための触覚センサのベンチマーク
物体操作における4種類の触覚センサ(視覚、音響、磁気、抵抗)の性能を、3つの操作タスクで系統的に評価し、タスクに適したセンサ選択の枠組みを提案した論文。
原題: TacO: Benchmarking Tactile Sensors for Object Manipulation / Anya Zorin, Zilin Si, Myungsun Park 他
日本語で読む → - 論文3D再構成画像認識
IVGT: 暗黙的視覚幾何トランスフォーマーによるニューラルシーン表現
カメラポーズが未知の多視点画像から、連続的で一貫した3D幾何と外観を暗黙的にモデル化する手法を提案。SDFと色を予測する軽量デコーダを用いて、任意の3D位置での空間クエリを可能にし、メッシュ再構成や新規視点合成など多様なタスクで高い性能を示した。
原題: IVGT: Implicit Visual Geometry Transformer for Neural Scene Representation / Yuqi Wu, Tianyu Hu, Wenzhao Zheng 他
日本語で読む → - 論文自動運転マップ生成ロボティクス
ジオデータ駆動型HDマップ生成ワークフロー:参照不要の制約ベース検証を統合した手法
オープンな地理データから車線レベルのHDマップを生成し、外部参照地図なしで制約ベース検証を組み込むワークフローを提案・評価した論文。
原題: Geo-Data-Driven HD Map Generation Workflow with Integrated Reference-Free Constraint-Based Verification / Ruidi He, Vaibhav Tiwari, Mohanad Al-Ghobari 他
日本語で読む → - 論文強化学習/転移学習ロボティクス
カスタムカーレース環境のための転移学習
深層強化学習において、あるサーキットで訓練したエージェントを別のカスタム環境に転移させ、ゼロショット転移や微調整で速いラップタイムを達成する手法を探求した。モデルベース手法がモデルフリー手法より性能と収束速度で優れることを示した。
原題: Transfer Learning for Customized Car Racing Environments / Benedict Florance Arockiaraj, Richard Chang, Wesley Yee
日本語で読む → - 論文ナビゲーションロボティクス
即時リセットは本当に必要か?衝突処理を見直して効率的なロボットナビゲーションを実現
衝突時に毎回環境をリセットする従来の強化学習手法を改め、同一エピソード内で再試行を許す「Multi-Collision reset Budget」を提案し、学習効率と実機性能を向上させた。
原題: Do We Really Need Immediate Resets? Rethinking Collision Handling for Efficient Robot Navigation / Shanze Wang, Xinming Zhang, Siwei Cheng 他
日本語で読む → - 論文世界モデルロボティクス
Driver-WM: 運転者中心の交通条件付き潜在世界モデルによる車内ダイナミクスの展開
車外の交通状況に基づいて車内の運転者状態を予測する潜在世界モデルを提案し、運転者の行動・感情認識と物理的運動予測を統合した。
原題: Driver-WM: A Driver-Centric Traffic-Conditioned Latent World Model for In-Cabin Dynamics Rollout / Haozhuang Chi, Daosheng Qiu, Hao Su 他
日本語で読む → - 論文歩行ロボティクス
コンプライアント足部を備えた4脚ロボットのエネルギー効率的な歩行
4脚ロボットの足にバネなどの柔軟性を持たせ、強化学習で歩行制御を学習させたところ、適度な硬さのバネがエネルギー消費を約17%削減できることをシミュレーションと実機で示した論文。
原題: Energy-Efficient Quadruped Locomotion with Compliant Feet / Pramod Pal, Shishir Kolathaya, Ashitava Ghosal
日本語で読む → - 論文タスク計画ロボティクス
二重LLMモジュールによる階層的プロンプティングを用いたロボットのタスク・動作計画
自然言語指示からロボットのタスクと動作を計画するため、高レベル計画と低レベル空間推論の2つのLLMモジュールを階層的に用いるフレームワークを提案し、24シナリオで86%の成功率を達成した。
原題: Hierarchical Prompting with Dual LLM Modules for Robotic Task and Motion Planning / Karolina Źróbek, Tessa Pulli, Paweł Gajewski 他
日本語で読む → - 論文マニピュレーションロボティクス
RoboHitch: 乱れたキーポイントからの視覚的アフォーダンス学習によるヒッチ結び
ロボットによる紐結びを、順序付けられていない3DキーポイントとRGB画像から学習するフレームワークを提案。明示的なトポロジー順序を不要とし、自己遮蔽下でも結びを成功させる。
原題: RoboHitch: Learning Visual Affordance from Disordered Keypoints for Hitch Knots Tying / Jiahui Zuo, Boyang Zhang, Fumin Zhang
日本語で読む → - 論文姿勢制御制御
チャンドラヤーン3号月着陸ミッションにおけるクォータニオンを用いた推力軸姿勢制御の分離手法
チャンドラヤーン3号の月面軟着陸において、クォータニオンに基づく姿勢制御の軸間結合を分離し、推力軸を独立に制御する新しい手法を提案した論文。
原題: Decoupled Thrust-Axis Attitude Control Using Quaternions for Chandrayaan-3 Lunar Landing Mission / Aditya Rallapalli, Suraj Kumar, Rijesh M P 他
日本語で読む → - 論文模倣学習ロボティクス
MARSポリシー:必要な時だけマルチモーダルに
ロボット操作の模倣学習において、タスクの全フェーズで多様性が必要とは限らないことに着目し、必要な時だけ確率的生成を適応的に行い、単一モードのフェーズでは決定的学習に切り替えるMARSポリシーを提案した。シミュレーションと実機で成功率向上と推論遅延削減を実証した。
原題: MARS Policy: Multimodality Only When It Matters / Jindou Jia, Tuo An, Yuxuan Hu 他
日本語で読む → - 論文シミュレーションロボティクス
GE-Sim 2.0: ロボット操作のための包括的クローズドループ映像世界シミュレータへのロードマップ
ロボット操作のためのクローズドループ映像世界シミュレータGE-Sim 2.0を提案。実ロボットデータで再学習し、状態デコーダ、世界判定器、高速化モジュールを追加して、映像シミュレーションからポリシー学習へのループを閉じる。
原題: GE-Sim 2.0: A Roadmap Towards Comprehensive Closed-loop Video World Simulators for Robotic Manipulation / Boxiang Qiu, Liliang Chen, Yue Liao 他
日本語で読む → - 論文経路計画ロボティクス
ロボットナビゲーションのための古典的およびニューラルサンプリングアルゴリズムの性能比較
RRT*、Neural RRT*、Neural Informed RRT*の3つのアルゴリズムを凸・凹障害物環境で比較し、ニューラルガイド型プランナーが経路長と滑らかさを改善することを示した。
原題: Performance Comparison of Classical and Neural Sampling Algorithms for Robotic Navigation / Hichem Cheriet, Badra Khellat Kihel, Samira Chouraqui
日本語で読む → - 論文ナビゲーションロボティクス
TravExplorer: traversabilityを考慮した3次元プランニングによる階層横断型具現化探索
ゼロショット物体ナビゲーションを複数階の建物に拡張し、 traversabilityを考慮した3次元プランニングとセマンティックガイダンスを組み合わせた探索フレームワークを提案した。
原題: TravExplorer: Cross-Floor Embodied Exploration via Traversability-Aware 3-D Planning / Han Zheng, Zhe Chen, Yudong Huang 他
日本語で読む → - 論文触覚/把持ロボティクス
TouchDrive: 支援把持のための電子回路不要の触覚センシングインターフェース
接触力を電子回路を使わずに空気圧フィードバックへ変換する、支援把持用の低コスト触覚インターフェースを提案した論文。
原題: TouchDrive: Electronics-Free Tactile Sensing Interface for Assistive Grasping / Jing Xu, Xuezhi Niu, Didem Gurdur Broo 他
日本語で読む → - 論文群制御ロボティクス
意図優先の航空機間V2Vによる戦術的協調と分離:密度と外乱下でのプロトコルと性能
低空密集運用向けに、意図情報を優先する航空機間V2V通信スタックを提案・実装し、実証実験で密度や外乱下での性能を評価した。
原題: Intent-First Aerial V2V for Tactical Coordination and Separation: Protocol and Performance Under Density and Disturbance / Mehrnaz Sabet
日本語で読む → - 論文データ合成/知覚ロボティクス
車両側LiDARデータセットから新規視点合成による路側LiDARデータセット生成
車両搭載LiDARデータから路側視点のラベル付きLiDARデータセットを合成するフレームワークVRSを提案し、実データ不足を補い路側3D物体検出の性能向上を実証した。
原題: Generating Roadside LiDAR Datasets from Vehicle-Side Datasets via Novel View Synthesis / Yuhan Xia, Runxin Zhao, Hanyang Zhuang 他
日本語で読む → - 論文強化学習機械学習
数分でレースを学習:Mini WheelbotにおけるInfoprop Dyna
実機のMini Wheelbot(一輪車ロボット)が、モデルベース強化学習フレームワークInfoprop Dynaを用いて、実世界でのインタラクションのみから11分でトラックを周回するレースを学習できることを実証した論文。
原題: Learning to Race in Minutes: Infoprop Dyna on the Mini Wheelbot / Devdutt Subhasish, Henrik Hose, Sebastian Trimpe
日本語で読む → - 論文水中ロボット/フォールトトレラント制御ロボティクス
LASSAアーキテクチャに基づく無人水中機の自律フォールトトレラント制御
大規模言語モデル(LLM)を用いて未知の故障を自律的に検出・再計画し、物理制約検証により幻覚を抑制する無人水中機の知的フォールトトレラント制御手法を提案した。
原題: LASSA Architecture-Based Autonomous Fault-Tolerant Control of Unmanned Underwater Vehicles / Hong Chen, Zixiang Tang, Yuanbao Chen 他
日本語で読む → - 論文軌道最適化ロボティクス
ミスマッチを考慮した適応的制約タイトニングによる自転車モデル軌道最適化
自動運転の軌道最適化で使われる自転車モデルと実車両の動的差異による安全違反を防ぐため、モデルミスマッチの理論解析に基づき、速度と曲率に依存する適応的な制約マージン(MACT)を提案した。
原題: Mismatch-Aware Adaptive Constraint Tightening for Bicycle-Model Trajectory Optimization / Lingxue Lyu, Zihui Liu
日本語で読む → - 論文自動運転/軌道計画/制御ロボティクス
限界領域での軌道計画と制御:RoboRacerプラットフォームにおけるオープンな実験ベンチマーク
高加速度走行を限界まで押し上げる軌道計画・制御手法を評価するモジュール式フレームワークを提案し、1/10スケールのRoboRacerプラットフォームで実証した。
原題: Trajectory Planning and Control near the Limits: an Open Experimental Benchmark on the RoboRacer Platform / Mattia Piccinini, Patrick Zambiasi, Aniello Mungiello 他
日本語で読む → - 論文交通シミュレーションロボティクス
自己対戦を超えて:閉ループ交通シミュレーションにおける連続運動のための階層的推論
自己対戦型強化学習の限界を克服するため、高レベルのマルチエージェント推論と低レベルの連続運動生成を組み合わせた階層的アーキテクチャを提案し、交通シミュレーションでの安全性と滑らかさを向上させた。
原題: Beyond Self-Play: Hierarchical Reasoning for Continuous Motion in Closed-Loop Traffic Simulation / Weifan Zhang, Xiaofeng Zhao, Adel Bazzi 他
日本語で読む → - 論文強化学習機械学習
エントロピー正則化に基づく近位方策最適化(ERPPO)
マルチエージェント強化学習における非定常な観測環境での方策最適化を改善するため、エントロピー正則化項を導入した新しいPPO手法を提案した。
原題: ERPPO: Entropy Regularization-based Proximal Policy Optimization / Changha Lee, Gyusang Cho
日本語で読む → - 論文ヒューマノイド安全制御ロボティクス
SPARKヒューマノイド安全フィルタの敵対的ストレステスト
SPARKヒューマノイドの安全フィルタを再現し、障害物の密集やノイズなどの厳しい条件下でロバスト性を評価した。
原題: Adversarial Stress Testing of SPARK Humanoid Safety Filters / Saurav Ghosh, Abdou Sow, Luke Zhang
日本語で読む →