論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/3 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文四足ロボットロボティクス
QLAUN: 研究指向・堅牢・機敏・モジュール式・低コストのトルク制御四足ロボット
3Dプリント製で低コストなトルク制御四足ロボットQLAUNを提案し、モジュール式の脚と準直接駆動アクチュエータによる堅牢性と機敏性の両立を目指した設計を紹介する。
原題: QLAUN: A Research-Oriented, Robust, Agile, Modular, and Affordable Torque-Controlled Quadruped Robot / Mohamad S. Moudallal, Noel J. Maalouf
日本語で読む → - 論文評価ロボティクス
R2S-Eval: 視覚言語モデルによる実機からシミュレーションへのキャリブレーションを用いたロボット評価
ロボット操作ポリシーの評価を、実機からシミュレーションへのキャリブレーションと視覚言語モデルによる選好評価を組み合わせて行うパイプラインを提案し、実機評価の不安定性やコストを低減する。
原題: R2S-Eval: Robot Evaluation with Real-to-Sim Calibration via Vision-Language Models / Yidi Wang, Feixiang Ruan, Ruoqu Chen 他
日本語で読む → - 論文オドメトリロボティクス
TRaIL-Odom: 適応的ドップラー重み付けを備えた密結合連続時間レーダー・IMU・LiDARオドメトリ
レーダーとLiDARの融合オドメトリにおいて、幾何学的縮退の方向性に応じてレーダーのドップラー制約を適応的に重み付けする2つのモジュールを提案し、縮退シーンでの精度を大幅に向上させた。
原題: TRaIL-Odom: Tightly Coupled Continuous Time Radar-IMU-LiDAR Odometry with Adaptive Doppler Weighting / Chiyun Noh, Turcan Tuna, William Talbot 他
日本語で読む → - 論文報酬学習機械学習
部分空間推論による選好からの効率的な能動報酬学習
選好に基づく報酬学習において、拡張カルマンフィルタを低次元部分空間で適用し、報酬モデルの不確実性を効率的に追跡する手法を提案した。
原題: Subspace Inference Enables Efficient Active Reward Learning from Preferences / Yutai Zhou, Erdem Bıyık
日本語で読む → - 論文ナビゲーションロボティクス
共有鳥瞰図による空陸協調型視覚言語ナビゲーション
UAVとUGVが協調する空陸協調型VLNの初の訓練不要ベースラインを提案し、共有鳥瞰図を用いて協調動作を実現、成功率77%を達成した。
原題: Air-Ground Collaborative Vision-and-Language Navigation via Shared Bird's-Eye Maps / Shuning Zhang, Liang Li, Yunheng Wang 他
日本語で読む → - 論文自動運転機械学習
低コストでオープンなミニチュアAckermann車両を用いたエンドツーエンド自動運転プラットフォーム
低コストのミニチュアAckermann車両とデジタルツインを組み合わせた、エンドツーエンド自動運転研究用のオープンプラットフォームを提案し、行動クローニングのベースラインを実装・評価した。
原題: A Low-Cost, Open Platform for End-to-End Autonomous Driving on a Miniature Ackermann Vehicle / Gustavo Claudio Karl Couto, Eric Aislan Antonelo, Gabriel George Zipperer
日本語で読む → - 論文計画/ワールドモデル機械学習
潜在エネルギー行動計画とワールドモデル
潜在ワールドモデルを用いたモデル予測制御において、行動系列全体を最適化変数として扱い、終端状態のエネルギー最小化と目標記述子の一致を組み合わせる新しい計画手法LEAPを提案。4つの制御ドメインで成功率を77.5%から94.8%に向上させた。
原題: Latent Energy Action Planning with World Models / Phu Pham, Aniket Bera
日本語で読む → - 論文自動運転シミュレーションロボティクス
信頼できるシミュレーションによる自動運転システムの仮想試験
自動運転システムの安全性評価におけるシミュレーションの信頼性を評価するためのリスクベースのフレームワークを提案し、NASAの標準を参考に検証・妥当性確認を拡張している。
原題: Virtual Testing of Automated Driving Systems through Credible Simulations / Riccardo Dona, Espedito Rusciano, Biagio Ciuffo
日本語で読む → - 論文両腕操作/VLA/データセットロボティクス
1500時間のデモからオン方針修正までの両腕家庭操作のスケーリング
家庭内両腕操作タスクの1500時間のデモデータセットを公開し、VLAモデルXR-2を訓練。データ量とDAgger修正データの増加に伴い成功率が向上するスケーリング傾向を実証した。
原題: Scaling Bimanual Household Manipulation from 1,500 hours of Demonstrations to On-Policy Corrections / Jiafeng Xu, Qi Li, Yan Shen 他
日本語で読む → - 論文HMI/認知モデルロボティクス
人間と機械の相互作用のための統合的認知・人間工学アーキテクチャ:認知モデルと人間工学の融合
認知アーキテクチャ(SOAR、ACT-R、LIDA、COCOM)と人間工学の原則を統合し、動的環境での人間と機械の相互作用を改善するためのモデルを提案した。産業用ロボット応用で実証し、意思決定やスキル獲得のメカニズムを明らかにした。
原題: Toward an~Integrated Cognitive--Ergonomic Architecture for~Human--Machine Interaction: Combining Cognitive Models with~Human Factors Ergonomics / Antoine Lenat, Olivier Cheminat, Damien Chablat 他
日本語で読む → - 論文サーベイロボティクス
統合ロボット学習に向けて:表現、視覚言語行動、世界モデルの橋渡し
ロボット学習における表現学習、VLAモデル、世界モデルの3つのパラダイムを統一的に整理し、それらの相互作用と課題を分析したサーベイ論文。
原題: Toward Unified Robot Learning: Bridging Representation, Vision-Language-Action, and World Models / Shaunak A. Mehta, Ananya Hazarika, Haochen Zhang 他
日本語で読む → - 論文自動運転ロボティクス
マルチスタイルのエンドツーエンド運転のための長期的整合性と相互作用を考慮したワールドモデル
ワールドモデルベースの強化学習を用いた自動運転フレームワークStyleDriveを提案し、長期的整合性の確保、相互作用状態の分離、多様な運転スタイルの最適化を実現した。
原題: Long-Horizon Consistent and Interaction-Aware World Models for Multi-Style End-to-End Driving / Yuxuan Han, Kunyuan Wu, Liyunong Yang 他
日本語で読む → - 論文ランタイム監視ロボティクス
予測的ゾノトープ縮小:不確実性下での高精度ランタイム監視
不確実なセンサー計測下でロボットの安全性を監視する際、ゾノトープの縮小方法を最適制御問題として動的に選択する手法を提案し、誤警報率を低減した。
原題: Predictive Zonotope Reduction: Precise Runtime Monitoring under Uncertainty / Vladimir Krsmanovic, Florian Kohn, Bernd Finkbeiner 他
日本語で読む → - 論文グリッパー設計ロボティクス
ARTiS: 分解作業における工具操作を強化する適応型ロボットグリッパー
分解作業で工具をしっかり握って使えるよう、柔らかい掌と指先、剛性機構を組み合わせた適応型グリッパーARTiSを提案・評価した論文。
原題: ARTiS: An Adaptive Robotic Gripper for Enhanced Tool Manipulation in Disassembly Applications / Roman Mykhailyshyn, Domae Yukiyasu, Harada Kensuke
日本語で読む → - 論文自動運転画像認識
SV-WAM: 効率的な全方位ビュー世界行動モデルによるエンドツーエンド自動運転
全方位カメラ入力を用いた世界行動モデルを提案し、将来ビデオ予測を訓練時の補助信号として活用することで、推論時の計算負荷を抑えつつ安全な運転計画を実現した。
原題: SV-WAM: An Efficient Surround-View World-Action Model for End-to-End Autonomous Driving / Jinyang Wang, Shiwei Li, Junjian Wang 他
日本語で読む → - 論文対話システムAI
IRWOZ 2.0: 産業用ロボット対話のための大規模言語モデル駆動対話データセット
産業用ロボットとの対話システムの性能を向上させるため、大規模言語モデルを用いてIRWOZデータセットを改良し、ノイズを低減して精度を大幅に改善した。
原題: IRWOZ 2.0: A Large Language Model-driven Dialogue Dataset for Industrial Robot Conversations / Chen Li, Dimitrios Chrysostomou
日本語で読む → - 論文セグメンテーション画像認識
DropClick: 農業ロボットデータのための半自動ワンクリックセグメンテーション
農業ロボットのセグメンテーションデータセットのアノテーションを簡略化するため、単一クリックで疑似ラベルを生成する半自動ツールDropClickを提案し、少ないクリック数で高い性能を達成した。
原題: DropClick: Semi-Automated One-Click Segmentation for Agricultural Robotic Data / Patrick Zimmer, Michael Halstead, Chris McCool
日本語で読む → - 論文人型ロボット/共設計ロボティクス
BRIDGE: 形態と制御の共設計による物理AIのためのオープンソース人型ロボットプラットフォーム
人間の動作データを活用できる人型ロボットの設計を、形態と全身制御をデータ駆動で共最適化するフレームワークを提案し、その設計を実現したオープンソースの小型人型ロボット「Bridge」を公開した。
原題: BRIDGE: An Open-Source Humanoid Platform via Morphology-Control Co-Design for Physical AI / Jianren Wang, Letian Qian, Zikai Wang 他
日本語で読む → - 論文自動運転/エッジコンピューティングロボティクス
スケーラブルなエッジ支援型融合とコネクテッド自動運転車の経路予測
エッジサーバが複数の自動運転車と路側機の情報を統合し、遮蔽を考慮して寄与度の高い車両を選びつつ、年齢制約内で将来軌道を予測するシステムを提案した。
原題: Scalable Edge-assisted Fusion and Path Prediction for Connected Autonomous Vehicles / Tyler Landle, Jackson Isenberg, Abhijit Chatterjee 他
日本語で読む → - 論文知識表現・推論AI
意味論的ベイズ世界モデル
知識グラフの確定的な事実表現と、確率的に推論する基盤モデルやエージェントとの不整合を指摘し、知識グラフ上の信念を共有・更新する「意味論的ベイズ世界モデル」を提案する論文。
原題: Semantic Bayesian World Models / Tommaso Soru
日本語で読む → - 論文ソフトロボティクスロボティクス
アクセス可能な作業チャネルと操舵を実現するマルチバインソフトロボット
2本のバインロボットを結合し、外部に作業チャネルを統合することで、先端だけでなく途中からもツールをアクセス可能にし、操舵性を向上させたソフトロボットを提案した。
原題: A Multi-Vine Soft Robot Enabling Accessible Working Channel and Steering / Reza Kashef, Cem Suulker, Mohammad Sheikh Sofla 他
日本語で読む → - 論文自動運転画像認識
離散的な心から連続的な行動へ:エンドツーエンド自動運転のための潜在整合プランニング
Vision-Language Modelの離散的な推論と自動運転の連続的な物理制約を橋渡しするため、潜在整合プランニングを備えたVLAフレームワークLaPlaを提案。量子化誤差を排除し、物理的に妥当な軌道を生成する。
原題: Continuous Actions from Discrete Minds: Latent-Aligned Planning for End-to-End Autonomous Driving / Ruoyu Yao, Yusen Xie, Qingzhao Liu 他
日本語で読む → - 論文エネルギー最適化AI
データセンターのエネルギー最適化のための人工知能
データセンターのエネルギー最適化に関するAI研究を体系的にレビューし、制御と持続可能性のギャップを指摘。新しい報告フレームワークCLEAR-DCを提案した。
原題: Artificial Intelligence for Energy Optimization in Data Centers / Mohammed Basharath Ullah, Summaiya Unnisa Begum, Mohammed Nadeem Ullah
日本語で読む → - 論文世界モデル機械学習
JEPA型世界モデルのためのスペクトルターゲット物理潜在構造化
潜在世界モデルにおいて、表現崩壊は防げても物理的特性を捉えられない「物理表現の怠惰」という新たな失敗モードを特定し、フーリエ補助ヘッドによる訓練時補助で潜在空間を物理的に構造化し、計画性能を向上させる手法を提案した。
原題: Spectral-Target Physical Latent Structuring for JEPA-Style World Models / Penghao Zhu, Salvatore Penachio, Kaustav Mukherjee 他
日本語で読む → - 論文VLAロボティクス
静かなる妨害:LLM搭載ロボットシステムに対する内部状態トリガーバックドア攻撃
LLMで制御されるロボットに、外部刺激ではなくロボット自身の過去の行動履歴をトリガーとする隠れたバックドアを埋め込めることを示し、通常時は性能を保ちつつ特定条件下で停止や衝突を引き起こせることを実験で明らかにした。
原題: Silent Sabotage: Internal State Triggered Backdoor Attacks on LLM-Powered Robotic Systems / Doniyorkhon Obidov, Shivayogi Akki, Tan Chen 他
日本語で読む → - 論文手術支援ロボティクス
MACAW: 単眼適応コンパクト注意窓による信頼性と効率を両立した外科的デブリードマン
外科的デブリードマン(壊死組織除去)の自動化システムを開発し、単眼カメラと適応的注意窓による深度制御法MACAWを提案。物理実験で93%の成功率と毎時304個の処理能力を達成した。
原題: MACAW: Reliable And Efficient Surgical Debridement Using Monocular Adaptive Compact Attention Windows / Ziyang Chen, Shutong Jin, Preethi Satish 他
日本語で読む → - 論文軌道計画ロボティクス
DiffuSearch:拡散と行動空間での整合した目的関数によるハイブリッド軌道計画の利点
自動運転の軌道計画において、拡散モデルとモンテカルロ木探索を統合したハイブリッドプランナーを提案し、共通の運転目的関数を用いて生成と洗練を一貫させ、衝突回避と快適性を向上させた。
原題: DiffuSearch: How Hybrid Trajectory Planning Benefits from Aligned Objectives in Diffusion and Action Space / Steffen Hagedorn, Aron Distelzweig, Alexandru P. Condurache
日本語で読む → - 論文ヒューマノイド制御ロボティクス
学習された停止可能性値によるヒューマノイドの安全停止
ヒューマノイドの緊急停止を到達回避問題として捉え、学習した停止ポリシーと停止可能性推定器を組み合わせたタスク非依存のフレームワークを提案。安全に停止できる場合のみ停止し、不可能な場合はフォールバック動作に切り替える。
原題: Humanoid Safe Stop via Learned Stoppability Value / Junfeng Long, Pieter Abbeel, Koushil Sreenath 他
日本語で読む → - 論文水中ロボティクスロボティクス
水中ロボティクスの民主化を進めるMini-Girona I-AUV:RAMI 2025での成果
約5万ドルで製作可能な低コスト水中介入AUV「Mini-Girona」を開発し、学生競技会RAMI 2025で2位を獲得した設計と性能を報告する論文。
原題: Advancing Accessible Underwater Robotics: The Mini-Girona I-AUV at RAMI 2025 / Taqi Hamoda, Bilal Ahmed, Deborah Ele-Ojo 他
日本語で読む → - 論文世界モデル機械学習
AGI迷路予測データセット:トランスフォーマーによる世界ダイナミクス学習のためのコンパクトなベンチマーク
手続き的に生成されたグリッドワールドを用いて、トランスフォーマーの世界モデル能力を評価するための軽量ベンチマークを提案し、空間メモリを持つアーキテクチャが有効であることを示した。
原題: AGI Maze Prediction Datasets: A Compact Benchmark for Learning World Dynamics with Transformers / Alexey Potapov
日本語で読む →