論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文認知モデルロボティクス
計画なし、されど人間らしく:反応的ロボティクスモデルが臨床課題における人間の計画失敗を予測
ロボット操作向けに開発された反応的勾配降下モデルAICONを、計画能力を評価する認知テスト(ロンドン塔課題)に適用し、人間の難易度順序や計画能力低下時の失敗パターンを再現できることを示した論文。
原題: No Plan, Yet Human: A Reactive Robotics Model Predicts Human Planning Failures on a Clinical Task / Michael Migacev, Vito Mengers, Antonia Köngeter 他
日本語で読む → - 論文操作学習ロボティクス
Tabero: 視覚・触覚・言語からの閉ループ力フィードバックによる優しい操作の学習
触覚フィードバックを活用した優しいロボット操作を実現するため、データ効率的なパイプラインで視覚・触覚・言語データを生成し、力と位置を分離した指令インターフェースを持つモデルを提案。優しい指示下で把持力を70%以上削減しつつ高い成功率を維持した。
原題: Tabero: Learning Gentle Manipulation with Closed-Loop Force Feedback from Vision, Touch, and Language / Qiwei Wu, Rui Zhang, Xin Xiang 他
日本語で読む → - 論文ドローン/衝突耐性/強化学習ロボティクス
HoLoArm: 衝突に耐えるクアッドローターのための変形可能アーム
トンボの翅の結節構造に着想を得た柔軟アームを持つクアッドローターを提案し、強化学習制御により衝突後の回復と安定飛行を実現した。
原題: HoLoArm: Deformable Arms for Collision-Tolerant Quadrotor Flight / Quang Ngoc Pham, Jonas Eschmann, Yang Zhou 他
日本語で読む → - 論文VLA画像認識
視覚予測型VLAモデルのテスト時学習
視覚予測型VLAモデルのOOD脆弱性を、テスト時に予測画像と観測のペアを用いた自己教師あり学習で改善する手法を提案。
原題: Test-Time Training for Visual Foresight Vision-Language-Action Models / Sangwu Park, Wonjoong Kim, Yeonjun In 他
日本語で読む → - 論文SLAMロボティクス
証明可能最適なポーズグラフ最適化を備えた分散型LiDAR-SLAMシステム
分散型マルチロボットLiDAR-SLAMのための、証明可能最適なポーズグラフ最適化を統合した初のシステムを提案し、大規模環境でのグローバルな一貫性を向上させた。
原題: A Decentralized LiDAR-SLAM System with Certifiably Optimal Pose Graph Optimization / Baoshan Song, Feng Huang, Li-Ta Hsu
日本語で読む → - 論文自動駐車ロボティクス
REAP: ガウススプラッティングシミュレータを用いた強化学習によるエンドツーエンド自動駐車とReal2Sim2Real転送
強化学習とガウススプラッティングシミュレータを組み合わせ、エンドツーエンドの自動駐車を実現し、実世界への転送を可能にする手法を提案した論文。
原題: REAP: Reinforcement-Learning End-to-End Autonomous Parking with Gaussian Splatting Simulator for Real2Sim2Real Transfer / Changze Li, Zhe Chen, Shaoyu Chen 他
日本語で読む → - 論文群制御ロボティクス
STEAM: 分散型マルチエージェント経路探索のための学習不要の混雑認識強化フレームワーク
学習ベースの分散型MAPFアルゴリズムに対し、再学習なしで混雑情報を注入し成功率や経路コストを改善するテスト時強化フレームワークを提案した。
原題: STEAM: A Training-Free Congestion-Aware Enhancement Framework for Decentralized Multi-Agent Path Finding / Mingyang Feng, Mengnuo Zhang, Shaoyuan Li 他
日本語で読む → - 論文環境モニタリングロボティクス
ガストモグラフィを用いたドローンによる火山ガスマッピングの実現
ドローンのダウンウォッシュで乱される火山ガス計測を、リモートセンシングとモデルベースのガストモグラフィ再構成で克服し、正確なガス分布マッピングを実証した論文。
原題: Towards Drone-based Mapping of Volcanic Gases using Gas Tomography / Marius Schaab, Niklas Karbach, Antonia Rabe 他
日本語で読む → - 論文マニピュレーションロボティクス
高速移動物体の衝撃を考慮したコンプライアント捕捉のためのキノダイナミック軌道多様体の学習
シミュレーションでの強化学習により捕捉軌道を収集し、低次元のキノダイナミック軌道多様体を学習。実行時は物体の初期状態から直接参照軌道を生成し、接触近傍ではコンプライアント制御で追従して衝撃吸収と捕捉安定性を向上させる。
原題: Learning a Kinodynamic Trajectory Manifold for Impact-Aware Compliant Catching of Fast-Moving Objects / Guorui Pei, Mengshi Zhang, Xi Chen 他
日本語で読む → - 論文ロボット学習機械学習
OGPO: 生成制御ポリシーのサンプル効率的な完全ファインチューニング
拡散やフローベースの生成制御ポリシーを、オフポリシーな批判ネットワークとPPO目的関数を用いて効率的にファインチューニングする手法OGPOを提案し、操作タスクで最先端の性能を達成した。
原題: OGPO: Sample Efficient Full-Finetuning of Generative Control Policies / Sarvesh Patil, Mitsuhiko Nakamoto, Manan Agarwal 他
日本語で読む → - 論文自動運転/人間-機械インタラクションHCI
部分自動運転における有意義な人間制御の評価:行動と知覚の関連付け
部分自動運転システムにおけるドライバーの有意義な人間制御を評価するため、シミュレータ実験で行動指標と主観的知覚を測定し、それらの関連を分析した。
原題: Linking Behaviour and Perception to Evaluate Meaningful Human Control over Partially Automated Driving / Ashwin George, Lucas Elbert Suryana, Lorenzo Flipse 他
日本語で読む → - 論文3D再構成画像認識
良いトークンの狩り方:視覚幾何学トランスフォーマーにおけるトークン選択の手引き
視覚幾何学トランスフォーマーの計算コストを削減するため、フレーム間・フレーム内の2段階でトークンを選択する手法を提案し、精度を保ちつつ85%以上の高速化を実現した。
原題: Good Token Hunting: A Hitchhiker's Guide to Token Selection for Visual Geometry Transformers / Shuhong Zheng, Michael Oechsle, Erik Sandström 他
日本語で読む → - 論文共有制御ロボティクス
HITL-D: 人間参加型拡散支援共有制御
拡散モデルによる自律支援と人間の操作を組み合わせた共有制御フレームワークを提案し、多段階・挿入・微細操作タスクでの性能向上を実証した。
原題: HITL-D: Human In The Loop Diffusion Assisted Shared Control / Riley Zilka, Sergey Khlynovskiy, Allie Wang 他
日本語で読む → - 論文VLA/展開ロボティクス
工場フロアでのVLAパイプライン展開事例研究:産業用包装タスクにおけるワークフロー、失敗、教訓
産業用包装タスクで事前学習済みVLAポリシーを工場現場に適応させる実践的な取り組みを報告し、反復的な微調整と展開駆動の改善を通じて得られた失敗モードと教訓をまとめた。
原題: A Factory-Floor Deployment Case Study of VLA Pipelines for Industrial Packaging Task: Workflow, Failures, and Lessons / Brian Zhu, Philipp Schmitt, Philine Meister 他
日本語で読む → - 論文設計最適化ロボティクス
運動学的構造に基づくロボット設計最適化のためのQUBO定式化フレームワーク:ロボットハンドのケーススタディ
ロボット設計最適化を量子アニーリング向けのQUBO問題として定式化するフレームワークを提案し、ロボットハンドの設計問題に適用して実現可能性を検証した。
原題: A QUBO Formulation Framework for Kinematic Structure-Based Robot Design Optimization: A Robotic Hand Case Study / HyoJae Kang, Yeong Jae Park, Jeongdo Ahn 他
日本語で読む → - 論文ナビゲーションロボティクス
MASt3R-Nav: 相対3DマップにおけるWayPixelナビゲーション
画像ペア間の相対3D座標系でのピクセル対応に基づくピクセル相対接続性マップを提案し、これをコストマップとして用いて制御器を訓練することで、高精度な視覚ナビゲーションを実現した。
原題: MASt3R-Nav: WayPixel Navigation in Relative 3D Maps / Vansh Garg, Rohit Jayanti, Krish Pandya 他
日本語で読む → - 論文sim2realロボティクス
浮遊廃棄物回収用ASVにおける統合認識を備えた強化学習制御のSim-to-Real転移とロバスト性評価
浮遊ゴミ回収用の自律水上艇(ASV)に対し、カメラベースの偏光認識と軽量DRL制御を組み合わせ、シミュレーションのみで訓練した制御器を実機に直接適用するシステムを構築し、sim-to-real転移の評価手法と実地試験結果を示した。
原題: Sim-to-Real Transfer and Robustness Evaluation of Reinforcement Learning Control with Integrated Perception on an ASV for Floating Waste Capture / Luis F. W. Batista, Stéphanie Aravecchia, Cédric Pradalier
日本語で読む → - 論文経路計画ロボティクス
凸ニューラルRRT*:高品質なロボット経路計画のための高速かつ信頼性の高い学習誘導サンプリング
ニューラルネットワークで高品質経路の近傍領域を予測し、その凸包領域にサンプリングを集中させることで、計算時間を大幅に削減しつつ経路長も改善するRRT*の拡張手法を提案した。
原題: Convex-Neural RRT*: Fast and Reliable Learning-Guided Sampling for High-Quality Robot Path Planning / Hichem Cheriet, Badra Khellat Kihel, Samira Chouraqui 他
日本語で読む → - 論文制御ロボティクス
多様体制約付きMPPI:ハード制約下でのリアルタイムサンプリングベース制御
標準MPPIのソフトペナルティでは保証できないハード制約を満たすため、VAEで制約多様体の潜在表現を学習し、実行レベルでQPにより残差を補正するMC-MPPIを提案した。閉連鎖双腕システムで100Hz動作を実証した。
原題: Manifold-Constrained MPPI: Real-Time Sampling-Based Control Under Hard Constraints / Seulchan Lee, Sanghyun Kim
日本語で読む → - 論文計画ロボティクス
信念空間における軌道ツリーの最適化:モデル予測制御からタスク・動作計画への応用
部分観測ロボット計画問題において、逐次軌道ではなく分岐を持つ軌道ツリーを信念空間で最適化する手法を提案し、MPCとTAMPの両方で有効性を示した。
原題: Optimizing Trajectory-Trees in Belief Space: An Application from Model Predictive Control to Task and Motion Planning / Camille Phiquepal, Marc Toussaint
日本語で読む → - 論文位置推定ロボティクス
擬似衛星補強航法のための疎結合因子グラフ最適化
GNSSが劣化した環境で、擬似衛星とIMUデータを疎結合因子グラフ最適化で統合し、測位精度を向上させる手法を提案した。
原題: Loosely Coupled Factor Graph Optimization for Pseudolite-Augmented Navigation / Chih-Chun Chen, Lipeng Tan, Shiyu Bai 他
日本語で読む → - 論文ロボットスキル学習ロボティクス
幾何学的ロボット表面作業のための転移可能な運動スキルの学習
ロボットの表面作業(塗装や溶接など)において、幾何学的な経路計画と実行レベルの専門的動作を分離し、CADモデルと軌道データから速度や姿勢の調整ルールを学習するフレームワークを提案した。
原題: Learning Transferable Motor Skills for Geometry-Aware Robotic Surface Tasks / Miroslav David, Karla Stepanova, Robert Babuska
日本語で読む → - 論文模倣学習ロボティクス
何を尋ねるべきか知るロボット:説明による報酬のずれの修正
不完全なデモから学習した報酬関数の不確実性を検出し、ロボットが自然言語で説明しながら追加のデモを能動的に要求する手法を提案。シミュレーションと実機で効果を検証した。
原題: Robots That Know What to Ask: Recovering Misaligned Rewards through Targeted Explanations / Helena Merker, Nick Walker, Andreea Bobu
日本語で読む → - 論文SLAMロボティクス
AERO-VIS: 非同期イベントベースのリアルタイムオンボード視覚慣性SLAM
イベントカメラのストリームを非同期に処理するステレオイベント慣性SLAMシステムを提案し、UAV搭載で閉ループ制御と大規模状態推定を実現した。
原題: AERO-VIS: Asynchronous Event-based Real-time Onboard Visual-Inertial SLAM / Yannick Burkhardt, Sebastián Barbas Laina, Simon Boche 他
日本語で読む → - 論文制御ロボティクス
リスク認識型ドメインランダム化が接触を伴うサンプリングベース予測制御に与える驚くべき影響
接触を伴うサンプリングベース予測制御において、リスク認識型ドメインランダム化がモデル誤差へのロバスト性だけでなく、最適化器が見るコスト地形を変えることを示した。
原題: On Surprising Effects of Risk-Aware Domain Randomization for Contact-Rich Sampling-based Predictive Control / Sergio A. Esteban, Junheng Li, Vince Kurtz 他
日本語で読む → - 論文自動運転/リスク制御/MPCロボティクス
リスクを考慮した制御のための多段階信念空間ダイナミクス学習
自動運転車のリスクを考慮した計画・制御のために、不確実性の時間発展を予測する分布ダイナミクスを学習し、実時間で最適化できるMPCフレームワークを提案。実車でのオフロード走行実験で有効性を実証した。
原題: Multistep Belief Space Dynamics Learning For Risk-Aware Control / Jason Gibson, Bogdan Vlahov, Patrick Spieler 他
日本語で読む → - 論文3Dシーングラフロボティクス
速い視覚と遅い視覚:オープンセットタスクのためのバイモーダル3Dシーングラフ
ロボットの探索中に粗い表現と細かい表現を切り替えるバイモーダル3Dシーングラフ生成手法BiMoSGを提案し、オープンセットタスクの実行を高速化した。
原題: Seeing Fast and Slow: Bimodal 3D Scene Graphs for Open-set Tasks / Marcel Bartholomeus Prasetyo, Shrutika Vishal Thengane, A Manicka Praveen 他
日本語で読む → - 論文ナビゲーションロボティクス
POINav: 実世界の視覚言語ナビゲーションにおける最終メートル到達のベンチマークと性能向上
実世界のPOI(関心地点)ゴールナビゲーションのための初のクローズドループ評価ベンチマークPOINav-Benchを構築し、POI推論を行うBrainモジュールと連続ウェイポイント予測を行うActionモジュールからなるフレームワークを提案した。
原題: POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation / Ruiyan Gong, Meisheng Zhang, Yuxiang Zhao 他
日本語で読む → - 論文強化学習/不確実性/能動的知覚制御
認識の罠を打ち破る:複合不確実性下での能動的知覚
強化学習において、状態推定と動的モデルの不確実性が相互に絡み合う「認識の罠」が性能を大幅に劣化させることを示し、情報量に基づく能動的探索と適応的安全制約を備えたアーキテクチャを提案した論文。
原題: Breaking the Epistemic Trap: Active Perception Under Compound Uncertainty / Chayan Banerjee, Ethan Goan
日本語で読む → - 論文安全制御/MPC制御
最大制御不変MPC:終端CBF制約による安全制御の実現可能性向上と保守性低減
制御バリア関数を終端制約として用いたMPCを提案し、予測ホライズン増加に伴う実現可能性と到達可能集合の改善を証明、非ホロノミック系のシミュレーションで有効性を検証した。
原題: Maximal Controlled Invariant-MPC: Enhancing Feasibility and Reducing Conservatism through Terminal CBF Constraint in Safety-Critical Control / Tanmay Dokania, Yashwanth Kumar Nakka
日本語で読む →