論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文共有制御/行動適応ロボティクス
ポリシー更新を伴わないフローに基づく行動適応
事前学習済みポリシーや人間の操作による非熟練の行動を、フローモデルを用いて熟練者の行動分布へと選択的に補正する共有制御モジュールGLOVESを提案。逆フロー評価による介入ゲートで、分布内の行動はそのまま通し、異常な行動のみ補正する。
原題: Flow-based Policy Adaptation without Policy Updates / Luzhe Sun, Jingtian Ji, Haoran Chen 他
日本語で読む → - 論文視覚慣性航法ロボティクス
アンカー特徴パラメータ化を用いた視覚慣性航法の可観測性と一貫性解析
アンカー特徴表現を用いたフィルタ型視覚慣性航法システムの可観測性と一貫性を解析し、一貫性向上のための手法を提案・検証した論文。
原題: Observability and Consistency Analysis for Visual-Inertial Navigation with Anchored Feature Parameterizations / Mitchell Cohen, Vassili Korotkine, James Richard Forbes
日本語で読む → - 論文距離推定画像認識
DroneDAR: 単眼視覚とバウンディングボックス特徴を用いた長距離ドローン距離推定
検出器が提供する画像クロップとバウンディングボックス情報からドローンの距離を推定するモデルを提案し、長距離での性能と失敗モードを分析した。
原題: DroneDAR: Long-Range Drone Distance Estimation Using Monocular Vision and Bounding-Box Features / Knut Peterson, Zaid Mayers, David Han
日本語で読む → - 論文ホッピングロボット/姿勢制御ロボティクス
プロペラ支援による階層的力配分を用いた堅牢な3Dホッピングロボット
脚とプロペラの推力を階層的に配分する枠組みを提案し、3Dホッピングロボットの飛行中の姿勢制御を強化して、屋内外での持続的なホッピングと外乱回復を実証した。
原題: Propeller-Assisted Robust 3D Hopping Robot with Hierarchical Force Allocation / Chuhan Zhang, Hongbo Zhang, Yanlin Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
L-SDPPO: 車両内ロボット操作のためのスパイキング拡散ポリシーのポリシー最適化
宇宙船内でのロボット操作を低エネルギーで実現するため、スパイキング拡散ポリシーを強化学習で最適化する手法を提案した。
原題: L-SDPPO: Policy Optimization of Spiking Diffusion Policy for Intra-vehicular Robotic Manipulation / Liwen Zhang, Dong Zhou, Guanghui Sun 他
日本語で読む → - 論文操作学習/報酬設計ロボティクス
RARM: 操作学習における信頼度ゲート付き進捗報酬モデリング
単一の成功デモ動画を参照し、ロボット操作の強化学習向けに信頼できる進捗報酬を生成する軽量な視覚比較モデルを提案した。
原題: RARM: Confidence-Gated Progress Reward Modeling for RL in Manipulation / Pengzhi Yang, Xinyu Wang, Pengyu Jing 他
日本語で読む → - 論文流体力学/ロコモーションロボティクス
非線形粘性流体における線形運動マップ
低レイノルズ数流体での運動が速度に線形な運動マップで記述できることを、べき乗則粘性流体に拡張し、さらにカロー・ヤスダ流体では相反運動でも正味の移動が可能になることを示した論文。
原題: Linear Motility Maps in Nonlinear Viscous Fluids / Yishun Zhou, Shai Revzen
日本語で読む → - 論文経路計画ロボティクス
移動障害物を伴う移動目標巡回セールスマン問題のための二段階二重レベル探索
移動する目標を時間窓内で訪問しつつ、移動障害物を回避する経路を計画する問題に対し、混合整数錐計画法と高速な二段階探索アルゴリズムを提案し、既存手法より高品質な解を短時間で得られることを示した。
原題: Two-Phase Bilevel Search for the Moving-Target Traveling Salesman Problem with Moving Obstacles / Allen George Philip, Anoop Bhat, Sivakumar Rathinam 他
日本語で読む → - 論文ROS 2/決定的実行ロボティクス
Lingua FrancaによるROS 2アプリケーションの決定的実行
ROS 2の非決定的な実行を、協調言語Lingua Francaを用いて決定的に実行するフレームワークを提案した論文。
原題: Deterministic Execution of ROS 2 Applications via Lingua Franca / Harun Teper, Shaokai Lin, Shulu Li 他
日本語で読む → - 論文VLA/残差RL/sim2realロボティクス
オブジェクト中心残差強化学習によるゼロショットSim-to-Real VLA性能向上
シミュレーションのみで訓練した残差強化学習ポリシーを、オブジェクトの姿勢情報を用いて実世界のVLAモデルに重ねることで、ゼロショットでロボット操作の成功率を大幅に向上させる手法を提案した。
原題: Object-Centric Residual RL for Zero-Shot Sim-to-Real VLA Enhancement / Kinam Kim, Namiko Saito, Heecheol Kim 他
日本語で読む → - 論文3D占有予測ロボティクス
歩道ロボットのためのハイブリッド2D-3D学習による単眼3D占有知覚
歩道を走行するロボット向けに、LiDAR-RGBペアデータと大規模な非ペア単眼画像を組み合わせたハイブリッド学習で3D占有予測を行うフレームワークWalkOCCを提案し、新たな歩道データセットSidewalk3Dも導入した。
原題: Monocular 3D Occupancy Perception for Robots on Sidewalks via Hybrid 2D-3D Learning / Yukai Ma, Joe Lin, Liu Liu 他
日本語で読む → - 論文予測制御ロボティクス
物理世界における予測ダイナミクスは存在し得るか?
予測モデルの出力が物理的に実行可能かどうかを判定する「物理的許容性」というゲートを提案し、シミュレーション環境でその有効性を検証した論文。
原題: Can Predicted Dynamics Exist in the Physical World? / Barak Or
日本語で読む → - 論文能動的再構築/単眼MVSロボティクス
ActMVS: 単眼マルチビューステレオによる能動的シーン再構築
ロボットやUAVが自律的に軌道計画と環境再構築を行うための、単眼カメラのみを用いた初の能動的再構築フレームワークを提案。ビュー因子グラフと大域的な深度最適化により、オンラインで高品質な一貫性のある深度マップを生成する。
原題: ActMVS: Active Scene Reconstruction with Monocular Multi-View Stereo / Guo Pu, Yixuan Han, Zhouhui Lian
日本語で読む → - 論文模倣学習/行動生成ロボティクス
暗黙的ドリフト方策:条件付き専門家幾何による一段階行動生成
拡散やフローマッチングに基づく生成行動ポリシーは反復サンプリングが遅いため、一段階生成を提案。訓練時のドリフト補正を明示的なベクトル場推定なしで取り込む暗黙的ドリフト方策(IDP)を導入し、2D・3D・実世界操作タスクで有効性を実証した。
原題: Implicit Drifting Policy: One-Step Action Generation via Conditional Expert Geometry / Zemin Yang, Yaoyu He, Yiming Zhong 他
日本語で読む → - 論文身体化推論/タスク計画ロボティクス
まず計画を立て、それから精密に調整する:効率的な身体化推論のためのシンボリック強化学習
身体化タスク計画において、BDDL仕様を共有インターフェースとして用い、ビデオからBDDLへのパーサー、LLM検証器、軽量シンボリックエンジンを組み合わせることで、ミリ秒単位の密な報酬を提供し、難易度適応型の長さスケジュールGroupAdaptを導入して、8BプランナーのBEHAVIOR-1000での性能を大幅に向上させた。
原題: Plan Right, Then Plan Tight: Symbolic RL for Efficient Embodied Reasoning / Xiangli Shi, Xiaomeng Zhu, Ye Tian 他
日本語で読む → - 論文追跡ロボティクス
CANMOT: 自動運転におけるマルチオブジェクト追跡のためのクラス認識ノイズモデリング
カルマンフィルタベースの3Dマルチオブジェクト追跡において、物体クラスごとに異なるノイズ共分散を導入し、物体座標系で表現することで追跡性能を向上させ、IDスイッチを削減する手法を提案した。
原題: CANMOT: Class-Aware Noise Modeling for Multi-Object Tracking in Autonomous Driving / Timo Osterburg, Stefan Schütte, Torsten Bertram
日本語で読む → - 論文VLA/安全性評価ロボティクス
いつ、どの程度深刻に:運転VLAのためのシナリオ別安全エンベロープ
運転用VLAプランナーの安全認証に向け、シナリオ別に失敗開始点と深刻度を評価し、単一の集約値では不十分で2次元の安全エンベロープが必要であることを示した。
原題: When and How Severely: Scenario-Specific Safety Envelopes for Driving VLAs / Abhinaw Priyadershi, Jelena Frtunikj
日本語で読む → - 論文触覚/操作ロボティクス
TacForeSight: 接触豊富な操作のための力誘導型触覚ワールドモデル
接触を伴う操作タスクにおいて、力覚と触覚の非対称な時空間的役割を考慮し、触覚潜在ダイナミクスを予測する軽量な触覚ワールドモデルと、予測結果を活用するポリシーを提案。実機実験で動的接触外乱下での優位性を示した。
原題: TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation / Yujie Zang, Yuhang Zheng, Xian Nie 他
日本語で読む → - 論文説明可能AI/自律システムロボティクス
危険環境における説明可能な自律性のための抽象アーキテクチャ
自律ロボットシステムの信頼性向上のため、説明可能性を設計段階から組み込む抽象アーキテクチャを提案し、原子力産業での適用例を示した論文。
原題: An Abstract Architecture for Explainable Autonomy in Hazardous Environments / Matt Luckcuck, Hazel M Taylor, Marie Farrell
日本語で読む → - 論文模倣学習ロボティクス
強化学習誘導型検索とソフト融合による欠損モダリティ下でのロバストなマルチモーダル模倣学習
センサ欠損時に強化学習で関連デモを検索し、ソフト融合で欠損を補完する模倣学習手法RL4ILを提案し、LIBEROベンチマークで優位性を示した。
原題: Reinforcement Learning-Guided Retrieval with Soft Fusion for Robust Multimodal Imitation Learning under Missing Modalities / Hassan Ismkhan, Hamid Bouchahcia
日本語で読む → - 論文マニピュレーションロボティクス
視覚ベースのロボット操作における強化学習の行動空間のベンチマーキング
視覚ベースの物体把持と押し操作タスクにおいて、4種類の行動空間(位置増分、位置速度、関節位置増分、関節速度)をシミュレーションと実世界で比較し、関節速度が最も優れていることを示した。
原題: Benchmarking Action Spaces in Reinforcement Learning for Vision-based Robotic Manipulation / Seyed Alireza Azimi, Homayoon Farrahi, Abhishek Naik 他
日本語で読む → - 論文群制御ロボティクス
OSDAG: 効率的なマルチロボット協調のためのオンラインスケジューリング
LLMによるタスク分解とDAG表現、制約を考慮したオンラインスケジューリングを統合し、マルチロボットの協調を効率化するフレームワークを提案。
原題: OSDAG: Online Scheduling for Efficient Multi-Robot Collaboration / Thanh Nguyen Canh, Thang Tran Viet, Phuc Van Dinh 他
日本語で読む → - 論文意味マッピング/航法ロボティクス
CrossMaps: ローバー航法のための信頼度考慮型オープン語彙意味マッピング
RGB-Dデータから言語で検索可能な意味マップをリアルタイム構築するパイプラインを提案。短期・長期メモリと信頼度融合により、ノイズの多い観測から頑健な意味ランドマークを生成し、ローバーの航法を支援する。
原題: CrossMaps: Confidence-Aware Open-Vocabulary Semantic Mapping for Rover Navigation / Jan-Niklas Klein, Sona Ghahremani, Christian Medeiros Adriano 他
日本語で読む → - 論文システム同定ロボティクス
不確かで時変なダイナミクスを持つ非線形システムのための共分散調整型再帰クープマン学習
時変なダイナミクス下でのロボットのオンライン学習を安定化するため、共分散の爆発やパラメータ凍結を防ぐ2つの戦略を備えた再帰クープマン学習フレームワークを提案し、実機実験で有効性を示した。
原題: Covariance-Regulated Recursive Koopman Learning for Nonlinear Systems with Uncertain Time-Varying Dynamics / Weibin Gu, Chen Yang, Lu Shi 他
日本語で読む → - 論文歩行ロボティクス
ADAPT: 解析的擾乱認識型ポリシートレーニングによる人型ロコモーション
外力による擾乱を物理モデルに基づく観測器で推定し、その情報をポリシーに直接入力することで、人型ロボットの外乱に対する頑健性と速度追従精度を向上させるフレームワークを提案した。
原題: ADAPT: Analytical Disturbance-Aware Policy Training for Humanoid Locomotion / Bofan Lyu, Jindou Jia, Kuangji Zuo 他
日本語で読む → - 論文器用操作/データ生成ロボティクス
EgoEngine: 一人称人間ビデオから高忠実度の器用なロボットデモへ
一人称視点の人間の操作ビデオを、ロボットが実行可能な高品質なデモデータに変換するフレームワークを提案。実ロボットデモなしで初のゼロショット視覚運動器用操作学習を実現。
原題: EgoEngine: From Egocentric Human Videos to High-Fidelity Dexterous Robot Demonstrations / Yangcen Liu, Shuo Cheng, Xinchen Yin 他
日本語で読む → - 論文模倣学習/データ収集ロボティクス
EgoGuide: 効率的なロボット不要のデモ収集と学習のための自己中心視点ガイド
手首と頭部の自己中心視点を同期記録し、オンラインの視覚・幾何学的品質ガイドを提供するデモ収集インターフェースを提案。さらに、視点変動に頑健なゲート付き自己中心残差ポリシーを導入し、データ効率と遮蔽耐性を向上させた。
原題: EgoGuide: Egocentric Guidance for Efficient Robot-Free Demonstration Collection and Learning / Yue Xu, Mingtao Nie, Tianle Li 他
日本語で読む → - 論文両腕操作/VLAロボティクス
選択的に見て適応的に動く:両腕ロボット操作のための二重レベル構造分解
両腕ロボット操作において、視覚情報の重要度と腕の協調パターンが状況に応じて変化する問題に対し、視覚ルータと行動MoEによる二重レベルの構造分解を導入したVLAフレームワークを提案し、シミュレーションと実機で性能を向上させた。
原題: See Selectively, Act Adaptively: Dual-Level Structural Decomposition for Bimanual Robot Manipulation / Yoon-Ji Choi, Young-Chae Son, Soo-Chul Lim
日本語で読む → - 論文VLAロボティクス
少なく見て、多く指定する:汎用VLAのための視覚的証拠予算
視覚言語行動(VLA)モデルの汎化を改善するため、指示を詳細な軌跡・サブタスク言語で再ラベルし、明示的な視覚的証拠予算を課して実行器を訓練するフレームワークS2を提案した。
原題: See Less, Specify More: Visual Evidence Budgets for Generalizable VLAs / Yueh-Hua Wu, Tatsuya Matsushima, Kei Ota
日本語で読む → - 論文VLAロボティクス
VLAMotor: エージェントベースのデータ合成による視覚言語行動モデルのテスト駆動型強化
VLAモデルのエッジケースでの失敗を検出し、その失敗を教師データに変換してモデルを微調整するフレームワークVLAMotorを提案した。
原題: VLAMotor: Test-Guided Enhancement of Vision-Language-Action Models via Agent-BasedData Synthesis / Zeqin Liao, Peifan Ren, Zixu Gao 他
日本語で読む →