論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御ロボティクス
riMESA: 実世界協調SLAMのためのコンセンサスADMM
通信制約や外れ値計測、オンライン動作といった実世界の課題に対応する、堅牢でインクリメンタルな分散型C-SLAMバックエンドを提案した。
原題: riMESA: Consensus ADMM for Real-World Collaborative SLAM / Daniel McGann, Michael Kaess
日本語で読む → - 論文全身制御/モーションリターゲティングロボティクス
追跡を簡単に:ヒューマノイド全身制御のためのニューラルモーションリターゲティング
人間の動作データをヒューマノイドロボットに転写する際の非凸最適化問題を、運動分布の学習として再定式化し、VAEクラスタリングと強化学習によるデータ精製とCNN-Transformerによる非自己回帰的生成で関節跳躍や自己衝突を抑える手法NMRを提案。
原題: Make Tracking Easy: Neural Motion Retargeting for Humanoid Whole-body Control / Qingrui Zhao, Kaiyue Yang, Xiyu Wang 他
日本語で読む → - 論文場所認識ロボティクス
PROBE: 解析的並進ロバスト性を備えた確率的占有BEV符号化による3D場所認識
LiDARのBEVセル占有をベルヌーイ確率変数としてモデル化し、極座標ヤコビアンを用いて連続的な並進を解析的に周辺化する学習不要の場所認識記述子を提案。4種のLiDARデータセットで高い精度を達成。
原題: PROBE: Probabilistic Occupancy BEV Encoding with Analytical Translation Robustness for 3D Place Recognition / Jinseop Lee, Byoungho Lee, Gichul Yoo
日本語で読む → - 論文ナビゲーションロボティクス
IntentReact: トポロジカルな意図による反応的オブジェクト中心ナビゲーションの誘導
オブジェクト目標ナビゲーションにおいて、局所的な観測のみに依存する反応的制御と大域的なトポロジカル計画のギャップを埋めるため、意図(intent)と呼ばれる低次元の方向信号を導入し、学習されたウェイポイント予測を条件付けてナビゲーションを誘導するフレームワークを提案した。
原題: IntentReact: Guiding Reactive Object-Centric Navigation via Topological Intent / Yanmei Jiao, Anpeng Lu, Wenhan Hu 他
日本語で読む → - 論文アフォーダンス推定ロボティクス
ロバストなアフォーダンス推定のための結合粒子フィルタ
把持可能領域と移動可能領域を推定する2つの粒子フィルタを結合し、相互に情報交換させることで、照明不足や混雑環境でも高精度にアフォーダンスを推定する手法を提案した。
原題: Coupled Particle Filters for Robust Affordance Estimation / Patrick Lowin, Vito Mengers, Oliver Brock
日本語で読む → - 論文群制御制御
車両マニピュレータシステムのポート・ハミルトン構造
本論文は、空中・水中・宇宙・移動マニピュレータを含む車両マニピュレータシステム(VMS)のポート・ハミルトン定式化を提案し、エネルギー構造を明示する標準形と制御設計に適した慣性分離形の2つの定式化を導出した。
原題: The Port-Hamiltonian Structure of Vehicle Manipulator Systems / Ramy Rashad
日本語で読む → - 論文自動運転/強化学習ロボティクス
強化学習に基づく動的ルックアヘッド距離を用いた自動運転レース用ピュア・パースート
自動運転レースにおいて、古典的なピュア・パースート制御のルックアヘッド距離をPPO強化学習で動的に調整するハイブリッド制御手法を提案し、シミュレーションと実車で性能を検証した。
原題: Dynamic Lookahead Distance via Reinforcement Learning-Based Pure Pursuit for Autonomous Racing / Mohamed Elgouhary, Amr S. El-Wakeel
日本語で読む → - 論文安全工学AI
能力の影:安全工学におけるAI支援の理論と限界
AI支援が安全工学の分析品質を向上させるのか、それとも系統的な盲点を生むのかを形式化し、能力の影という概念を導入して、協調構造に応じた性能限界を導出した論文。
原題: The Competence Shadow: Theory and Bounds of AI Assistance in Safety Engineering / Umair Siddique
日本語で読む → - 論文オフライン強化学習ロボティクス
一段階フローポリシーによる潜在方針の操縦
オフライン強化学習において、元の行動空間のQ勾配を微分可能な一段階MeanFlowポリシーを通じて逆伝播させ、潜在行動空間のアクターを更新する新しい手法LPSを提案。代理の潜在批評家を排除し、行動制約付き生成事前分布として機能させることで、最小限のチューニングで高い性能を達成した。
原題: Latent Policy Steering through One-Step Flow Policies / Hokyun Im, Andrey Kolobov, Jianlong Fu 他
日本語で読む → - 論文ナビゲーションロボティクス
複合ニューラル制御バリア関数による動的環境下でのロボットナビゲーション
動的環境での安全なロボットナビゲーションのため、複数のニューラルCBFを組み合わせた複合CBFを提案し、オフラインの到達可能性解析で訓練して安全な動作を実現した。
原題: CN-CBF: Composite Neural Control Barrier Function for Robot Navigation in Dynamic Environments / Bojan Derajić, Sebastian Bernhard, Wolfgang Hönig
日本語で読む → - 論文マニピュレーションロボティクス
CLaD: クロスモーダル潜在ダイナミクスによる接地された先見性を用いた計画
ロボット操作における運動学的遷移と意味的遷移を、非対称クロスアテンションで統合し、自己教師あり学習で接地された潜在先見性を予測して拡散ポリシーを条件付けるフレームワークを提案。LIBERO-LONGで94.7%の成功率を達成。
原題: CLaD: Planning with Grounded Foresight via Cross-Modal Latent Dynamics / Andrew Jeong, Jaemin Kim, Sebin Lee 他
日本語で読む → - 論文農業ロボット/物体検出画像認識
注釈から検出へ:移動農業ロボットによる圃場でのブドウ幹位置特定のための自律的かつ堅牢なフレームワーク
限られたラベル付きデータで頑健なマルチモーダル検出器を訓練するための注釈から検出へのフレームワークを提案し、実際のブドウ園で幹検出と位置特定を実証した。
原題: An Annotation-to-Detection Framework for Autonomous and Robust Vine Trunk Localization in the Field by Mobile Agricultural Robots / Dimitrios Chatziparaschis, Elia Scudiero, Brent Sams 他
日本語で読む → - 論文マニピュレーションロボティクス
曲面制約付きオフライン変形と接触認識オンラインポーズ投影による安全なロボット軌道実行
曲面に沿った繰り返し工具動作を安全に実行するため、オフラインで曲面に適合する参照軌道を生成し、オンラインで接触力と姿勢制約を考慮して軌道ずれを補正する2段階フレームワークを提案した。
原題: Surface-Constrained Offline Warping with Contact-Aware Online Pose Projection for Safe Robotic Trajectory Execution / Farong Wang, Sai Swaminathan, Fei Liu
日本語で読む → - 論文自動運転/VLAロボティクス
Uni-World VLA: 自動運転のための世界モデリングと計画の交互実行
自動運転向けに、将来フレーム予測と軌道計画を交互に行う統合VLAモデルを提案し、閉ループな意思決定を実現した。
原題: Uni-World VLA: Interleaved World Modeling and Planning for Autonomous Driving / Qiqi Liu, Huan Xu, Jingyu Li 他
日本語で読む → - 論文医療ロボティクス/コンプライアント機構ロボティクス
トリガー誘起型双安定コンプライアント腹腔鏡用把持鉗子のハイブリッド設計手法
剛体リンクを使わず、コンプライアント機構と双安定性を組み合わせて、一度の操作で把持状態を保持できる腹腔鏡用把持鉗子を設計・試作した。
原題: TiBCLaG: Hybrid design approach for a trigger-induced bistable compliant laparoscopic grasper / Joel J Nellikkunnel, Prabhat Kumar
日本語で読む → - 論文VLAロボティクス
Ψ₀: 汎用人型ロコマニピュレーションに向けたオープン基盤モデル
高品質な一人称視点の人間動画でVLMを事前学習し、人型ロボットの実機データで追加学習する段階的パラダイムにより、少ないデータで人型ロコマニピュレーションを実現するオープン基盤モデルを提案した。
原題: $\Psi_0$: An Open Foundation Model Towards Universal Humanoid Loco-Manipulation / Songlin Wei, Hongyi Jing, Boqian Li 他
日本語で読む → - 論文自動運転/世界モデル機械学習
DreamerAD: 潜在世界モデルによる自動運転のための効率的な強化学習
動画拡散モデルのサンプリングを100ステップから1ステップに圧縮し80倍高速化した潜在世界モデルで、自動運転の強化学習を安全かつ高頻度に訓練可能にした。
原題: DreamerAD: Efficient Reinforcement Learning via Latent World Model for Autonomous Driving / Pengxuan Yang, Yupeng Zheng, Deheng Qian 他
日本語で読む → - 論文ナビゲーションロボティクス
視覚言語モデルによる動的制御バリア関数の調整:安全・適応・リアルタイムな視覚ナビゲーション
ロボットのナビゲーションにおいて、視覚言語モデル(VLM)がカメラ画像からリスクを推定し、制御バリア関数(CBF)の安全フィルタの保守性をリアルタイムに調整するフレームワークAlphaAdjを提案。固定パラメータと比較して効率を最大18.5%向上させつつ衝突回避を維持する。
原題: Dynamic Control Barrier Function Regulation with Vision-Language Models for Safe, Adaptive, and Realtime Visual Navigation / Jeffrey Chen, Rohan Chandra
日本語で読む → - 論文VLM/3D位置推定/HRI画像認識
人間とロボットのインタラクションのためのVLMによる単眼3D物体位置推定
手首カメラの単眼RGB画像と自然言語入力から物体の3D位置を推定するため、QLoRAと回帰ヘッドでVLMを微調整した。テストセットで中央値MAE 13mmを達成し、ベースラインより5倍改善した。
原題: Monocular 3D Object Position Estimation with VLMs for Human-Robot Interaction / Ari Wahl, Dorian Gawlinski, David Przewozny 他
日本語で読む → - 論文器用操作/強化学習ロボティクス
多様なリセットと大規模強化学習による創発的な器用さ
シミュレータのリセットを多様化して強化学習に様々なロボットと物体の相互作用を経験させることで、単一の報酬関数と固定ハイパーパラメータで長時間の器用な操作タスクを解くフレームワークOmniResetを提案した。
原題: Emergent Dexterity via Diverse Resets and Large-Scale Reinforcement Learning / Patrick Yin, Tyler Westenbroek, Zhengyu Zhang 他
日本語で読む → - 論文ロボットシステムロボティクス
精密光学システムの閉ループロボット組立・位置合わせ・自己回復のためのフレームワーク
ロボットによる精密光学システムの自律的な構築・位置合わせ・自己回復を実現するフレームワークを提案し、レーザー共振器の完全自律組み立てを実証した。
原題: A Framework for Closed-Loop Robotic Assembly, Alignment and Self-Recovery of Precision Optical Systems / Seou Choi, Sachin Vaidya, Caio Silva 他
日本語で読む → - 論文VLAロボティクス
KineVLA: 運動学を考慮した視覚言語行動モデルと二段階行動分解
言語指示に運動学的属性(方向、軌道、姿勢、相対変位など)を細かく組み込んだ新しいVLAタスクを提案し、目標の不変性と運動学的可変性を分離する二段階行動表現と推論トークンを持つKineVLAフレームワークを導入した。シミュレーションと実機で精度・制御性・汎化性が向上することを示した。
原題: KineVLA: Towards Kinematics-Aware Vision-Language-Action Models with Bi-Level Action Decomposition / Gaoge Han, Zhengqing Gao, Ziwen Li 他
日本語で読む → - 論文位置推定ロボティクス
TreeLoc++: コンパクトな森林インベントリを用いた頑健な6自由度LiDAR位置推定
森林管理のためのロボット位置推定において、従来の大容量点群ではなく、コンパクトなデジタル森林インベントリ(DFI)を直接利用する新しいグローバル位置推定フレームワークを提案し、センチメートル精度を達成した。
原題: TreeLoc++: Robust 6-DoF LiDAR Localization in Forests with a Compact Digital Forest Inventory / Minwoo Jung, Dongjae Lee, Nived Chebrolu 他
日本語で読む → - 論文UAV制御ロボティクス
適応SINDy:残差力システム同定に基づくUAV外乱抑制
風などの外乱下でのUAV安定飛行のため、データ駆動のSINDyによる残差力モデリングとRLS適応制御を統合した手法を提案し、シミュレーションと実機で検証した。
原題: Adaptive SINDy: Residual Force System Identification Based UAV Disturbance Rejection / Fawad Mehboob, Amir Atef Habel, Roohan Ahmed Khan 他
日本語で読む → - 論文宇宙機ランデブーロボティクス
マルチエージェント・マルチビュー実験およびデジタルツインランデブー(MMEDR-Autonomous)フレームワークの現状
軌道上サービスやデブリ除去などの自律ランデブー・ドッキングを目指し、学習ベースの光学航法と強化学習による誘導、ハードウェアインザループ試験を統合したフレームワークMMEDR-Autonomousを提案し、その現状と課題を報告する。
原題: Current state of the multi-agent multi-view experimental and digital twin rendezvous (MMEDR-Autonomous) framework / Logan Banker, Michael Wozniak, Mohanad Alameer 他
日本語で読む → - 論文テレオペレーション/リターゲティングロボティクス
キロヘルツ対応:制約付き器用なリターゲティングのためのスケーラブルフレームワーク
非線形最適化に頼らず、関節微分空間での凸二次計画問題として再定式化し、制御バリア関数で安全性を保証する、高速で安全な器用な手のテレオペレーション用モーションリターゲティング手法を提案した。
原題: Kilohertz-Safe: A Scalable Framework for Constrained Dexterous Retargeting / Yinxiao Tian, Ziyi Yang, Zinan Zhao 他
日本語で読む → - 論文操作学習ロボティクス
Act-Observe-Rewrite: マルチモーダルコーディングエージェントによるロボット操作の文脈内ポリシー学習
LLMエージェントが試行錯誤の観察から失敗を診断し、実行可能なPythonコードを書き換えることで、勾配更新やデモなしにロボット操作ポリシーを改善するフレームワークを提案した。
原題: Act-Observe-Rewrite: Multimodal Coding Agents as In-Context Policy Learners for Robot Manipulation / Vaishak Kumar
日本語で読む → - 論文動作生成ロボティクス
推論誘導型ビジョン・言語・モーションディフュージョンアーキテクチャによる人型教育ロボットの共感的動作生成
教育ロボットが指示に応じた共感的ジェスチャを生成するため、感情推定・教育的推論・動作生成を統合した推論誘導型フレームワークを提案し、NAOロボットへの適用可能性を示した。
原題: Empathetic Motion Generation for Humanoid Educational Robots via Reasoning-Guided Vision--Language--Motion Diffusion Architecture / Fuze Sun, Lingyu Li, Lekan Dai 他
日本語で読む → - 論文マニピュレーションロボティクス
SafeDMPs: 適応的HRIのための形式的安全性とDMPの統合
動的運動プリミティブ(DMP)に形式的な安全性保証を組み合わせ、最適化を必要とせずに障害物回避を実現する閉形式の制御則を提案した論文。
原題: SafeDMPs: Integrating Formal Safety with DMPs for Adaptive HRI / Soumyodipta Nath, Pranav Tiwari, Ravi Prakash
日本語で読む → - 論文3D幾何推定画像認識
Interp3R: フレームとイベントによる連続時間3D幾何推定
フレーム間の時間を埋めるイベントデータを用いて、任意の時刻の深度とカメラ姿勢を推定する初の手法を提案。合成データのみで訓練しつつ、実世界でも高い汎化性能を示す。
原題: Interp3R: Continuous-time 3D Geometry Estimation with Frames and Events / Shuang Guo, Filbert Febryanto, Lei Sun 他
日本語で読む →