論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文宇宙機制御/模倣学習ロボティクス
宇宙機近接運用のための非線形モデル予測制御からの安全性保証付き模倣学習
宇宙機の近接制御において、制御バリア関数と制御リアプノフ関数を用いて安全性と安定性を保証しつつ、非線形MPCの専門家からニューラルポリシーを模倣学習し、展開時には軽量なQPフィルタで安全性を維持する手法を提案した。
原題: Safety-Guaranteed Imitation Learning from Nonlinear Model Predictive Control for Spacecraft Close Proximity Operations / Alexander Meinert, Niklas Baldauf, Peter Stadler 他
日本語で読む → - 論文VLAロボティクス
フローからワンステップへ:暗黙的最大尤度推定に基づく分布蒸留によるリアルタイムマルチモーダル軌道ポリシー
条件付きフローマッチングの専門家を暗黙的最大尤度推定で単一ステップの生徒モデルに蒸留し、多様な動作モードを保ちながらリアルタイムな閉ループ制御を可能にした。
原題: From Flow to One Step: Real-Time Multi-Modal Trajectory Policies via Implicit Maximum Likelihood Estimation-based Distribution Distillation / Ju Dong, Liding Zhang, Lei Zhang 他
日本語で読む → - 論文視覚言語モデル/ナビゲーション支援画像認識
視覚障害者向けナビゲーション支援におけるVLMの活用可能性の探求
視覚障害者(pBLV)のナビゲーション支援における視覚言語モデル(VLM)の性能を、閉域・オープンソースモデルを比較評価し、空間推論やシーン理解の課題と可能性を明らかにした。
原題: Exploring the Use of VLMs for Navigation Assistance for People with Blindness and Low Vision / Yu Li, Yuchen Zheng, Giles Hamilton-Fletcher 他
日本語で読む → - 論文操作学習ロボティクス
Act-Observe-Rewrite: マルチモーダルコーディングエージェントによるロボット操作の文脈内ポリシー学習
LLMエージェントが試行錯誤の観察から失敗を診断し、実行可能なPythonコードを書き換えることで、勾配更新やデモなしにロボット操作ポリシーを改善するフレームワークを提案した。
原題: Act-Observe-Rewrite: Multimodal Coding Agents as In-Context Policy Learners for Robot Manipulation / Vaishak Kumar
日本語で読む → - 論文センサキャリブレーション画像認識
拡散LiDARの空間キャリブレーション
拡散型LiDARの各画素のフットプリントと空間感度を推定し、RGB画像との対応を取るキャリブレーション手法を提案した。
原題: Spatial Calibration of Diffuse LiDARs / Nikhil Behari, Ramesh Raskar
日本語で読む → - 論文sim2realロボティクス
CAR: モビリティ表現による車両間キノダイナミクス適応
Transformerエンコーダで車両の軌道遷移と物理構成を共通のモビリティ潜在空間に埋め込み、近傍から共通性を抽出することで、新たな車両へのキノダイナミクス適応を短時間・低計算コストで実現するフレームワークを提案。
原題: CAR: Cross-Vehicle Kinodynamics Adaptation via Mobility Representation / Tong Xu, Chenhui Pan, Xuesu Xiao
日本語で読む → - 論文状態推定ロボティクス
無人地上車両ナビゲーションのためのハイブリッドニューラル支援アンセンテッドカルマンフィルタ
慣性センサとGNSSの融合に用いるUKFのノイズ共分散を、シミュレーションデータのみで訓練した深層ニューラルネットワークが実測値から予測するハイブリッド推定手法を提案し、3データセットで位置精度を向上させた。
原題: A Hybrid Neural-Assisted Unscented Kalman Filter for Unmanned Ground Vehicle Navigation / Gal Versano, Itzik Klein
日本語で読む → - 論文農業ロボット/予測制御ロボティクス
農作業ロボットのオフセット点追従のための予測制御戦略
アッカーマン型農業車両を対象に、装着した作業機を剛体オフセット点として明示的にモデル化し、横滑りやてこの腕効果を考慮した閉形式予測制御を提案。実機実験で追従誤差を大幅に低減した。
原題: A Predictive Control Strategy to Offset-Point Tracking for Agricultural Mobile Robots / Stephane Ngnepiepaye Wembe, Vincent Rousseau, Johann Laconte 他
日本語で読む → - 論文マニピュレーションロボティクス
輸送から操作へ:磁気浮上を磁気ロボティクスへ変革する
磁気浮上システムを利用した低コスト6自由度パラレルキネマティクスプラットフォーム「6D-Platform MagBot」を提案し、サブミリ精度の位置決めと自動着脱による自律的なピックアップ/ドロップオフを実証した。
原題: From Transportation to Manipulation: Transforming Magnetic Levitation to Magnetic Robotics / Lara Bergmann, Noah Greis, Klaus Neumann
日本語で読む → - 論文マニピュレーションロボティクス
RMBench:記憶依存型ロボットマニピュレーションのベンチマークと政策設計への洞察
記憶を必要とするロボット操作タスクを体系的に評価する9タスクのシミュレーションベンチマークRMBenchと、明示的記憶モジュールを持つ操作政策Mem-0を提案し、既存政策の記憶限界と設計指針を明らかにした。
原題: RMBench: Memory-Dependent Robotic Manipulation Benchmark with Insights into Policy Design / Tianxing Chen, Yuran Wang, Mingleyang Li 他
日本語で読む → - 論文自動運転ロボティクス
ユーザーは走行速度を指定できるか? Bench2Drive-Speed: 所望速度条件付き自動運転のためのベンチマークとベースライン
自動運転において、ユーザーが希望する速度や追い越し可否を指定できるようにするためのベンチマークとデータセット、ベースラインモデルを提案した論文。
原題: Can Users Specify Driving Speed? Bench2Drive-Speed: Benchmark and Baselines for Desired-Speed Conditioned Autonomous Driving / Yuqian Shao, Xiaosong Jia, Langechuan Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
曲面制約付きオフライン変形と接触認識オンラインポーズ投影による安全なロボット軌道実行
曲面に沿った繰り返し工具動作を安全に実行するため、オフラインで曲面に適合する参照軌道を生成し、オンラインで接触力と姿勢制約を考慮して軌道ずれを補正する2段階フレームワークを提案した。
原題: Surface-Constrained Offline Warping with Contact-Aware Online Pose Projection for Safe Robotic Trajectory Execution / Farong Wang, Sai Swaminathan, Fei Liu
日本語で読む → - 論文両腕操作ロボティクス
両腕ロボット操作のための時間的タスク構造と動作タイミングの統合学習
人間のデモから記号的・非記号的な時間的制約を学習し、両腕操作の実行可能な時間パラメータ付きプランを生成する手法を提案した。
原題: Unified Learning of Temporal Task Structure and Action Timing for Bimanual Robot Manipulation / Christian Dreher, Patrick Dormanns, Andre Meixner 他
日本語で読む → - 論文状態推定ロボティクス
脚式ロボットのための相互作用多重モデル固有受容オドメトリ
接触仮定の不確かさに対処するため、相互作用多重モデル(IMM)を用いて複数の接触仮説を確率的に融合する脚式ロボットの固有受容オドメトリ手法を提案し、姿勢推定精度を向上させた。
原題: Interacting Multiple Model Proprioceptive Odometry for Legged Robots / Wanlei Li, Zichang Chen, Shilei Li 他
日本語で読む → - 論文触覚ロボティクス
生体模倣触覚ハンドによる接触状態認識と滑り検出
多指生体模倣ハンドの触覚センサから得た信号をウェーブレット変換し、特徴抽出とビニング手法で接触状態を認識することで滑りを検出する手法を提案した。
原題: Contact Status Recognition and Slip Detection with a Bio-inspired Tactile Hand / Chengxiao He, Wenhui Yang, Hongliang Zhao 他
日本語で読む → - 論文自動運転シナリオ生成ロボティクス
マップ非依存かつ対話的な安全性臨界シナリオ生成:多目的木探索によるアプローチ
自動運転システムの検証のため、多目的モンテカルロ木探索を用いて、現実的で多様な衝突シナリオを生成するフレームワークを提案した。地図に依存せず、交通参加者間の明示的な相互作用を考慮する。
原題: Map-Agnostic And Interactive Safety-Critical Scenario Generation via Multi-Objective Tree Search / Wenyun Li, Zejian Deng, Chen Sun
日本語で読む → - 論文農業ロボット/物体検出画像認識
注釈から検出へ:移動農業ロボットによる圃場でのブドウ幹位置特定のための自律的かつ堅牢なフレームワーク
限られたラベル付きデータで頑健なマルチモーダル検出器を訓練するための注釈から検出へのフレームワークを提案し、実際のブドウ園で幹検出と位置特定を実証した。
原題: An Annotation-to-Detection Framework for Autonomous and Robust Vine Trunk Localization in the Field by Mobile Agricultural Robots / Dimitrios Chatziparaschis, Elia Scudiero, Brent Sams 他
日本語で読む → - 論文計画ロボティクス
相互作用データから学習した記号的抽象化を用いた二段階計画法
ロボットの探索データから学習した確率的記号規則で候補計画を高速生成し、連続効果モデルで検証・補完する二段階のニューロシンボリック計画フレームワークを提案した。
原題: Bilevel Planning with Learned Symbolic Abstractions from Interaction Data / Fatih Dogangun, Burcu Kilic, Serdar Bahar 他
日本語で読む → - 論文マニピュレーションロボティクス
HyReach: 未知の雑然環境における視覚誘導型ハイブリッドマニピュレータのリーチング
剛体と軟体を組み合わせた連続体マニピュレータで、視覚と3D再構成に基づく動作計画により、未見の雑然環境でも2cm以下の誤差で対象物に到達できるシステムを実現した。
原題: HyReach: Vision-Guided Hybrid Manipulator Reaching in Unseen Cluttered Environments / Shivani Kamtikar, Kendall Koe, Justin Wasserman 他
日本語で読む → - 論文UAV計画/LLMロボティクス
LLMによる能動的質問生成を用いたドローン計画における知識ギャップの推論
UAVと人間の協調計画において、制御の引き継ぎではなく能動的な情報引き出しを行う枠組みを提案。LLMを用いて障害物や目標に関する知識ギャップを最小限の質問で解消する。
原題: Reasoning Knowledge-Gap in Drone Planning via LLM-based Active Elicitation / Zeyu Fang, Beomyeol Yu, Cheng Liu 他
日本語で読む → - 論文自動運転/経路計画ロボティクス
Wild-Drive: 頑健なマルチモーダルルーティングと効率的な大規模言語モデルによるオフロードシーン記述と経路計画
オフロード環境でのシーン記述と経路計画を統合するフレームワークWild-Driveを提案。センサ劣化時に信頼できる情報を適応的に集約するMoRo-Formerと効率的なLLMを用い、劣化条件下でも安定した性能を実現。
原題: Wild-Drive: Off-Road Scene Captioning and Path Planning via Robust Multi-modal Routing and Efficient Large Language Model / Zihang Wang, Xu Li, Benwu Wang 他
日本語で読む → - 論文ナビゲーションロボティクス
文脈依存の人間選好を解釈する多目的ロボットナビゲーション
VLMとLLMで環境文脈と自然言語の指示を解釈し、選好ベクトルに変換して多目的強化学習ナビゲーション方策を適応させるフレームワークを提案した。
原題: Interpreting Context-Aware Human Preferences for Multi-Objective Robot Navigation / Tharun Sethuraman, Subham Agrawal, Nils Dengler 他
日本語で読む → - 論文マニピュレーションロボティクス
MemoAct: アトキンソン=シフリン記憶モデルに着想を得たロボットマニピュレーション向け階層的記憶拡張ポリシー
人間の記憶モデルに倣い、感覚・短期・長期の階層的記憶を組み合わせてロボットのマニピュレーションを記憶依存タスクで高精度化するポリシーを提案し、新ベンチマークで有効性を示した。
原題: MemoAct: Atkinson-Shiffrin-Inspired Hierarchical Memory-Augmented Policy for Robotic Manipulation / Liufan Tan, Jiale Li, Gangshan Jing
日本語で読む → - 論文ナビゲーションロボティクス
eNavi: 低照度屋内移動ロボットナビゲーションのためのイベントベース模倣ポリシー
イベントカメラとRGBを融合した模倣学習ポリシーを提案し、低照度環境での人物追従ナビゲーションの堅牢性を向上させた。
原題: eNavi: Event-based Imitation Policies for Low-Light Indoor Mobile Robot Navigation / Prithvi Jai Ramesh, Kaustav Chanda, Krishna Vinod 他
日本語で読む → - 論文マニピュレーション画像認識
デジタルツイン駆動の繊維分類と異物認識による自動選別システム
デジタルツインとVLMを組み合わせ、双腕ロボットが衣類を把持・検査・分類し異物も検出する自動選別システムを構築し、9種のVLMを223シーンで評価した。
原題: Digital Twin Driven Textile Classification and Foreign Object Recognition in Automated Sorting Systems / Serkan Ergun, Tobias Mitterer, Hubert Zangl
日本語で読む → - 論文物体探索ナビゲーションロボティクス
IGV-RRT: 変化する環境における能動的物体探索のための事前・リアルタイム観測融合
時間的に変化する屋内環境で物体を探すため、3Dシーングラフの事前知識とVLMによるリアルタイム観測を融合し、情報利得と意味的手がかりを考慮したRRTプランナで探索する手法を提案。
原題: IGV-RRT: Prior-Real-Time Observation Fusion for Active Object Search in Changing Environments / Wei Zhang, Ping Gong, Yujie Wang 他
日本語で読む → - 論文マルチエージェント強化学習画像認識
支援動作の学習:マルチエージェント強化学習による物理基盤の人間-人間制御
人間同士の支援動作(力のやり取りを伴う)を物理シミュレータ上でマルチエージェント強化学習により模倣する手法を提案し、支援者と被支援者の双方のポリシーを協調学習させることで、従来手法では困難だった支援動作の追跡を可能にした。
原題: Learning to Assist: Physics-Grounded Human-Human Control via Multi-Agent Reinforcement Learning / Yuto Shibata, Kashu Yamazaki, Lalit Jayanti 他
日本語で読む → - 論文安全性・ガバナンスcs.MA
アラインメント・フライホイール:アーキテクチャ非依存の安全性を実現するガバナンス中心のハイブリッドMAS
意思決定生成と安全ガバナンスを分離し、安全障害をオラクルの更新で局所的に修正できる、ガバナンス中心のハイブリッドマルチエージェントシステムを提案した論文。
原題: The Alignment Flywheel: A Governance-Centric Hybrid MAS for Architecture-Agnostic Safety / Elias Malomgré, Pieter Simoens
日本語で読む → - 論文自動運転画像認識
WorldVLM:世界モデル予測と視覚言語推論の統合
自動運転向けに、高次シーン理解のVLMと環境ダイナミクス予測の世界モデルを統合したハイブリッドアーキテクチャを提案し、VLMの行動コマンドで世界モデルを誘導する手法を評価した。
原題: WorldVLM: Combining World Model Forecasting and Vision-Language Reasoning / Stefan Englmeier, Katharina Winter, Fabian B. Flohr
日本語で読む → - 論文強化学習機械学習
オンライン強化学習制御アルゴリズム解釈のためのCritic適合損失景観の可視化
オンライン強化学習のCriticネットワークの学習過程を低次元部分空間に射影して損失景観を可視化し、定量的指標で性能を比較する手法を提案。
原題: Visualizing Critic Match Loss Landscapes for Interpretation of Online Reinforcement Learning Control Algorithms / Jingyi Liu, Jian Guo, Eberhard Gill
日本語で読む →