論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文自動運転ロボティクス
IDOL: 逆動力学に基づく未来予測によるエンドツーエンド自動運転
エンドツーエンド自動運転において、BEV世界モデルによる未来予測と逆動力学モデルを組み合わせ、予測から軌道生成への橋渡しを行うことで、プランニング性能を向上させるフレームワークを提案した。
原題: IDOL: Inverse-Dynamics-Guided Future Prediction for End-to-End Autonomous Driving / Chenghao Zhang, Timin Li, Dongmei Li
日本語で読む → - 論文マニピュレーションロボティクス
多様性の罠を回避するアンカー中心適応によるロボット操作
ロボット操作におけるVLAモデルの実機適応で、多様なデモ収集が逆効果になる「多様性の罠」を特定し、アンカー中心適応(ACA)という2段階フレームワークを提案。実機実験で成功率を向上させた。
原題: Escaping the Diversity Trap in Robotic Manipulation via Anchor-Centric Adaptation / Yanzhe Chen, Kevin Yuchen Ma, Qi Lv 他
日本語で読む → - 論文模倣学習ロボティクス
表面拘束ポリシー:表面拘束かつ動的に実現可能なロボットスキルの学習
拡散ベースの模倣学習に表面形状の拘束と動的実現可能性を組み込み、自由曲面に沿ったロボット動作を生成する新しいポリシーを提案した。
原題: Surface Constraint Policy for Learning Surface-Constrained and Dynamically Feasible Robot Skills / Shuai Ke, Jiexin Zhang, Huan Zhao 他
日本語で読む → - 論文タスク学習ロボティクス
デモンストレーションからの帰納論理プログラミングによる合成的シンボリックタスクルールの学習
複雑なロボットタスクを抽象度の異なる複数の単純な学習目標に分解し、帰納論理プログラミングでシンボリックなルールを学習する手法を提案。合成ブロック組み立てタスクで解釈可能性と汎化性能を評価した。
原題: Learning Compositional Symbolic Task Rules from Demonstrations with Inductive Logic Programming / Oleh Borys, Karla Stepanova
日本語で読む → - 論文強化学習機械学習
数分でレースを学習:Mini WheelbotにおけるInfoprop Dyna
実機のMini Wheelbot(一輪車ロボット)が、モデルベース強化学習フレームワークInfoprop Dynaを用いて、実世界でのインタラクションのみから11分でトラックを周回するレースを学習できることを実証した論文。
原題: Learning to Race in Minutes: Infoprop Dyna on the Mini Wheelbot / Devdutt Subhasish, Henrik Hose, Sebastian Trimpe
日本語で読む → - 論文強化学習機械学習
エントロピー正則化に基づく近位方策最適化(ERPPO)
マルチエージェント強化学習における非定常な観測環境での方策最適化を改善するため、エントロピー正則化項を導入した新しいPPO手法を提案した。
原題: ERPPO: Entropy Regularization-based Proximal Policy Optimization / Changha Lee, Gyusang Cho
日本語で読む → - 論文遠隔操作ロボティクス
視覚ベース遠隔操作のための生成的予測ディスプレイに向けて:既製ビデオモデルのゼロショットベンチマーク
通信遅延による遠隔操作の性能低下を補うため、既製の生成ビデオモデルをゼロショットで用いた短期的な未来フレーム予測のベンチマークを実施し、現状のモデルでは低誤差・非発散・リアルタイム性を同時に満たせないことを示した。
原題: Towards Generative Predictive Display for Vision-Based Teleoperation: A Zero-Shot Benchmark of Off-the-Shelf Video Models / Aws Khalil, Jaerock Kwon
日本語で読む → - 論文ナビゲーションロボティクス
サンドボックスで計画し、オープンワールドでナビゲート:物理に基づく抽象化経験学習による具現化ナビゲーション
物理法則に基づく抽象化環境で強化学習を行い、その経験を実世界のナビゲーションに転移するフレームワークSAGEを提案した。
原題: Plan in Sandbox, Navigate in Open Worlds: Learning Physics-Grounded Abstracted Experience for Embodied Navigation / Zhixuan Shen, Jiawei Du, Ziyu Guo 他
日本語で読む → - 論文自動運転/駐車支援ロボティクス
センサ融合と動作計画を用いたトラクタートレーラー輸送車両の駐車支援
トラクタートレーラーの自動駐車を実現するため、センサ融合、Hybrid A*経路計画、非線形モデル予測制御を統合したフレームワークを提案し、オープンソースのA*シミュレーションを拡張して実証した。
原題: Parking Assistance for Trailer-Truck Transport Vehicles Using Sensor Fusion and Motion Planning / George Alenchery, Thomas Jeske, Tova Quinones 他
日本語で読む → - 論文最適化機械学習
最適輸送による非微分可能ネットワークの学習
スパイキング閾値や量子化など微分不可能な損失関数を、前方計算のみで最適化する手法PolyStepを提案した論文。
原題: Training Non-Differentiable Networks via Optimal Transport / An T. Le
日本語で読む → - 論文触覚ロボティクス
TacO: 物体操作のための触覚センサのベンチマーク
物体操作における4種類の触覚センサ(視覚、音響、磁気、抵抗)の性能を、3つの操作タスクで系統的に評価し、タスクに適したセンサ選択の枠組みを提案した論文。
原題: TacO: Benchmarking Tactile Sensors for Object Manipulation / Anya Zorin, Zilin Si, Myungsun Park 他
日本語で読む → - 論文ビデオ世界モデルロボティクス
RoboAlign-R1: ロボットビデオ世界モデルのための蒸留型マルチモーダル報酬アライメント
ロボットビデオ世界モデルの訓練を、再構成損失などの低レベル目的ではなく、指示追従や操作成功などの意思決定に重要な能力に合わせるため、報酬アライメントと長期推論安定化を組み合わせたフレームワークを提案した。
原題: RoboAlign-R1: Distilled Multimodal Reward Alignment for Robot Video World Models / Hao Wu, Yuqi Li, Yuan Gao 他
日本語で読む → - 論文ナビゲーションロボティクス
EvoNav: 大規模言語モデルを用いたロボットナビゲーションの進化的報酬関数設計
ロボットナビゲーションの強化学習における報酬関数の設計を、大規模言語モデルと進化的アルゴリズムで自動化する手法を提案した論文。
原題: EvoNav: Evolutionary Reward Function Design for Robot Navigation with Large Language Models / Zhikai Zhao, Chuanbo Hua, Federico Berto 他
日本語で読む → - 論文ロボット学習基盤ロボティクス
Nautilus: 単一プロンプトからプラグアンドプレイのロボット学習へ
ロボット学習研究の断片化を解消するため、単一のユーザープロンプトから再現・評価・微調整・展開ワークフローを自動生成するオープンソースハーネスNAUTILUSを提案。ポリシー、シミュレータ、実ロボット間の統一インターフェースと自動検証により、手書きのグルーコードなしで相互検証を拡張する。
原題: Nautilus: From One Prompt to Plug-and-Play Robot Learning / Yufeng Jin, Jianfei Guo, Xiaogang Jia 他
日本語で読む → - 論文ヒューマノイド安全制御ロボティクス
SPARKヒューマノイド安全フィルタの敵対的ストレステスト
SPARKヒューマノイドの安全フィルタを再現し、障害物の密集やノイズなどの厳しい条件下でロバスト性を評価した。
原題: Adversarial Stress Testing of SPARK Humanoid Safety Filters / Saurav Ghosh, Abdou Sow, Luke Zhang
日本語で読む → - 論文ソフトロボティクス制御
離散コセラットロッドの準静的制御
コセラットロッド理論に基づくソフトロボットの準静的モデルに対して、外部ワンチを入力とするフィードバック制御則を設計し、エンドエフェクタの軌道追従と形状制御を数値実験で実証した。
原題: Quasi-Static Control of Discrete Cosserat Rod / Srishti Siddharth, Domenico Campolo, Ravi Banavar
日本語で読む → - 論文ナビゲーションロボティクス
PathPainter: 画像生成モデルの汎化能力を身体化ナビゲーションへ転移する
鳥瞰図画像を大域的な事前情報として用い、画像生成モデルで自然言語から目標地点と走行可能領域を推定し、クロスビュー位置合わせでドリフトを補正するナビゲーションシステムを提案。UAVで160mの長距離ナビゲーションを実証した。
原題: PathPainter: Transferring the Generalization Ability of Image Generation Models to Embodied Navigation / Yijin Wang, Yuru Tian, Xijie Huang 他
日本語で読む → - 論文ナビゲーションロボティクス
G-DRAGON: 屋外ナビゲーションのための地理空間推論と動的計画を備えた検索拡張フレームワーク
自然言語の指示からOSM地図を検索して大域経路を計画し、SLAMと組み合わせてロボットを目的地まで誘導し、最後の区間はフロンティア探索とセマンティックボクセルマッピングで目標物を探索する屋外ナビゲーション手法を提案した。
原題: G-DRAGON: Geospatial Reasoning and Dynamic Planning for Retrieval-Augmented Outdoor Navigation / Dongzhihan Wang, Yi Du, Jianan Sun 他
日本語で読む → - 論文マニピュレーションロボティクス
ハンド・イン・ザ・ループ:シームレスな手と腕の介入による巧みな操作のためのVLAポリシー改善
高自由度ロボットハンドの巧みな操作において、人間の介入時に発生する「ジェスチャージャンプ」を防ぐため、人間の修正意図と自律ポリシー実行をブレンドする介入手法HandITLを提案し、介入ジッタや把持失敗を大幅に低減した。
原題: Hand-in-the-Loop: Improving VLA Policies for Dexterous Manipulation via Seamless Hand-Arm Intervention / Zhuohang Li, Liqun Huang, Wei Xu 他
日本語で読む → - 論文プランニング機械学習
EUPHORIA: ハイブリッド最適化による効率的な汎用プランニングで堅牢な産業用ロボット組立を実現
建築用ロボット組立のための、グラフハイパーネットワークと物理情報付きトランスフォーマーを組み合わせた、少数ショット適応と動的効率性を両立する統合プランニングフレームワークを提案した。
原題: EUPHORIA: Efficient Universal Planning via Hybrid Optimization for Robust Industrial Robotic Assembly / Shih-Yu Lai, Chia-Ching Yen, Yang-Ting Shen 他
日本語で読む → - 論文UAV追跡/シミュレーションロボティクス
CosFly: マトリックスで計画し、世界で飛ぶ
空中追跡のためのボックス構造計画とマルチモーダルシミュレーションパイプライン、および多様な環境での動的ターゲット追跡用の大規模UAVデータセットCosFly-Trackを提案する。
原題: CosFly: Plan in the Matrix, Fly in the World / Hanxuan Chen, Xiangyue Wang, Songsheng Cheng 他
日本語で読む → - 論文VLA/ベンチマーク画像認識
Embodied3DBench: 視覚言語モデルの低水準身体化空間知能のベンチマーク
視覚言語モデルの身体化3D環境における低水準空間知能を評価するベンチマークを提案し、13モデルの評価と大規模データセットによる改善を示した。
原題: Embodied3DBench: Benchmarking Low-Level Embodied Spatial Intelligence of Vision Language Models / Jiyao Zhang, Mingxu Zhang, Yitong Peng 他
日本語で読む → - 論文群制御AI
SOAR: ロボット移動フルフィルメントシステムにおける注文割り当てとロボットスケジューリングのリアルタイム統合最適化
注文割り当てとロボットスケジューリングを統合的に扱う深層強化学習フレームワークSOARを提案し、実時間性と大域最適性の両立を図った。
原題: SOAR: Real-Time Joint Optimization of Order Allocation and Robot Scheduling in Robotic Mobile Fulfillment Systems / Yibang Tang, Yifan Yang, Jingyuan Wang 他
日本語で読む → - 論文セキュリティ/VLAロボティクス
ATAAT: 視覚-言語-行動モデルに対するバックドア攻撃を防ぐ適応型脅威認識敵対的チューニングフレームワーク
視覚-言語-行動(VLA)モデルの視覚経路へのバックドア攻撃を研究し、従来手法の失敗原因である「勾配干渉」を解決する適応型フレームワークを提案した。
原題: ATAAT: Adaptive Threat-Aware Adversarial Tuning Framework against Backdoor Attacks on Vision-Language-Action Models / Kewei Chen, Yayu Long, Shuai Li 他
日本語で読む → - 論文空中操作/制御ロボティクス
クワッドローターによるケーブル吊り下げ荷物の敏捷な輸送のためのセンサレス状態推定と制御
UAVによるケーブル吊り下げ荷物の輸送において、Udwadia-Kalaba法を用いてケーブルの幾何学的制約を明示的にモデル化し、センサレスで荷物の状態を推定しつつNMPCに統合する手法を提案した。実機実験で軌道追従誤差が低減することを示した。
原題: Sensorless State Estimation and Control for Agile Cable-Suspended Payload Transport by Quadrotors / Ana Maria Nascimento, Augusto Sales, Antonio Marcus Lima 他
日本語で読む → - 論文経路計画ロボティクス
制約環境下での3次元ナビゲーションのためのセル分割に基づく経路計画手法
占有グリッドを隣接セル間で相互可視性を保証するセルに分割し、その枠組みでSOCPやMISOCPによる経路最適化を可能にし、さらにYenのk最短経路とSOCPを組み合わせたKSP-SOCP法を提案した。都市様の環境で評価し、大規模問題に適した性能を示した。
原題: A cell-decomposition based path planner for 3D navigation in constrained workspaces / João P. L. Morais, Luciano C. A. Pimenta, Marcelo A. Santos 他
日本語で読む → - 論文具現化AI/材料科学cond-mat.mes-hall
Qumus: 具現化AI量子材料実験者の実現
ロボット実験室に具現化したマルチモーダル・マルチエージェントAIシステムQumusを開発し、グラフェン生成やvdW積層によるナノデバイス作製など、量子材料の自律的な実験サイクルを初めて実現した。
原題: Qumus: Realization of An Embodied AI Quantum Material Experimentalist / Lihan Shi, Zhaoyi Joy Zheng, Xinzhe Juan 他
日本語で読む → - 論文ニューロモルフィックビジョンeess.IV
ニューロモルフィックビジョンによる動きの中のシルエット認識
イベントカメラとフレームを組み合わせ、CPUのみでリアルタイムに高フレームレートの二値化を行う手法を提案。動きぼけや照明変化に強く、従来法より低コストで高精度。
原題: See Silhouettes in Motion with Neuromorphic Vision / Pei Zhang, Shijie Lin, Zhou Ge 他
日本語で読む → - 論文操作ロボティクス
LLMによる将来仮説の生成を用いた多段階ロボット操作における地平線認識探索
多段階ロボット操作において、LLMとビデオ拡散モデルを用いて短期的な未来ビデオを生成し、それを条件としてポリシーを学習することで、探索と適応を改善する手法を提案した。
原題: LLM-Guided Future Hypotheses for Horizon-Aware Exploration in Multi-Step Robot Manipulation / Mohammad Khoshnazar, Andrew Melnik, Michael Beetz
日本語で読む → - 論文データセット画像認識
LRDDv3: 距離情報と熱画像を備えた高解像度長距離ドローン検出データセット
長距離ドローン検出のための高解像度RGB画像と熱画像を含む大規模データセットを構築し、距離情報も提供する。
原題: LRDDv3: High-Resolution Long-Range Drone Detection Dataset with Range Information and Thermal Data / Knut Peterson, Zaid Mayers, Azmain Yousuf 他
日本語で読む →