論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ヒューマノイド動作生成機械学習
PhysMoDPO: 選好最適化による物理的に妥当なヒューマノイド動作生成
全身制御器(WBC)を訓練に組み込み、拡散モデルが生成する動作を物理法則とテキスト指示の両方に適合させる選好最適化フレームワークを提案し、シミュレーションと実機G1ヒューマノイドで有効性を示した。
原題: PhysMoDPO: Physically-Plausible Humanoid Motion with Preference Optimization / Yangsong Zhang, Anujith Muraleedharan, Rikhat Akizhanov 他
日本語で読む → - 論文VLAロボティクス
思考の改変が行動を変える:VLAロボット操作におけるChain-of-Thoughtの脆弱性の探究
VLAモデルが生成する推論トレースを人為的に破壊すると、物体名の置換のみが成功率を大きく低下させ、行動デコーダが推論の質ではなく実体参照の整合性に依存していることを示した。
原題: Altered Thoughts, Altered Actions: Probing Chain-of-Thought Vulnerabilities in VLA Robotic Manipulation / Tuan Duong Trinh, Naveed Akhtar, Basim Azam
日本語で読む → - 論文水中ロボットロボティクス
水中ロボットの身体化知能:計画・制御・展開における制約連成の視点
水中ロボットの自律性を阻む物理的制約(流体力学的不確実性、部分観測性、通信帯域、エネルギー制約)が相互に連成する問題を整理し、強化学習や信念計画、ハイブリッド制御などの最新手法を統合するレビュー論文。
原題: Underwater Embodied Intelligence for Autonomous Robots: A Constraint-Coupled Perspective on Planning, Control, and Deployment / Jingzehua Xu, Guanwen Xie, Jiwei Tang 他
日本語で読む → - 論文マイクロマニピュレーションロボティクス
時間変動流下でのマイクロロボット細胞押し操作のための残差RL-MPC
マイクロ流体中の細胞押し操作を、MPCに強化学習で学習した残差ポリシーを組み合わせたハイブリッド制御で行い、時間変動流下でのロバスト性と追従精度を向上させた。
原題: Residual RL-MPC for Robust Microrobotic Cell Pushing Under Time-Varying Flow / Yanda Yang, Sambeeta Das
日本語で読む → - 論文動作生成ロボティクス
推論誘導型ビジョン・言語・モーションディフュージョンアーキテクチャによる人型教育ロボットの共感的動作生成
教育ロボットが指示に応じた共感的ジェスチャを生成するため、感情推定・教育的推論・動作生成を統合した推論誘導型フレームワークを提案し、NAOロボットへの適用可能性を示した。
原題: Empathetic Motion Generation for Humanoid Educational Robots via Reasoning-Guided Vision--Language--Motion Diffusion Architecture / Fuze Sun, Lingyu Li, Lekan Dai 他
日本語で読む → - 論文器用操作/強化学習ロボティクス
多様なリセットと大規模強化学習による創発的な器用さ
シミュレータのリセットを多様化して強化学習に様々なロボットと物体の相互作用を経験させることで、単一の報酬関数と固定ハイパーパラメータで長時間の器用な操作タスクを解くフレームワークOmniResetを提案した。
原題: Emergent Dexterity via Diverse Resets and Large-Scale Reinforcement Learning / Patrick Yin, Tyler Westenbroek, Zhengyu Zhang 他
日本語で読む → - 論文群制御AI
学習誘導型優先順位計画法による倉庫自動化における生涯マルチエージェント経路探索
倉庫自動化のための生涯マルチエージェント経路探索(MAPF)において、強化学習と探索ベース計画を統合した初のフレームワークRL-RH-PPを提案し、動的優先順位割り当てをPOMDPとして定式化し、注意機構付きニューラルネットワークで優先順位を逐次生成することで、高いスループットと汎化性能を実現した。
原題: Learning-guided Prioritized Planning for Lifelong Multi-Agent Path Finding in Warehouse Automation / Han Zheng, Yining Ma, Brandon Araki 他
日本語で読む → - 論文模倣学習/自動運転ロボティクス
補正行動拡張とマルチスケール模倣学習による歩道自動運転の実現
歩道向け小型モビリティの自動運転制御を、補正行動データの追加とマルチスケール模倣学習アーキテクチャにより強化し、実世界での堅牢性と汎化性を向上させた。
原題: Learning Sidewalk Autopilot from Multi-Scale Imitation with Corrective Behavior Expansion / Honglin He, Yukai Ma, Brad Squicciarini 他
日本語で読む → - 論文安全強化学習機械学習
LTL制約をPPOに統合した安全な強化学習
線形時相論理(LTL)で記述された安全制約をPPOに統合し、制約違反を監視してペナルティ信号に変換することで、安全な強化学習を実現するフレームワークを提案した。
原題: Integrating LTL Constraints into PPO for Safe Reinforcement Learning / Maifang Zhang, Hang Yu, Qian Zuo 他
日本語で読む → - 論文ビジョンシステム画像認識
惑星探査ローバーのための深層学習支援ビジョンシステム
惑星探査ローバー向けに、リアルタイム認識とオフライン地形再構成を組み合わせたビジョンシステムを提案し、月面画像での距離推定精度を評価した。
原題: Deep Learning Aided Vision System for Planetary Rovers / Lomash Relia, Jai G Singla, Amitabh 他
日本語で読む → - 論文マニピュレーションロボティクス
受動ローラーによる異方性摩擦変調を用いたロボット巧緻操作
指先に受動ローラーを備え、制動や旋回により接触摩擦と拘束方向を変調できる指先を設計し、把持内の滑りや回転など多様な巧緻操作を実現した。
原題: Robotic Dexterous Manipulation via Anisotropic Friction Modulation using Passive Rollers / Ethan Fisk, Taeyoon Lee, Shenli Yuan
日本語で読む → - 論文流体力学/群制御ロボティクス
過去を目覚めさせる:流体後流効果をロボットにモデル化するための記憶の利用
マルチコプターや魚雷など、媒体を撹乱して移動するロボットが生み出す後流効果が隣接ロボットに及ぼす影響を、過去の状態履歴と輸送遅延を考慮したデータ駆動モデルで正確に予測する手法を提案・検証した。
原題: Wake Up to the Past: Using Memory to Model Fluid Wake Effects on Robots / Luca Vendruscolo, Eduardo Sebastián, Amanda Prorok 他
日本語で読む → - 論文運動計画ロボティクス
非微分平坦システム向け連続安全性保証付き高速スプライン時間最適運動計画
分離超平面の決定を最適制御問題から分離し、線形システムや二次計画で解くことで、障害物回避のための非凸制約を線形化し、計算時間を最大60%削減しつつ連続的な安全性を保証する手法を提案した。
原題: Accelerated Spline-Based Time-Optimal Motion Planning with Continuous Safety Guarantees for Non-Differentially Flat Systems / Dries Dirckx, Jan Swevers, Wilm Decré
日本語で読む → - 論文群制御ロボティクス
UMBRELLA: 動的時相論理タスク下での不確実性を考慮したマルチロボットリアクティブ協調
動的で移動する目標を含む協調タスクを、不確実性を明示的にモデル化しつつ、時相論理の制約を満たすようにマルチロボットを協調させるフレームワークを提案。MCTSと不確実性を考慮したロールアウトを組み合わせ、CVaRを最小化する。
原題: UMBRELLA: Uncertainty-aware Multi-robot Reactive Coordination under Dynamic Temporal Logic Tasks / Qisheng Zhao, Meng Guo, Hengxuan Du 他
日本語で読む → - 論文オドメトリロボティクス
厳しい条件下でのLiDAR-慣性-視覚オドメトリにおける視覚特徴表現のベンチマーキング
厳しい視覚条件下でのロバストな位置推定を目指し、FAST-LIVO2に直接法と記述子ベースの特徴マッチングを組み合わせたハイブリッド手法を提案し、複数の特徴ペアを精度・計算コスト・追跡安定性で比較評価した。
原題: Benchmarking Visual Feature Representations for LiDAR-Inertial-Visual Odometry Under Challenging Conditions / Eunseon Choi, Junwoo Hong, Daehan Lee 他
日本語で読む → - 論文ナビゲーションロボティクス
視覚言語モデルによる動的制御バリア関数の調整:安全・適応・リアルタイムな視覚ナビゲーション
ロボットのナビゲーションにおいて、視覚言語モデル(VLM)がカメラ画像からリスクを推定し、制御バリア関数(CBF)の安全フィルタの保守性をリアルタイムに調整するフレームワークAlphaAdjを提案。固定パラメータと比較して効率を最大18.5%向上させつつ衝突回避を維持する。
原題: Dynamic Control Barrier Function Regulation with Vision-Language Models for Safe, Adaptive, and Realtime Visual Navigation / Jeffrey Chen, Rohan Chandra
日本語で読む → - 論文自動運転/プランニングロボティクス
自動運転のための時間的に分離された拡散プランニング
自動運転の軌道生成を時間的に分離し、近い将来と遠い将来の異なる依存関係を扱う拡散モデルを提案。ノイズをマスクとして用いる手法と新しい正規化層により、nuPlanベンチマークで高い性能を達成した。
原題: Temporally Decoupled Diffusion Planning for Autonomous Driving / Xiang Li, Bikun Wang, John Zhang 他
日本語で読む → - 論文軌道予測ロボティクス
後悔せず修正せよ:軌道予測における微分可能シミュレーションの落とし穴を避ける
自動運転の軌道予測で、微分可能な閉ループシミュレーションが将来情報の漏洩による近道学習を起こす問題を指摘し、計算グラフを切断した非微分可能なリセッティングホライズンロールアウトを提案して、真の回復行動を学習させる。
原題: Rectify, Don't Regret: Avoiding Pitfalls of Differentiable Simulation in Trajectory Prediction / Harsh Yadav, Christian Bohn, Tobias Meisen
日本語で読む → - 論文軌道予測ロボティクス
ガウス軌道予測器の再考:安全な計画のための較正された不確実性
歩行者の将来位置をガウス分布で予測する際の信頼度をカーネル密度推定とカイ二乗分布の一致で較正する新損失関数を提案し、安全な経路計画に貢献する。
原題: Rethinking Gaussian Trajectory Predictors: Calibrated Uncertainty for Safe Planning / Fatemeh Cheraghi Pouria, Mahsa Golchoubian, Katherine Driggs-Campbell
日本語で読む → - 論文拡散計画/安全フィルタロボティクス
PC-Diffuser: 拡散ベース軌道計画のための経路整合型カプセルCBF安全フィルタ
拡散モデルによる軌道計画のノイズ除去ループに、カプセル距離バリア関数と経路整合型安全フィルタを組み込み、生成軌道の安全性を保証しつつ学習分布から大きく外れないようにする手法を提案。
原題: PC-Diffuser: Path-Consistent Capsule CBF Safety Filtering for Diffusion-Based Trajectory Planner / Eugene Ku, Yiwei Lyu
日本語で読む → - 論文シーン表現ロボティクス
Kernel-SDF: カーネル回帰を用いたリアルタイム符号付距離関数推定のためのオープンソースライブラリ
カーネル回帰とガウス過程回帰を組み合わせ、ストリーミングセンサデータから不確かさを考慮した符号付距離関数をリアルタイムで推定するオープンソースライブラリを開発した。
原題: Kernel-SDF: An Open-Source Library for Real-Time Signed Distance Function Estimation using Kernel Regression / Zhirui Dai, Tianxing Fan, Mani Amani 他
日本語で読む → - 論文自動運転/4DGS画像認識
ReconDrive: 自動運転シーン再構成のための高速フィードフォワード4Dガウススプラッティング
自動運転シーンの高忠実度再構成と新規視点合成を高速に行うフィードフォワード型4Dガウススプラッティング手法を提案。3D基盤モデルを動的シーン向けに拡張し、静的・動的要素を分離して表現することで、シーン毎の最適化と同等の品質を桁違いの高速処理で実現した。
原題: ReconDrive: Fast Feed-Forward 4D Gaussian Splatting for Autonomous Driving Scene Reconstruction / Haibao Yu, Kuntao Xiao, Jiahang Wang 他
日本語で読む → - 論文VLAロボティクス
不確実性を臨界の瞬間へ:VLAモデルのための信頼できる不確実性定量化
VLAモデルのロールアウト成否予測において、最大値ベースのスライディングウィンドウと運動安定性重み付け、自由度適応キャリブレーションを組み合わせ、短時間の危険な不確実性スパイクを捉える手法を提案。
原題: Shifting Uncertainty to Critical Moments: Towards Reliable Uncertainty Quantification for VLA Model / Yanchuan Tang, Taowen Wang, Yuefei Chen 他
日本語で読む → - 論文ロボットシステムロボティクス
精密光学システムの閉ループロボット組立・位置合わせ・自己回復のためのフレームワーク
ロボットによる精密光学システムの自律的な構築・位置合わせ・自己回復を実現するフレームワークを提案し、レーザー共振器の完全自律組み立てを実証した。
原題: A Framework for Closed-Loop Robotic Assembly, Alignment and Self-Recovery of Precision Optical Systems / Seou Choi, Sachin Vaidya, Caio Silva 他
日本語で読む → - 論文3D再構成画像認識
全方位RGB-LiDARデータを3Dガウシアンスプラッティングへ変換するパイプライン
ロボティクスや自動運転で収集された既存の全方位RGB-LiDARログを再利用し、3DGSの初期化に適したデータへ変換するパイプラインを提案。歪み補正や点群ダウンサンプリング、位置合わせを統合し、破棄されがちなデータを高品質な3Dシーン再構成に活用する。
原題: Transforming Omnidirectional RGB-LiDAR data into 3D Gaussian Splatting / Semin Bae, Hansol Lim, Jongseong Brad Choi
日本語で読む → - 論文VLAcs.CR
TRAP: 敵対的パッチによるVLAのCoT推論ハイジャック
CoT推論を行うVLAモデルに対し、テーブルクロスなどの敵対的パッチを用いて推論経路を操作し、指示とは異なる危険な行動を引き起こす攻撃手法を提案した。
原題: TRAP: Hijacking VLA CoT-Reasoning via Adversarial Patches / Zhengxian Huang, Wenjun Zhu, Haoxuan Qiu 他
日本語で読む → - 論文全身制御ロボティクス
ZeroWBC: 一人称視点の人間データから自然な全身ヒューマノイド動作を学習
人間の一人称視点動画と全身動作・テキスト注釈から、テレオペレーションなしでヒューマノイドの全身インタラクションを学習するフレームワークを提案し、Unitree G1で多様なシーン適応行動を実現した。
原題: ZeroWBC: Learning Natural Whole-Body Humanoid Interaction from Human Egocentric Data / Haoran Yang, Jiacheng Bao, Yucheng Xin 他
日本語で読む → - 論文群制御ロボティクス
異種計測群の統合協調位置推定:統一データ駆動手法
異なる計測能力を持つロボット群の協調位置推定問題に対し、相互計測とオドメトリのみを用いたペア相対位置推定と、弱連結な有向計測トポロジー下での分散協調位置推定を実現する統一データ駆動手法を提案した。
原題: Integrated cooperative localization of heterogeneous measurement swarm: A unified data-driven method / Kunrui Ze, Wei Wang, Guibin Sun 他
日本語で読む → - 論文VLAロボティクス
RoboStream: 視覚言語モデルに時空間推論と記憶を統合したロボット操作フレームワーク
視覚言語モデルに時空間融合トークンと因果時空間グラフを導入し、長期ロボット操作における幾何学的定位と行動による状態変化の記憶を訓練なしで実現する。
原題: RoboStream: Weaving Spatio-Temporal Reasoning with Memory in Vision-Language Models for Robotics / Yuzhi Huang, Jie Wu, Weijue Bu 他
日本語で読む → - 論文データセット/ベンチマークロボティクス
LARD 2.0: 自律着陸システムのための拡張データセットとベンチマーキング
自律着陸システムの物体検出モデル訓練用データセットLARDを拡張し、多様な画像ソースの追加や現実的なシナリオへの改良、複数滑走路環境でのベンチマークフレームワークを提供した論文。
原題: LARD 2.0: Enhanced Datasets and Benchmarking for Autonomous Landing Systems / Yassine Bougacha, Geoffrey Delhomme, Mélanie Ducoffe 他
日本語で読む →