論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御ロボティクス
EFLUX: エージェント型LLMによる弾力的なマルチロボット隊列ナビゲーションと適応
閉塞環境で隊列を変形・再構成しながらナビゲーションするマルチロボットシステムを、LLMを用いて幾何学的に制御するフレームワークを提案した。
原題: EFLUX: Elastic Multi-Robot Formation Navigation and Adaptation with Agentic LLMs / Jinyuan Zhang, Yuwei Wu, Guangyao Shi 他
日本語で読む → - 論文自動運転ロボティクス
GeoWorldAD: 自動運転のための幾何学的世界アクションモデル
自動運転のための行動モデルに、自己中心の3D空間での軌道計画と、潜在的な未来の幾何学トークンによる短期的なシーン進化の予測を組み込んだ手法を提案し、NAVSIMベンチマークで最高性能を達成した。
原題: GeoWorldAD: Geometry World Action Model for Autonomous Driving / Songyan Zhang, Jinyuan Tian, Hanbing Li 他
日本語で読む → - 論文自己教師あり学習/3D認識画像認識
TOLiD: 視覚基盤モデルからLiDAR事前学習へのアーキテクチャギャップをトークンリフティング蒸留で橋渡しする手法
視覚基盤モデル(VFM)の特徴をLiDARバックボーンへ蒸留する自己教師あり事前学習法TOLiDを提案。点群をパッチトークン化し、トークン単位の蒸留と可視性マスクでモダリティ・アーキテクチャのギャップを解消する。
原題: TOLiD: Bridging the Architecture Gap in Vision Foundation Model to LiDAR Pretraining via Token Lifting for Distillation / Sutharsan Mahendran, Darshana Priyasad, Kaushik Roy 他
日本語で読む → - 論文新規視点合成画像認識
NeoMap: 単一画像・動画からの学習不要な新規視点合成
事前学習済み動画モデルから、学習や追加調整なしで高品質かつ視点一貫性のある新規視点映像を生成するフレームワークを提案した。
原題: NeoMap: Training-free Novel-View Synthesis from Single Images and Videos / Jinxi Li, Tianyi Zhang, Yafei Yang 他
日本語で読む → - 論文移動機構ロボティクス
高段差昇降と旋回を両立する再構成可能なロッカー・ボギー機構ロボット
ボギー関節にモータを追加し能動的にボギーを上下させることで4輪/6輪構成を切り替え、4輪時はオムニホイールによる差動駆動で高機動な旋回を実現しつつ、6輪時は高い段差乗り越え能力を維持する再構成可能なロッカー・ボギー機構を提案・実証した。
原題: A Reconfigurable Rocker-Bogie Robot for High Step Climbing and Turning / Kento Koizumi, Tomoaki Ohba, Yuta Saito 他
日本語で読む → - 論文VLAロボティクス
CAC-VLA: 視覚言語行動モデルのための文脈ゲート型行動条件付け
VLAモデル内に軽量な潜在行動インターフェースを導入し、文脈ゲートで行動エキスパートへの影響を調整することで、ロボット操作の成功率を向上させた。
原題: CAC-VLA: Context-Gated Action Conditioning for Vision-Language-Action Models / Yifu Xiong, Wenhao Yu, Jiaxuan Lin 他
日本語で読む → - 論文自動運転/自己教師あり学習画像認識
CRISP: 予測型ワールドモデル事前学習による運転用時空間カメラ・レーダーバックボーン
カメラとレーダーの融合表現を、将来のLiDAR点群予測という事前学習タスクで学習するバックボーンを提案。推論時はカメラとレーダーのみで動作し、下流タスクに転移可能。
原題: CRISP: A Spatiotemporal Camera-Radar Backbone for Driving via Forecasting-Based World-Model Pretraining / Jingyu Song, Yi Liu, Katherine A. Skinner
日本語で読む → - 論文VLAロボティクス
SEAM: 視覚言語行動ポリシーにおけるアクションチャンク動作の滑らかな実行
アクションチャンク方式のVLAポリシーで生じるチャンク境界の不連続を、学習不要の推論時補正で滑らかにする手法を提案した。
原題: SEAM: Smooth Execution of Action-Chunked Motion for Vision-Language-Action Policies / Dijia Zhan, Xuemiao Xu, Jinyi Li 他
日本語で読む → - 論文マニピュレーションロボティクス
KAM-WM: 潜在世界モデルからの運動学的アフォーダンスマップによるロボット操作
凍結したビデオ世界モデルから粗い方向性の相互作用手がかりを抽出し、拡散ポリシーを条件付ける運動学的アフォーダンスマップを生成するフレームワークを提案。LIBEROとRoboTwin2.0で高い成功率を達成した。
原題: KAM-WM: Kinematic Affordance Maps from Latent World Models for Robot Manipulation / Xinyu Shao, Keru Zhou, Guowei Huang 他
日本語で読む → - 論文ワールドモデルロボティクス
RynnWorld-4D: ロボット操作のための4D具現化ワールドモデル
RGB、深度、オプティカルフローを統合した4Dワールドモデルを提案し、将来のシーン変化を予測してロボット操作のポリシー学習を支援する。
原題: RynnWorld-4D: 4D Embodied World Models for Robotic Manipulation / Haoyu Zhao, Xingyue Zhao, Siteng Huang 他
日本語で読む → - 論文水中ロボティクス/ロバスト性検証ロボティクス
自律型水中ロボット搭載プランクトン分類器のロバスト性検証
水中環境でのプランクトン分類AIの誤分類問題に対し、到達可能性解析に基づくロバスト性検証フレームワークとニューラルODEモデルを提案し、環境擾乱に対する安定性を形式的に保証する。
原題: Robustness Verification of an Autonomous Underwater Vehicle-based Plankton Classifier / Abdelrahman Sayed Sayed, Pierre-Jean Meyer, Asgeir J. Sørensen 他
日本語で読む → - 論文遠隔操作ロボティクス
DexTele: 動作リターゲティングと適応力制御に基づく双腕器用遠隔操作システム
双腕器用遠隔操作において、視覚ベースの動作リターゲティングと適応的把持力制御を組み合わせ、異なるロボットプラットフォーム間での正確な動作再現と柔軟な把持を実現するシステムを提案した。
原題: DexTele: A Dual-Arm Dexterous Teleoperation System Based on Motion Retargeting and Adaptive Force Control / Yuanchuan Lai, Qing Gao, Ziyan Liang 他
日本語で読む → - 論文非言語コミュニケーションロボティクス
単軸 vs 多軸ロボット首動作のコミュニケーション効率
ロボットの首動作を情報伝達チャネルとみなし、自由度や運動パラメータが伝達情報量とエネルギー効率に与える影響を情報理論的に解析した。2自由度で情報量がピークとなり、3自由度では低下する「形態情報ボトルネック」を発見した。
原題: Communicative Efficiency of Single vs. Multi-Axis Robot Neck Motion / Chapa Sirithunge, Haewon Jeong, Qinghua Guan 他
日本語で読む → - 論文自己位置推定ロボティクス
物理正則化機械学習によるオンボードセンサを用いた自己位置推定
カルマンフィルタと機械学習を融合し、物理則に基づく正則化を施すことで、車両の自己位置推定精度と汎化性を向上させるハイブリッド手法を提案した。
原題: Physics-Regularized Machine Learning for Proprioceptive Vehicle Localization Using Onboard Sensors / Abinav Kalyanasundaram, Karthikeyan Chandra Sekaran, Wolfgang Utschick 他
日本語で読む → - 論文マニピュレーションロボティクス
LAMP: 潜在運動事前分布による実世界での器用な手操作学習のガイド
高次元の手の動作を扱う実世界学習の不安定さを解決するため、潜在運動事前分布モジュールを導入し、模倣学習とオンライン強化学習を組み合わせた3段階の学習フレームワークを提案。実ロボット4タスクで高い成功率を達成。
原題: LAMP: Latent Motion Prior-Guided Real-World Learning for Dexterous Hand Manipulation / Xinye Yang, Zhiyuan Ma, Hongze Yu 他
日本語で読む → - 論文水中オドメトリロボティクス
DIVO: 無人水中ビークルのための連続時間DVL-慣性-視覚オドメトリ
水中環境での視覚SLAMの課題に対処するため、ガウス過程に基づく連続時間軌跡推定フレームワークを用いて、ドップラー速度ログ、ステレオカメラ、慣性計測ユニットの非同期計測を統合した新しいオドメトリシステムを提案した。学習ベースの特徴抽出・マッチングを備えた視覚フロントエンドも導入し、実データで既存手法を上回る精度と堅牢性を示した。
原題: DIVO: Continuous-time DVL-Inertial-Visual Odometry for Unmanned Underwater Vehicles / Kyungmin Jung, Angad Bajwa, Junha Yoo 他
日本語で読む → - 論文マニピュレーションロボティクス
強化学習と機構設計における事前知識による堅牢な手内操作
指先接触の不確実性や重力による外乱に強い手内回転操作を実現するため、把持品質と接触形状の物理事前知識を強化学習と指先設計に組み込んだ手法を提案し、回転効率・安定性・外乱耐性の向上を実証した。
原題: Robust In-Hand Manipulation via Priors in Reinforcement Learning and Mechanical Design / Yifei Chen, Shihan Lu, Ed Colgate 他
日本語で読む → - 論文モーションプランニングロボティクス
ベクトル化による高速漸近最適キノダイナミックプランニング
GPU並列計算をPython標準ツールで実現するため、JAXとXLAコンパイラを用いた並列キノダイナミックプランナーPAKRを提案し、AO-xメタアルゴリズムと組み合わせて漸近最適性を達成した。
原題: Fast Asymptotically Optimal Kinodynamic Planning via Vectorization / Yitian Gao, Andrew Lu, Zachary Kingston
日本語で読む → - 論文群制御ロボティクス
位相分解強化学習による分散型多ロボット月面貨物輸送
月面での協調貨物輸送を、持ち上げ・輸送・設置の各段階に分解し、専用の強化学習ポリシーで最適化するフレームワークを提案。シミュレーションと実機実験で有効性を実証した。
原題: Distributed Multi Robot Lunar Cargo Transportation via Phase Decomposed Reinforcement Learning / Ashutosh Mishra, Elian Neppel, Shreya Santra 他
日本語で読む → - 論文自動運転/制御ロボティクス
適応型微分可能モデル予測輪郭制御による自動運転レース
路面状態の変化に対応するため、オンラインでパラメータ推定と目的関数の重み調整を行う適応型MPCCを提案し、シミュレーションで安全性と速いラップタイムを実証した。
原題: AD-MPCC: Adaptive Differentiable Model Predictive Contouring Control for Autonomous Racing / Nam T. Nguyen, Binh Nguyen, Ahmad Amine 他
日本語で読む → - 論文SLAM画像認識
深層学習はなぜビジュアルSLAMを改善するのか?
深層学習ベースのビジュアルSLAMの性能向上が、学習された2Dデータ対応と不確実性によるものか、再帰的アーキテクチャによるものかを制御実験で検証した論文。
原題: Why does Deep Learning Improve Visual SLAM? / Giovanni Cioffi, Davide Scaramuzza
日本語で読む → - 論文動作計画ロボティクス
NeHMO: ニューラルハミルトン-ヤコビ到達可能性学習による分散型安全マルチアーム動作計画
多腕ロボットの安全な動作計画を、ニューラルネットワークで近似したハミルトン-ヤコビ到達可能性解析に基づく価値関数を用いて分散的に行う手法を提案した。
原題: NeHMO: Neural Hamilton-Jacobi Reachability Learning for Decentralized Safe Multi-Arm Motion Planning / Qingyi Chen, Zachary Kingston, Ahmed H. Qureshi
日本語で読む → - 論文検証ロボティクス
RoboVAST: ロボットの大規模シナリオベース自動検証
ロボットシステムの検証を自動化するフレームワークRoboVASTを提案し、5480のシナリオ設定と10万回以上の実行を通じて、系統的失敗と確率的異常を区別できることを示した。
原題: RoboVAST: Automated Scenario-Based Validation of Robots at Scale / Frederik Pasch, Samuel Wiest, Argentina Ortega 他
日本語で読む → - 論文マルチエージェント経路探索ロボティクス
双方向情報を用いた垂直展開によるAnyTime Conflict-Based Searchの多目的ノード選択
マルチエージェント経路探索のCBSアルゴリズムにおいて、ノード選択を最適化するDIVEポリシーを提案し、探索効率とメモリ使用量のトレードオフを改善した。
原題: Dual-Informed Vertical Expansion for Multi-Objective Node Selection in Anytime Conflict-Based Search / Willem van Osselaer, Jiarui Li, Meshal Alharbi 他
日本語で読む → - 論文動作計画ロボティクス
時空間凸集合グラフに基づく探索型の時空間・マルチロボット動作計画
時空間凸集合のグラフ上で経路探索を行い、動的障害物や複数ロボットの干渉を扱う動作計画手法を提案した。
原題: Search-Based Spatiotemporal and Multi-Robot Motion Planning on Graphs of Space-Time Convex Sets / Jingtao Tang, Zining Mao, Lufan Yang 他
日本語で読む → - 論文制御ロボティクス
受動コンプライアンス自由度によるロボット環境相互作用の堅牢性向上:フィードバック線形化を用いたハイブリッド位置・力制御アプローチ
エンドエフェクタに受動的なばね・ダンパ機構を組み込み、フィードバック線形化ハイブリッド位置・力制御と組み合わせることで、接触時の衝撃や振動を物理的に吸収し、ロボット環境相互作用の堅牢性を向上させる手法を提案・評価した。
原題: Enhancing Robustness in Robot-Environment Interactions through Passive Compliant Degrees of Freedom: A Hybrid Position-Force Control Approach with Feedback Linearization / Rahman Ardakanian, Iman Kardan, AliAkbar Akbari 他
日本語で読む → - 論文VLM評価画像認識
危険か異常か?VLMによる危険性と不一致の理解の評価
視覚言語モデル(VLM)が危険と異常を区別できるかを評価し、異常を危険と誤認する傾向を明らかにした論文。
原題: Hazard or Anomaly? Evaluating VLMs for Understanding Dangers and Discrepancies / Murali Indukuri, Mohammad Eskandari, Sree Nitya Kollu 他
日本語で読む → - 論文掘削ロボット/歩容生成/制御ロボティクス
新型地中掘進ロボットの動的モデリング、歩容生成、および制御
ミミズの動きとトンネル掘削機を組み合わせた地中探査・掘削用モジュール型ロボットを提案し、動的モデルと歩容生成、フィードバック制御を設計してシミュレーションと実機で検証した。
原題: [Preprint] Dynamic Modeling, Gait Synthesis, and Control of a Novel Subsurface Bore Propagator / Lina van Brügge, Shruti Kotpalliwar, Anton Koval 他
日本語で読む → - 論文接触力学cs.GR
厳密な低次元クーロン摩擦のための分割アーキテクチャ
摩擦接触問題を、円錐制約付き線形応答と接線速度による非結合スカラー項に分割し、外側反復と内側の凸二次計画で解く手法を提案。摩擦則を緩めずに厳密な解を実現する。
原題: A Splitting Architecture for Exact Reduced Coulomb Friction / Hongcheng Song, Ye Fan, Uri M. Ascher 他
日本語で読む → - 論文VLA/評価AI
空中MLLMエージェントのゼロショットミッションレベル評価
空中3D環境での長期的なタスクを評価するベンチマークMissionBenchを提案し、22のMLLMモデルが人間の84.4%に対し35%未満の成功率であることを示した。
原題: Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents / Suman Navaratnarajah, Taehyoung Kim, Jona Ruthardt 他
日本語で読む →