論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/14 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
MPCを足場にした実世界強化学習による巧みな操作
サンプリングベースMPCを足場として実機の巧みなハンド操作を強化学習し、短時間で高成功率と高速回転を実現した。
原題: Real-World Reinforcement Learning with MPC Scaffolding for Dexterous Manipulation / Emek Barış Küçüktabak, Karankumar Patel, Zhaodong Yang 他
日本語で読む → - 論文VLAロボティクス
IMPACT-VLA: 視覚言語行動ポリシーのための反事実軌道による相互作用対応マルチモーダル伝播帰属
VLAポリシーにおいて、各モダリティがタスク成功に寄与する実行段階を明らかにするため、反事実的な再実行に基づく帰属手法を提案し、LIBEROタスクで有効性を示した。
原題: IMPACT-VLA: Interaction-aware Multimodal Propagation Attribution via Counterfactual Trajectories for Vision-Language-Action Policies / Jinwoong Kim, Sangjin Park
日本語で読む → - 論文マニピュレーションロボティクス
プリミティブ誘導サンプリングベースMPCによる多指巧み操作
低次元の操作プリミティブでサンプリングを誘導し、関節レベルの残差を同時最適化するサンプリングベースMPCを提案し、実機Allegroハンドで物体の連続回転や把持・再配向・運搬を実現した。
原題: Primitive-Informed Sampling-Based MPC for Multi-Fingered Dexterous Manipulation / Emek Barış Küçüktabak, Karankumar Patel, Jinda Cui 他
日本語で読む → - 論文VLA画像認識
GRAVA: 自動運転のための接地推論から行動への表現と学習
自動運転VLAモデルにおいて、推論を物理的な場面証拠に接地させ、実行可能な行動と結びつけるGRAフレームワークを提案し、NAVSIMベンチマークで最先端性能を達成した。
原題: GRAVA: Grounded Reasoning-to-Action Representation and Learning for Autonomous Driving / Xiao Liu, Haoyu Li, Jianghao Leng 他
日本語で読む → - 論文マニピュレーションロボティクス
LieSpline-DP: 滑らかなロボットマニピュレーションのためのリー群Bスプライン拡散ポリシー
拡散ポリシーの軌道をSE(3)上のBスプラインで表現し、チャンク間で境界制御姿勢を共有することでC²連続性を保証し、滑らかで成功率の高いマニピュレーションを実現した。
原題: LieSpline-DP: Lie-Group B-Spline Diffusion Policy for Smooth Robot Manipulation / Erxuan Xie, Bang Liu, Pingyun Nie 他
日本語で読む → - 論文VLAロボティクス
辞書式選好による生成ロボット方策の誘導
凍結した拡散・フローマッチング方策を推論時に誘導し、優先順位付きの制約と選好を守らせる手法を提案。ナビゲーションとLIBERO操作で成功率を維持しつつ遵守率を改善。
原題: Steering Generative Robot Policies with Lexicographic Preferences / Yixuan Jia, Jonathan P. How
日本語で読む → - 論文触覚ロボティクス
PredTac: 予測触覚による接触の多いマニピュレーションの学習
触覚センサの実測値の代わりに、視覚とロボット状態から触覚を予測してポリシー学習・実行に使う枠組みを提案し、実機で実測触覚に迫る成功率を達成した。
原題: PredTac: Learning Contact-Rich Manipulation with Predicted Touch / Weijia Fan, Daqiang Guo
日本語で読む → - 論文VLAロボティクス
C²Nav: ゼロショット視覚言語ナビゲーションのための比較ベース意思決定
VLMに制御器が生成した候補を比較させることで、幾何学的判断や不可逆な決定をロボット側に残す訓練不要のナビゲーションフレームワークを提案。
原題: C$^2$Nav: Compare Before You Commit for Zero-Shot Vision-and-Language Navigation / Runtian Zheng, Congpeng Zhang, Ying Liu
日本語で読む → - 論文VLA画像認識
LG-VLN: LangGraph状態オーケストレーションによるゼロショット視覚言語ナビゲーション
単眼カメラのみで未知環境をナビゲートするゼロショットVLNフレームワークを提案し、LangGraphで状態遷移を管理することでR2R-CEで21.3%の成功率を達成した。
原題: LG-VLN: A Zero-Shot Vision-and-Language Navigation Framework with LangGraph State Orchestration / Jianhe Zhao, Yanhua Qiu, Zhiyu Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
予測から意思決定へ:世界モデルによる連続的な掘削作業の行動選択
ホイールローダの掘削を世界モデルで予測し候補の中から最適なすくい動作を選ぶ手法を提案し、実機での自律掘削ループを実証した。
原題: From Prediction to Decision: World-Model-Guided Action Selection for Continuous Pile Excavation / Ailing Zhang, Fan Gao, Song Zhang 他
日本語で読む → - 論文群制御ロボティクス
軌道曲率制約下のマルチロボットシステムのための分散安全協調ベクトル場
ロボットの旋回能力限界による軌道曲率制約を考慮し、協調移動と衝突回避を両立する分散ベクトル場手法を提案し、実機実験で有効性を示した。
原題: Distributed Safe Cooperative Vector Field for Trajectory Curvature Constrained Multi-Robot Systems / Zhouru Xiao, Tao Teng, Weijia Yao 他
日本語で読む → - 論文VLAロボティクス
バックボーン内計画:運転VLMによるネイティブ連続軌道生成のためのDiffAdapterVLA
運転用VLMの後段層に軌道トークンを注入し、軽量なDiffAdapterで再帰的に軌道を洗練させることで、追加のプランナーなしに連続軌道計画を実現した手法。
原題: Planning in the Backbone: DiffAdapterVLA for Native Continuous Trajectory Generation with Driving VLMs / Changxin Lu, Xiaoliang Meng, Yu Wu 他
日本語で読む → - 論文全身制御/クロスエンボディメントロボティクス
X-WBC:ヒューマノイド全身制御のためのクロスエンボディメント基盤モデル
人間の動作データを共通の意味表現として学習し、ロボット固有の軽量モジュールで各機体に適応させることで、複数のヒューマノイドをまたいで全身制御方策を訓練する基盤フレームワークを提案。
原題: X-WBC: A Cross-Embodiment Foundation Model for Humanoid Whole-Body Control / Juntong Zhang, Chun Gu, Li Zhang
日本語で読む → - 論文マルチロボット安全制御ロボティクス
マルチロボットCBF安全フィルタの厳密な実行可能性認定と最適な責任配分
複数ロボットのCBF安全フィルタが実行不可能になる原因を厳密に特定する認定手法を開発し、共有安全制約を最適配分することで実行不可能な制御ステップを約50%から6.2%に削減した。
原題: Exact Feasibility Certification and Optimal Responsibility Allocation for Multi-Robot CBF Safety Filters / Chandan Kumar Sah, Jishnu Keshavan
日本語で読む → - 論文VLAロボティクス
法的推論による世界モデルベース計画の法制化
欠陥義務論理と学習済み世界モデルを組み合わせ、ロボットの行動前に法的制約を課す計画スタックを提案し、グリッド上のロボットアーム実験で遵守率の向上と実行時効率を確認した。
原題: Legislating World-Model-Based Planning with Legal Reasoning / Dylan Waldner, Yiannis Kantaros, Guido Governatori 他
日本語で読む → - 論文機構設計ロボティクス
シート上3Dプリンティングによる低クリアランスヒンジ関節機構
シート上への3Dプリンティングで作る低クリアランスヒンジ関節を提案し、0.1mmのクリアランスを実現して3自由度デルタマニピュレータで精密動作を実証した。
原題: Low Clearance Hinge Joint Mechanism Based on 3D Printing on Sheet Fabrication Methodology / Jaehyung Jang, Euibin Shin, Allison M. Okamura 他
日本語で読む → - 論文タスク計画ロボティクス
ロボットタスク計画におけるシーングラフ十分性への情報空間的アプローチ
シーングラフ上の計画を情報空間で定式化し、タスクに十分な縮約シーングラフの条件を明らかにした。
原題: An Information-Space Perspective to Scene Graph Sufficiency for Robotic Task Planning / Başak Sakçak, Francesco Verdoja
日本語で読む → - 論文模倣学習ロボティクス
フローマッチング運動事前分布:模倣学習のためのオンライン最適輸送報酬
現在のロールアウトと専門家運動の間の経路に沿ってフローマッチングで学習したスカラー報酬を提案し、Unitree G1の歩行タスクで従来のAMPや重心OT報酬より安定した歩行を実現した。
原題: Flow-Matched Motion Priors: Online Optimal-Transport Rewards for Imitation Learning / Yilin Zou, Chenghua Liu, Chenglong Wu 他
日本語で読む → - 論文VLAロボティクス
DIDO: インタラクション中心のダイナミクスを1ステップ拡散に蒸留するワールドアクションモデル
動画生成ベースのロボット操作モデルを1ステップ拡散に蒸留し、把持器と対象物のインタラクションを保ちつつ推論遅延を削減した手法。
原題: DIDO: Distilling Interaction-Centric Dynamics into One-Step Denoising for World Action Models / Jing Lyu, Shuanghao Bai, Runze Xiao 他
日本語で読む → - 論文ナビゲーションロボティクス
クアッドロータのための体積調和場ナビゲーション
事前計算した体積調和場を予測プランナに組み込み、クアッドロータの衝突回避と運動制約を満たす局所動作を生成する手法を提案し、実機で検証した。
原題: Volumetric Harmonic Field Navigation for Quadrotors / Shuxiu Jia, Amartya Mukherjee, Yating Yuan 他
日本語で読む → - 論文VLAロボティクス
P-POSEMEM: ポーズグラフ再構築下で一貫した言語接地を実現する射影的意味記憶
SLAMのポーズグラフが最適化・ループ閉じ込め・圧縮されても、言語指示が同じ物体を指し続けるよう、観測を誕生キーフレームの不変イベントとして保持しベイズ木の消去条件付きを統合する意味記憶手法を提案。
原題: P-POSEMEM: Projective Semantic Memory for Consistent Language Grounding under Pose-Graph Rewrites / Ha Sier, Ali Salmasi, Mengya Xu 他
日本語で読む → - 論文模倣学習ロボティクス
接触の多い模倣学習のための連続多様体分解インピーダンス再ターゲティング
固定インピーダンスの実演を連続可変インピーダンス制御器に変換し、模倣学習の構造的教師信号として利用する手法を提案。実タスクで力変動とピーク力を低減し、学習可能性を示した。
原題: Continuous Manifold-Decomposed Impedance Retargeting for Contact-Rich Imitation Learning / Jiahao Liu, Kento Kawaharazuka, Tasuku Makabe 他
日本語で読む → - 論文土壌認識ロボティクスロボティクス
地面を追う:農業環境におけるロボット起因の土壌変形のオンラインLiDAR同定
LiDAR観測からロボット走行による土壌変形をオンラインで推定する枠組みを提案し、物理的解釈可能な低次元モデルで土壌状態を継続的に表現する。
原題: Tracking the Ground: Online Lidar Identification of Robot-Induced Soil Deformation in Agricultural Environments / Tom Montagnon, Johann Laconte, Benoit Thuilot 他
日本語で読む → - 論文マニピュレーションロボティクス
StereoPatch: ロボットマニピュレーションの空間知覚のためのパッチ整合RGB-深度融合
RGBパッチと深度情報をパッチ単位で非対称クロスアテンションにより融合し、幾何学的な曖昧さを解消する視覚運動ポリシー向け表現を提案。実機6タスクで外観のみ・幾何のみ・生RGB-D・後段融合のベースラインを上回る成功率を達成。
原題: StereoPatch: Patch-Aligned RGB-Depth Fusion for Spatial Perception in Robot Manipulation / Yanan Zhou, Zhaoyan Qian, James Zhao 他
日本語で読む → - 論文社会的ロボティクスロボティクス
InterSocialBench:コンパニオンロボットの社会的行動に対する人間とLLMの選好を評価するベンチマーク
家庭内の210シナリオと18の高レベル行動について、100人の人間の判断と7つのLLMの応答を収集し、コンパニオンロボットの社会的行動選択における人間とLLMの選好の違いを評価するベンチマークを提案した。
原題: InterSocialBench: Benchmarking Human and LLM Preferences for Companion-Robot Social Behavior / Yaodan Xu, Boyang Guo, Yuqing Gu 他
日本語で読む → - 論文VLA画像認識
画像生成による推論
マルチモーダルLLMの推論に画像生成モデルを柔軟な視覚操作ツールとして組み込み、多視点空間推論や衝突予測など6タスクで最大25%の性能向上を達成した。
原題: Reasoning with Image Generation / Nishad Singhi, Hector Garcia Rodriguez, Aditya Arora 他
日本語で読む → - 論文量子ロボティクスロボティクス
ロボット運動学のための構造保存型量子回路アーキテクチャ
剛体変換とDH運動学を量子回路で表現し、古典的な運動学量を再現する構造保存型アーキテクチャを提案した。
原題: Structure-Preserving Quantum Circuit Architectures for Robot Kinematics / Andrea Morghen, Pierluigi Arpenti, Roberto Schiattarella 他
日本語で読む → - 論文実験自動化physics.optics
プログラマブル光学クラウドラボラトリ
自由空間光学実験を遠隔・自動で再構成できるロボットクラウドラボ基盤PICOを提案し、実験ケーススタディで実証した。
原題: A Programmable Optics Cloud Laboratory / Sachin Vaidya, Caio Silva, Seou Choi 他
日本語で読む → - 論文社会シミュレーション機械学習
社会シミュレーションのためのLLMエージェントの解釈と操作
LLMベースの社会シミュレーションにおいて、プロンプト操作・SAE特徴操作・プローブ方向操作の3手法を比較し、選好や能力の制御性能を評価した。
原題: Interpreting and Steering LLM Agents for Social Simulations / Jiayue Gaveal Fan, Arul Murugan, Shreyas Krishnan 他
日本語で読む → - 論文sim2realロボティクス
幾何か構造か:LiDAR点群シミュレーション忠実度のためのグラフベース診断
実スキャンとシミュレーションのLiDAR点群からグラフを構築し、Louvain法で空間的にまとまった部分グラフを抽出して対応付けることで、従来の幾何指標では捉えにくい構造的な忠実度を評価する枠組みを提案した。
原題: Geometry vs Structure: Graph-Based Diagnostics for LiDAR Point-Cloud Simulation Fidelity / Ghazal Farhani, Taufiq Rahman
日本語で読む →