論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/9 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マルチモーダル融合/ヒューマンロボット協調ロボティクス
産業用ヒューマンロボット協調のための信頼度対応マルチモーダル融合フレームワーク
物体6D姿勢・視線・骨格動作・IMU手動作の4モダリティを信頼度に基づいて動的に融合し、産業用ロボットとの協調作業における人間の意図予測を高精度かつ安定に実現する手法を提案した。
原題: A Confidence-Aware Multimodal Fusion Framework for Industrial Human-Robot Collaboration / Xinyu Liu, Qiqi Dong, Boya Jia 他
日本語で読む → - 論文歩行ロボティクス
粒状地形における地形適応型ヒューマノイド歩行の学習
3次元抵抗力理論に基づく物理的に正確な粒状接触モデルを構築し、教師-生徒強化学習とVAEによる地形エンコードで、未知の粒状地形にも適応できるヒューマノイド歩行制御器を実現した。
原題: Learning Terrain-Adaptive Humanoid Locomotion on Granular Terrain / Junnosuke Kamohara, Feiyang Wu, Andy Ningan Zong 他
日本語で読む → - 論文逆問題/正則化stat.ML
学習が閉形式対角正則化を再発見する理由
モーダル逆問題において、等方的な打ち切りノイズ下ではベイズ最適なTikhonov正則化が事前分布のみで決まる閉形式のべき乗則になることを示し、学習ベースの対角正則化がそれを超えにくい理由を理論と実験で明らかにした論文。
原題: Why Learning Rediscovers the Closed-Form Diagonal Regularizer / Jeahn Han, Pyojin Kim
日本語で読む → - 論文世界モデル機械学習
半群JEPA:ゼロショット物理汎化のための潜在ダイナミクス整合性
物理パラメータを行動条件として与え、自己回帰的な潜在ロールアウトでエンコーダと予測器を共同学習するSG-JEPAを提案し、異なる重力場でのゼロショット物理汎化性能を向上させた。
原題: Semigroup-JEPA: Latent Dynamics Consistency for Zero-Shot Physics Generalization / Andy Zeyi Liu, Haoran Sun, Lucas Baker 他
日本語で読む → - 論文VLAロボティクス
ReactHuman: 身体性マルチモーダルLLMのための物理に基づく人間らしい反応的意思決定ベンチマーク
家庭内の突発的な物理的危険に対し、マルチモーダルLLMが人間のように即座に反応できるかを評価する、物理シミュレーションに基づく初のベンチマークを提案し、代表的モデルの反応的安全性が未解決であることを示した。
原題: ReactHuman: A Physics-Grounded Benchmark for Human-Like Reactive Decision-Making in Embodied Multimodal LLMs / Yizhan Li, Jianxin You, Mengyang Xiong 他
日本語で読む → - 論文共有制御ロボティクス
オンライン有界合理性人間行動推定を用いた適応的共有制御
人間の完全合理性を仮定せず、レベルk有界合理性モデルと適応動的計画法で候補方策を構築し、状態遷移残差から人間行動分布をオンライン推定してロボットが期待コスト最小の応答を計算する共有制御手法を提案した。
原題: Adaptive Shared Control with Online Bounded-Rational Human Behavior Estimation / Henry Ascencio Trejo, Roel Pieters, Gokhan Alcan
日本語で読む → - 論文ヒューマノイド制御ロボティクス
ViBe: 知覚型ヒューマノイド全身制御のための視覚行動適応
事前学習済み視覚エンコーダと低ランクアダプタを用いて、運動追跡型ヒューマノイド制御器を知覚型タスクに効率的に適応させ、シミュレーションから実機へのゼロショット転移を実現した。
原題: ViBe: Visual Behavior Adaptation for Perceptive Humanoid Whole-Body Control / Lokesh Krishna, Sarvesh Venkatesan, An Zhang 他
日本語で読む → - 論文深度推定/レーダー画像認識
GRADE: 視界不良下での単一フレーム生成レーダー深度推定
煙や霧、暗闇でも使えるmmWaveレーダーの単一フレームから、生成モデルの事前知識を活用して高精度なメートル深度を推定する手法を提案。
原題: GRADE: Single-Frame Generative Radar Depth Estimation Under Visual Degradation / Bin Zhao, Patrick Chiou, Nakul Garg
日本語で読む → - 論文連合学習セキュリティ機械学習
連合学習におけるLT符号に着想を得たピーリングによる勾配逆転の連鎖
連合学習の勾配逆転攻撃を消失訂正符号の理論と結びつけ、単一ラウンドでバッチを完全復元する新手法を提案し、従来の限界を大幅に超えることを示した。
原題: Cascading Gradient Inversion via LT-Code Inspired Peeling in Federated Learning / Saeed Shariati, Mohsen Alambardar Meybodi
日本語で読む → - 論文水中ロボティクスロボティクス
円筒型水中筐体向け汎用マストと中央ユーティリティボード
円筒型水中筐体の断面を有効活用する円形PCB「CUB」とセンサーマスト「CougarTail」を開発し、電子機器スタックを大幅に小型軽量化した。
原題: CougarTail & CUB: A General-Purpose Mast and Central Utility Board for Cylindrical Underwater Enclosures / Ben Washburn, Clayton Smith, Eli Gaskin 他
日本語で読む → - 論文マニピュレーションロボティクス
制約多様体の微分可能チャートに沿った計画:汎用IKソルバーを用いて
IKFastなどの汎用逆運動学ソルバーが出力する解析的IKを微分可能に扱うため、逆関数定理を用いて勾配を計算する手法を提案し、マニピュレータの制約付き軌道計画に応用した。
原題: Planning along Differentiable Charts of Constraint Manifolds with General-Purpose IK Solvers / Thomas Cohn, Seiji Shaw, Harel Biggie 他
日本語で読む → - 論文VLA画像認識
多様な海岸環境における視覚言語モデルの評価
ハワイの海岸で収集した1000枚以上の画像データセットを構築し、7つの視覚言語モデルを3つの実験で評価した。海岸特有の概念の認識が難しいが、その原因は環境よりもセグメンテーションと言語表現にあることを示した。
原題: Evaluation of Vision-Language Models Across Diverse Coastal Environments / Seth Knoop, Chad R. Samuelson, Gabriel R. Slade 他
日本語で読む → - 論文自動運転/安全強化学習ロボティクス
安全でロバストな自動運転のためのリスク感受性と不確実性を考慮した意思決定・制御フレームワーク
リスク感受性分布強化学習とアンサンブル不確実性推定を組み合わせ、不確実性に応じて制約を適応調整するHOCBF安全補正機構を備えた自動運転意思決定・制御フレームワークを提案。無信号交差点でのシミュレーションで安全性・効率・ロバスト性のバランスを実証。
原題: A Risk-Sensitive and Uncertainty-Aware Decision-Making and Control Framework for Safe and Robust Autonomous Driving / Zhuoren Li, Ran Yu, Weiqi Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
DUET-DINO: ロボットマニピュレーションの潜在計画のための同時クロスビュー世界モデリング
側面カメラと手首カメラの観測をクロスビュー条件付けで統合し、7自由度エンドエフェクタ制御のための行動条件付き潜在世界モデルを学習する手法を提案。到達・角度付き到達・把持持ち上げタスクで単一視点や独立二視点のベースラインを上回る性能を達成した。
原題: DUET-DINO: Simultaneous Cross-View World Modeling for Latent Planning in Robot Manipulation / Nisarga Nilavadi, Ralf Römer, Moritz Reuss 他
日本語で読む → - 論文群制御ロボティクス
狭い産業環境における大型異種車両のための交通管理システム
NURBS曲線で生成したロードマップ上でL-MAPFアルゴリズムを動作させ、大型で異種なAGVの安全な協調を保証する交通管理システムを提案した。
原題: A traffic management system for large and heterogeneous vehicles in narrow industrial environments / Alessandro Bonetti, Silvia Proia, Simone Guidetti 他
日本語で読む → - 論文マルチエージェント強化学習ロボティクス
山火事対応における自律UAV探査のためのマルチエージェント強化学習
深層強化学習を用いてUAVエージェントが模擬山火事環境を航行・監視する枠組みを開発し、学習の安定化と火災境界追跡などの有効な行動獲得を示した。
原題: Multi-Agent Reinforcement Learning for Autonomous UAV Exploration in Wildfire Response / Caden Chandra, Jerry Ng
日本語で読む → - 論文VLAAI
証明付き認知:現実に基づく報酬による検証ギャップの解消
形式領域外の推論に対する検証不可能な報酬問題を「検証ギャップ」と定式化し、現実に接地した報酬(実行結果など)で検証器の健全性を保つ手法を理論・実験の両面から示した。
原題: Proof-Carrying Cognition: Closing the Verification Gap with Reality-Settled Reward / Eshwar Reddy M, Sourav Karmakar
日本語で読む → - 論文VLAロボティクス
周波数条件付きフローマッチングによる視覚-言語-行動モデル
VLAモデルの行動生成をDCT周波数座標で行い、周波数ごとに条件付け・重み付けするFreqFMを提案。LIBERO等で性能向上と実機6タスクでの有効性を示した。
原題: Frequency-Conditioned Flow Matching for Vision-Language-Action Models / Haochen Niu, Shengye Dong, Hao Liu 他
日本語で読む → - 論文フィジカルAIAI
フィジカルAIの能力形成における7つの源泉
フィジカルAIの能力がどのように形成されるかを整理し、記録経験・予測モデリング・評価的相互作用・代理環境・機構基盤・身体結合・進化駆動という7つの非排他的な源泉を提唱した論文。
原題: Seven Sources of Physical AI Capability Formation / Gang Chen
日本語で読む → - 論文通信最適化AI
UAV搭載RIS支援D2D通信のためのDecision Transformer
UAV搭載RIS支援D2D通信において、UAVの軌道・姿勢・RIS位相をDecision Transformerで最適化し、シナリオ間のゼロショット転移とオンライン微調整の有効性を示した。
原題: Decision Transformer for UAV-Mounted RIS-Assisted Dynamic D2D Communications / Yaxuan Liu
日本語で読む → - 論文VLAeess.SP
6Gにおけるプライバシー保護型身体知能のためのモダリティ分離連合学習
VLAモデルの連合学習において、視覚・言語・行動の各モダリティ特性に応じて集約・プライバシー配分・通信圧縮を分離設計し、6G網でのロボット協調を効率化するフレームワークを提案。
原題: Modality-Decoupled Federated Learning for Privacy-Preserving Embodied Intelligence in 6G / Zhuodong Liu, Xiangyu Li, Chunhong Yuan 他
日本語で読む → - 論文SLAM/自己位置推定ロボティクス
OpenStreetMap車線形状を用いたオドメトリ非依存のドリフト補正
オドメトリの短区間をOpenStreetMapの車線中心線に直接位置合わせすることで、高密度地図や複雑な処理を必要とせずに長期的なドリフトを補正する軽量なオンライン手法を提案した。
原題: Odometer-Agnostic Drift Correction Using OpenStreetMap Lane Geometry / Joaquin Caballero, Emilio Garcia-Fidalgo, Alberto Ortiz 他
日本語で読む → - 論文VLAAI
時間周波数幾何クロスアテンションによるチャンク型視覚言語行動モデルの改善
行動チャンクを学習可能なウェーブレット変換で時間周波数トークンに分解し、内積とウェッジ積を融合したクロスアテンションで位相間の直交的な関係を捉える、VLAポリシー向けの追加モジュールを提案。
原題: Time-Frequency Geometric Cross-Attention for Chunked Vision-Language-Action Models / Shengye Dong, Haochen Niu, Hao Liu 他
日本語で読む → - 論文探査計画ロボティクス
情報の価値はリスクに見合うか:危険環境ロボット探査のための行動的評価
危険環境でのロボット探査において、情報獲得のリスクを考慮して経路を評価するPrelec確率重み付けに基づく行動的情報評価手法を提案し、情報とリスクのトレードオフ構造を理論的・実験的に示した。
原題: When Information is Worth the Risk: Behavioral Valuation for Hazardous Robotic Exploration / Alkesh K. Srivastava, Aamodh Suresh, Carlos Nieto-Granda 他
日本語で読む → - 論文群制御ロボティクス
HiRAD: 柔軟な大規模AGVルーティングシステム
連続空間でのAGVルーティングを階層型強化学習で解き、時空間表現と非同期イベント駆動型パイプラインによりリアルタイム性を確保しつつ、メイクスパンを45〜63%削減した。
原題: HiRAD: A Flexible Large-Scale AGV Routing System / Yunjie Huang, Ruizhong Wu, Mengxuan Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
片手で二部品を組み立てるイン・ハンド・アセンブリ
2つの剛体部品を片手だけで把持・位置合わせして組み立てるタスクを強化学習で解き、シミュレーション学習から実機へゼロショット転移を実現した。
原題: Assembling Two Parts in One Hand / Liuao Pei, Tianyue Wu, Hui Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
生成動画プランをシミュレーションで接地し多様な器用操作コントローラを実現
生成された手と物体のインタラクション動画をシミュレーションで接地し、多様な把持や操作を実行できる器用なロボットハンドコントローラを学習する手法を提案。
原題: Grounding Generated Video Plans in Simulation Towards Versatile Dexterous Controllers / Tianyue Wu, Boyuan An, Shuqi Zhao 他
日本語で読む → - 論文キャリブレーションロボティクス
自動再現可能なカメラ内部キャリブレーション
画像の自動選別と歪み次数の自動選択を組み合わせ、手動調整なしで高精度なカメラ内部キャリブレーションを実現するパイプラインを提案。
原題: Automatic Reproducible Camera Intrinsic Calibration / Xiangcheng Hu
日本語で読む → - 論文模倣学習cs.GR
InstantMimic: 物理ベーススキルを数秒で学習する高性能システム
強化学習による物理ベースキャラクタ制御の学習ループ全体をGPU上で完結させ、多様なスキルを数秒で学習可能にしたシステム。
原題: InstantMimic: A High Performance System for Learning Physics-based Skills in Seconds / Ikjun Choi, Geonho Leem, Jungdam Won
日本語で読む → - 論文マニピュレーションロボティクス
GTA-2: 接地されたタスク軸によるロボットマニピュレーションスキル合成のためのマルチVLMフレームワーク
4つのVLMエージェントがタスクを分解し、キーポイントや軸・制御パラメータを接地させて、実機ロボットのマニピュレーションスキルをゼロショットで生成するフレームワーク。
原題: GTA-2: A Multi-VLM Framework for Synthesizing Robot Manipulation Skills via Grounded Task Axes / M. Yunus Seker, Shobhit Aggarwal, Ruwan Wickramarachchi 他
日本語で読む →