論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文農業ロボティクスロボティクス
枝を押しのけて果実検出を向上させる遮蔽処理
農業ロボットが枝葉に隠れた果実を検出・収穫できるよう、RGB-Dカメラとロボットアームで枝を押しのけて視認性を高める手法を提案した。
原題: Occlusion Handling by Pushing for Enhanced Fruit Detection / Ege Gursoy, Dana Kulić, Andrea Cherubini
日本語で読む → - 論文VLAロボティクス
AIM: 空間価値マップを用いた意図認識型統合世界行動モデリング
事前学習済みのビデオ生成モデルを基盤に、将来の観測と空間価値マップを共同で予測し、意図認識型の注意機構と自己蒸留強化学習によりロボットの行動生成を高精度化する手法を提案した。
原題: AIM: Intent-Aware Unified world action Modeling with Spatial Value Maps / Liaoyuan Fan, Zetian Xu, Chen Cao 他
日本語で読む → - 論文世界モデル機械学習
世界行動検証器:順方向・逆方向の非対称性による自己改善型世界モデル
世界モデルが自身の予測誤差を検出し自己改善するフレームワークWAVを提案。状態の妥当性と行動の到達可能性を分離検証し、順方向・逆方向の非対称性を活用してサンプル効率とポリシー性能を向上させる。
原題: World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry / Yuejiang Liu, Fan Feng, Lingjing Kong 他
日本語で読む → - 論文テスト選択ロボティクス
構成型MLシステムにおける能力モジュール更新のための回帰テスト選択:原子品質プローブによるアプローチ
構成型機械学習システムで、モジュール更新時に有効な組み合わせを維持するための回帰テスト選択手法を提案し、支配的スキル効果を特定してコスト削減を実現した。
原題: Regression Test Selection for Updated Capability Modules in Compositional ML Systems via Atomic-Quality Probes / Xue Qin, Simin Luan, Cong Yang 他
日本語で読む → - 論文オドメトリロボティクス
レーダー慣性オドメトリのための等変フィルタ
レーダー慣性オドメトリの精度とロバスト性を向上させるため、リー群対称性に基づく等変フィルタを提案し、外部キャリブレーション誤差が大きい場合でも収束性を改善した。
原題: Equivariant Filter for Radar-Inertial Odometry / Giulio Delama, Jan Michalczyk, Morten Nissov 他
日本語で読む → - 論文世界モデル/リスク予測ロボティクス
ICAT: 身体化世界モデルにおける物理的リスク予測のためのインシデント事例に基づく適応的テスト
ビデオ生成型世界モデルが危険な行動のリスクを過小評価する問題を指摘し、実際の事故報告や安全マニュアルからリスク記憶を構築してテストケースを生成するICATを提案した。
原題: ICAT: Incident-Case-Grounded Adaptive Testing for Physical-Risk Prediction in Embodied World Models / Zhenglin Lai, Sirui Huang, Yuteng Li 他
日本語で読む → - 論文データセット/模倣学習ロボティクス
EgoVerse:世界各地から収集したロボット学習用の自己中心視点人間データセット
人間の自己中心視点のデモデータを大規模に収集・共有するプラットフォームとデータセットを構築し、人間データからロボットへの転移学習の大規模実験を行った。
原題: EgoVerse: An Egocentric Human Dataset for Robot Learning from Around the World / Ryan Punamiya, Simar Kareer, Zeyi Liu 他
日本語で読む → - 論文自動運転/sim2realロボティクス
Sim2Real-AD: VLM誘導強化学習を実車の自動運転に展開するためのモジュール型Sim-to-Realフレームワーク
シミュレーションで訓練したVLM誘導強化学習ポリシーを、実車にゼロショットで展開するためのフレームワークを提案し、CARLA訓練ポリシーを電気バンに搭載して実証した。
原題: Sim2Real-AD: A Modular Sim-to-Real Framework for Deploying VLM-Guided Reinforcement Learning in Real-World Autonomous Driving / Zilin Huang, Zhengyang Wan, Zihao Sheng 他
日本語で読む → - 論文ナビゲーション画像認識
効率的なロボットナビゲーションのための空間記憶表現に関するサーベイ
視覚ベースのロボットが大規模環境をナビゲートする際の空間記憶のメモリ効率問題を調査し、ピーク時メモリと保存マップサイズの比αを導入して、ニューラル表現を含む様々な手法の実運用コストを比較した。標準化された評価プロトコルを提案し、パレート最適解析により単一のパラダイムが優位でないことを示した。
原題: A Survey of Spatial Memory Representations for Efficient Robot Navigation / Ma. Madecheen S. Pangaliman, Steven S. Sison, Erwin P. Quilloy 他
日本語で読む → - 論文制御/MPCロボティクス
GPUによる到達可能性制約付きシステムレベル合成を用いたミリ秒単位の安全な大規模ロバスト非線形MPC
GPU並列化により、高次元の不確かなロボットシステムに対する安全でロバストな非線形モデル予測制御をリアルタイムで実現するフレームワークを提案。名目軌道、追従制御器、閉ループ到達可能集合を共同最適化し、四足歩行ロボットや人型ロボットで有効性を実証した。
原題: Safe Large-Scale Robust Nonlinear MPC in Milliseconds via Reachability-Constrained System Level Synthesis on the GPU / Jeffrey Fang, Glen Chou
日本語で読む → - 論文模倣学習ロボティクス
人間のビデオからのロボット学習:サーベイ
ロボットが人間の行動ビデオからスキルを獲得する手法を包括的にレビューし、タスク・観察・行動指向の転移経路とデータ基盤を整理したサーベイ論文。
原題: Robot Learning from Human Videos: A Survey / Junyi Ma, Erhang Zhang, Haoran Yang 他
日本語で読む → - 論文空間グラウンディングAI
GIST: インテリジェント意味トポロジーによるマルチモーダル知識抽出と空間グラウンディング
小売店や倉庫などの複雑な環境向けに、携帯端末の点群から意味的に注釈されたナビゲーショントポロジーを構築するパイプラインを提案し、意味検索や位置特定などの下流タスクで有効性を示した。
原題: GIST: Multimodal Knowledge Extraction and Spatial Grounding via Intelligent Semantic Topology / Shivendra Agrawal, Bradley Hayes
日本語で読む → - 論文強化学習ロボティクス
VA-FastNavi-MARL: マルチメディア駆動メタ強化学習によるリアルタイムロボット制御
音声と視覚の非同期入力を統一表現に変換し、メタ強化学習で未知の指示に迅速適応するロボット制御フレームワークを提案。マルチアーム環境でサンプル効率とリアルタイム性を実証した。
原題: VA-FastNavi-MARL: Real-Time Robot Control with Multimedia-Driven Meta-Reinforcement Learning / Yang Zhang, Shengxi Jing, Fengxiang Wang 他
日本語で読む → - 論文触覚ロボティクス
SPLIT: 画像ベース触覚センサにおける潜在算術による物理接触の分離
画像ベース触覚センサのシミュレーション手法SPLITを提案。接触形状とセンサ固有の光学特性を潜在空間で分離し、異なるセンサや背景への適応を可能にする。
原題: SPLIT: Separating Physical-Contact via Latent Arithmetic in Image-Based Tactile Sensors / Wadhah Zai El Amri, Nicolás Navarro-Guerrero
日本語で読む → - 論文交通シミュレーションAI
現実的な高速道路交通シミュレーションのための異種自己対戦
高速道路の交通生成を目的に、エージェントごとの条件付けと合成シナリオ生成、閉ループマルチエージェント学習を組み合わせた自己対戦フレームワークPHASEを提案。実データなしで訓練しつつ、実シナリオへのゼロショット転移で高い成功率と低い誤差を達成した。
原題: Heterogeneous Self-Play for Realistic Highway Traffic Simulation / Jinkai Qiu, Alessandro Saviolo, Chaojie Wang 他
日本語で読む → - 論文ハードウェア・ソフトウェア協調設計機械学習
マルチモーダル基盤モデルを高速化するハードウェア・ソフトウェア技術のフォーカスセッション
マルチモーダル基盤モデルの計算・メモリ負荷を、量子化や枝刈り、投機的復号、カスケード推論などのソフトウェア最適化と専用ハードウェア設計を組み合わせて削減する手法を提案し、医療分野とコード生成タスクで有効性を示した。
原題: Focus Session: Hardware and Software Techniques for Accelerating Multimodal Foundation Models / Muhammad Shafique, Abdul Basit, Muhammad Abdullah Hanif 他
日本語で読む → - 論文歩行/強化学習/sim2realロボティクス
asRoBallet: 摩擦を考慮した強化学習による非駆動球体ダイナミクスのSim2Realギャップ解消
ヒューマノイド型ボールボットの移動制御に、摩擦モデルを考慮した強化学習を適用し、実機へのゼロショット転送を実現した初のエンドツーエンドポリシーを提案する論文。
原題: asRoBallet: Closing the Sim2Real Gap via Friction-Aware Reinforcement Learning for Underactuated Spherical Dynamics / Fang Wan, Guangyi Huang, Tianyu Wu 他
日本語で読む → - 論文SLAM/協調マッピングロボティクス
MR.ScaleMaster: クラウドソースの単眼ビデオからのスケール一貫性のある協調マッピング
単眼カメラ映像をクラウドソースで集めて協調的に3次元再構成する際に生じるスケール崩壊とスケールドリフトという2つの問題を解決するシステムを提案した。
原題: MR.ScaleMaster: Scale-Consistent Collaborative Mapping from Crowd-Sourced Monocular Videos / Hyoseok Ju, Giseop Kim
日本語で読む → - 論文位置推定ロボティクス
夜間UAV位置推定フレームワーク:熱画像と意味的3Dマップの活用
昼間のRGBデータから構築した意味的3Dマップと夜間の熱画像を意味的領域で照合し、GNSS非依存の夜間UAV位置推定を実現するフレームワークを提案。実飛行データで評価し、誤差2m程度を達成。
原題: Lights Out: A Nighttime UAV Localization Framework Using Thermal Imagery and Semantic 3D Maps / Ryan Allen, Melissa Greeff
日本語で読む → - 論文強化学習/水中ロボットロボティクス
自律サンゴ礁モニタリングのための文脈型マルチタスク強化学習
水中ロボットの不確実な動的環境下での制御を、文脈型マルチタスク強化学習を用いて学習し、サンゴ礁監視タスクの汎用性と堅牢性を向上させる手法を提案・評価した。
原題: Contextual Multi-Task Reinforcement Learning for Autonomous Reef Monitoring / Melvin Laux, Yi-Ling Liu, Rina Alo 他
日本語で読む → - 論文視覚オドメトリ画像認識
DINO-VO: 注目すべき場所を学習し、状態推定を強化する
DINO-VOは、適応的なパッチ選択機構を組み込んだエンドツーエンドの単眼視覚オドメトリシステムで、シーン一般化性能を向上させ、多様な環境での追跡精度を達成した。
原題: DINO-VO: Learning Where to Focus for Enhanced State Estimation / Qi Chen, Guanghao Li, Sijia Hu 他
日本語で読む → - 論文動作生成画像認識
Re$^2$MoGen: LLM推論と物理認識リファインメントによるオープンボキャブラリ動作生成
テキストから動作を生成する際、訓練データにない未知の記述に対して性能が落ちる問題を解決するため、LLMの推論と強化学習による物理的妥当性の改善を組み合わせたフレームワークを提案した。
原題: Re$^2$MoGen: Open-Vocabulary Motion Generation via LLM Reasoning and Physics-Aware Refinement / Jiakun Zheng, Ting Xiao, Shiqin Cao 他
日本語で読む → - 論文4D再構成画像認識
Genie 4D: 意味的先行知識で導く4D動的シーン再構成
手持ちスマホの映像から、意味的に接地され行動制御可能な4D世界モデルを構築するフレームワークを提案。リアルタイムの慣性ガウススプラッティングと意味的特徴を先行知識として用いた4Dバックボーンを組み合わせ、動的トラッキング精度と再構成品質を向上させた。
原題: Genie 4D: Semantic-Prior-Guided 4D Dynamic Scene Reconstruction / Yiru Yang, Zhuojie Wu, Nishant Kumar Singh 他
日本語で読む → - 論文VLAロボティクス
A1: 完全透過型オープンソースの適応的かつ効率的なトランケート型視覚言語行動モデル
低コストで高スループットな推論を実現するため、事前学習済みVLMと適応的早期終了・層間トランケートフローマッチングを導入したVLAモデルA1を提案し、シミュレーションと実機でSOTA性能と推論コスト削減を達成した。
原題: A1: A Fully Transparent Open-Source, Adaptive and Efficient Truncated Vision-Language-Action Model / Kaidong Zhang, Jian Zhang, Rongtao Xu 他
日本語で読む → - 論文群制御ロボティクス
姿勢が重要:飛行中のマルチロータUAV放射パターン学習による通信可用性モデリングの向上
キャリブレーション飛行データから異種クアッドコプターUAVのアンテナ放射パターンを学習し、観測された結合利得から各UAVのパターンを分離する手法を提案。実データで4.56dBのRMS誤差を達成し、ペイロード変更時の迅速な再較正を可能にする。
原題: Orientation Matters: Learning Radiation Patterns of Multi-Rotor UAVs In-Flight to Enhance Communication Availability Modeling / Martin Zoula, Daniel Bonilla Licea, Jan Faigl 他
日本語で読む → - 論文計画・強化学習ロボティクス
運動学から動力学へ:物理的に実行可能なハイブリッド計画の学習による洗練
ハイブリッドプランナーが生成した一次(運動学的)計画を、強化学習を用いて二次(動的)制約を満たす物理的に実行可能な軌道へと洗練する手法を提案した論文。
原題: From Kinematics to Dynamics: Learning to Refine Hybrid Plans for Physically Feasible Execution / Lidor Erez, Shahaf S. Shperberg, Ayal Taitler
日本語で読む → - 論文VLAロボティクス
文法制約付き大規模言語モデルによる精密なロボットコマンド理解
産業用ロボットの安全な操作のために、文法制約を組み込んだLLMを提案し、自然言語入力をロボット実行可能なJSON形式のコマンドに変換する。
原題: Precise Robot Command Understanding Using Grammar-Constrained Large Language Models / Xinyun Huo, Raghav Gnanasambandam, Xinyao Zhang
日本語で読む → - 論文位置合わせ/外れ値除去ロボティクス
特徴の乏しい環境における4Dレーダ位置合わせのためのグラフ理論的外れ値除去
4Dイメージングレーダのスキャン位置合わせにおいて、グラフベースのペアワイズ整合性最大化(PCM)をICPループに組み込み、外れ値を除去する手法を提案。不確実性を考慮した残差を用いることで、特徴の乏しい露天掘り鉱山での位置合わせ精度を向上させた。
原題: Graph Theoretical Outlier Rejection for 4D Radar Registration in Feature-Poor Environments / Georg Dorndorf, Daniel Adolfsson, Masrur Doostdar
日本語で読む → - 論文シミュレーション/変形物操作ロボティクス
FLASH: GPU高速シミュレーションによる数分での高忠実度変形物操作の高速学習
GPUネイティブな変形物操作シミュレーションフレームワークFLASHを提案し、数分の合成データ学習で実ロボットのタオル折りや衣類折りをゼロショットで成功させた。
原題: FLASH: Fast Learning via GPU-Accelerated Simulation for High-Fidelity Deformable Manipulation in Minutes / Siyuan Luo, Bingyang Zhou, Chong Zhang 他
日本語で読む → - 論文3D再構成画像認識
PAGaS: 画素整合1自由度ガウススプラッティングによる深度精緻化
ガウススプラッティングを多視点ステレオ深度推定に応用し、画素の深度を1自由度のガウス分布でモデル化して高精細な深度を生成する手法を提案した。
原題: PAGaS: Pixel-Aligned 1DoF Gaussian Splatting for Depth Refinement / David Recasens, Robert Maier, Aljaz Bozic 他
日本語で読む →