論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文3次元再構成画像認識
ZeD-MAP:バンドル調整によるゼロショット深度マップのリアルタイム航空撮影への応用
UAV画像からリアルタイムに高精度な深度を復元するため、拡散モデルによる深度推定にバンドル調整を組み合わせ、メートル単位の一貫性を実現するフレームワークを提案した。
原題: ZeD-MAP: Bundle Adjustment Guided Zero-Shot Depth Maps for Real-Time Aerial Imaging / Selim Ahmet Iz, Francesco Nex, Norman Kerle 他
日本語で読む → - 論文ナビゲーション制御
到達可能集合を用いたニューラル放射場による安全ナビゲーション
ロボットの安全な経路計画のために、障害物の体積表現をNeRFで計算し、到達可能集合と制約付き最適制御を用いて安全な経路を生成する手法を提案した。
原題: Safe Navigation using Neural Radiance Fields via Reachable Sets / Omanshu Thapliyal, Malarvizhi Sankaranarayanasamy, Ravigopal Vennelakanti
日本語で読む → - 論文3D再構成画像認識
LiDAR-慣性オドメトリとRGB直接ラベル転送によるインクリメンタルな意味論支援メッシュ生成
LiDAR-慣性スキャンから高品質な3Dメッシュを生成する際に、RGB画像のセマンティックラベルをフレーム単位で転送・融合し、TSDF融合を意味論で支援することで、点群の疎密やドリフトによる境界の不正確さを改善する手法を提案した。
原題: Incremental Semantics-Aided Meshing from LiDAR-Inertial Odometry and RGB Direct Label Transfer / Muhammad Affan, Ville Lehtola, George Vosselman
日本語で読む → - 論文歩行/モデル予測制御ロボティクス
RK-MPC: 不整地環境における四足歩行のための残差クープマンモデル予測制御
四足歩行ロボットのモデル誤差をデータ駆動で補正する残差予測器をクープマン理論に基づき組み込み、実時間性を保ちつつ予測精度を向上させたMPCフレームワークを提案。シミュレーションと実機で不整地歩行を実証した。
原題: RK-MPC: Residual Koopman Model Predictive Control for Quadruped Locomotion in Offroad Environments / Sriram S. K. S. Narayanan, Umesh Vaidya
日本語で読む → - 論文HRI/ヘルスケアロボティクス
思いやりのある人とロボットの共存に向けて:ヘルスケアにおけるロボット設計と人間の知覚の二重空間フレームワーク
ヘルスケアロボットの14週間の共設計研究の追跡インタビューから、人間の知覚空間(分解度、証拠源、推論範囲、時間的指向)を特定し、ロボット設計空間との共進化的ループとしての共存モデルを提案した論文。
原題: Towards Considerate Human-Robot Coexistence: A Dual-Space Framework of Robot Design and Human Perception in Healthcare / Yuanchen Bai, Zijian Ding, Ruixiang Han 他
日本語で読む → - 論文触覚/HRIHCI
表現的なロボットタッチの設計における「他者性」という品質
ロボットタッチの設計において、現実再現ではなく「他者性」を品質として捉え、曖昧さや多様な解釈を生む表現的なタッチデザインを提案する論文。
原題: Otherness as a Quality in Designing Expressive Robotic Touch / Ran Zhou, Laurens Boer, Daniel Leithinger 他
日本語で読む → - 論文ドローン/自律飛行ロボティクス
AgiPIX: 屋内空中点検におけるシミュレーションと実世界の橋渡し
屋内の重要設備点検のための自律飛行を実現する、シミュレーションと実機で再現可能なオープンソースのハードウェア・ソフトウェアプラットフォームを提案した。
原題: AgiPIX: Bridging Simulation and Reality in Indoor Aerial Inspection / Sasanka Kuruppu Arachchige, Juan Jose Garcia, Changda Tian 他
日本語で読む → - 論文安全性ロボティクス
RedVLA: 視覚言語行動モデルに対する物理的レッドチーミング
VLAモデルの物理的安全性リスクを事前検出するため、リスクシナリオ合成とリスク増幅の2段階からなるレッドチーミングフレームワークRedVLAを提案し、生成データで軽量ガードSimpleVLA-Guardも構築した。
原題: RedVLA: Physical Red Teaming for Vision-Language-Action Models / Yuhao Zhang, Borong Zhang, Jiaming Fan 他
日本語で読む → - 論文ベンチマーク/ワールドモデルロボティクス
ロボット操作におけるワールドモデル評価のためのベンチマーク RoboWM-Bench
ロボット操作タスクに特化した、ビデオワールドモデルの物理的実行可能性を評価するベンチマークを提案。生成動画を実行動作に変換し、シミュレーションで検証する。
原題: RoboWM-Bench: A Benchmark for Evaluating World Models in Robotic Manipulation / Feng Jiang, Yang Chen, Kyle Xu 他
日本語で読む → - 論文手と物体のインタラクション生成画像認識
HO-Flow: 潜在フローマッチングによる汎用的な手と物体のインタラクション生成
テキストと3D物体から手と物体のインタラクション動作を生成するフレームワークを提案。相互作用を考慮したVAEとマスク付きフローマッチングで時間的一貫性と物理的妥当性を向上させた。
原題: HO-Flow: Generalizable Hand-Object Interaction Generation with Latent Flow Matching / Zerui Chen, Rolandos Alexandros Potamias, Shizhe Chen 他
日本語で読む → - 論文群制御画像認識
産業倉庫におけるAMRの安全性と効率向上のための視覚ベース人間認識推定
単一RGBカメラで人間のAMRへの認識状態を推定し、安全かつ効率的な動作を可能にする手法を提案。シミュレーションで検証した。
原題: Vision-Based Human Awareness Estimation for Enhanced Safety and Efficiency of AMRs in Industrial Warehouses / Maximilian Haug, Christian Stippel, Lukas Pscherer 他
日本語で読む → - 論文AIシステムガバナンスロボティクス
統治された能力進化:AIコンポーネントベースシステムにおけるライフサイクルタイム互換性チェックとロールバック(具現化エージェントをケーススタディとして)
AIコンポーネントのバージョンアップ時に安全性を保証するため、互換性チェックと段階的デプロイメントを含む統治フレームワークを提案し、PyBullet操作タスクで評価した。
原題: Governed Capability Evolution: Lifecycle-Time Compatibility Checking and Rollback for AI-Component-Based Systems, with Embodied Agents as Case Study / Xue Qin, Simin Luan, John See 他
日本語で読む → - 論文自動運転/物体検出ロボティクス
自動運転のための深層ニューラルネットワークによる工事現場検出
YOLOニューラルネットワークとLiDARデータを組み合わせ、走行中に工事現場の物体を検出・位置特定し、統合して世界座標で輪郭を記録するリアルタイムシステムを提案した。実地評価で0.5m未満の位置精度を達成した。
原題: Deep Neural Network Based Roadwork Detection for Autonomous Driving / Sebastian Wullrich, Nicolai Steinke, Daniel Goehring
日本語で読む → - 論文VLAロボティクス
視覚言語行動モデルにおける具現化推論の幻想を暴く
標準ベンチマークの成功率と真の具現化推論能力の乖離を検証するため、因果介入と運動学的分離を用いた診断ベンチマークBeTTERを導入し、最先端VLAモデルが動的シナリオで重大な失敗を起こすことを実証した。
原題: Unmasking the Illusion of Embodied Reasoning in Vision-Language-Action Models / Haiweng Xu, Sipeng Zheng, Hao Luo 他
日本語で読む → - 論文3D生成/サーベイロボティクス
具身AIとロボットシミュレーションのための3D生成:サーベイ
本論文は、具身AIとロボットシステムにおける3D生成の役割を、データ生成、シミュレーション環境構築、Sim2Real橋渡しの3つの観点から整理したサーベイである。物理的整合性やインタラクション対応など、視覚的リアリズムを超えた要件に焦点を当て、現状の課題を分析している。
原題: 3D Generation for Embodied AI and Robotic Simulation: A Survey / Tianwei Ye, Yifan Mao, Minwen Liao 他
日本語で読む → - 論文ナビゲーションロボティクス
未知かつ障害物の多い環境における方向認識型凸自由領域生成による安全なナビゲーション
未知で障害物の多い環境でのロボットナビゲーションのために、候補運動方向とロボット形状を考慮した凸自由領域生成と連続安全軌道生成を統合したフレームワークを提案した。
原題: Safe Navigation in Unknown and Cluttered Environments via Direction-Aware Convex Free-Region Generation / Zhicheng Song, Yongjian Li, Kai Chen 他
日本語で読む → - 論文探索ロボティクス
ベイズ情報利得で強化した漸近有界な3次元フロンティア探索
OctoMapベースのフロンティア探索アルゴリズムを提案し、環境規模に依存しない計算量を実現。ベイズ回帰で情報利得を推定し、探索時間を最大54%短縮する。
原題: Asymptotically-Bounded 3D Frontier Exploration enhanced with Bayesian Information Gain / John Lewis, Meysam Basiri, Pedro U. Lima
日本語で読む → - 論文センサ/測距ロボティクス
複数反射によるLiDAR測距の曖昧さの特性評価
LiDARセンサが複数の反射面を持つ環境で確率的に測距する現象を、実データの累積分布関数を用いて特性評価した論文。
原題: Characterizing Lidar Range-Measurement Ambiguity due to Multiple Returns / Jason H. Rife, Yifan Li
日本語で読む → - 論文マニピュレーションロボティクス
SpaceDex: 階層型作業空間における汎用器用把持
SpaceDexは、制約のある3D環境での器用なマニピュレーションのための階層的フレームワークであり、VLMプランナーとアーム・ハンド特徴分離ネットワークを導入して、把持成功率を向上させる。
原題: SpaceDex: Generalizable Dexterous Grasping in Tiered Workspaces / Wensheng Wang, Chuanjun Guo, Wei Wei 他
日本語で読む → - 論文歩行ロボティクス
SafeMind: 適応的で安全な四足歩行のためのリスク認識型微分可能制御フレームワーク
確率的制御バリア関数と意味理解、メタ適応的リスク調整を統合し、四足ロボットの安全な歩行を実現する微分可能な制御フレームワークを提案した。
原題: SafeMind: A Risk-Aware Differentiable Control Framework for Adaptive and Safe Quadruped Locomotion / Zukun Zhang, Kai Shu, Mingqiao Mo
日本語で読む → - 論文安全性評価AI
大規模言語モデルを用いた具現化プランニングには系統的な安全リスクが存在する
大規模言語モデルをロボットのプランナーとして使う際の安全性を評価するベンチマークDESPITEを導入し、計画能力が高くても危険な計画を生成するリスクが高いことを示した。
原題: Using large language models for embodied planning introduces systematic safety risks / Tao Zhang, Kaixian Qu, Zhibin Li 他
日本語で読む → - 論文軌道計画ロボティクス
DAG-STL: 信号時相論理仕様下でのゼロショット軌道計画のための階層的フレームワーク
未知のダイナミクス下でSTL仕様を満たす軌道を計画するため、論理推論と軌道生成を分離し、分解・割り当て・生成の3段階からなる階層的フレームワークDAG-STLを提案した。
原題: DAG-STL: A Hierarchical Framework for Zero-Shot Trajectory Planning under Signal Temporal Logic Specifications / Ruijia Liu, Ancheng Hou, Xiao Yu 他
日本語で読む → - 論文VLAロボティクス
ReFineVLA: 教師ガイドによるファインチューニングを用いたマルチモーダル推論対応の汎用ロボットポリシー
VLAモデルに推論能力を組み込むため、専門家教師モデルが生成した推論根拠をデータセットに追加し、事前学習済みVLAをファインチューニングする手法を提案。シミュレーション操作ベンチマークで評価し、視覚・言語・行動の整合性と汎化性能の向上を示した。
原題: ReFineVLA: Multimodal Reasoning-Aware Generalist Robotic Policies via Teacher-Guided Fine-Tuning / Tuan Van Vo, Tan Q. Nguyen, Khang Nguyen 他
日本語で読む → - 論文スケジューリングcs.NI
EOS-Bench: 地球観測衛星スケジューリングのための包括的ベンチマーク
地球観測衛星の撮像スケジューリング問題を評価するための、高忠実度の軌道力学とプラットフォーム制約を統合した大規模ベンチマークフレームワークを提案した。
原題: EOS-Bench: A Comprehensive Benchmark for Earth Observation Satellite Scheduling / Qian Yin, Jiaxing Li, Jiaqi Cheng 他
日本語で読む → - 論文軌道最適化機械学習
Sobolev学習による拡散ポリシーで軌道最適化を高速化
軌道最適化の初期解を拡散モデルで生成し、フィードバックゲインを利用したSobolev学習により誤差蓄積を防ぎ、求解時間を2〜20倍短縮する手法を提案した。
原題: Accelerating trajectory optimization with Sobolev-trained diffusion policies / Théotime Le Hellard, Franki Nguimatsia Tiofack, Quentin Le Lidec 他
日本語で読む → - 論文ローカライゼーション画像認識
COMPASS: フロアプランに基づく視覚的ローカライゼーションのためのコンパクトなマルチチャネル事前地図とシーンシグネチャ
フロアプランの幾何情報と意味情報を活用し、二つの魚眼カメラを搭載したロボットの位置姿勢を推定するアルゴリズムを提案した。
原題: COMPASS: COmpact Multi-channel Prior-map And Scene Signature for Floor-Plan-Based Visual Localization / Muhammad Shaheer, Miguel Fernandez-Cortizas, Asier Bikandi-Noya 他
日本語で読む → - 論文VLA/記憶/ナビゲーションロボティクス
EmbodiedLGR: ロボットエージェントのための軽量グラフ表現と検索を統合した意味空間メモリ
ロボットが環境の記憶を効率的に構築・検索できるよう、視覚言語モデルを用いて物体の位置情報をグラフに、シーンの高レベル記述を検索アーキテクチャに格納するハイブリッド手法を提案した。NaVQAデータセットで最先端の推論・問い合わせ時間を達成した。
原題: EmbodiedLGR: Integrating Lightweight Graph Representation and Retrieval for Semantic-Spatial Memory in Robotic Agents / Paolo Riva, Leonardo Gargani, Matteo Frosi 他
日本語で読む → - 論文SLAMロボティクス
GGD-SLAM: 動的環境向け汎用運動モデルを活用した単眼3DGS SLAM
動的環境下でのカメラ位置推定と高精細な稠密マッピングを、事前の意味注釈や深度入力なしで実現する、汎用運動モデルを用いた単眼3DGS SLAMフレームワークを提案した。
原題: GGD-SLAM: Monocular 3DGS SLAM Powered by Generalizable Motion Model for Dynamic Environments / Yi Liu, Haoxuan Xu, Hongbo Duan 他
日本語で読む → - 論文制御制御
微分平坦性を活用した制約付き多入力制御アフィン系の効率的な学習ベースモデル予測制御
微分平坦性を利用し、入力制約と半空間平坦状態制約を満たす多入力非線形アフィン系の学習ベースMPCを、2つの逐次凸最適化のみで実現し、計算効率を大幅に向上させた。
原題: Exploiting Differential Flatness for Efficient Learning-based Model Predictive Control of Constrained Multi-Input Control Affine Systems / Tobias A. Farger, Adam W. Hall, Angela P. Schoellig
日本語で読む → - 論文意思決定機械学習
記憶拡張検索を用いたイベント中心の世界モデルによる身体化意思決定
環境を構造化されたセマンティックイベントとして表現し、過去の経験を検索して行動を生成するERAフレームワークを提案。UAVナビゲーションでリアルタイムかつ適応的な意思決定を実証した。
原題: Event-Centric World Modeling with Memory-Augmented Retrieval for Embodied Decision-Making / Zhaowen Fan, Rongchao Zhang, Yunxiang Han
日本語で読む →