論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文点群処理ロボティクス
点群形状を統計多様体として学習する:理論と実践
点群の局所形状をガウス分布の統計多様体としてモデル化し、自己教師ありで各点のガウス形状を推定するニューラルネットワークPOLIを提案した。ラベルなしで高精度な形状推定を実現し、既存のロボット知覚パイプラインに容易に統合できる。
原題: Learning Point Cloud Geometry as a Statistical Manifold: Theory and Practice / Jinwoo Lee, Jiwoo Kim, Woojae Shin 他
日本語で読む → - 論文協調マニピュレーションロボティクス
協調マニピュレータのタスク能力向上アルゴリズム
物体の把持点に力を加えることで生じる余分なモーメントを利用し、個々のマニピュレータと協調グループ全体のタスク能力を向上させる手法を提案し、シミュレーションで5.86%の能力向上を確認した。
原題: Task Capability Improvement Algorithm for Collaborative Manipulators / Keshab Patra, Arpita Sinha, Anirban Guha
日本語で読む → - 論文サロゲートモデル/流体力学/自動運転ロボティクス
水陸両用環境における自律地上車両のリアルタイム流体力推定のための幾何認識サロゲートモデル
高忠実度CFDデータで訓練したニューラルネットワークサロゲートを用い、車両の形状・水深・流向に応じた流体力をリアルタイム(0.9ms未満)で予測する手法を提案。実車の渡水試験で抗力の速度二乗則や浮力の水深線形性を再現した。
原題: Geometry-Aware Surrogate for Real-Time Hydrodynamics Estimation of Autonomous Ground Vehicles in Amphibious Environments / Ammar Waheed, Luke Gallantree, Zohaib Hasnain
日本語で読む → - 論文センサ融合機械学習
OSINT支援による異種センサ融合を用いたベイズ物体分類のための証拠階層
CBRNE脅威の検出・分類を目的に、直接・間接・文脈情報を階層化し、OSINTで得た環境情報をベイズ分類に組み込む融合手法を提案・評価した。
原題: An Evidence Hierarchy for Bayesian Object Classification via OSINT-Aided Heterogeneous Sensor Fusion / Jan Nausner, Michael Hubner
日本語で読む → - 論文強化学習/連続制御ロボティクス
ZAPS-DA: ゼロ位相アクション平滑化と分離アクターによる強化学習の連続制御
強化学習で訓練された連続制御ポリシーの高周波なアクションジッタを、位相遅れをほぼ生じさせずに低減する新しい手法を提案。主アクターとは別の分離アクターをゼロ位相フィルタ済みターゲットへの模倣学習で訓練し、推論時はフィルタ不要で平滑なアクションを出力する。
原題: ZAPS-DA: Zero-Phase Action Policy Smoothing with Decoupled Actor for Continuous Control in Reinforcement Learning / Faiq Shamass
日本語で読む → - 論文自動運転/強化学習機械学習
CRAFT: 運転ポリシーのための反事実からインタラクティブへの強化学習ファインチューニング
閉ループ運転ポリシーの事後学習を、反事実的利点をプロキシとして使い、実閉ループ利点との残差補正で整合させるオン方策強化学習フレームワークを提案した。
原題: CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies / Keyu Chen, Nanfei Ye, Yida Wang 他
日本語で読む → - 論文群制御ロボティクス
PECMAN: 未知環境における知覚連携型マルチエージェントナビゲーション
未知環境でのマルチエージェントナビゲーションのために、分散型ツリーモーフィングと共有知覚戦略を用いたPECMANを提案し、シミュレーションと実機実験で有効性を示した。
原題: PECMAN: Perception-enabled Collaborative Multi-Agent Navigation in Unknown Environments / Tianchonghui Fang, Shaunak Roy, Shalabh Gupta
日本語で読む → - 論文VLA/強化学習ロボティクス
Feat2Go: 視覚特徴に基づく価値推定による身体化強化学習
事前学習済み視覚世界モデルから得た段階的進捗目標を価値モデルで予測し、終端報酬を整形することでVLAモデルの強化学習を改善するフレームワークを提案。
原題: Feat2Go: Visual Feature-Grounded Value Estimation for Embodied Reinforcement Learning / Junyang Shu, Zhiwei Lin, Bingqing Wei 他
日本語で読む → - 論文VLAロボティクス
HARP-VLA: 人間とロボットの視覚表現を整合させる視覚言語行動モデル学習
人間の動画とロボットのデータを共同学習する際、視覚表現のずれを埋めるため、限られたペアデータを橋渡しにし、大規模な非ペア動画から整合的な表現を学習するフレームワークを提案した。
原題: HARP-VLA: Human-Robot Aligned Representation Learning for Vision-Language-Action Model / Xiang Zhu, Puzhen Yuan, Yichen Liu 他
日本語で読む → - 論文イベントベース視覚/FPGA/速度推定ロボティクス
EventShiftFlow:FPGAベースのハードウェア効率的なフロー推定に向けて
イベントベースの視覚センサーを用いて、固定幅整数演算のみで並列に速度仮説を評価するストリーミング速度推定器を提案し、FPGA実装に適したハードウェア効率的な手法を示した。
原題: EventShiftFlow: Towards Hardware-efficient FPGA-based Flow Estimation / Arianna Alonso Bizzi, Fernando Cladera, C. J. Taylor
日本語で読む → - 論文動作計画制御
不確実環境下での確率的再帰的実現可能性を保証する動作計画
不確実で時間変動する環境下で、指定された確率で再帰的実現可能性を保証するモデル予測制御フレームワークを提案した。
原題: Probabilistic Recursively Feasible Motion Planning Under Uncertain Environments / Hyeontae Sung, Hyeongchan Ham, Junyoung Park 他
日本語で読む → - 論文生物模倣ロボティクス
生物模倣ロボティクス研究の正当化:戦略の分類学
生物模倣設計の動機と方法を体系的に整理する分類学を提案し、ロボティクス研究者が自身のアプローチを正当化し、資金提供者がその価値を評価する手助けをする。
原題: Justifying bio-inspired robotics research: A taxonomy of strategies / Margaret J. Zhang, Justin Ting, Talia Y. Moore
日本語で読む → - 論文自動運転画像認識
時間的サンプリング周波数の重要性:エンドツーエンド運転軌道予測の容量認識研究
エンドツーエンド自動運転の軌道予測において、カメラフレームの時間的サンプリング周波数を訓練データ設計の変数として扱い、モデル容量に応じて最適な周波数が異なることを示した研究。
原題: Temporal Sampling Frequency Matters: A Capacity-Aware Study of End-to-End Driving Trajectory Prediction / Yumao Liu, Tao Liu, Xiangyu Li 他
日本語で読む → - 論文参照解決ロボティクス
PoseRefer: 意味的接地参照解決のための経路局所パラメータ
VRインタラクションから自然な共発話ジェスチャを収集し、ポーズと言語を融合するアーキテクチャを提案。カテゴリ埋め込みの融合が単独のポーズやテキストより高い精度を達成。
原題: PoseRefer: Pathway-Local Parameters for Semantically Grounded Reference Resolution / Anna Deichler
日本語で読む → - 論文ナビゲーションロボティクス
状態および動的物体予測不確実性下での確率制約MPPIと衝突リスク較正の評価
本論文は、動的環境でのナビゲーションにおける確率制約付きMPPI制御の衝突リスク較正を評価する手法を提案し、位置推定と予測の不確実性を統合するDUCCT-MPPIを開発して、過信や過度な保守性による失敗を軽減する。
原題: Chance-Constrained MPPI under State and Dynamic Object Prediction Uncertainty and the Evaluation of Collision Risk Calibration / Benjamin Serfling, Konrad Doll, Kati Radkhah-Lens
日本語で読む → - 論文移動ロボティクス/継続学習ロボティクス
二度と騙されない:経験駆動推論による実環境での逆境適応
移動ロボットが未知環境で遭遇する障害をオンライン学習し、視覚言語モデルとカーネル回帰を用いて原因推定と将来予測を行う継続学習フレームワークを提案。
原題: Don't Fool Me Twice: Adapting to Adversity in the Wild with Experience-Driven Reasoning / Navin Sriram Ravie, Andrew Jong, Krrish Jain 他
日本語で読む → - 論文3Dシーン理解ロボティクス
屋内空間のための階層的かつ全体的なオープンボキャブラリー機能3Dシーングラフ
機能的な3Dシーングラフの構築において、テーブルトップ上の密集した物体や多階層の機能関係を扱う新しいパイプラインを提案し、2D視覚グラウンディングと3Dグラフ最適化により頑健なグラフ構造を復元する。
原題: Hierarchical and Holistic Open-Vocabulary Functional 3D Scene Graphs for Indoor Spaces / Xinggang Hu, Chenyangguang Zhang, Alexandros Delitzas 他
日本語で読む → - 論文オフライン強化学習機械学習
オフライン強化学習のための軌道レベルデータ拡張
限られた準最適な軌道からオフライン強化学習を効果的に行うため、タスク構造と報酬・価値関数・ロギングポリシーの幾何学的関係を利用した軌道ベースのデータ拡張手法を提案し、理論的正当性と実験的検証を行った。
原題: Trajectory-Level Data Augmentation for Offline Reinforcement Learning / Tobias Schmähling, Matthias Burkhardt, Tobias Windisch
日本語で読む → - 論文環境認識ロボティクス
半静的シーンに対する予測的時空間シーングラフ
時間変化する環境で物体の状態遷移を学習し、未来の状態を予測するためのベイズフィルタを組み込んだ3Dシーングラフ構造を提案した論文。
原題: Predictive Spatio-Temporal Scene Graphs for Semi-Static Scenes / Miguel Saavedra-Ruiz, Charlie Gauthier, Kumaraditya Gupta 他
日本語で読む → - 論文ナビゲーションロボティクス
D-CLING: ナビゲーション基盤モデルのための事前知識を保持する深度条件付きファインチューニング
ナビゲーション基盤モデルを新しい環境やカメラ設定に適応させる際、事前学習の知識を保ちながら効率的に学習するファインチューニング手法を提案した。ControlNetに着想を得て、ゼロ初期化の残差経路を持つ学習可能なバックボーンを追加し、深度情報を活用することで、衝突や人間の介入を減らしつつ長期的なナビゲーションを実現した。
原題: D-CLING: Prior-Preserving Depth-Conditioned Fine-Tuning for Navigation Foundation Models / Shintaro Nakaoka, Takayuki Kanai, Kazuhito Tanaka
日本語で読む → - 論文マニピュレーションロボティクス
予測対応ガウススプラッティングによる言語誘導ピックアンドプレース操作のための予測的3D表現
言語指示に基づくロボット操作において、タスク完了状態を明示的に予測する3D表現フレームワークを提案し、実世界のピックアンドプレースタスクで成功率を向上させた。
原題: Forecast-aware Gaussian Splatting for Predictive 3D Representation in Language-Guided Pick-and-Place Manipulation / Kaixin Jia, Jiacheng Xu
日本語で読む → - 論文ナビゲーションロボティクス
進化する学習:動的環境における堅牢な人型ロボットナビゲーションのためのマルチモーダル対話フィールド
人型ロボットの操作ナビゲーション向けに、歩行による視覚歪みや環境変化に頑健なマルチモーダル対話フィールド(MIF)を提案し、実機で再配置成功率を大幅に向上させた。
原題: Learning to Evolve: Multi-modal Interactive Fields for Robust Humanoid Navigation in Dynamic Environments / Peifeng Jiang, Hong Liu, Jin Jin 他
日本語で読む → - 論文3Dシーングラフ画像認識
OpenSGA: オープンワールドにおける効率的な3Dシーングラフアライメント
3Dシーングラフ間のオブジェクト対応を推定する統一フレームワークを提案し、視覚言語・テキスト・幾何特徴を融合して大規模座標ずれでも高精度なアライメントを実現。大規模データセットScanNet-SGも導入。
原題: OpenSGA: Efficient 3D Scene Graph Alignment in the Open World / Gang Chen, Sebastián Barbas Laina, Stefan Leutenegger 他
日本語で読む → - 論文マニピュレーションロボティクス
物体情報を活用したモデル予測経路積分制御による非把持ロボット操作
非把持操作の長期的計画を、物体単体の計画を参照してロボットと物体の統合計画を解く階層型MPPI制御で効率化し、シミュレーションと実機で成功率を向上させた。
原題: Object-Informed Model Predictive Path Integral Control for Non-Prehensile Robot Manipulation / Nikola Raicevic, Bharath Raam Radhakrishnan, Chenbin Yu 他
日本語で読む → - 論文ナビゲーションロボティクス
CaMeRL: 衝突認識と記憶強化によるマルチスケール障害物環境でのUAVナビゲーション強化学習
UAVの障害物回避ナビゲーションにおいて、障害物のスケール変化に着目し、衝突リスクを考慮した潜在表現と時間的記憶モジュールを導入した強化学習フレームワークCaMeRLを提案した。
原題: CaMeRL: Collision-Aware and Memory-Enhanced Reinforcement Learning for UAV Navigation in Multi-Scale Obstacle Environments / Hong Hong, Feiyu Liao, Yongheng Liang 他
日本語で読む → - 論文セマンティックセグメンテーションロボティクス
オフロード環境におけるセマンティックセグメンテーションの分布シフト緩和法
オフロード環境でのセマンティックセグメンテーションの精度低下を招く分布シフトに対し、スタイル拡張とテクスチャ正則化を用いたフレームワークST-Segを提案し、既存手法を上回る性能を実証した。
原題: How to Relieve Distribution Shifts in Semantic Segmentation for Off-Road Environments / Ji-Hoon Hwang, Daeyoung Kim, Hyung-Suk Yoon 他
日本語で読む → - 論文力学系学習機械学習
離散オイラー・ラグランジュ方程式による構造保存ガウス過程
離散強制オイラー・ラグランジュ方程式を用いたラグランジュガウス過程(LGPs)を提案し、位置データのみから物理的に一貫した力学系の学習と不確実性定量化を実現した。
原題: Structure-Preserving Gaussian Processes Via Discrete Euler-Lagrange Equations / Jan-Hendrik Ewering, Kathrin Flaßkamp, Niklas Wahlström 他
日本語で読む → - 論文ロボットテストcs.SE
VISOR: ロボットテストのための視覚言語モデルベースのテストオラクル
ロボットのタスク実行の正しさと品質を自動評価する視覚言語モデルベースのテストオラクル手法を提案し、複数のロボットタスクで評価した。
原題: VISOR: A Vision-Language Model-based Test Oracle for Testing Robots / Prasun Saurabh, Pablo Valle, Aitor Arrieta 他
日本語で読む → - 論文ナビゲーションロボティクス
G-DRAGON: 屋外ナビゲーションのための地理空間推論と動的計画を備えた検索拡張フレームワーク
自然言語の指示からOSM地図を検索して大域経路を計画し、SLAMと組み合わせてロボットを目的地まで誘導し、最後の区間はフロンティア探索とセマンティックボクセルマッピングで目標物を探索する屋外ナビゲーション手法を提案した。
原題: G-DRAGON: Geospatial Reasoning and Dynamic Planning for Retrieval-Augmented Outdoor Navigation / Dongzhihan Wang, Yi Du, Jianan Sun 他
日本語で読む → - 論文マニピュレーションロボティクス
ハンド・イン・ザ・ループ:シームレスな手と腕の介入による巧みな操作のためのVLAポリシー改善
高自由度ロボットハンドの巧みな操作において、人間の介入時に発生する「ジェスチャージャンプ」を防ぐため、人間の修正意図と自律ポリシー実行をブレンドする介入手法HandITLを提案し、介入ジッタや把持失敗を大幅に低減した。
原題: Hand-in-the-Loop: Improving VLA Policies for Dexterous Manipulation via Seamless Hand-Arm Intervention / Zhuohang Li, Liqun Huang, Wei Xu 他
日本語で読む →