論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御ロボティクス
COHORT: 実時間制約下のマルチロボットシステムにおける大規模DNN推論のためのハイブリッド強化学習
マルチロボットシステムで大規模DNN推論を協調実行するため、オフライン強化学習とオンライン適応を組み合わせたハイブリッドRLフレームワークCOHORTを提案し、バッテリー消費削減とGPU利用効率向上を実証した。
原題: COHORT: Hybrid RL for Collaborative Large DNN Inference on Multi-Robot Systems Under Real-Time Constraints / Mohammad Saeid Anwar, Anuradha Ravi, Indrajeet Ghosh 他
日本語で読む → - 論文セグメンテーション/ドメイン適応画像認識
視野を超えて:外挿型ドメイン適応パノラマセグメンテーション
局所視点画像で学習し、360度パノラマ画像でテストする外挿型ドメイン適応セグメンテーション手法を提案。視野の幾何学的ずれと未知クラスの意味的不確実性を扱う。
原題: Seeing Beyond: Extrapolative Domain Adaptive Panoramic Segmentation / Yuanfan Zheng, Kunyu Peng, Xu Zheng 他
日本語で読む → - 論文データセット/モーション生成/制御ロボティクス
QuadFM: テキスト駆動の四足歩行モーション生成と制御のための基盤データセット
四足歩行ロボット向けに、多様な動作と感情表現を含む大規模なモーションデータセットを構築し、テキストからモーションを生成・制御する統一フレームワークを提案した。
原題: QuadFM: Foundational Text-Driven Quadruped Motion Dataset for Generation and Control / Li Gao, Fuzhi Yang, Jianhui Chen 他
日本語で読む → - 論文ナビゲーションロボティクス
深層強化学習とベイズ推論の統合による移動ロボットの物体探索
物体探索のためのハイブリッドフレームワークを提案。ベイズ推論で物体位置の信念地図を更新し、深層RLでその確率的表現から行動を選択する。シミュレーションで成功率向上と探索効率改善を確認。
原題: Integrating Deep RL and Bayesian Inference for ObjectNav in Mobile Robotics / João Castelo-Branco, José Santos-Victor, Alexandre Bernardino
日本語で読む → - 論文データ収集/構成的一般化ロボティクス
汎用ロボットデータフライホイールに向けて:高次元因子分解と構成
ロボットデータの多様性不足と効率性の課題に対し、データ分布を因子空間に分解し、因子ごとの収集と反復学習で構成的一般化を促すF-ACILフレームワークを提案。実世界実験で少ないデモ数で大幅な性能向上を実証した。
原題: Towards Generalizable Robotic Data Flywheel: High-Dimensional Factorization and Composition / Yuyang Xiao, Yifei Zhou, Haoran Wang 他
日本語で読む → - 論文状態推定ロボティクス
等変フィルタ変換による一貫性と効率性を備えた視覚慣性航法
視覚慣性航法において、異なる対称性を持つ等変フィルタ間の変換則を導出し、一貫性を保証しつつ計算効率を向上させる手法を提案した。
原題: Equivariant Filter Transformations for Consistent and Efficient Visual--Inertial Navigation / Chungeng Tian, Fenghua He, Ning Hao
日本語で読む → - 論文VLAロボティクス
FocusVLA: 視覚言語行動モデルにおける視覚情報の焦点化
VLAモデルの性能が視覚表現の質ではなく視覚情報の活用方法に制限されることを示し、注意をタスク関連領域に集中させるFocusVLAを提案した。
原題: FocusVLA: Focused Visual Utilization for Vision-Language-Action Models / Yichi Zhang, Weihao Yuan, Yizhuo Zhang 他
日本語で読む → - 論文LiDAR-慣性オドメトリロボティクス
UAV向けクラスタ-平面拘束を導入した一貫性と効率性を両立するMSCKFベースのLiDAR-慣性オドメトリ
UAVの厳しいSWaP制約下で、推定の一貫性と計算効率を両立するMSCKFベースのLiDAR-慣性オドメトリを提案。スライディングウィンドウの平面特徴からクラスタ-平面拘束を構築し、ヌル空間投影で特徴パラメータ依存を除去して一貫性を改善、並列ボクセルデータ対応とコンパクトな測定モデルで高速化を実現。
原題: Consistent and Efficient MSCKF-based LiDAR-Inertial Odometry with Inferred Cluster-to-Plane Constraints for UAVs / Jinwen Zhu, Xudong Zhao, Fangcheng Zhu 他
日本語で読む → - 論文研削ロボティクス
DecompGrind: 切削面計画と接触力適応によるロボット研削の分解フレームワーク
ロボット研削を形状除去計画と接触力適応に分解し、学習を局所的な接触力適応に限定することで、少ないデモデータで異なる形状や硬さのワークを効率的に研削するフレームワークを提案した。
原題: DecompGrind: A Decomposition Framework for Robotic Grinding via Cutting-Surface Planning and Contact-Force Adaptation / Shunsuke Araki, Takumi Hachimine, Yuki Saito 他
日本語で読む → - 論文SLAMロボティクス
AIM-SLAM: 基礎モデルを用いた適応的かつ情報豊富なマルチビューキーフレーム優先選択による高密度単眼SLAM
幾何学基礎モデルを活用し、適応的なマルチビューキーフレーム選択と統合最適化により、単眼SLAMの高精度なポーズ推定と高密度再構成を実現した。
原題: AIM-SLAM: Dense Monocular SLAM via Adaptive and Informative Multi-View Keyframe Prioritization with Foundation Model / Jinwoo Jeon, Dong-Uk Seo, Eungchang Mason Lee 他
日本語で読む → - 論文タスク計画ロボティクス
タスク駆動型3D知覚と計画のための文脈的グラフ表現
3Dシーングラフからタスクに必要な部分だけを抽出し、グラフニューラルネットワークで計画に有用な表現を学習して、プランナーの効率を高める研究。
原題: Contextual Graph Representations for Task-Driven 3D Perception and Planning / Christopher Agia
日本語で読む → - 論文歩行ロボティクス
自律走行を目指して:動的リターゲティングと制御誘導型強化学習による高性能・制御可能な人型ロボットの走行
人間の走行動作を動的最適化でリターゲティングし、制御誘導型報酬を用いた強化学習で人型ロボットの高速走行(最大3.3m/s)と屋外での自律障害物回避を実現した。
原題: Chasing Autonomy: Dynamic Retargeting and Control Guided RL for Performant and Controllable Humanoid Running / Zachary Olkin, William D. Compton, Ryan M. Bena 他
日本語で読む → - 論文視覚ナビゲーション画像認識
視覚ナビゲーションのための言語条件付きワールドモデリング
言語指示に基づく視覚ナビゲーションを、初期の一人称視点のみから将来の軌道を予測する問題として定式化し、大規模データセットと2つのモデル群を提案した。
原題: Language-Conditioned World Modeling for Visual Navigation / Yifei Dong, Fengyi Wu, Yilong Dai 他
日本語で読む → - 論文ナビゲーションロボティクス
NavThinker: 社会的ナビゲーションにおける結合予測と計画のための行動条件付きワールドモデル
ロボットの行動に応じて将来のシーンと歩行者動態を予測する行動条件付きワールドモデルを強化学習と組み合わせ、社会的ナビゲーションの性能を向上させた。
原題: NavThinker: Action-Conditioned World Models for Coupled Prediction and Planning in Social Navigation / Tianshuai Hu, Zeying Gong, Lingdong Kong 他
日本語で読む → - 論文ロボット学習/VLA画像認識
S-VAM: 幾何学的・意味的先読みの自己蒸留によるショートカット動画行動モデル
動画行動モデル(VAM)の推論速度と先読み精度のトレードオフを解決するため、単一パスで幾何・意味表現を予測するショートカットモデルS-VAMを提案。多段階拡散の生成事前知識を一段階推論に凝縮する自己蒸留戦略を導入し、シミュレーションと実世界で高性能を実証した。
原題: S-VAM: Shortcut Video-Action Model by Self-Distilling Geometric and Semantic Foresight / Haodong Yan, Zhide Zhong, Jiaguan Zhu 他
日本語で読む → - 論文製造/LLM/最適化ロボティクス
不完全なAIによる製造ロボットのプログラミング:FDMプリント設定選択のためのチューニング専門家としてのLLM
3Dプリントの設定調整を、LLMを専門家としてベイズ最適化ループに組み込むことで自動化し、単発のAI推奨よりも高品質な結果を得る手法を提案した。
原題: Programming Manufacturing Robots with Imperfect AI: LLMs as Tuning Experts for FDM Print Configuration Selection / Ekta U. Samani, Christopher G. Atkeson
日本語で読む → - 論文ソフトロボティクス/変形推定ロボティクス
柔軟センサアレイとケージベース3Dガウスモデリングによるソフトロボットのゼロショット変形再構成
ソフトロボットの変形を、視覚情報なしに触覚センサのみでゼロショット推定するフレームワークを提案。柔軟な圧電抵抗センサアレイとケージベースの3Dガウス変形モデルを組み合わせ、未見のロボットの曲げやねじれ変形を高精度に再構成する。
原題: Zero Shot Deformation Reconstruction for Soft Robots Using a Flexible Sensor Array and Cage Based 3D Gaussian Modeling / Linrui Shou, Zilang Chen, Wenjia Xu 他
日本語で読む → - 論文ナビゲーションロボティクス
120分とノートPCだけで実現する画像ゴールナビゲーション:教師なし探索とオフライン強化学習による最小構成アプローチ
大規模データや高価な計算資源を前提とせず、ノートPC上で120分以内にデータ収集から実環境でのポリシー展開までを自動で行う画像ゴールナビゲーション手法MINavを提案した。
原題: 120 Minutes and a Laptop: Minimalist Image-goal Navigation via Unsupervised Exploration and Offline RL / Xiaoming Liu, Borong Zhang, Qingbiao Li 他
日本語で読む → - 論文UAV制御ロボティクス
全方位UAVにおける作動認識型制御配分のための後退水平ヌル空間最適化
全方位UAVの制御配分に、アクチュエータの非対称ダイナミクスを考慮し、予測ホライズン内でヌル空間最適化によりモータ指令の振動を抑制する手法を提案した。
原題: Receding-Horizon Nullspace Optimization for Actuation-Aware Control Allocation in Omnidirectional UAVs / Riccardo Pretto, Mahmoud Hamandi, Abdullah Mohamed Ali 他
日本語で読む → - 論文強化学習ロボティクス
解析的力学正則化による物理情報を活用した方策最適化
ロボット制御の強化学習に、シミュレータから得られる微分可能なラグランジュ残差を正則化項として導入し、物理的に一貫した方策学習を効率化する手法PIPERを提案した。
原題: Physics-Informed Policy Optimization via Analytic Dynamics Regularization / Namai Chandra, Liu Mohan, Zhihao Gu 他
日本語で読む → - 論文視覚-触覚融合画像認識
視覚-触覚融合による透明破片の輪郭推定:自律的再組立に向けて
透明な破片の輪郭を視覚と触覚の融合で推定するフレームワークを提案し、データセットとネットワークを構築して実世界で検証した。
原題: Transparent Fragments Contour Estimation via Visual-Tactile Fusion for Autonomous Reassembly / Qihao Lin, Borui Chen, Yuping Zhou 他
日本語で読む → - 論文マニピュレーションロボティクス
Bi-HIL: サブタスク進行率とキーフレームメモリを用いた双方向制御に基づくマルチモーダル階層模倣学習による長時間の接触を伴うロボット操作
長時間の接触を伴うロボット操作を安定化するため、サブタスク進行率とキーフレームメモリを統合した双方向制御ベースの階層模倣学習フレームワークを提案し、実機タスクで有効性を検証した。
原題: Bi-HIL: Bilateral Control-Based Multimodal Hierarchical Imitation Learning via Subtask-Level Progress Rate and Keyframe Memory for Long-Horizon Contact-Rich Robotic Manipulation / Thanpimon Buamanee, Masato Kobayashi, Yuki Uranishi
日本語で読む → - 論文SLAMロボティクス
TRGS-SLAM: ぼやけ・ローリングシャッター・ノイズを含む熱画像のためのIMU支援ガウススプラッティングSLAM
熱カメラの劣化(モーションブラー、ローリングシャッター歪み、固定パターンノイズ)に対処するため、3Dガウススプラッティングに基づく熱慣性SLAMシステムを提案し、実世界の高速・高ノイズ熱データで正確なトラッキングを実現した。
原題: TRGS-SLAM: IMU-Aided Gaussian Splatting SLAM for Blurry, Rolling Shutter, and Noisy Thermal Images / Spencer Carmichael, Katherine A. Skinner
日本語で読む → - 論文ナビゲーションロボティクス
GSAT: 自己教師あり学習と異常検知による多様な地形の幾何学的走行可能性推定
ロボットの安全な自律航法のため、自己教師あり学習と異常検知を組み合わせ、負例なしで走行可能領域を分類する新しい手法を提案した。
原題: GSAT: Geometric Traversability Estimation using Self-supervised Learning with Anomaly Detection for Diverse Terrains / Dongjin Cho, Miryeong Park, Juhui Lee 他
日本語で読む → - 論文ナビゲーションロボティクス
SignNav: 大規模屋内環境における標識を活用した意味的視覚ナビゲーション
標識の意味的手がかりを解釈して目的地へ移動する新しいナビゲーションタスクSignNavを提案し、空間・時間認識トランスフォーマー(START)モデルで80%の成功率を達成した。
原題: SignNav: Leveraging Signage for Semantic Visual Navigation in Large-Scale Indoor Environments / Jian Sun, Yuming Huang, He Li 他
日本語で読む → - 論文オドメトリロボティクス
SE(3)-LIO: SE(3)多様体上の同時分布ポーズによる滑らかなIMU伝播を用いた高精度・高ロバストなLiDAR-慣性オドメトリ
本論文では、IMU伝播をSE(3)多様体上で行い、回転変化を並進に適切に反映させるとともに、予測ポーズ間の相関を考慮した不確かさを運動補償に組み込むことで、LiDAR-慣性オドメトリの精度とロバスト性を向上させる手法を提案している。
原題: SE(3)-LIO: Smooth IMU Propagation With Jointly Distributed Poses on SE(3) Manifold for Accurate and Robust LiDAR-Inertial Odometry / Gunhee Shin, Seungjae Lee, Jei Kong 他
日本語で読む → - 論文歩行ロボティクス
不連続な足場におけるヒューマノイド歩行のための知覚型可変タイミング足踏み計画
障害物や危険な地面領域により不連続な足場環境で、足の配置と歩行タイミングを同時に計画する混合整数モデル予測制御フレームワークを提案。深度画像から凸な可踏領域を抽出し、DCMダイナミクスに基づく安全性制約を組み込むことで、実時間で動的に一貫した歩容を生成する。
原題: Perceptive Variable-Timing Footstep Planning for Humanoid Locomotion on Disconnected Footholds / Zhaoyang Xiang, Upama Pant, Ayonga Hereid
日本語で読む → - 論文ロボット制御ロボティクス
高精度ヘキサポッドロボットアクチュエータのモデルベース熱ドリフト補償
ヘキサポッドロボットのアクチュエータの熱膨張による位置誤差を、表面温度から膨張状態を推定するモデルを用いて補正し、実験で80%以上の誤差低減を実証した。
原題: Model-based thermal drift compensation for high-precision hexapod robot actuators / Clément Robert, Alain Vissiere, Olivier Company 他
日本語で読む → - 論文計画/強化学習ロボティクス
GraSP-STL: オフライン目標条件付き強化学習によるゼロショット信号時相論理計画のためのグラフベースフレームワーク
オフラインデータのみを用いて、未見のSTL仕様を満たす制御戦略をゼロショットで合成するグラフ探索ベースのフレームワークを提案した。
原題: GraSP-STL: A Graph-Based Framework for Zero-Shot Signal Temporal Logic Planning via Offline Goal-Conditioned Reinforcement Learning / Ancheng Hou, Ruijia Liu, Xiang Yin
日本語で読む → - 論文群制御ロボティクス
非同期センサ融合によるマルチロボットの分散協調自己位置推定
GPSの使えない環境で、各ロボットが拡張カルマンフィルタで局所的に自己位置推定しつつ、通信可能なときだけ計測情報を共有する分散協調測位フレームワークを提案。静的ランドマークと他ロボットを併用し、非同期・異なるサンプリングレートのセンサにも対応する。
原題: Decentralized Cooperative Localization for Multi-Robot Systems with Asynchronous Sensor Fusion / Nivand Khosravi, Niusha Khosravi, Mohammad Bozorg 他
日本語で読む →