論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA画像認識
PVI: 視覚言語行動モデルのためのプラグイン型視覚注入
事前学習済みの視覚言語モデルと行動エキスパートを組み合わせたVLAアーキテクチャに対し、軽量でエンコーダ非依存のモジュールを追加し、時間的視覚特徴を注入することで性能を向上させる手法を提案した。
原題: PVI: Plug-in Visual Injection for Vision-Language-Action Models / Zezhou Zhang, Songxin Zhang, Xiao Xiong 他
日本語で読む → - 論文能動知覚ロボティクス
OA-NBV: 移動ロボットによる人間中心の能動知覚のための遮蔽を考慮した次視点計画
遮蔽された人物をより完全に観察できる次の移動可能な視点を自律的に選択する、遮蔽を考慮した次視点計画パイプラインを提案した。
原題: OA-NBV: Occlusion-Aware Next-Best-View Planning for Human-Centered Active Perception on Mobile Robots / Boxun Hu, Chang Chang, Jiawei Ge 他
日本語で読む → - 論文ナビゲーションロボティクス
SignNav: 大規模屋内環境における標識を活用した意味的視覚ナビゲーション
標識の意味的手がかりを解釈して目的地へ移動する新しいナビゲーションタスクSignNavを提案し、空間・時間認識トランスフォーマー(START)モデルで80%の成功率を達成した。
原題: SignNav: Leveraging Signage for Semantic Visual Navigation in Large-Scale Indoor Environments / Jian Sun, Yuming Huang, He Li 他
日本語で読む → - 論文群制御ロボティクス
運用制約下のUAV-UGVチームにおける同期並行協調計画
UAVとUGVの異種ロボットチームが、エネルギーや走行可能地形などの運用制約を考慮しつつ、同期して並行に協調計画を行う学習ベース手法CoPCSを提案した。
原題: Collaborative Planning with Concurrent Synchronization for Operationally Constrained UAV-UGV Teams / Zihao Deng, Qianhuang Li, Peng Gao 他
日本語で読む → - 論文視覚-触覚融合画像認識
視覚-触覚融合による透明破片の輪郭推定:自律的再組立に向けて
透明な破片の輪郭を視覚と触覚の融合で推定するフレームワークを提案し、データセットとネットワークを構築して実世界で検証した。
原題: Transparent Fragments Contour Estimation via Visual-Tactile Fusion for Autonomous Reassembly / Qihao Lin, Borui Chen, Yuping Zhou 他
日本語で読む → - 論文水中ロボットロボティクス
低コスト水質モニタリングのための生体模倣型ミニ潜水艇の設計
イカのジェット推進に着想を得た低コストの小型潜水艇を設計・実験検証し、水質モニタリングへの応用可能性を示した論文。
原題: Design of a Bio-Inspired Miniature Submarine for Low-Cost Water Quality Monitoring / Quang Huy Vu, Quan Le, Manh Duong Phung
日本語で読む → - 論文拡散ポリシー/操作ロボティクス
動的補正を備えた閉ループアクションチャンクによる学習不要の拡散ポリシー
拡散ベースのポリシーに動的環境情報を注入し、リアルタイムでアクションを補正する閉ループ拡散ポリシーフレームワークDCDPを提案。再学習なしで動的シナリオへの適応性を向上させる。
原題: Closed-Loop Action Chunks with Dynamic Corrections for Training-Free Diffusion Policy / Pengyuan Wu, Pingrui Zhang, Zhigang Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
Bi-HIL: サブタスク進行率とキーフレームメモリを用いた双方向制御に基づくマルチモーダル階層模倣学習による長時間の接触を伴うロボット操作
長時間の接触を伴うロボット操作を安定化するため、サブタスク進行率とキーフレームメモリを統合した双方向制御ベースの階層模倣学習フレームワークを提案し、実機タスクで有効性を検証した。
原題: Bi-HIL: Bilateral Control-Based Multimodal Hierarchical Imitation Learning via Subtask-Level Progress Rate and Keyframe Memory for Long-Horizon Contact-Rich Robotic Manipulation / Thanpimon Buamanee, Masato Kobayashi, Yuki Uranishi
日本語で読む → - 論文外骨格/高齢者支援ロボティクス
タスク非依存型外骨格制御による高齢者の股関節負担軽減:股関節中心動作時の関節エネルギー支援
高齢者の股関節に着目し、タスクに依存しない外骨格制御を実装し、歩行や階段昇降など複数の動作で生体力学的な仕事量を削減できることを実証した論文。
原題: Task-Agnostic Exoskeleton Control Supports Elderly Joint Energetics during Hip-Intensive Tasks / Jiefu Zhang, Nikhil V. Divekar, Chandramouli Krishnan 他
日本語で読む → - 論文認知アーキテクチャ/LLM比較ロボティクス
認知ロボティクスが重要な理由:安全重視のロボットチームにおけるOntoAgentとLLM導入のHARMONICからの教訓
認知アーキテクチャOntoAgentとLLMを同一ロボットシステムで比較し、LLMは知識状態の自己評価が不十分で診断推論や行動選択に失敗することを示し、安全重視のシステムでは認知アーキテクチャが主導すべきと論じた論文。
原題: Why Cognitive Robotics Matters: Lessons from OntoAgent and LLM Deployment in HARMONIC for Safety-Critical Robot Teaming / Sanjay Oruganti, Sergei Nirenburg, Marjorie McShane 他
日本語で読む → - 論文ソフトロボティクス/sim2realロボティクス
SOFTMAP: トポロジカルメッシュ整列と物理事前知識によるソフトロボットのSim2Real順モデリング
腱駆動ソフトフィンガーの3次元順モデルを、シミュレーションと実データを組み合わせて高精度に学習するフレームワークを提案。
原題: SOFTMAP: Sim2Real Soft Robot Forward Modeling via Topological Mesh Alignment and Physics Prior / Ziyong Ma, Uksang Yoo, Jonathan Francis 他
日本語で読む → - 論文水中ロボット/航法ロボティクス
AUV航法における予測モデリング:カルマンフィルタリングの視点から
通信途絶時に備え、音響測位とカルマンフィルタを統合してAUVの位置精度と軌道予測を向上させ、探索・回収を支援する枠組みを提案した。
原題: Predictive Modeling in AUV Navigation: A Perspective from Kalman Filtering / Zizhan Tang, Yao Liu, Jessica Liu
日本語で読む → - 論文形状センシングロボティクス
OFDRを用いた単一ファイバによる同心管ステアラブル掘削ロボットの形状センシング
FBGの代わりにOFDRを用いて、同心管ステアラブル掘削ロボットの形状を連続的に計測する手法を提案し、掘削中の形状推定精度を実証した。
原題: A Single-Fiber Optical Frequency Domain Reflectometry (OFDR)-Based Shape Sensing of Concentric Tube Steerable Drilling Robots / Yash Kulkarni, Mobina Tavangarifard, Daniyal Maroufi 他
日本語で読む → - 論文デジタルツイン/試験ロボティクス
最適化可能から対話可能へ:車両・インフラ協調システムの混合デジタルツイン試験
車両・インフラ協調システムの試験に、人間が直接介入できるL5レベルの対話可能なデジタルツインを導入し、高品質なコーナーケースを生成するフレームワークを提案した。
原題: From Optimizable to Interactable: Mixed Digital Twin-Empowered Testing of Vehicle-Infrastructure Cooperation Systems / Jianghong Dong, Chunying Yang, Mengchi Cai 他
日本語で読む → - 論文ナビゲーションロボティクス
車いす向け社会的認識と透明性を備えた自律移動ナビゲーションフレームワーク
車いす利用者のための自律移動システムに、大規模言語モデルを用いて他者の意図を予測し社会的状況を認識する意思決定機構と、各経由点での判断理由をテキストで提示する透明性機能を統合したフレームワークを提案し、シミュレーションで評価した。
原題: SAATT Nav: a Socially Aware Autonomous Transparent Transportation Navigation Framework for Wheelchairs / Yutong Zhang, Shaiv Y. Mehra, Bradley S. Duerstock 他
日本語で読む → - 論文BEV検出画像認識
ピンホールと魚眼カメラの混在環境におけるマルチビューBEV物体検出のベンチマーク
ピンホールカメラと魚眼カメラが混在する自動運転システム向けに、魚眼歪みに頑健なBEV物体検出モデルの適応手法を比較評価するベンチマークを構築した。
原題: Benchmarking Multi-View BEV Object Detection with Mixed Pinhole and Fisheye Cameras / Xiangzhong Liu, Hao Shen
日本語で読む → - 論文群制御ロボティクス
自律移動ロボット群のバッテリ劣化を考慮したフリートスケジューリング
複数の自律移動ロボットのタスク割り当てと充電計画を、バッテリ劣化を考慮して最適化する手法を提案。階層的matheuristicにより大規模問題を効率的に解く。
原題: Fleet-Level Battery-Health-Aware Scheduling for Autonomous Mobile Robots / Jiachen Li, Shihao Li, Jian Chu 他
日本語で読む → - 論文ナビゲーションロボティクス
CATNAV: キャッシュ型視覚言語走破性による効率的なゼロショットロボットナビゲーション
マルチモーダルLLMを用いて、ロボットの身体性を考慮したコストマップをゼロショットで生成し、視覚意味キャッシュによりオンライン推論を85.7%削減するナビゲーションフレームワークを提案。四足ロボットで屋内・屋外の5タスクで高い成功率と制約違反の低減を実証した。
原題: CATNAV: Cached Vision-Language Traversability for Efficient Zero-Shot Robot Navigation / Aditya Potnis, Francisco Affonso, Shreya Gummadi 他
日本語で読む → - 論文ナビゲーションロボティクス
E-SocialNav: 言語モデルを用いた効率的な社会的規範準拠ナビゲーション
ロボットナビゲーションにおける社会的規範遵守を評価し、小型データセットで訓練した効率的な言語モデルE-SocialNavを提案。GPT-4o等の大規模モデルより高速で、社会的行動生成性能が高い。
原題: E-SocialNav: Efficient Socially Compliant Navigation with Language Models / Ling Xiao, Daeun Song, Xuesu Xiao 他
日本語で読む → - 論文移動ロボット/タスク計画ロボティクス
AIエージェントとマルチLMMモジュールによる移動建設ロボットの即興タスク対応位置決め
建設現場の即興タスクに対応するため、自然言語指示を理解し、図面から位置を特定して移動するAIエージェントを四足ロボットで実装し、92.2%の成功率を達成した。
原題: Task-Aware Positioning for Improvisational Tasks in Mobile Construction Robots via an AI Agent with Multi-LMM Modules / Seongju Jang, Francis Baek, SangHyun Lee
日本語で読む → - 論文オフロード走行/MPC/安全性ロボティクス
高速・全地形自律走行:機動限界での安全性確保
不整地を高速で走行する自律オフロード車両向けに、転倒を予測・回避しつつリアルタイム実行可能な新しいモデル予測制御(MPC)に基づく局所軌道プランナーを提案した。
原題: High-Speed, All-Terrain Autonomy: Ensuring Safety at the Limits of Mobility / James R. Baxter, Bogdan I. Epureanu, Paramsothy Jayakumar 他
日本語で読む → - 論文世界モデル画像認識
ABot-PhysWorld: 物理整合を備えたロボット操作のための対話型世界基盤モデル
物理的に不自然な操作動画を生成する問題を解決するため、物理認識アノテーション付きの大規模データセットとDPOベースの後訓練を導入し、物理的に妥当で行動制御可能な動画を生成する世界モデルを提案した。
原題: ABot-PhysWorld: Interactive World Foundation Model for Robotic Manipulation with Physics Alignment / Yuzhi Chen, Ronghan Chen, Dongjie Huo 他
日本語で読む → - 論文群制御ロボティクス
SwiftBot: LLM駆動の連合ロボットタスク実行のための分散プラットフォーム
LLMによるタスク分解とDHTオーバーレイ上のコンテナオーケストレーションを統合し、中央制御なしでロボット群が協調してタスクを実行できる分散プラットフォームを提案した。
原題: SwiftBot: A Decentralized Platform for LLM-Powered Federated Robotic Task Execution / YueMing Zhang, Shuai Xu, Zhengxiong Li 他
日本語で読む → - 論文ハプティクスロボティクス
アクチュエータ制約下でのハプティックインターフェースのための最適優先散逸と閉形式ダンピング制限
ハプティックインターフェースの安定性を保証しつつ透明性を最大化するため、アクチュエータの電力制約を考慮した優先散逸に基づく新しいダンピング制限法を提案し、実験で検証した。
原題: Optimal Prioritized Dissipation and Closed-Form Damping Limitation under Actuator Constraints for Haptic Interfaces / Camilla Celli, Andrea Bini, Valerio Novelli 他
日本語で読む → - 論文計画/強化学習ロボティクス
GraSP-STL: オフライン目標条件付き強化学習によるゼロショット信号時相論理計画のためのグラフベースフレームワーク
オフラインデータのみを用いて、未見のSTL仕様を満たす制御戦略をゼロショットで合成するグラフ探索ベースのフレームワークを提案した。
原題: GraSP-STL: A Graph-Based Framework for Zero-Shot Signal Temporal Logic Planning via Offline Goal-Conditioned Reinforcement Learning / Ancheng Hou, Ruijia Liu, Xiang Yin
日本語で読む → - 論文手術支援ロボティクスロボティクス
CTを用いた患者特異的シミュレーションと接触を考慮した人工内耳挿入のロボット計画
CT画像から患者固有の蝸牛形状を再構築し、電極アレイの接触を考慮した低次元モデルと計画手法を提案。シミュレーションと実験で挿入力の低減と挿入深度の向上を実証した。
原題: CT-Enabled Patient-Specific Simulation and Contact-Aware Robotic Planning for Cochlear Implantation / Lingxiao Xun, Gang Zheng, Alexandre Kruszewski 他
日本語で読む → - 論文マニピュレーションロボティクス
言語基盤の分離型行動表現によるロボット操作
自然言語を意味的ブリッジとして用い、翻訳・回転・グリッパー制御という3つの解釈可能な行動プリミティブを導入し、対照学習と模倣学習を組み合わせて汎化性能を高めるロボット操作フレームワークを提案した。
原題: Language-Grounded Decoupled Action Representation for Robotic Manipulation / Wuding Weng, Tongshu Wu, Liucheng Chen 他
日本語で読む → - 論文VLAロボティクス
ReMem-VLA: 二重レベル再帰クエリによる記憶を備えた視覚言語行動モデル
視覚言語行動モデルに、フレーム単位とチャンク単位の再帰クエリを導入し、短期・長期記憶を実現。過去の観測予測を補助タスクとして追加し、記憶依存タスクで既存モデルを大幅に上回る性能を達成した。
原題: ReMem-VLA: Empowering Vision-Language-Action Model with Memory via Dual-Level Recurrent Queries / Hang Li, Fengyi Shen, Dong Chen 他
日本語で読む → - 論文ロボット操作ロボティクス
学習ロボットポリシーの展開時信頼性
学習ベースのロボット操作ポリシーの実世界展開における信頼性向上を目指し、実行時監視、解釈可能性、長期タスク計画の3つの展開時メカニズムを提案した論文。
原題: Deployment-Time Reliability of Learned Robot Policies / Christopher Agia
日本語で読む → - 論文自動運転/地図生成/動作予測ロボティクス
不確実性が重要:自動運転における動作予測のための構造化確率的オンラインマッピング
オンライン地図生成を確率的タスクとして扱い、低ランク+対角成分の共分散分解で空間的相関を捉える不確実性モデルを提案し、地図生成と動作予測の精度を向上させた。
原題: Uncertainty Matters: Structured Probabilistic Online Mapping for Motion Prediction in Autonomous Driving / Pritom Gogoi, Faris Janjoš, Bin Yang 他
日本語で読む →