論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
視覚・触覚・グラフ融合による適応的動的モダリティ拡散方策:マルチエージェントマニピュレーション
視覚・触覚・エージェント間位置グラフを適応的に統合する拡散方策を提案し、マルチエージェント協調マニピュレーションの把持安定性と衝突回避を改善した。
原題: ADM-DP: Adaptive Dynamic Modality Diffusion Policy through Vision-Tactile-Graph Fusion for Multi-Agent Manipulation / Enyi Wang, Wen Fan, Dandan Zhang
日本語で読む → - 論文自己位置推定ロボティクス
Graph-Loc: 低観測性・遮蔽環境下でのコンパクトな構造地図事前分布を用いたロバストなグラフベースLiDAR姿勢追跡
点と線の軽量グラフで表現した地図事前分布に対し、LiDARスキャンから抽出した点・線を不均衡最適輸送で対応付けることで、遮蔽や低観測性に強い姿勢追跡を実現した。
原題: Graph-Loc: Robust Graph-Based LiDAR Pose Tracking with Compact Structural Map Priors under Low Observability and Occlusion / Wentao Zhao, Yihe Niu, Zikun Chen 他
日本語で読む → - 論文sim2realロボティクス
CLASH: 拡張Sim-to-realハイブリダイゼーションによる衝突学習でリアリティギャップを埋める
不完全なシミュレータから衝突モデルを蒸留し、少数の実衝突データで微調整することで、衝突を含むタスクのsim-to-real転移精度を高めるフレームワークを提案。
原題: CLASH: Collision Learning via Augmented Sim-to-real Hybridization to Bridge the Reality Gap / Haotian He, Ning Guo, Siqi Shi 他
日本語で読む → - 論文情報経路計画ロボティクス
推定不確かさを保証する情報経路計画
ガウス過程の事後分散を指定閾値以下に抑える最短経路を、非定常カーネルや障害物環境に対応した三段階手法で計画する。
原題: Informative Path Planning with Guaranteed Estimation Uncertainty / Kalvik Jakkala, Saurav Agarwal, Jason O'Kane 他
日本語で読む → - 論文空中マニピュレーションロボティクス
楕円体モデルから動的ヒッチの空中制御へ
2本のケーブルを絡めて作る「ヒッチ」を4機のドローンで動かすため、楕円体ベースの運動学モデルとCLF-HOCBF-QP制御器を提案し、張力制約を守りつつ高速追従を実現した。
原題: From Ellipsoids to Midair Control of Dynamic Hitches / Jiawei Xu, Subhrajit Bhattacharya, David Saldaña
日本語で読む → - 論文VLA画像認識
CapNav: 能力条件付き屋内ナビゲーションにおける視覚言語モデルのベンチマーク
エージェントの移動能力(階段可否やサイズなど)を条件として、視覚言語モデルが複雑な屋内環境をナビゲートできるかを評価するベンチマークCapNavを提案し、13モデルを評価した。
原題: CapNav: Benchmarking Vision Language Models on Capability-conditioned Indoor Navigation / Xia Su, Ruiqi Chen, Benlin Liu 他
日本語で読む → - 論文HRIロボティクス
シグナルか「ノイズ」か:実環境におけるロボットのエラーに対する人間の反応
コーヒーロボットを公共の場に導入し、ロボットのエラーに対する人々の社会的反応を調査した。その結果、実環境では反応が豊かだが「ノイズ」も多く、グループ相互作用で特に多様なシグナルが見られた。
原題: Signal or 'Noise': Human Reactions to Robot Errors in the Wild / Maia Stiber, Sameer Khan, Russell Taylor 他
日本語で読む → - 論文センサフュージョンロボティクス
SODA-CitrON: マルチモーダルセンサ検出のオンラインクラスタリングによる静的物体データ関連付け
異種センサで断続的に観測される静的物体を、オンラインクラスタリングで関連付け・追跡する教師なし学習手法を提案し、シミュレーションで既存手法を上回る精度を示した。
原題: SODA-CitrON: Static Object Data Association by Clustering Multi-Modal Sensor Detections Online / Jan Nausner, Kilian Wohlleben, Michael Hubner
日本語で読む → - 論文マニピュレーション機械学習
AR遠隔操作による拡張可能な器用ロボット学習
ARを用いた遠隔操作で収集したデモデータを行動クローニングで事前学習し、対照学習強化学習で微調整することで、器用なマニピュレーションタスクの成功率と学習効率を向上させる手法を提案。
原題: Scalable Dexterous Robot Learning with AR-based Remote Human-Robot Interactions / Yicheng Yang, Ruijiao Li, Lifeng Wang 他
日本語で読む → - 論文VLAロボティクス
Vision-Language-Actionロボットのメタモルフィックテスト
VLAモデルを搭載したロボットのテストオラクル問題を緩和するため、メタモルフィック関係を提案し、入力変更が軌道に与える影響を評価する手法を検証した。
原題: Metamorphic Testing of Vision-Language Action-Enabled Robots / Pablo Valle, Sergio Segura, Shaukat Ali 他
日本語で読む → - 論文摩擦モデリング制御
ブラシル動力学を伴う一次摩擦モデル:集中定式化と分布定式化
物理原理から一次動摩擦モデルを導出し、LuGreモデルに類似した定式化の安定性・受動性を解析するとともに、転がり接触向けの分布型PDEモデルを提案した。
原題: First-order friction models with bristle dynamics: lumped and distributed formulations / Luigi Romano, Ole Morten Aamo, Jan Åslund 他
日本語で読む → - 論文自動運転テストロボティクス
衝突への道:自動運転システムのための二段階衝突シナリオテスト手法
自動運転システムの安全性評価に向け、まず「コンフリクト」と呼ばれる衝突に至る前段階の危険状況を探索し、その後それらを変異させて実際の衝突を誘発する二段階のシナリオテスト手法を提案した。
原題: From Conflicts to Collisions: A Two-Stage Collision Scenario-Testing Approach for Autonomous Driving Systems / Siyuan Chen, Fuyuan Zhang, Hua Qi 他
日本語で読む → - 論文sim2realロボティクス
GeCo-SRT: ロボットのクロスタスクSim-to-Real転移のための幾何認識型継続適応
局所幾何特徴をドメイン・タスク不変な知識として活用し、継続的なSim-to-Real転移を可能にする幾何認識型Mixture-of-Expertsと優先経験再生を提案。新タスク適応でデータ効率を大幅に改善。
原題: GeCo-SRT: Geometry-aware Continual Adaptation for Robotic Cross-Task Sim-to-Real Transfer / Wenbo Yu, Wenke Xia, Weitao Zhang 他
日本語で読む → - 論文ナビゲーションロボティクス
ReasonNavi: 人間に着想を得たゼロショット身体性ナビゲーションのためのグローバル地図推論
トップダウン地図を部屋分割と候補ノードに離散化し、MLLMに多段階で推論させて指示に合う目標を選び、決定論的プランナで経路生成するゼロショットナビゲーション手法を提案。
原題: ReasonNavi: Human-Inspired Global Map Reasoning for Zero-Shot Embodied Navigation / Yuzhuo Ao, Anbang Wang, Yu-Wing Tai 他
日本語で読む → - 論文sim2real画像認識
SAGE: 身体性AIのためのスケーラブルなエージェント型3Dシーン生成
ユーザーが指定した身体性タスクを理解し、複数の生成器と評価器を組み合わせて物理的に妥当でシミュレータ対応の3D環境を自動生成するエージェントフレームワークを提案。
原題: SAGE: Scalable Agentic 3D Scene Generation for Embodied AI / Hongchi Xia, Xuan Li, Zhaoshuo Li 他
日本語で読む → - 論文関節物体生成画像認識
PAct: 部分分解による単視点関節物体生成
単一画像から関節物体を部分ごとに分解し、形状・構成・関節運動を生成するフィードフォワード手法を提案。
原題: PAct: Part-Decomposed Single-View Articulated Object Generation / Qingming Liu, Xinyue Yao, Shuyuan Zhang 他
日本語で読む → - 論文ウェアラブルアシスト/エクソスーツロボティクス
快適性と使いやすさを損なわずに支援性能を高める肩用エクソスーツの再設計
肩用ソフトエクソスーツを快適性重視で再設計し、支援性能を維持しつつ前腕の前方位置決めと可動域を改善できることを健常者8名で検証した。
原題: Can We Redesign a Shoulder Exosuit to Enhance Comfort and Usability Without Losing Assistance? / Roberto Ferroni, Daniele Filippo Mauceri, Jacopo Carpaneto 他
日本語で読む → - 論文安全制御制御
動的システム間での安全証明書の転移
動特性が異なるシステム間で安全制約を転移する枠組みを提案し、シミュレーション関数とマージン項を用いて制御バリア関数を変換、二次計画法ベースの安全フィルタで目標システムに適用する。
原題: On transferring safety certificates across dynamical systems / Nikolaos Bousias, Charalampia Stamouli, Anastasios Tsiamis 他
日本語で読む → - 論文VLAロボティクス
適応的視覚トークンキャッシュによるVision-Language-Actionモデルの高速化学習
VLAモデルの推論を、再利用する視覚トークンを動的に選ぶ学習可能なポリシーとして最適化し、精度を保ちながら最大1.76倍の高速化を実現した。
原題: Learning to Accelerate Vision-Language-Action Models through Adaptive Visual Token Caching / Yujie Wei, Jiahan Fan, Jiyu Guo 他
日本語で読む → - 論文空中ナビゲーションロボティクス
APEX: 非同期空中物体ゴールナビゲーションのための分離型記憶ベース探索器
VLMによる動的空間記憶と強化学習による行動決定、オープンボキャブラリ検出を組み合わせ、UAVが言語指示に基づき空中で目標物体を自律探索する階層型エージェントを提案。
原題: APEX: A Decoupled Memory-based Explorer for Asynchronous Aerial Object Goal Navigation / Daoxuan Zhang, Ping Chen, Xiaobo Xia 他
日本語で読む → - 論文VLAセキュリティロボティクス
一度注入すれば生き残る:下流ファインチューニングを耐え抜くVLAモデルへのバックドア攻撃
VLAモデルのファインチューニングで消えにくいモジュールにバックドアを注入し、ユーザー側の追加学習後も攻撃が持続する手法INFUSEを提案した。
原題: Inject Once Survive Later: Backdooring Vision-Language-Action Models to Persist Through Downstream Fine-tuning / Jianyi Zhou, Yujie Wei, Ruichen Zhen 他
日本語で読む → - 論文超冗長ロボット肢ロボティクス
汎用超冗長ロボット肢による人間のバランス補助
汎用超冗長ロボット肢を用いて人間のバランスを保つ階層型フレームワークを提案し、10名の被験者実験で姿勢の不安定性が低減することを示した。
原題: Augmenting Human Balance with Generic Supernumerary Robotic Limbs / Xuanyun Qiu, Dorian Verdel, Hector Cervantes-Culebro 他
日本語で読む → - 論文キーポイント検出画像認識
RaCo: 実用的な学習ベースキーポイントのためのランキングと共分散
透視画像クロップのみで学習し、回転に頑健なキーポイント検出器と、限られた数のキーポイントでマッチ数を最大化する微分可能ランカー、空間的不確かさを定量化する共分散推定器を統合した軽量ニューラルネットワークを提案。
原題: RaCo: Ranking and Covariance for Practical Learned Keypoints / Abhiram Shenoi, Philipp Lindenberger, Paul-Edouard Sarlin 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
FR-GESTURE: ファーストレスポンダー操作のためのジェスチャー型ヒューマンロボットインタラクション向けRGBDデータセット
災害現場で活動するファーストレスポンダーがUGVをジェスチャーで操作するための12種類のコマンドを定義し、2視点・7距離から撮影した3312組のRGBDデータセットを構築してベースライン評価を行った論文。
原題: FR-GESTURE: An RGBD Dataset For Gesture-based Human-Robot Interaction In First Responder Operations / Konstantinos Foteinos, Georgios Angelidis, Aggelos Psiris 他
日本語で読む → - 論文ナビゲーションロボティクス
RA-Nav: 予測不能な環境における空中ロボットのためのセマンティックセグメンテーションに基づくリスク認識ナビゲーションシステム
セマンティックセグメンテーションで障害物を分類し、突然動き出す障害物のリスクを推定して安全な経路を計画する空中ロボット向けナビゲーション手法を提案。
原題: RA-Nav: A Risk-Aware Navigation System Based on Semantic Segmentation for Aerial Robots in Unpredictable Environments / Ziyi Zong, Xin Dong, Jinwu Xiang 他
日本語で読む → - 論文ソーシャルナビゲーションロボティクス
PISHYAR: 視覚障害者向けの社会的インテリジェントなスマート杖による屋内ソーシャルナビゲーションとマルチモーダルな人間-ロボットインタラクション
視覚障害者支援のため、社会的配慮のあるナビゲーションとマルチモーダル対話を統合したスマート杖を開発し、シミュレーションと実環境で約80%の精度を達成した。
原題: PISHYAR: A Socially Intelligent Smart Cane for Indoor Social Navigation and Multimodal Human-Robot Interaction for Visually Impaired People / Mahdi Haghighat Joo, Maryam Karimi Jafari, Alireza Taheri
日本語で読む → - 論文触覚ロボティクス
内部音響センシングを内部視覚に追加することで、柔らかいロボット指先による人間らしい布地認識を実現
柔らかい触覚センサ(カメラとマイク)を指先に搭載し、布地を能動的にこすって音と変形を同時に計測することで、20種類の布地を97%の精度で分類した研究。
原題: Adding internal audio sensing to internal vision enables human-like in-hand fabric recognition with soft robotic fingertips / Iris Andrussow, Jans Solano, Benjamin A. Richardson 他
日本語で読む → - 論文ソフトアクチュエータロボティクス
ソフトロボティクス向け幾何学ベース空気圧アクチュエータ
CNC熱シール可能な制約層を導入し、予測可能な変形や極小曲げ半径、多状態駆動を実現する幾何学ベース空気圧アクチュエータを提案し、外骨格・触覚インタフェース・二足歩行ロボットで応用を示した。
原題: Geometry-based pneumatic actuators for soft robotics / Rui Chen, Daniele Leonardis, Domenico Chiaradia 他
日本語で読む → - 論文SLAM/視覚オドメトリ画像認識
FLIGHT: フィボナッチ格子を用いた実時間幾何学的方位推定
単眼動画からカメラの進行方向を推定するため、単位球面上のハフ変換をフィボナッチ格子で離散化する手法を提案し、ノイズや外れ値に頑健で高精度・高効率な推定を実現した。
原題: FLIGHT: Fibonacci Lattice-based Inference for Geometric Heading in real-Time / David Dirnfeld, Fabien Delattre, Pedro Miraldo 他
日本語で読む → - 論文VLAロボティクス
HALO: 身体性マルチモーダル連鎖推論のための統合視覚-言語-行動モデル
テキスト推論・視覚的サブゴール予測・行動予測を統合したEM-CoT推論を可能にするVLAモデルHALOを提案し、シミュレーションと実環境でベースラインを上回る性能を示した。
原題: HALO: A Unified Vision-Language-Action Model for Embodied Multimodal Chain-of-Thought Reasoning / Quanxin Shou, Fangqi Zhu, Shawn Chen 他
日本語で読む →