論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/22 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文画像マッチングロボティクス
MatcherCompass: 実環境での画像マッチャ選択を支援するデプロイメント対応ベンチマーク
フィールドロボット向けに、9つの画像マッチング手法を4つの解像度・精度・GPUで評価し、時間・リソース制約下で最適な構成を選ぶためのベンチマークを提案。
原題: MatcherCompass: A Deployment-Aware Benchmark to Guide Image Matcher Selection in the Wild / Hyunwoo Kim, Giseop Kim
日本語で読む → - 論文群制御ロボティクス
協調型マルチロボット建設のためのスキル系列計画
建設作業を複数の多機能ロボットが協調して行うため、再利用可能なスキル(把持、穴あけ、締結など)を組み合わせた系列を自動計画する手法を提案。デジタルツイン上で人間が確認・承認できる。
原題: Skill Sequence Planning for Collaborative Multi-Robot Construction / Xi Wang, Bo Fu, Carol C. Menassa 他
日本語で読む → - 論文マニピュレーションロボティクス
ローカルコーディングエージェントによるマニピュレーションスキルの汎化
ローカルのオープンウェイトVLMがコーディングエージェントとしてロボットアームを制御し、追加の学習やプログラミングなしで新しいタスクに一度で汎化できるかを検証した。
原題: Generalizing Manipulation Skills with a Local Coding Agent / Raman Talwar, Elias Nijs, Andreas Verleysen 他
日本語で読む → - 論文ナビゲーションロボティクス
基盤モデルによる身体性ナビゲーションの実環境展開
基盤モデルをナビゲーションエージェントに適用する際の訓練バイアスと文脈長制限に対処するため、人間習慣データによる事前調整とメモリヘッドによる能動的記憶管理を提案し、実環境で性能向上を実証した。
原題: Deploying Foundation Models for Embodied Navigation / Vishnu Sashank Dorbala, Dinesh Manocha
日本語で読む → - 論文SLAMロボティクス
デュアル共分散ガウシアンスプラッティングSLAM:ロバストなリアルタイム追跡のためのレンダリングと位置合わせの分離
3DガウシアンスプラッティングSLAMにおいて、レンダリング用と追跡用に別々の共分散を持たせることで、リアルタイム追跡のロバスト性と精度を向上させた。
原題: Dual Covariance Gaussian Splatting SLAM: Decoupling Rendering and Registration for Robust Real-Time Tracking / Edward Beng Wai Tan, Siew-Kei Lam
日本語で読む → - 論文歩行ロボティクス
SG-CPG: 継続的なアクチュエータ劣化下での適応的四足歩行のための重症度ゲート付き中枢パターン生成器
動物が弱った脚をかばいながら歩行を続ける仕組みに着想を得て、アクチュエータの劣化度に応じて残差ゲートと振幅ゲートで四足歩行を適応させるCPG手法を提案し、シミュレーションと実機で有効性を示した。
原題: SG-CPG: Severity-Gated Central Pattern Generators for Adaptive Quadruped Locomotion under Continuous Actuator Degradation / Adarsh Kumar Kosta, Kaushik Roy
日本語で読む → - 論文マニピュレーションロボティクス
DynaForge: 動的マニピュレーションのデモ生成のための計画誘導型残差学習
低周波の大域計画と高周波の物体中心逆運動学を組み合わせ、残差方策で接触時の動的相互作用を補正することで、動的物体操作の高品質なデモンストレーションを生成するフレームワーク。
原題: DynaForge: Planning-Guided Residual Learning for Dynamic Manipulation Demonstration Generation / Yiyang Jin, Yu Zheng, Xiao He 他
日本語で読む → - 論文月面採掘/ISRUロボティクス
月面資源採掘のためのスパイラルキャビティホイール:視覚ベースの充填率・沈下解析による比較研究
月面レゴリスの採掘用にスパイラルキャビティホイールを提案し、視覚による充填率と沈下の推定、およびエネルギー効率の評価を行った。従来のバケットドラムと比較して、採掘速度が2.2~3.0倍、比エネルギーが29%削減されることを示した。
原題: Designing an Efficient Excavator Bucket for Lunar ISRU: A Comparative Study with Vision-Based Fill and Displacement Analysis / Abdulla Hil Kafi, Tomoki Koshi, Jorge Casir 他
日本語で読む → - 論文SLAMロボティクス
2D点群レジストレーションのための符号なし距離マップ
2D点群レジストレーションにおいて、符号なし距離マップを事前計算し、SE(2)多様体上でガウス・ニュートン最適化を行うことで、反復的な最近傍探索を不要にした手法を提案。
原題: Unsigned Distance Maps on 2D Point Cloud Registration / Ricardo B. Sousa, Giorgio Grisetti, Héber Miguel Sobreira 他
日本語で読む → - 論文マルチエージェント強化学習機械学習
完全ビザンチン耐性マルチエージェント強化学習
通信層にビザンチン攻撃がある分散マルチエージェント強化学習において、2ホップメッセージの冗長性を利用して信頼できるメッセージを特定し、攻撃がない場合と同じ極限点に収束する手法を提案した。
原題: Fully Byzantine-Resilient Multi-Agent Reinforcement Learning / Haejoon Lee, Dimitra Panagou
日本語で読む → - 論文マニピュレーションロボティクス
PAKT: 強化学習のための物理的整合性を備えたキネステティック教示
人間がロボットを直接動かして教示する際に、ロボットや方策が物理的に再現できない軌道を防ぐアドミッタンス制御ベースの枠組みを提案し、低頻度のRL行動を高頻度トルク指令に変換する制御スタックを構築した。
原題: PAKT: Physically-Aligned Kinesthetic Teaching for Reinforcement Learning / Lars Johannsmeier, Yashraj Narang
日本語で読む → - 論文移動マニピュレーションロボティクス
Zephyron:太陽光支援移動マニピュレータの統合設計と解析的評価によるマルチモーダル環境偵察と分散視覚推論
太陽光パネルを搭載した4輪ローバーとフロントマニピュレータの設計を提案し、エネルギー消費やセンサ統合の制約を解析的に評価した。
原題: Zephyron: Integrated Design and Analytical Evaluation of a Solar-Assisted Mobile Manipulator for Multimodal Environmental Reconnaissance and Distributed Visual Inference / Sabik Bin Sultan, Shafi Bin Sultan, Safwan Sadad
日本語で読む → - 論文群制御ロボティクス
視覚に基づく水中ロボットのフォーメーション制御:入力飽和を考慮したバリアリアプノフ関数アプローチ
完全駆動型水中ロボットの視覚ベースのフォーメーション制御において、センシング制約・衝突回避・入力飽和を考慮した通信不要のフレームワークを提案し、GazeboでのSITLシミュレーションで検証した。
原題: Vision-based Underwater Formation Control With Input Saturations via Barrier Lyapunov Functions / Nicola De Carli, João Zenário, Victor Nan Fernandez-Ayala 他
日本語で読む → - 論文協調認識/3D多物体追跡ロボティクス
CDKF-Track: クラスタ対応データ駆動型カルマンフィルタによる協調3D多物体追跡
複数車両のLiDAR検出をグラフラプラシアンで融合し、クラスタ単位で冗長検出を削減した上で、データから運動ダイナミクスを学習するカルマンフィルタとウェーブレット時間補正で協調3D多物体追跡を行うフレームワーク。
原題: CDKF-Track: Cluster-aware Data-Driven Kalman Filtering for Cooperative 3D Multi-Object Tracking / Maria Damanaki, Nikos Piperigkos, Alexandros Gkillas 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
PLAT: 特権潜在遷移学習によるヒューマノイド制御のためのスパース時間指定キーフレーム動作追従
スパースなキーフレームと到達時刻のみから全身動作を生成するヒューマノイド制御フレームワークPLATを提案し、シミュレーションとUnitree G1実機で有効性を示した。
原題: PLAT: Sparse Timed Keyframe Motion Tracking for Humanoid Control via Privileged Latent Transition Learning / Zepeng Wang, Jiangxing Wang, Chao Ma 他
日本語で読む → - 論文VLAロボティクス
行動は1パッチに値する:PatchWAMによる統合的世界-行動モデリング
連続行動を固定マッピングでパッチとして表現し、専用の行動ヘッドや専門家なしに単一の生成モデルで視覚予測と行動生成を同時に行うPatchWAMを提案。LIBERO-Plusで91.8%、RoboTwin 2.0で96.12%の成功率を達成。
原題: An Action Is Worth One Patch: Unified World-Action Modeling with PatchWAM / Tianheng Wang, Zhou Xie, Heng Jia 他
日本語で読む → - 論文顔匿名化画像認識
HYDRO: 高忠実度ハイブリッド拡散とターゲット指向アプローチによる非可逆的な顔匿名化
ターゲット指向の顔匿名化に拡散モデルを組み合わせ、復元攻撃を防ぐ非可逆的な匿名化手法を提案。
原題: HYDRO: Towards Non-Reversible Face De-Identification Using a High-Fidelity Hybrid Diffusion and Target-Oriented Approach / Felix Rosberg, Vitomir Štruc, Cristofer Englund 他
日本語で読む → - 論文VLAロボティクス
魚眼VLA:単一魚眼カメラで操作のための広域認識と高精細視野を両立
単一の魚眼カメラから広域視野とエンドエフェクタ中心の局所クロップを同時に取得し、VLAモデルと組み合わせて卓上・棚・コンベア上の操作を実現した研究。
原題: Fisheye-VLA: Decoupling Coverage and Acuity for Manipulation with a Single Fisheye Camera / Ziang Ren, Zike Yan, Raymond Zhang 他
日本語で読む → - 論文世界モデルロボティクス
TriWorldBench: 三視点整合性で評価する身体性世界モデル
頭部と両手首のカメラ映像を同期させた二腕操作タスクのベンチマークを提案し、視点間の整合性や物理的・時間的一貫性を19指標で評価する。
原題: TriWorldBench: A Tri-View Consistency Perspective on Embodied World Models / Xuanyi Liu, Haofeng Wang, Ruiqi Li 他
日本語で読む → - 論文外骨格ロボティクス
ベンチ/バックパック両対応の再構成可能な双方向ケーブル駆動股関節外骨格
ベンチ据置型とバックパック型のアクチュエーションを素早く切り替えられる、共通の装着インターフェースを持つケーブル駆動股関節外骨格を開発し、動作追従性と歩行データ収集を検証した。
原題: A Reconfigurable Bidirectional Cable-Driven Hip Exoskeleton with Swappable Bench/Backpack Dual-configuration Actuation / YuanLong Ji, Shuhan Xiang, Qihan Ye 他
日本語で読む → - 論文移動マニピュレーションロボティクス
地図認識型視覚運動ポリシーによる移動マニピュレーション
テレオペ実演から地図を構築し、ベース姿勢を明示的に予測・追従させることで移動マニピュレーションの成功率を高める枠組みMAVPを提案。
原題: MAVP: Map-Aware Visuomotor Policies for Mobile Manipulation / Jinhe Tang, Ruixiao Dai, Weiming Zhi
日本語で読む → - 論文強化学習/エージェントAI
サブタスク分解による強化学習
マルチターンの軌跡報酬をサブタスクごとに分解し、各サブタスクのグループ相対アドバンテージを計算してトークン単位でクレジットを配分するRLDSを提案。エージェント系ベンチマークで有効性を示す。
原題: Reinforcement Learning with Decomposed Subtasks / Mattie Terzolo, Mikolaj Sacha, Ayan Sinha 他
日本語で読む → - 論文VLAロボティクス
CableVLA: ケーブル配線のためのシミュレーション特権的グローバル・ローカル表現学習
シミュレーションの特権情報を活用し、ケーブルのトポロジーと触覚を表現する視覚言語行動フレームワークを提案。ケーブル配線タスクの成功率を62.6%から84.9%に向上させた。
原題: CableVLA: Simulation-Privileged Global-Local Representation Learning for Cable Routing / Zhifei Teng, Bo Feng, Xiang Zou 他
日本語で読む → - 論文運動計画ロボティクス
制約付き運動計画のための誘導リーマン計量
制約により曲がった部分多様体上での運動計画において、陰的・陽的表現のどちらでも同じ誘導計量が得られることを示し、サンプリングプランナと軌道最適化に応用した。
原題: Induced Riemannian Metrics for Motion Planning with Constraints / Phone Thiha Kyaw, Thomas Cohn, Miguel Angel Rogel Garcia 他
日本語で読む → - 論文動的マニピュレーションロボティクス
MotionForge:動的物体の長期的操作のためのデータ生成パイプラインと大規模ベンチマーク
動的環境でのロボット操作を評価するため、11種類の運動パターンを含む40タスクと長期タスク17件を備えた大規模シミュレーションベンチマークとデータ生成パイプラインを提案し、ドメインシフト下での汎用ポリシーの限界を明らかにした。
原題: MotionForge: A Data Generation Pipeline and Large-Scale Benchmark for Long-Horizon Manipulation of Dynamic Objects with Domain Shifts / Mohan Liu, Dengchen Mei, Haotian Xian 他
日本語で読む → - 論文医療ロボティクスロボティクス
モータ履歴条件付き残差学習によるシャフト構成適応型カテーテル先端位置推定
モータ角度と駆動トルクの履歴からシャフト構成を推定し、GRUで幾何モデルの残差を補正することで、形状センサなしにカテーテル先端位置を高精度に推定する手法を提案した。
原題: Shaft-Configuration-Adaptive Catheter Tip Position Estimation via Motor-History Conditioned Residual Learning / Peihan Zhang, Michael C. Yip, Ankur Kapoor 他
日本語で読む → - 論文テレオペレーションロボティクス
Astrobee用テレオペ自由飛行マニピュレーションのための展開可能な4指ペイロード
国際宇宙ステーション内の自由飛行ロボットAstrobeeに搭載する4指ハンドと、VRによる遠隔操作パイプラインを提案し、無重力シミュレータで貨物輸送タスクの予備実験を行った。
原題: A Deployable Four-Finger Payload for Teleoperated Free-Flying Manipulation with Astrobee / William Su, Jordan Kam, Yunosuke Nakamura 他
日本語で読む → - 論文VLA画像認識
Metric-Bench: 屋内シーンにおけるVLMの文脈内空間メトリック推論の探究
画像内の参照物体を手がかりに、カメラ内部パラメータなしでVLMが2Dから3Dへのメトリック推論を行うベンチマークと強化学習微調整手法を提案。
原題: Metric-Bench: Exploring In-context Spatial Metric Reasoning in VLMs for Indoor Scenes / Yuling Xi, Haokai Zhang, Muzhi Zhu 他
日本語で読む → - 論文シーン再構成ロボティクス
CODA: 単一RGB-D画像からの深度整合シーン補完と物体分解
単一のRGB-D画像からシーン全体の形状を生成し、環境と可動物体に分解する手法。観測点群との整合性を保つ3Dグラウンディング機構により、物体検出に依存せず高精度な再構成を実現する。
原題: CODA: Depth-Aligned Scene Completion and Object Decomposition from a Single RGB-D Image / Dongwon Son, Junhyek Han, Yoontae Cho 他
日本語で読む → - 論文キャリブレーションロボティクス
レーザートラッカー支援による移動ロボットのカメラ・ロボット間キャリブレーション
レーザートラッカーによる3次元計測とカメラの2次元観測を組み合わせ、移動ロボット上のカメラ姿勢を高精度にキャリブレーションする汎用手法を提案した。
原題: Laser-Tracker-Assisted Camera-to-Robot Calibration for Mobile Robots / Jan A. Rudolph, Öykü Kandemir, Markus Ulrich
日本語で読む →