論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
潜在推論VLA:視覚-言語-行動モデルのための潜在思考と予測
Chain-of-Thought推論を連続潜在表現に内部化し、推論時の明示的生成を不要にすることで、最大90%の遅延削減を実現したVLAフレームワーク。
原題: Latent Reasoning VLA: Latent Thinking and Prediction for Vision-Language-Action Models / Shuanghao Bai, Jing Lyu, Wanqi Zhou 他
日本語で読む → - 論文医療ロボティクスロボティクス
血管内ロボットナビゲーションにおける解剖学的経路曖昧性解消のためのトポロジー符号化グラフを用いた視覚ベース推論
冠動脈インターベンション支援ロボット向けに、血管セグメンテーションとグラフアテンションで分岐の投影による誤認を解消し、実時間経路計画を行う二段階フレームワークを提案した。
原題: Vision-Based Reasoning with Topology-Encoded Graphs for Anatomical Path Disambiguation in Robot-Assisted Endovascular Navigation / Jiyuan Zhao, Zhengyu Shi, Wentong Tian 他
日本語で読む → - 論文VLAロボティクス
UniPlan: 統合PDDL定式化による移動マニピュレーションの視覚言語タスクプランニング
大規模屋内環境での長期的な移動マニピュレーションのため、シーン構造・視覚情報・ロボット能力をPDDLに統合し、VLMで物体を接地して既存のPDDLソルバで計画を生成するシステムを提案した。
原題: UniPlan: Vision-Language Task Planning for Mobile Manipulation with Unified PDDL Formulation / Haoming Ye, Yunxiao Xiao, Cewu Lu 他
日本語で読む → - 論文自動運転ロボティクス
自動運転車のベンチマーク:ドライバー基盤モデルフレームワーク
自動運転車の性能を人間ドライバーと比較評価するための「ドライバー基盤モデル」の概念と、その構築・活用フレームワークを提案した論文。
原題: Benchmarking Autonomous Vehicles: A Driver Foundation Model Framework / Yuxin Zhang, Cheng Wang, Hubert P. H. Shum
日本語で読む → - 論文船舶モビリティ/軌跡補間cs.DB
船舶軌跡の欠損補間フレームワークHABIT:AISデータによる海上モビリティ解析
AISデータに生じる船舶軌跡の欠損を、H3地理空間インデックスと過去の航行パターンを用いて補間する軽量フレームワークHABITを提案し、精度と計算効率の両面で有効性を示した。
原題: Data-Driven Trajectory Imputation for Vessel Mobility Analysis / Giannis Spiliopoulos, Alexandros Troupiotis-Kapeliaris, Kostas Patroumpas 他
日本語で読む → - 論文マルチロボット/タスクプランニングロボティクス
Hyperledger Fabric上のLLMオラクルによる分散型意図ベースマルチロボットタスクプランナ
複数ベンダーのLLM出力をタスクの時間順序を考慮して集約する新手法を提案し、Hyperledger Fabric上で自然言語意図をサブタスクに分解して異なるロボットを協調制御する分散型マルチロボット基盤を構築した。
原題: Decentralized Intent-Based Multi-Robot Task Planner with LLM Oracles on Hyperledger Fabric / Farhad Keramat, Salma Salimi, Tomi Westerlund
日本語で読む → - 論文マニピュレーションロボティクス
接触アンカーポリシー:接触条件付けによる強力なロボットユーティリティモデル
言語指示の代わりに空間上の接触点を条件として使い、モジュール型ユーティリティモデル群として構成した操作ポリシーCAPを提案。軽量シミュレータEgoGymでの実機-シミュレーション反復により、23時間のデモデータのみで新環境・新機体にゼロショット汎化し、最先端VLAを56%上回る。
原題: Contact-Anchored Policies: Contact Conditioning Creates Strong Robot Utility Models / Zichen Jeff Cui, Omar Rayyan, Haritheja Etukuru 他
日本語で読む → - 論文マニピュレーションロボティクス
安全強化学習による狭所での二台四脚ロボット協調搬送
二台の四脚ロボットが狭い環境で協調して荷物を運ぶため、衝突回避を制約として定式化した安全強化学習手法を提案し、実機実験で有効性を示した。
原題: Dual-Quadruped Collaborative Transportation in Narrow Environments via Safe Reinforcement Learning / Zhezhi Lei, Zhihai Bi, Wenxin Wang 他
日本語で読む → - 論文変形物体操作ロボティクス
変形可能物体操作における未解決課題への展望
変形可能物体操作の最新研究をレビューし、遮蔽処理やタスク汎化、リアルタイム制御などの課題と、マルチモーダル知覚・物理情報に基づく強化学習・微分可能シミュレーションの進展を整理した展望論文。
原題: A Perspective on Open Challenges in Deformable Object Manipulation / Ryan Paul McKennaa, John Oyekan
日本語で読む → - 論文VLAロボティクス
頑健なスキル、脆い接地:マルチオブジェクトピッキングによる視覚言語行動ポリシーの限定的汎化の診断
VLAポリシーが物体と言語の対応を本当に学習しているのかを調べるため、物体配置のばらつきを段階的に増やすマルチオブジェクトピッキング実験を行い、操作スキルと指示追従が分離していることを示した。
原題: Robust Skills, Brittle Grounding: Diagnosing Restricted Generalization in Vision-Language Action Policies via Multi-Object Picking / David Emukpere, Romain Deffayet, Jean-Michel Renders
日本語で読む → - 論文マルチロボット計画ロボティクス
プロンプト最適化を備えた階層型LLMマルチエージェントによるマルチロボットタスク計画
LLMで自然言語指示を分解し、下位エージェントがPDDL問題を生成して古典プランナで解く階層型マルチエージェント計画手法を提案。失敗時にはテキスト勾配でプロンプトを最適化し、MAT-THORで従来手法を上回る成功率を達成した。
原題: Hierarchical LLM-Based Multi-Agent Framework with Prompt Optimization for Multi-Robot Task Planning / Tomoya Kawabe, Rin Takano
日本語で読む → - 論文触覚ロボティクス
多指把持における反射的スリップ制御:触覚センシングと内力最適化のハイブリッド
圧電・ピエゾ抵抗触覚センサを組み合わせてスリップを高速検出し、モデルベースの内力制御で物体を把持したまま反射的に安定化する枠組みを構築した。
原題: Reactive Slip Control in Multifingered Grasping: Hybrid Tactile Sensing and Internal-Force Optimization / Théo Ayral, Saifeddine Aloui, Mathieu Grossard
日本語で読む → - 論文バイオハイブリッドアクチュエータロボティクス
機械学習によるバイオハイブリッドアクチュエータの挙動予測
骨格筋を用いたバイオハイブリッドアクチュエータの挙動を機械学習で予測する研究。静的モデルと動的モデル(LSTM)を構築し、高い精度で力を予測できることを示した。
原題: Machine Learning Driven Prediction of the Behavior of Biohybrid Actuators / Michail-Antisthenis Tsompanas, Marco Perez Hernandez, Faisal Abdul-Fattah 他
日本語で読む → - 論文変形可能物体操作ロボティクス
布を広げる動作を学習:変形可能物体操作へのワールドモデルのスケーリング
DreamerV2を改良し、表面法線入力を用いたワールドモデルで空中での布広げ操作を学習。シミュレーションと実機でのゼロショット展開で汎化性能を示した。
原題: Learning to unfold cloth: Scaling up world models to deformable object manipulation / Jack Rome, Stephen James, Subramanian Ramamoorthy
日本語で読む → - 論文移動ロボティクス
必要なときは掴み、滑るときは滑る:超音波潤滑によるロボット移動
超音波振動で接触面の摩擦を能動的に切り替え、尺取り虫やハチの産卵管を模したロボットで90%超の効率で双方向移動を実現した。
原題: Grip as Needed, Glide on Demand: Ultrasonic Lubrication for Robotic Locomotion / Mostafa A. Atalla, Daan van Bemmel, Jack Cummings 他
日本語で読む → - 論文水中ロボットロボティクス
海洋フィールドワークのための自律型ウミガメロボット
ウミガメに着想を得た自律型水中ロボットを開発し、水族館のサンゴ礁展示で高速で動く海洋動物やダイバーを追跡できることを実証した。
原題: Autonomous Sea Turtle Robot for Marine Fieldwork / Zach J. Patterson, Emily Sologuren, Levi Cai 他
日本語で読む → - 論文群集ナビゲーションロボティクス
Crowd-FM: 群集ナビゲーションのための条件付きフローマッチング生成軌道の学習に基づく最適選択
条件付きフローマッチングで衝突回避軌道を生成し、人間らしさを評価するスコア関数で最適な軌道を選択する群集ナビゲーション手法を提案。
原題: Crowd-FM: Learned Optimal Selection of Conditional Flow Matching-generated Trajectories for Crowd Navigation / Antareep Singha, Laksh Nanwani, Mathai Mathew P. 他
日本語で読む → - 論文HRIロボティクス
大規模言語モデル時代の人間-ロボット相互作用研究の動向:系統的レビュー
PRISMAガイドラインに沿った系統的文献検索で86件の論文を分析し、LLMがHRIの文脈理解・社会的相互作用・継続的適応をどう変えているか、また研究手法や評価指標の課題を整理したレビュー。
原題: How Do We Research Human-Robot Interaction in the Age of Large Language Models? A Systematic Review / Yufeng Wang, Yuan Xu, Anastasia Nikolova 他
日本語で読む → - 論文ナビゲーションロボティクス
入力アフィン系に対するナビゲーションのための合成可能なモデルフリー強化学習
各環境要素(目標や障害物)ごとに価値関数と最適方策を学習し、オンラインで合成することで、未知の非線形連続時間入力アフィン系において目標到達と衝突回避を実現するモデルフリー強化学習手法を提案。
原題: Composable Model-Free RL for Navigation with Input-Affine Systems / Xinhuan Sang, Abdelrahman Abdelgawad, Roberto Tron
日本語で読む → - 論文マルチモーダル触覚ロボティクス
TactEx: 人間らしい触覚と硬さ推定のための説明可能なマルチモーダルロボットインタラクションフレームワーク
視覚・触覚・言語を統合し、果物の熟度判定を通じて硬さを推定する説明可能なロボットフレームワークを提案。触覚配置にはGSAMが有効で、LLMによる自然言語説明を付与し、90%のタスク成功率を達成。
原題: TactEx: An Explainable Multimodal Robotic Interaction Framework for Human-Like Touch and Hardness Estimation / Felix Verstraete, Lan Wei, Wen Fan 他
日本語で読む → - 論文自動運転意思決定ロボティクス
自動運転の相互作用を考慮した意思決定のためのマルチプレイヤー・マルチストラテジー量子ゲームモデル
量子ゲーム理論を自動運転の意思決定に応用し、複数エージェント間の相互作用を考慮した新しいモデルを提案。シミュレーションで従来手法より成功率と衝突回避率が向上することを示した。
原題: Multi-Player, Multi-Strategy Quantum Game Model for Interaction-Aware Decision-Making in Automated Driving / Karim Essalmi, Fernando Garrido, Fawzi Nashashibi
日本語で読む → - 論文空中物理インタラクションロボティクス
バンパードローン:空中物理インタラクションのための弾性形態設計
弾性のある角(ホーン)を備えたドローンが、壁に接触しながら跳ね返る「タッチアンドゴー」動作を実現し、剛体ホーンよりピッチ振動を38%低減することを示した。
原題: Bumper Drone: Elastic Morphology Design for Aerial Physical Interaction / Pongporn Supa, Alex Dunnett, Feng Xiao 他
日本語で読む → - 論文ヒューマノイドロボティクス
LessMimic: 統一距離場表現による長期的ヒューマノイドインタラクション
距離場(DF)を統一表現として用い、参照動作なしで物体形状に汎化し、長期的な全身インタラクションを単一ポリシーで実現する手法を提案。
原題: LessMimic: Long-Horizon Humanoid Interaction with Unified Distance Field Representations / Yutang Lin, Jieming Cui, Yixuan Li 他
日本語で読む → - 論文軌道計画ロボティクス
生贄エージェントを用いた旋回率制限付き交戦領域の推定と安全な軌道計画
生贄エージェントの直線軌道と生存/迎撃結果から追跡者の旋回率制限パラメータを推定し、高価値エージェントの安全な時間最適経路を生成する学習フレームワークを提案。
原題: Inferring Turn-Rate-Limited Engagement Zones with Sacrificial Agents for Safe Trajectory Planning / Grant Stagg, Cameron K. Peterson
日本語で読む → - 論文移動制御ロボティクス
最適幾何移動のための劣リーマン境界値問題
細長い移動体の形状変化による移動を、散逸最小化の境界値問題として定式化し、劣リーマン測地線として数値的に解く幾何モデルを提案した。
原題: Sub--Riemannian boundary value problems for Optimal Geometric Locomotion / Oliver Gross, Florine Hartwig, Martin Rumpf 他
日本語で読む → - 論文世界モデル/量子化機械学習
世界モデル計画におけるビット配分の重要性:効率的な空間推論のためのペア混合ビット研究
DINO-WMの壁計画タスクで、均一・混合・非対称・層別の量子化を比較し、4ビット付近ではエンコーダ精度を保つ配分が計画性能を改善することを示した。
原題: Where Bits Matter in World Model Planning: A Paired Mixed-Bit Study for Efficient Spatial Reasoning / Suraj Ranganath, Anish Patnaik, Vaishak Menon
日本語で読む → - 論文VLAロボティクス
世界行動モデルはゼロショット方策である
動画拡散モデルを基盤に未来の世界状態と行動を予測するWorld Action Model「DreamZero」を提案し、実機でVLAを上回る汎化性能と7Hzのリアルタイム閉ループ制御を実現した。
原題: World Action Models are Zero-shot Policies / Seonghyeon Ye, Yunhao Ge, Kaiyuan Zheng 他
日本語で読む → - 論文全身マニピュレーションロボティクス
AdaptManip: オンライン再帰的状態推定による適応的な全身物体持ち上げ・運搬の学習
ヒューマノイドが強化学習のみで物体の持ち上げと運搬を自律的に行う枠組みを提案し、再帰的物体状態推定とLiDAR自己位置推定を組み合わせて実機でゼロショット動作を実現した。
原題: AdaptManip: Learning Adaptive Whole-Body Object Lifting and Delivery with Online Recurrent State Estimation / Morgan Byrd, Donghoon Baek, Kartik Garg 他
日本語で読む → - 論文VLAロボティクス
Habilis-β: 高速動作と長時間稼働を実現するオンデバイス視覚言語行動モデル
実環境での連続稼働を想定し、大規模プレイデータでの事前学習と整流フロー蒸留を組み合わせることで、エッジデバイス上で高速かつ長時間安定して動作するVLAモデルを実現した。
原題: Habilis-$\beta$: A Fast-Motion and Long-Lasting On-Device Vision-Language-Action Model / Tommoro Robotics, :, Jesoon Kang 他
日本語で読む → - 論文VLAロボティクス
不確実性を考慮したポリシーステアリング:行動・質問・学習の判断
VLM検証器の不確実性を較正し、高信頼行動の実行・自然言語での曖昧性解消・介入要求を選択する枠組みを提案。
原題: When to Act, Ask, or Learn: Uncertainty-Aware Policy Steering / Jessie Yuan, Yilin Wu, Andrea Bajcsy
日本語で読む →