論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA/ヒューマノイド移動ロボティクス
WOLF-VLA: 全身ヒューマノイド最適移動のための視覚言語行動学習フレームワーク
全身最適制御による動作生成と大規模マルチモーダルデータセットを統合し、自然言語指示から直接ヒューマノイドの移動ポリシーを生成するVLAモデルを訓練する新しいフレームワークを提案した。
原題: WOLF-VLA: Whole-Body Humanoid Optimal Locomotion Framework for Vision-Language-Action Learning / Melya Boukheddimi, Omar Adjali, Daniel Sontag 他
日本語で読む → - 論文ナビゲーションロボティクス
MVP-Nav: 多層価値マップによる物理認識ナビゲーション
RGB画像のみを用いたゼロショット物体ゴールナビゲーションにおいて、3D基盤モデルで2Dセマンティクスを3D境界ボックスに投影して物理占有を再構成し、セマンティック優先度と幾何を統合した多層価値マップで物理的に安全な経路計画を行う手法を提案。
原題: MVP-Nav: Multi-layer Value Map Planner Navigator / Wenyuan Xie, Shaokai Wu, Yijin Zhou 他
日本語で読む → - 論文ワールドモデルロボティクス
イベント条件付き診断:受動的オブジェクト状態ワールドモデルにおける運動学的・接触・物体永続性フィールドの解析
物理的状態を予測するワールドモデルの内部表現が、自由運動・衝突・遮蔽などのイベントに応じてどのように情報を編成・再重み付けするかを診断する手法を提案し、予測への機能的影響を検証した。
原題: Event-Conditioned Diagnostics of Kinematic, Contact, and Object-Permanence Fields in Passive Object-State World Models / Yang Liu, Yuming Chen
日本語で読む → - 論文世界モデルロボティクス
PAIWorld: ロボット操作のための3D整合性を持つ世界基盤モデル
複数視点の3D整合性を保つ世界基盤モデルを提案し、ロボット操作のための予測と計画を改善した。
原題: PAIWorld: A 3D-Consistent World Foundation Model for Robotic Manipulation / Yuhang Huang, Xuan Lv, Junyan Xu 他
日本語で読む → - 論文交通シミュレーションロボティクス
閉ループ交通モデリングにおける局所観測と大域シミュレーションの橋渡し
自動運転の交通シミュレータが、局所的な観測データで学習した結果、閉ループ環境で不自然な挙動を起こす問題を、自己教師ありで失敗を発見し、選好アライメントで補正するフレームワークCRAFTを提案した。
原題: Bridging Local Observation and Global Simulation in Closed-Loop Traffic Modeling / Ziyan Wang, Tan Xiang, Peng Chen 他
日本語で読む → - 論文自動運転画像認識
PriorEye: エンドツーエンド自動運転のための地理空間視覚事前知識
エンドツーエンド自動運転に、走行経路に紐づく地理空間の視覚事前知識を導入し、デュアルメモリと適応ゲートでセンサ非依存の先読みを実現する手法を提案。NAVSIM-v2で性能向上とセンサ劣化への頑健性を確認。
原題: PriorEye: Geospatial Visual Priors for End-to-End Autonomous Driving / Kyuhwan Yeon, Benjamin Ramtoula, Daniele De Martini
日本語で読む → - 論文歩行/強化学習ロボティクス
インラインスケート型ヒューマノイドロボットの強化学習に基づく制御
受動的なインラインスケートを装着したヒューマノイドロボットに対し、強化学習で制御ポリシーを訓練し、動的でエネルギー効率の高いスケーティング動作を実現した。実機へのゼロショット転送にも成功している。
原題: Reinforcement Learning-Based Control for an Inline Skating Humanoid Robot / Ethan Marot, Thomas Bi, Clemens Schwarke 他
日本語で読む → - 論文触覚ロボティクス
RCT: ロボット収集による触覚-視覚-言語データセットと触覚汎化の評価
ロボットが122種類の工業材料を押した際の触覚データを収集し、未見の材料に対する触覚表現の汎化性能を評価するためのデータセットと評価手法を提案した論文。
原題: RCT: A Robot-Collected Touch-Vision-Language Dataset for Tactile Generalization / Jingbo He, Michael Färber, Roberto Calandra
日本語で読む → - 論文継続学習/模倣学習ロボティクス
ワールドアクションモデルによる再帰的生成リプレイを用いた継続的模倣学習
ロボットの行動予測に加えて未来の視覚観測も生成できるワールドアクションモデルを用いて、過去のタスクの疑似軌道を合成し、元のデモデータを保存せずに継続学習を行うフレームワークを提案した。実験では忘却を最大50%削減し、実データを使う手法に匹敵する性能を示した。
原題: World Action Models Enable Continual Imitation Learning with Recurrent Generative Replays / Manish Kumar Govind, Dominick Reilly, Smit Patel 他
日本語で読む → - 論文触覚/操作ロボティクス
UniTacVLA: 視覚言語行動モデルにおける統合触覚理解と予測
接触を伴う器用な操作のために、触覚信号を動的な相互作用の手がかりとして扱い、現在の触覚状態と将来の接触変化を統合的にモデル化するフレームワークを提案。触覚連鎖思考と粗密な将来触覚予測により状態・動態を考慮した事前知識を構築し、実時間と予測触覚を組み合わせた混合制御で高精度な操作を実現。
原題: UniTacVLA: Unified Tactile Understanding and Prediction in Vision Language Action Models / Xidong Zhang, Yichi Zhang, Jiaxin Shi 他
日本語で読む → - 論文動作計画ロボティクス
圧縮表現空間における動作計画
高圧縮オートエンコーダで学習した離散トークンの潜在空間を直接探索することで、任意の目的関数を最適化しつつ現実的な動作を生成する新しい動作計画フレームワークを提案した。nuPlanとWaymoデータセットで評価し、閉ループ計画やマルチエージェントシナリオ生成で高い性能を示した。
原題: Motion Planning in Compressed Representation Spaces / Lukas Lao Beyer, Sertac Karaman
日本語で読む → - 論文医療ロボティクスロボティクス
血管内ガイドワイヤナビゲーションの文脈認識報酬モデリングのための視覚言語手続き推論
ロボット支援血管内介入におけるガイドワイヤ自律ナビゲーションのため、視覚言語モデルを用いて手続き的推論を行い、ナビゲーション段階に応じて報酬を動的に調整するフレームワークを提案した。物理ロボット実験で有効性を示した。
原題: Vision-Language Procedural Reasoning for Context-Aware Reward Modeling of Robotic Endovascular Guidewire Navigation / Wentong Tian, Jiyuan Zhao, Tianliang Yao 他
日本語で読む → - 論文評価ロボティクス
RoboGaze:構造化視覚言語分析によるロボット世界モデルの評価
ロボット操作動画の生成品質を、マルチエージェントVLMを用いて構造化・解釈可能に評価するフレームワークを提案した論文。
原題: RoboGaze: Evaluating Robot World Models via Structured Vision-Language Analysis / Minh-Loi Nguyen, Nghiem Tuong Diep, Hung Khang Nguyen 他
日本語で読む → - 論文宇宙ロボティクス/視覚マーカーロボティクス
宇宙機の自律ランデブー・近傍運用・ドッキングのためのフィデューシャルマーカー
宇宙機の近接運用でカメラ視野から外れにくい再帰的構造を持つ新しいフィデューシャルマーカーAstraTagを提案し、曲面での検出性能を既存手法と比較して向上させた。
原題: Spacecraft Fiducial Marker for Autonomous Rendezvous, Proximity Operations, and Docking / Ravi Kumar Thakur, Matouš Vrba, Martin Saska
日本語で読む → - 論文模倣学習ロボティクス
WARP-RM: ワープ拡張相対進行報酬モデルによるデータキュレーション
成功デモから時間ワープ拡張を用いて自己教師ありでフレームごとの相対進行報酬を学習し、模倣学習のデータ品質を向上させる手法を提案。
原題: WARP-RM: A Warp-Augmented Relative Progress Reward Model for Data Curation / Justin Yu, Andrew Goldberg, Kavish Kondap 他
日本語で読む → - 論文全身操作/データ収集ロボティクス
HumanoidUMI: ロボット不要のデモからヒューマノイド全身操作への橋渡し
軽量VRデバイスとUMI風グリッパーを用いてロボットを使わずにヒューマノイドの全身操作データを収集し、そのデータで高次ポリシーを訓練して全身制御に転用する枠組みを提案した。
原題: HumanoidUMI: Bridging Robot-Free Demonstrations and Humanoid Whole-Body Manipulation / Hongwu Wang, Chenhao Yu, Youhao Hu 他
日本語で読む → - 論文触覚/言語条件付けロボティクス
TacStyle: 構造化行動表現を用いた触覚ロボットポリシーの個人化
言語で好みを伝え、ロボットの動作スタイルを調整する手法を提案。行動の潜在表現を学習し、基盤モデルで解釈して所望の動作を選択する。
原題: TacStyle: Personalizing Tactile Robot Policies using Structured Behavior Representations / Kevin Robledo, Matías I. Torres Galaz, Kumar Dixhant Rai 他
日本語で読む → - 論文身体化AI/推論最適化ロボティクス
速度向上のパラドックス:身体化タスクにおける推論速度と品質のトレードオフ再考
身体化基盤モデルにおける損失を伴う推論最適化(量子化、枝刈り、非同期推論など)が、タスクレベルの性能に与える影響を分析する枠組みTISEDを提案し、静的・動的タスクで逆説的な効果(遅延低下にもかかわらず完了時間が延びる、成功率が向上するなど)を明らかにした。
原題: The Speedup Paradox: Rethinking Inference Speed-Quality Trade-off in Embodied Tasks / Yujin Wang, Junli Chen, Yixuan Li 他
日本語で読む → - 論文交通シミュレーションロボティクス
多交差点都市交通のためのコリドースケールCARLA-VISSIM共シミュレーションフレームワーク
都市部の連続交差点を含むコリドーを対象に、CARLAとVISSIMを双方向に同期させる共シミュレーションフレームワークを構築し、実証実験を行った。
原題: A Corridor-Scale CARLA-VISSIM Co-Simulation Framework for Multi-Intersection Urban Traffic / Sima Ashayer, Austin Haris, Mina Sartipi
日本語で読む → - 論文安全性解析ロボティクス
λ-Reachability: ヒューマノイド安全性のための幾何学的ホライズン安全ベルマン方程式
高次元ロボットシステムの安全性解析をスケーラブルに行うため、割引なしの到達可能性目標を学習できる新しい安全価値推定法λ-Reachabilityを提案し、実機ヒューマノイドで有効性を示した。
原題: $\lambda$-Reachability: Geometric-Horizon Safety Bellman Equations for Humanoid Safety / Rui Chen, Shangtao Li, Yifan Sun 他
日本語で読む → - 論文強化学習/人型ロボット/省エネルギーロボティクス
電力モデル同定に基づく深層強化学習による人型ロボットの省エネルギー腕到達動作
人型ロボットの腕到達動作を省エネルギー化するため、実測電力モデルとSAC強化学習を組み合わせた枠組みを提案し、シミュレーションと実機で検証した。
原題: Energy-Efficient Arm Reaching for a Humanoid Robot via Deep Reinforcement Learning with Identified Power Models / Nestor N. Deniz, Simon Parsons, Fernando Auat Cheein
日本語で読む → - 論文移動操作ロボティクス
GeoHAT: 移動操作のための幾何適応型ハイブリッド行動変換器
移動操作タスクにおいて、信頼できる幾何情報のみを注入し、必要な箇所にのみ注意を向けるという原理に基づく、エンドツーエンドの拡散ベースフレームワークGeoHATを提案。軽量なフーリエ空間エンコーダとゲート付き融合、およびアームとベースを分離したハイブリッド行動デコーダにより、シミュレーションベンチマークで高い成功率を達成した。
原題: GeoHAT: Geometry-Adaptive Hybrid Action Transformer for Mobile Manipulation / Xiangyu Zhu, Renjun Wu, Luzhou Ge 他
日本語で読む → - 論文オフライン強化学習ロボティクス
目標状態ではなく目標集合:目標集合の後知恵リラベリングによる問い合わせ可能なロボット目標
後知恵リラベリングを拡張し、達成状態が単一の目標状態ではなくクエリで定義された目標集合を満たすようにすることで、不要な状態次元に影響されないロボット学習を実現する手法を提案した。
原題: Goal Sets, Not Goal States: Queryable Robot Goals through Goal-Set Hindsight Relabeling / Carlos Vélez García, Miguel Cazorla, Jorge Pomares
日本語で読む → - 論文HRI/動作生成ロボティクス
製造環境における人間とロボットの相互作用のための安全で流暢かつ受け入れ可能な動作生成と実行
人間と共有する環境でロボットが安全かつ社会的に受け入れられる動作を生成するため、社会的認識を考慮したMPCフレームワークを実装し、ユーザー調査でその効果を検証した論文。
原題: Safe, Fluent and Acceptable Motion Generation and Execution for Human--Robot Interaction in Manufacturing Environments / Thibaut Lopez, Olivier Aycard, Pierre-Brice Wieber 他
日本語で読む → - 論文マルチロボット動作計画ロボティクス
ファイブレーションツリー:マルチロボット動作計画への統一的アプローチ
高次元のマルチロボット動作計画問題を解くため、射影と分解を統一的に扱う「ファイブレーションツリー」を導入し、確率的完全性を持つサンプリングベースプランナーFibration-RRTを提案した。
原題: Fibration Trees: A Unified Approach to Multi-Robot Motion Planning / Andreas Orthey, Florian T. Pokorny, Lydia E. Kavraki
日本語で読む → - 論文製造/デジタルツインロボティクス
ロボット衣料自動化における導入事例研究:デジタルツイン統合、相互運用性、労働力の有効活用
デニム製造におけるロボット縫製システムの導入事例を報告し、デジタルツインや相互運用性レイヤーによるシステム統合が実用化に重要であることを示した論文。
原題: A Deployment Case Study in Robotic Apparel Automation: Digital Twin Integration, Interoperability, and Workforce Enablement / Gokul Narayanan, Abhiroop Ajith, Jonathan Zornow 他
日本語で読む → - 論文経路探索ロボティクス
ニューロモルフィック強化学習による移動型ロボットフルフィルメントシステムの効率的経路探索
移動型ロボットフルフィルメントシステムの経路探索を、スパイクニューラルネットワークを用いたニューロモルフィックチップ上で実行する強化学習フレームワークを提案し、GPU比で約1万倍の省エネと約2倍の低遅延を実現した。
原題: A Neuromorphic Reinforcement Learning Framework for Efficient Pathfinding in Robotic Mobile Fulfillment Systems / Junzhe Xu, Zecui Zeng, Lusong Li 他
日本語で読む → - 論文自動運転/対向訓練ロボティクス
攻撃からカリキュラムへ:安全な自動運転のための学習可能性ガイド付き対向訓練
自動運転の安全性向上のため、対向シナリオ生成を解決可能かつポリシーの能力に合わせたカリキュラムに変換する学習可能性ガイド付きフレームワークAlignADVを提案した。
原題: From Attacks to Curricula: Learnability-Guided Adversarial Training for Safe Autonomous Driving / Yuewen Mei, Tong Nie, Jie Sun 他
日本語で読む → - 論文視覚場所認識画像認識
外洋から密閉キャビンへ:海事認識とキャビン点検のためのクロスシーン視覚場所認識ProteusVPR
船舶環境での視覚場所認識の課題に対し、2段階の検索・精密化フレームワークProteusVPRを提案し、新しい船舶搭載データセットXHZで精度を大幅に向上させた。
原題: From Open Waters to Enclosed Cabins: ProteusVPR for Cross-Scene Visual Place Recognition in Maritime Perception and Cabin Inspection / Zexi Chen, Zitai Huang, Qiwen Gu 他
日本語で読む → - 論文VLAロボティクス
フロー制御:シンプルなリアルタイム入力による視覚言語行動モデルの操縦
キーボードなどの簡単な入力で、再学習なしにVLAモデルの行動をリアルタイムに操縦する手法を提案。ユーザーの意図を反映しつつ、高品質な行動を生成できる。
原題: Flow Control: Steering Vision-Language-Action Models with Simple Real-Time Inputs / Jonathan C. Kao, Jason Chan, Andy Wang
日本語で読む →