論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
パッチポリシー:高密度視覚表現による効率的な身体制御
Vision Transformerの事前学習済みパッチ特徴を直接利用する軽量なロボットポリシーを提案し、グローバル表現や大規模VLAを凌ぐ性能を達成した。
原題: Patch Policy: Efficient Embodied Control via Dense Visual Representations / Gaoyue Zhou, Zichen Jeff Cui, Ada Langford 他
日本語で読む → - 論文マニピュレーションロボティクス
ConceptTree: ロボット操作のブラックボックス意思決定に意味的透明性をもたらす
ロボット操作の高レベルスキル選択を、人間が解釈可能な概念に基づく決定木で表現し、透明性と介入可能性を実現するフレームワークを提案した。実世界の複雑な長期的タスクで既存手法より優れた性能を示し、個々の概念の修正による細かい介入も可能にした。
原題: ConceptTree: Bringing Semantic Transparency to Black-Box Decision Making for Robotic Manipulation / Yongyan Wen, Feifan Liu, Jinyi Chen 他
日本語で読む → - 論文ナビゲーションロボティクス
潜時想像を用いた予測学習による視覚四足歩行ナビゲーション
四足ロボットのナビゲーション方策に、訓練中のみ予測的補助信号を加えて障害物の動きを先読みさせ、推論時は追加コストなしで衝突率を低減する手法を提案。シミュレーションと実機で効果を実証した。
原題: Predictive Training with Latent Imagination for Visual Quadruped Navigation / Yancheng Zhu, Wanli Ma, Chen Han 他
日本語で読む → - 論文逆強化学習機械学習
一般化と誘導:少数ショット逆強化学習のための報酬分解
少数の目標タスクデモと関連タスクのデモを用いて、新しいタスクの報酬を学習する逆強化学習手法を提案。報酬を一般化可能な判別器と近接関数に分解し、探索時の誘導を実現する。
原題: Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning / Ziyi Liu, Grace Zhang
日本語で読む → - 論文世界モデルロボティクス
Worldscape-MoE: スケーラブルな異種行動制御のための統一Mixture-of-Experts世界モデル
異なる行動モダリティ(カメラ軌道、ロボット動作、手の関節信号など)を統一的に扱える拡張可能な世界モデルを提案し、MoEアーキテクチャにより異種の行動制御を共有の世界ダイナミクスに統合する。
原題: Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control / Jianjie Fang, Yongyan Xu, Ziyou Wang 他
日本語で読む → - 論文模倣学習/拡散ポリシー/マルチモーダルロボティクス
遅延対応ガイダンス融合による非同期マルチモーダル拡散ポリシー合成
異なるセンシングレートや推論遅延を持つ複数のモダリティを、各ポリシーが本来の速度で動作しつつ遅延を補正して融合するフレームワークLAG-Fusionを提案し、接触を伴う操作タスクで有効性を示した。
原題: Asynchronous Multimodal Diffusion Policy Composition via Latency-Aware Guidance Fusion / Zihao He, Hongjie Fang, Shirun Tang 他
日本語で読む → - 論文位置認識画像認識
InLiER: 中間混合基数構造キーポイントトークン化による学習不要の異種LiDAR位置認識
異なる特性のLiDAR間で頑健な位置認識を実現するため、構造要素のキーポイントを混合基数トークン化し、3段階の検索で高速かつ高精度に位置を推定する学習不要の手法を提案した。
原題: InLiER: Learning-Free Heterogeneous LiDAR Place Recognition via Intermediate Mixed-Radix Structural Keypoint Tokenization / Nikolaos Stathoulopoulos, George Nikolakopoulos
日本語で読む → - 論文群制御ロボティクス
プログラム可能な同期グラフによる適応的で耐故障性のあるモジュール型小型ロボット
モジュール型小型ロボットの協調動作を、リーダーや固定歩容テンプレートなしで実現するため、各アクチュエータ-センサ対をノードとする同期グラフを導入し、グラフ結合により位相同期や位相差をプログラムする手法を提案した。物理ロボット群で検証し、故障耐性や学習による位相調整も実証した。
原題: Programmable Synchronization Graphs for Adaptive and Fault-Tolerant Modular Miniature Robots / Okan Kulekcioglu, Arqam Bin Ahmad, Ines Garcia 他
日本語で読む → - 論文マニピュレーションロボティクス
産業用巧緻操作ベンチマーク:産業用巧緻マニピュレーションのためのハードウェア・ソフトウェアベンチマークプラットフォーム
産業用の巧緻操作タスク(ケーブル配線やコネクタ挿入など)を模したベンチマーク基板と、模倣学習フレームワークを提案し、マルチモーダル拡散ポリシーが高い成功率を達成することを示した論文。
原題: Industrial Dexterity Benchmark: A Hardware-Software Benchmarking Platform for Industrial Dexterous Manipulation / Honglu He, Jacob Laufer, Zhiwu Zheng 他
日本語で読む → - 論文VLA/ロボット操作ロボティクス
RoboBRIDGE: 堅牢な実世界ロボットエージェントへのポリシー橋渡しのためのモジュラーフレームワーク
事前学習済みのVLAモデルを実世界で使えるロボットエージェントに変換するためのモジュラーフレームワークを提案。監視、知覚、計画、制御、ロボットインターフェースの5つのモジュールを統合し、失敗回復や長期実行の安定性を向上させる。
原題: RoboBRIDGE: A Modular Framework for Bridging Policies to Robust Real-World Robotic Agents / Sihyung Yoon, Minjong Yoo, Sanghyun Ahn 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
博物館に戻る:感情シミュレーションの有無によるアンドロイドAndreaの受容調査
ドイツの博物館でアンドロイドロボットAndreaを6日間公開し、感情シミュレーションの有無が来館者の受容に与える影響をアンケートで調査した。感情シミュレーションは主観評価に有意な効果をもたらさなかった。
原題: Back to the museum: Investigation of the acceptance of Android Andrea with and without emotion simulation in a museum / Marcel Heisler, Christian Becker-Asano
日本語で読む → - 論文マニピュレーションロボティクス
先見的残差強化学習による視覚言語行動モデルを用いた長期的ロボット操作
凍結したVLAベースポリシー上で残差RLを行う際、各サブタスクの成功報酬に将来の成功確率を掛け合わせることで、サブタスク間の受け渡し品質を最適化し、長期的なタスク成功率を向上させる手法を提案した。
原題: Foresight Residual RL for Long-Horizon Robot Manipulation with Vision-Language-Action Models / Yuhan Liu, Xinyu Zhang, Litao Liu 他
日本語で読む → - 論文世界モデル画像認識
マスク視覚アクションによる統一世界モデリング
ロボットの行動をビデオのピクセル空間で表現する新しいインターフェースを導入し、少量のデータで学習したモデルが将来予測や逆モデリングを実現する。
原題: Masked Visual Actions for Unified World Modeling / Hadi Alzayer, Wenlong Huang, Haonan Chen 他
日本語で読む → - 論文VLM評価画像認識
危険か異常か?VLMによる危険性と不一致の理解の評価
視覚言語モデル(VLM)が危険と異常を区別できるかを評価し、異常を危険と誤認する傾向を明らかにした論文。
原題: Hazard or Anomaly? Evaluating VLMs for Understanding Dangers and Discrepancies / Murali Indukuri, Mohammad Eskandari, Sree Nitya Kollu 他
日本語で読む → - 論文ロボットプラットフォームロボティクス
オープンアント:強化学習研究のためのロボットプラットフォーム
強化学習研究でよく使われるGymnasiumのAnt環境を物理ロボットとして実装し、実機での学習やシミュレーションからの転移を可能にするプラットフォームを提案した。
原題: The Open Ant: A Robot Platform for Reinforcement Learning Research / Elena Sorina Lupu, Patrick Spieler, Khurram Javed 他
日本語で読む → - 論文VLA/操作学習ロボティクス
TFP: 時間条件付きメモリ融合ポリシーによる視覚運動学習
視覚言語行動(VLA)ポリシーは反応的で、段階依存の操作タスクで失敗する問題を解決するため、時間条件付きメモリ融合ポリシー(TFP)を提案。液体時定数ダイナミクスでタスク進行の信念を維持し、フローマッチング行動デコーダに適応変調で注入することで、LIBERO等で成功率を向上させた。
原題: TFP: Temporally Conditioned Memory-Fusion Policies for Visuomotor Learning / Yushen Liang, Yue Peng, Baosheng Jin 他
日本語で読む → - 論文遠隔操作ロボティクス
小型人型ロボットのVRと強化学習による遠隔操作・移動・操作
小型人型ロボット向けに、VRによる上半身遠隔操作と強化学習による下半身のバランス・歩行制御を組み合わせた全身遠隔操作システムを開発し、実機で歩行と物体移動を実証した。
原題: Towards Miniature Humanoid Tele-Loco-Manipulation Using Virtual Reality and Reinforcement Learning / Nicolas Kosanovic, Jordan Dowdy, Jean Chagas Vaz
日本語で読む → - 論文ナビゲーションロボティクス
MemoGuard: 通信制限下のロボットナビゲーションにおけるメモリトラップを防ぐ適応型ランタイム
通信が制限された環境で、過去のエピソード記憶を再利用する際に、類似度が高いが実行が危険な「メモリトラップ」を検証し、必要時のみフォールバック推論を呼び出す適応型ランタイムを提案した。シミュレーションで安全性違反を76.6%削減しつつ、フォールバック呼び出しを21.4%削減した。
原題: MemoGuard: An Adaptive Runtime for Guarding Against Memory Traps in Communication-Limited Robot Navigation / Rajat Bhattacharjya, Hyeonjong Ju, Sing-Yao Wu 他
日本語で読む → - 論文経路計画ロボティクス
非対称上昇率を持つダビンズ航空機の最短時間経路
固定翼機の上昇・降下率が非対称な場合の最短時間経路を提案し、対称制約と比べて最大71%の時間短縮を実証した。
原題: Minimum Time Dubins Airplane Paths with Asymmetric Climb Rates / Jaeyoung Lim, Giuseppe Loianno
日本語で読む → - 論文ナビゲーションロボティクス
SkillNav: スコアレベルスキル介入によるゼロショット物体目標ナビゲーション
VLMベースのナビゲーションエージェントに、地図上の好奇心価値マップを書き換える形で行動記憶を埋め込むスキルフレームワークを提案し、追加トークンなしでデッドエンドやループなどの失敗を軽減する。
原題: SkillNav: Score-Level Skill Intervention for Zero-Shot Object Goal Navigation / Ruijie Sang, Yiqun Duan, Pinhan Fu 他
日本語で読む → - 論文選好学習ロボティクス
確率的結果に対するリスク認識型選好学習
人間のリスク感受性を考慮した選好学習フレームワークを提案し、累積プロスペクト理論を用いることで、リスク回避的なユーザーの選好から報酬関数をより正確に学習できることを示した。
原題: Risk-Aware Preference Learning for Stochastic Outcomes / Yi-Shiuan Tung, Yuni Wu, Wei Jiang 他
日本語で読む → - 論文自動運転/状態推定画像認識
トラック・セミトレーラ連結部の屈曲角推定のためのハイブリッド機械学習
トラックとトレーラの連結角を、視覚と運動情報から機械学習モデルで直接推定し、拡張カルマンフィルタで統合する手法を提案。実車実験で汎用性と精度を実証した。
原題: Hybrid Machine Learning for Articulation Angle Estimation of Truck-Semitrailer Combinations / Qixuan Zhang, Jonas Boettcher, Simon F. G. Ehlers 他
日本語で読む → - 論文ソフトロボティクスロボティクス
ソフトロボットアクチュエータのための堅牢なシリコーン注型とセンサ埋め込み手順
ソフト空気圧アクチュエータの再現性と拡張性を高めるため、2液注型による堅牢な作製手順と、薄型フレックスセンサの埋め込み方法を提案し、実験でその性能を検証した。
原題: Robust Silicone Pour Casting and Sensor Embedding Procedures for Soft Robotic Actuators / Harshit Thakker, Paul Dela Cruz, Mostafa Mo. Massoud 他
日本語で読む → - 論文触覚ロボティクス
人工神経を目指して:ロボットのための生体模倣光ファイバ触覚センシング
人間の皮膚の触覚機構を模倣し、各機械ピンを光ファイバ(人工神経)に接続した生体模倣触覚センサOptiTacを提案。触覚信号を画像として扱い、深層学習ではなく単純な解析手法で接触位置・サイズ・形状を推定する。
原題: Towards Artificial Nerves: Biomimetic Optical-Fiber Tactile Sensing for Robots / Laura E. Butcher, Chris J. Ford, Nathan F. Lepora 他
日本語で読む → - 論文強化学習/制御ロボティクス
アクチュエータ動力学を考慮した物理認識型エンドツーエンド深層強化学習によるクアッドコプター制御
クアッドコプターの低レベル制御に、アクチュエータの遅れや空力モーメントを考慮した高忠実度シミュレータを用いたエンドツーエンド深層強化学習を適用し、DDPG、TD3、PPO、SACの性能を比較した。
原題: Physics-Aware End-to-End Deep Reinforcement Learning for Quadcopter Control with Actuator Dynamics / Ya-Chia Shen, Woei-Leong Chan
日本語で読む → - 論文群制御ロボティクス
通信制約下における半分散型多宇宙機衝突回避
地上局との断続的な通信を考慮し、宇宙機間の衝突回避を半分散型POMDPとして定式化し、近似アルゴリズムで中央集権型に近い性能を達成した。
原題: Semi-Decentralized Multi-Spacecraft Collision Avoidance under Communication Constraints / Grace Ra Kim, Mahdi Al-Husseini, Duncan Eddy 他
日本語で読む → - 論文触覚/VLA/操作ロボティクス
接触を伴うロボット操作のための表現整合型触覚グラウンディング
触覚強化型VLAポリシーにおいて、将来の触覚状態を予測する中間表現の位置を特定し、軽量な潜在触覚予測器(LTP)を導入して行動表現と接触結果を整合させる手法を提案した。実機の接触を伴う操作タスクで有効性を実証した。
原題: Representation-Aligned Tactile Grounding for Contact-Rich Robotic Manipulation / Ruilin Chen, Jingkai Jia, Tong Yang 他
日本語で読む → - 論文接触力学cs.GR
厳密な低次元クーロン摩擦のための分割アーキテクチャ
摩擦接触問題を、円錐制約付き線形応答と接線速度による非結合スカラー項に分割し、外側反復と内側の凸二次計画で解く手法を提案。摩擦則を緩めずに厳密な解を実現する。
原題: A Splitting Architecture for Exact Reduced Coulomb Friction / Hongcheng Song, Ye Fan, Uri M. Ascher 他
日本語で読む → - 論文実験自動化/液体ハンドリングロボティクス
AEGIS: オープンソース液体ハンドリングロボット向けアッセイ認識プロトコル検証と実行時監視
低コスト液体ハンドラー(Opentrons OT-2)の未検出の失敗モードに対処するため、プロトコルのアッセイ固有不変条件を検証するLLMベースの層と、ピペット動作の物理的失敗を監視するPCAモデル層の2層ガーディアンAEGISを提案した。
原題: AEGIS: Assay-Aware Protocol Validation and Runtime Monitoring for Open-Source Liquid Handling Robots / Priyanka V. Setty, Arvind Ramanathan, Ian Foster 他
日本語で読む → - 論文V2X/自動運転ロボティクス
計画に従う:エンドツーエンドV2X運転のための適応型マルチエージェント融合
V2X環境での自動運転において、計画タスクを直接最適化するエンドツーエンドの協調運転システムを提案。時空間特徴の圧縮と適応的融合により、閉ループ評価で既存手法を上回る性能を達成した。
原題: Defer to Plan: Adaptive Multi-Agent Fusion for End-to-End V2X Driving / Nuoran Li, Zhang Zhang, Yueran Zhao 他
日本語で読む →