論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文移動操作ロボティクス
家庭用移動操作タスクのシームレスな実-シミュレーション-実転送を実現するスケーラブルな具現化知能プラットフォーム
実環境からシミュレーションへの自動シーン再構築と、ハードウェア非依存のミドルウェアにより、家庭用移動操作タスクの実-シミュレーション-実転送をシームレスに行うプラットフォーム「BestMan」を開発した。
原題: A Scalable Embodied Intelligence Platform for Seamless Real-to-Sim-to-Real Transfer of Household Mobile Manipulation Tasks / Kui Yang, Xianlei Long, Haoxuan Li 他
日本語で読む → - 論文路面分類ロボティクス
エネルギー特徴量を用いた深層学習による路面分類:3つの独立データセットにわたる比較分析
移動ロボットの路面分類において、エネルギー由来の特徴量を単独または慣性データと組み合わせて使用する手法を、3つの公開データセットで深層学習モデルを用いて評価し、単独で85-90%、併用で96-99%の精度を達成した。
原題: Leveraging Energy Features for Surface Classification with Deep Learning: A Comparative Analysis Across Three Independent Datasets / Alexander Belyaev, Oleg Kushnarev
日本語で読む → - 論文位置認識画像認識
不均一レーダー位置認識のための空間階層蒸留
4D自動車レーダーと高精度スピニングレーダーの特徴を整合する際、空間的に層別化した蒸留法を提案し、疎な領域での蒸留重みを割引くことで性能を向上させた。
原題: Spatially Stratified Distillation for Heterogeneous Radar Place Recognition / Sagun Singh Shrestha, Samuel Harding, Abdelwahed Khamis 他
日本語で読む → - 論文世界モデルロボティクス
PAIWorld: ロボット操作のための3D整合性を持つ世界基盤モデル
複数視点の3D整合性を保つ世界基盤モデルを提案し、ロボット操作のための予測と計画を改善した。
原題: PAIWorld: A 3D-Consistent World Foundation Model for Robotic Manipulation / Yuhang Huang, Xuan Lv, Junyan Xu 他
日本語で読む → - 論文センシングロボティクス
直接レーザー描画を用いた連続体ロボットの形状センシング
連続体ロボットの関節とひずみセンサを同じレーザーで一体加工し、センサで関節角度を推定して閉ループ制御を実現した論文。
原題: Shape Sensing of Continuum Robots using Direct Laser Writing / Amber K. Rothe, Nidhi Malhotra, Jaydev P. Desai
日本語で読む → - 論文HRI/グループ協調ロボティクス
いつ手助けしましょうか?グループ人間-ロボット協調におけるプロアクティブ性の効果について
ペア参加者がヒューマノイドロボットと脱出ゲームを行う実験で、ロボットが呼ばれた時だけ反応するリアクティブモデルと、常時聞いて自発的に貢献するプロアクティブモデルを比較し、相互作用頻度や成功率、参加者の評価に与える影響を調べた。
原題: When May I Help You? On The Effect of Proactivity on Group Human-Robot Collaboration / Thomas Vitry, Vanessa Maeder, Kieran von Valeburg 他
日本語で読む → - 論文ナビゲーションロボティクス
VISTA: 行動履歴条件付けによるスケール認識型視覚ナビゲーション
視覚ナビゲーション基盤モデルが正規化された行動予測により物理的スケールを誤解する問題を解決するため、行動履歴を条件付けに加え、DINOv3エンコーダで空間・幾何情報を強化したモデルVISTAを提案。未見環境でのゼロショット実世界展開で高い性能を示した。
原題: VISTA: Scale-Aware Visual Navigation via Action History Conditioning / Maeva Guerrier, Koki Kobayashi, Simon Roy 他
日本語で読む → - 論文ソフトロボティクスロボティクス
建築材料のダメージ適応を数秒で実現
ソフトアクチュエータシステムの破損に自己受容感覚で適応する手法を提案し、6自由度ソフトリストのトレーシングタスクで切断や焼損、修理への適応を実証した。
原題: Damage Adaptation in Seconds for Architected Materials / James Avtges, Jake Ketchum, Helena Young 他
日本語で読む → - 論文自動運転評価画像認識
DriveJudge: 視覚言語モデルによる自動運転評価の再考
自動運転の評価を、ルールベースの物理的根拠と視覚言語モデルの文脈理解を組み合わせたエージェントDriveJudgeを提案し、大規模データセットで人間の判断と高い一致を示した。
原題: DriveJudge: Rethinking Autonomous Driving Evaluation with Vision-Language Models / Xinglong Sun, Kevin Xie, Jenny Schmalfuss 他
日本語で読む → - 論文自動運転シミュレーションロボティクス
ControlMap: 交通シナリオシミュレーションのための制御可能な高精細地図生成
潜在拡散モデルとControlNetを用いて、道路トポロジーを空間条件として高精細地図を生成するデータ駆動パイプラインを提案。制御強度の調整や都市スタイル転送も可能で、新たな評価指標も導入した。
原題: ControlMap: Controllable High-Definition Map Generation for Traffic Scenario Simulation / Marwan Farag, Steffen Wäldele, Yu Yao
日本語で読む → - 論文プランニングロボティクス
AHポリヘドロンを用いた正確・効率的・安全な遮蔽考慮プランニング
自律駐車における遮蔽問題を、AHポリヘドロン到達可能性解析と線形計画法により正確かつ効率的に解決するフレームワークを提案した。
原題: Exact, Efficient, and Safe Occlusion-Aware Planning Using AH-Polyhedrons / Long Kiu Chung, David Isele, Toktam Mohammadnejad 他
日本語で読む → - 論文人間ロボット協調ロボティクス
プレハブ建設における計画指向の人間ロボット協調のための認知・身体的負担の知覚ダイナミクスの理解とモデル化
プレハブ建設の人間ロボット協調作業で、繰り返し作業と休憩中の知覚される負担(認知・身体)の蓄積と回復を実験で測定し、線形・指数モデルと混合効果モデルで表現する計画用モデルを構築した。
原題: Understanding and Modeling Perceived Cognitive and Physical Strain Dynamics for Planning-Oriented Human-Robot Collaboration in Prefabricated Construction / Yifan Wang, Bo Xiao, Shane T. Mueller
日本語で読む → - 論文VLA/コード生成ポリシーロボティクス
RHO: あなたのコーディングエージェントは実はロボット工学者
コード生成エージェントを訓練時に活用し、ロボット制御のための複数ファイルからなる解釈可能なポリシーリポジトリを探索する新しいパラダイムを提案。環境報酬に基づく反射的フィードバックで検索し、実時間制御に適した単一ターン実行で高い成功率を達成した。
原題: RHO: Your Coding Agent is Secretly a Roboticist / Karim Elmaaroufi, Justin Svegliato, Sarunas Kalade 他
日本語で読む → - 論文VLA/強化学習ロボティクス
階層的アドバンテージ重み付けによるスパースなエピソード結果からのVLAオンラインRL微調整
事前学習済みVLAポリシーをオンライン強化学習で微調整する際、エピソードごとの成功/失敗のみのスパースな報酬を、生存性と効率性の2つの目的に分離し、状態適応的に重み付けして遷移レベルの学習信号を生成する手法を提案した。
原題: Hierarchical Advantage Weighting for Online RL Fine-Tuning of VLAs from Sparse Episode Outcomes / Tongyan Fang, Siyuan Huang, Naiyu Fang 他
日本語で読む → - 論文群制御制御
非対称入力と時変出力制約下での分散安全コンセンサス
単一積分器マルチエージェントシステムにおいて、非対称アクチュエータ制約と出力安全制約を同時に満たす分散コンセンサス制御則を提案し、安全性と同期を保証する。
原題: Distributed Safe Consensus Under Asymmetric Input and Time-Varying Output Constraints / Abhinav Sinha, Shashi Ranjan Kumar
日本語で読む → - 論文操作ロボティクス
フロー逆転ステアリングによるロボット汎用ポリシーの性能向上
フローマッチングに基づく汎用ロボットポリシーに対し、不完全な行動を逆フローで潜在ノイズに変換し、近傍の高品質な行動モードへ写像する手法を提案。シミュレーションと実機でゼロショット制御や強化学習の改善に効果を示した。
原題: Improving Robotic Generalist Policies via Flow Reversal Steering / Andy Tang, William Chen, Andrew Wagenmaker 他
日本語で読む → - 論文VLA画像認識
エンコーダの勝者はVLAバックボーンの規模を超えて確実には転送されない:凍結バックボーン移植診断
VLAポリシーにおいて、小規模バックボーンで最適な視覚エンコーダが大規模バックボーンでも最適とは限らないことを、凍結バックボーン移植診断法を用いて実証した。
原題: Encoder Winners Do Not Reliably Transfer Across VLA Backbone Scale: A Frozen-Backbone Grafting Diagnostic / Qingping Zeng, Fei She
日本語で読む → - 論文UAV自律性ロボティクス
UAV自律性のための選択的エージェント回復と持続的ミッションランタイム
UAVのミッション実行中に、外部エージェントによる高レベルな回復推論を必要な時だけ呼び出すフレームワークを提案し、成功率を大幅に向上させつつ通信コストを削減した。
原題: Selective Agentic Recovery for UAV Autonomy with a Persistent Mission Runtime / Taewoo Park, Kyeonghyun Yoo, Seunghyun Yoo 他
日本語で読む → - 論文メモリシステムロボティクス
eMEM: 身体化エージェントのためのハイブリッド時空間メモリシステム
身体化エージェント向けに、意味・空間・時間で検索可能なハイブリッドグラフベースのメモリシステムを提案し、認知心理学のパラダイムに基づくベンチマークも導入した。
原題: eMEM: A Hybrid Spatio-Temporal Memory System For Embodied Agents / A. Haroon Rasheed, Maria Kabtoul
日本語で読む → - 論文空中マニピュレーションロボティクス
AERMANI-PLACE: 空中マニピュレータによる言語誘導オブジェクト配置
空中マニピュレータを用いて、自然言語の指示から物体の配置位置を推定し、実際に配置するフレームワークを提案。画像編集モデルと深度情報を組み合わせて配置点を特定し、実機で高い成功率を達成した。
原題: AERMANI-PLACE: Language Guided Object Placement with Aerial Manipulators / Sarthak Mishra, Ritama Sanyal, Rishabh Dev Yadav 他
日本語で読む → - 論文VLA/操作ロボティクス
ReactVLA: 改良平均流アクション生成による高速・軽量なリアクティブロボット操作
拡散型VLAの推論遅延を改善するため、改良平均流アクション生成と注意残差機構を備えた軽量・低遅延なVLAフレームワークを提案し、シミュレーションと実機で性能と速度を向上させた。
原題: ReactVLA: Fast and Lightweight Reactive Robot Manipulation via Improved Mean Flow Action Generation / Yanzhao Guo, Wenkai Chen, Jianwei Zhang
日本語で読む → - 論文モバイル操作/VLAロボティクス
SERF: 長時間ホライズンのモバイル操作のための時空間環境・ロボット特徴マップ
ロボットの長時間操作タスクにおいて、環境とロボット自身を共有潜在空間のニューラル点群として表現する時空間特徴マップを導入し、これをVLAモデルの状態入力として用いることで、長期的な推論とタスク成功率を向上させる。
原題: SERF: Spatiotemporal Environment and Robot Feature Map for Long-Horizon Mobile Manipulation / Sunghwan Kim, Byeonghyun Pak, Kehan Long 他
日本語で読む → - 論文動作生成ロボティクス
G-MAPP: GPU加速によるマルチエージェント計画と知覚を用いたリアクティブ動作生成
GPUを用いて環境モデリングとベクトル場ベースの計画を高速化し、動的で複雑な環境におけるリアクティブな動作生成を実現するフレームワークを提案した。CPU版と比較して最大5倍の高速化を達成し、実機実験で衝突回避を確認した。
原題: G-MAPP: GPU-accelerated Multi-Agent Planning and Perception for Reactive Motion Generation / Tanmay Bishnoi, Riddhiman Laha, Tobias Löw 他
日本語で読む → - 論文全身制御/スタイル転送ロボティクス
人間の動作スタイルを移植するヒューマノイド全身制御のための生体模倣手法
短い人間の動作スタイル例から、目標の動作内容を保ちつつスタイルを移植した全身参照動作を生成し、物理実行可能な制御ポリシーでヒューマノイドに実行させる枠組みを提案した。
原題: Bionic Human-Motion Style Transfer for Physically Executable Whole-Body Control of Humanoid Robots / Tianchen Huang, Mingkuan Zhao, Yang Gao 他
日本語で読む → - 論文VLA/ジェスチャー理解ロボティクス
GIVE: 視覚言語行動モデルにおける人間のジェスチャーの接地
人間のジェスチャーを視覚・意味の2経路でVLAモデルに統合し、曖昧な指示でも物体接地と操作意図の推定を改善する手法を提案。実世界実験で成功率を大幅に向上させた。
原題: GIVE: Grounding Human Gestures in Vision-Language-Action Models / Pengfei Liu, Gen Li, Junqiao Fan 他
日本語で読む → - 論文ROS 2/観測性ロボティクス
ros2probe: ROS 2ミドルウェア向けの非侵入型カーネル選択的観測手法
ROS 2のノード間通信を観測する際に生じるプローブ効果を排除するため、ディスカバリパケットから通信状態を再構築し、カーネル内フィルタで必要なトピックのみを取得する非侵入型観測フレームワークを提案した。
原題: ros2probe: Non-intrusive, Kernel-selective Observability for Robot Operating System 2 Middleware / Jisang Yu, Sanghoon Lee, Yeonwoo Choi 他
日本語で読む → - 論文マニピュレーションロボティクス
PLUME: 多指操作のための確率的潜在統合世界モデリングとパラメータ推定
多指ロボットの操作タスクにおいて、物理パラメータの不確実性に対処するため、パラメータの信念とダイナミクスを同時に学習する世界モデルを提案し、シミュレーションから実機へのゼロショット転送を実現した。
原題: PLUME: Probabilistic Latent Unified World Modeling and Parameter Estimation for Multi-Finger Manipulation / Abhinav Kumar, Soshi Iba, Rana Soltani Zarrin 他
日本語で読む → - 論文マルチロボット動作計画ロボティクス
ファイブレーションツリー:マルチロボット動作計画への統一的アプローチ
高次元のマルチロボット動作計画問題を解くため、射影と分解を統一的に扱う「ファイブレーションツリー」を導入し、確率的完全性を持つサンプリングベースプランナーFibration-RRTを提案した。
原題: Fibration Trees: A Unified Approach to Multi-Robot Motion Planning / Andreas Orthey, Florian T. Pokorny, Lydia E. Kavraki
日本語で読む → - 論文ハンド設計ロボティクス
多パラメータ指ベンチマークと選定によるモジュール式人型ハンド設計
指の設計をモジュール化し、定量的ベンチマークで最適な指を選定して組み込むことで、人型ロボットハンド全体の性能を向上させる手法を提案・検証した。
原題: Modular Anthropomorphic Hand Design via Multi-Parameter Finger Benchmarking and Selection / Yu Zhang, Huijiang Wang, Josie Hughes
日本語で読む → - 論文全身制御/動作生成ロボティクス
OMG: 汎用人型ロボット制御のための全モーダル動作生成
多様な入力モダリティ(言語、音声、人間の参照動作)に基づいて全身動作を生成する拡散モデルを提案し、データキュレーションと階層的制御構造により汎用的な人型ロボット制御を実現した。
原題: OMG: Omni-Modal Motion Generation for Generalist Humanoid Control / Siqiao Huang, Kun-Ying Lee, Dongming Qiao 他
日本語で読む →