論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA/クロスエンボディメント転移ロボティクス
行動整合表現によるクロスエンボディメント転移
ロボット操作の大規模模倣学習において、行動整合表現(物体のバウンディングボックスや言語動作、エンドエフェクタの軌跡など)がVLAモデルのクロスエンボディメント転移を促進するかを検証し、シミュレーションベンチマークで評価。エンドエフェクタ軌跡が特に有効で、シミュレーションから実機への転移成功率を28%向上させた。
原題: Cross-Embodiment Transfer via Behavior-Aligned Representations / Ajay Sridhar, Jensen Gao, Jonathan Yang 他
日本語で読む → - 論文全身制御/安全性ロボティクス
PAC-MAN: 認識を考慮したCBF-RLによる人型ロボットのドッジボール全身安全性
人型ロボットがドッジボールを避けるための、認識を考慮した制御バリア関数と強化学習を組み合わせたフレームワークを提案し、実機で95%の成功率を達成した。
原題: PAC-MAN: Perception-Aware CBF-RL for Whole-Body Safety in Humanoid Dodgeball / Lizhi Yang, Junheng Li, Aaron D. Ames
日本語で読む → - 論文VLAロボティクス
小型VLAモデルに「どこを見るか」と「どう動くか」を教える
小型の視覚言語行動モデルに、空間的接地と行動生成の能力を効率的に教えるフレームワークXS-VLAを提案。蒸留とフローマッチングにより、実時間制御に適した小型モデルの性能を大幅に向上させた。
原題: Teaching Tiny VLA Models Where to Look and How to Move / Iok Tong Lei, Ying Jie Yap, Wei Huang 他
日本語で読む → - 論文制御ロボティクス
連続体ロボットアームの点間運動における入力整形
ケーブル駆動の連続体ロボットアームの残留振動を抑制するため、時間遅延フィルタによる入力整形を適用し、実験でオーバーシュートと整定時間の低減を確認した。
原題: Input Shaping for Point-to-Point Motion with a Continuum Robot Arm / Rodolfo Hdz. Ibarra, Karan Baker, Parsa Molaei 他
日本語で読む → - 論文ナビゲーションロボティクス
BioVLN: 生物医学実験室における視覚言語ナビゲーションのためのシミュレーションプラットフォーム
生物医学実験室のロボットが機器の操作可能な側面から安全に接近することを考慮した、視覚言語ナビゲーションのためのシミュレーションプラットフォームを提案した。
原題: BioVLN: A Simulation Platform for Visual Language Navigation in Biomedical Laboratories / Zhe Liu, Quan Lu, Zhaohui Du 他
日本語で読む → - 論文マニピュレーションロボティクス
統一ハンド行動空間によるクロスエンボディメントロボット操作
球体ベースの統一行動表現とカスケード逆運動学を用いて、異なるロボットハンド間で操作ポリシーを転送可能にする手法を提案した。
原題: Cross-Embodiment Robot Manipulation via a Unified Hand Action Space / Luis Felipe Casas, Robert Teal, Keval Shah 他
日本語で読む → - 論文ナビゲーションロボティクス
UWB測位とD* Lite経路計画に基づく視覚障害者向け屋内ナビゲーションシステム
UWB測位とD* Liteアルゴリズムを用いて、視覚障害者向けの屋内ナビゲーションシステムを提案し、動的障害物への迅速な経路再計画を実現した。
原題: An Indoor Navigation System for the Visually Impaired based on UWB Positioning and D* Lite Path Planning Algorithm / Thanh C. Vo, Dong LT. Tran, Huy HM. Le 他
日本語で読む → - 論文群制御ロボティクス
D-CLIPSE: 共有状態交換における受動的リスニングを用いた分散コンセンサスベース位置推定
各ロボットが自身と隣接ロボットの状態を推定する分散フィルタリング手法を提案し、通信効率と一貫性を保ちつつ中央集権的処理に近い精度を実現した。
原題: D-CLIPSE: Distributed Consensus-based Localization with Passive Listening on Shared State Exchange / Kyle Biron-Gricken, James Richard Forbes
日本語で読む → - 論文触覚/操作ロボティクス
FELT: 視覚から触覚信号を生成する視触覚操作のためのフレームワーク
RGB画像から指ごとの圧力触覚画像を生成する学習ベースのフレームワークを提案し、触覚データの不足を補い、視触覚ポリシーの性能を向上させる。
原題: FELT: Generating Tactile Signals from Vision for Visuo-Tactile Manipulation / Zinan Li, Yiyang Ling, Yuming Gu 他
日本語で読む → - 論文3Dシーンマップ/動作認識/不確実性ロボティクス
視覚・言語・動作マップ:3Dシーンマップのためのオープンボキャブラリで不確実性を考慮したクエリ可能な動作属性
静的環境を前提とした既存の3Dマップに、物体の動作可能性と観測された動きを融合した動作属性と不確実性を付与し、言語クエリで「動くもの」「動きうるもの」等を識別できるようにした。シミュレーションと実データで有効性を検証した。
原題: Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps / Dibyendu Ghosh, Ayushi Shakya
日本語で読む → - 論文模倣学習/メタ学習/ロボット操作ロボティクス
動力学を考慮したメタ模倣学習による未知ロボット操作への汎化
メタ学習と動力学情報を統合した模倣学習フレームワークDAMIを提案し、未知タスクへの迅速な適応と汎化を実現した。
原題: Dynamics-Aware Meta-Imitation for Generalization to Unseen Robotic Manipulation / Zhenduo Shang, Xiyao Liu, Bohan Li 他
日本語で読む → - 論文動作計画ロボティクス
エース!ロボットアームによるプロ級の卓球サーブの動作計画
卓球のサーブをロボットで実現するため、動作プリミティブ、モデル予測制御、ベイズ最適化を組み合わせて、公式ルールに適合し、プロ級のスピンと速度を持つサーブを生成する手法を提案した。
原題: Ace! Motion Planning of Professional-Level Table Tennis Serves with a Robot Arm / Guillem Torrente, Guilherme Jorge Maeda, Divij Grover 他
日本語で読む → - 論文LiDAR-IMU融合ロボティクス
WNOJ-LIO: 高ダイナミックなLiDAR-IMU融合のためのジャーク白色雑音運動事前分布を用いたEKF
本論文は、高ダイナミックな運転環境でのLiDAR-IMUオドメトリの精度向上を目的とし、ジャーク白色雑音(WNOJ)事前分布を用いた拡張カルマンフィルタ(EKF)による新しい融合フレームワークWNOJ-LIOを提案する。IMUを状態伝播の駆動源ではなく高周波測定源として扱うことで、ノイズの影響を低減し、シミュレーションと実車実験で性能を実証した。
原題: WNOJ-LIO: A White-Noise-on-Jerk Motion-Prior EKF for High-Dynamic LiDAR-IMU Fusion / Junning Lyu, Qizhi Guo, Xia Ning 他
日本語で読む → - 論文軌跡生成/拡散モデル/ADAS機械学習
SevDiff: 重大度条件付き拡散モデルによるロングテール衝突軌跡生成
ADAS評価用の軌跡データセットは日常運転に偏っており、稀な車両間衝突イベントが不足している問題に対し、目標TTC値を条件として与え、その値に一致する衝突軌跡を生成する拡散モデルSevDiffを提案した。
原題: SevDiff: Severity-Conditioned Diffusion for Long-Tail Conflict Trajectory Generation / Eni Solomon Laughter
日本語で読む → - 論文群制御ロボティクス
Arm2Air: クロスエンボディスケルトン転送による3Dリレー編隊形成
ロボットアームの動作スケルトンをUAV中継配置に転送する手法を提案し、都市部の3D障害物環境で高速かつ高品質な中継チェーンを生成する。
原題: Arm2Air: Cross-Embodiment Skeleton Transfer for 3D Relay Formation / Dohun Lee, Kyeonghyun Yoo, Seokmin Kim 他
日本語で読む → - 論文制御・計画制御
アクチュエータを考慮した時空間チューブ合成:時間制約付き到達・回避・滞在タスク向け
アクチュエータの制約を直接チューブ合成に組み込むことで、オンライン再最適化やコントローラ再設計を不要にした時空間チューブ合成フレームワークを提案。全方向移動ロボットのシミュレーションで制御努力を約50%削減。
原題: Actuator-Aware Spatiotemporal Tube Synthesis for Temporal Reach-Avoid-Stay Tasks / Keshab Patra, K Madhava Krishna
日本語で読む → - 論文移動操作画像認識
探索・対話・展開可能:オープンワールド移動操作のための視覚駆動型具現化エージェント
実世界展開可能な移動操作エージェントのためのフレームワークREALを提案し、シミュレーションと実機のギャップを埋める環境とベンチマークを構築、物理ロボットで高い成功率を達成した。
原題: Exploratory, Communicative, and Deployable: Vision-Driven Embodied Agents for Open-World Mobile Manipulation / Boyu Mi, Mengchen Ma, Yifei Yao 他
日本語で読む → - 論文VLAロボティクス
言葉は長く語る:言語によるロボットポリシー合成のガイド
この論文では、ロボットのポリシー獲得を対話的なプログラム合成タスクとして扱うフレームワーク「ARCHITECT」を提案し、人間の自然言語による修正をコードに反映し、再利用可能なスキルライブラリを構築することで、長期的なタスクでの性能向上と人間の介入削減を実現しています。
原題: A Few Words Go a Long Way: Language Guided Robot Policy Synthesis / Daphne Chen, Archit Ritesh Jain, Eric Goossen 他
日本語で読む → - 論文科学エージェントAI
ロボット化学実験室における大規模言語モデルエージェントのストレステスト
ロボット化学実験室を物理世界のテストベッドとして使い、大規模言語モデルエージェントの科学的エージェンシーを測定可能にした研究。実験の実行可能性と証拠に基づく再計画の能力を評価した。
原題: Stress-testing large language model agents in a robotic chemistry laboratory / Lulu Guo, Yingkai Sun, Xiaobo Li 他
日本語で読む → - 論文VLA評価画像認識
HumanCLAW: 視覚言語モデルは身体を通して行動できるか?
視覚言語モデル(VLM)の身体を使った行動能力を評価するフレームワークを提案し、41の屋内シーンで1,218エピソードのベンチマークを構築。最先端のVLMでも成功率は最大16.8%にとどまり、物体認識ではなく身体の自己認識が欠如していることが課題と判明。
原題: HumanCLAW: Can Vision-Language Models Act Through a Body? / Li Siyao, Jiawei Gu, Shuai Liu 他
日本語で読む → - 論文マルチエージェント強化学習cs.MA
通信喪失下でのロバストなマルチエージェント協調のための価値認識予測
通信が途切れる環境で、エージェントが欠落した状態情報を予測する際に、価値関数に基づく重み付けを導入し、予測モデルの学習を政策の進化に結びつける手法を提案した。
原題: Value-Aware Prediction for Robust Multi-Agent Coordination Under Communication Loss / Kemal Devrim Kafadar, Eren Özaltun, Mahmud Efnan Şanlı 他
日本語で読む → - 論文イベントベースビジョン/深度センシングロボティクス
アクティブイベントベースステレオ視覚による超高速深度センシングに向けて
イベントカメラと赤外線パターン投影機を統合したアクティブイベントベースステレオ視覚を提案し、高速シーンでの高密度深度推定を実現する軽量ニューラルネットワークActiveEventNet+を開発した。
原題: Towards Ultrafast Depth Sensing Via Active Event-based Stereo Vision / Jianing Li, Yunjian Zhang, Haiqian Han 他
日本語で読む → - 論文HRIロボティクス
公共空間3箇所で運用した人型ロボットヘッドの受容性に関するケーススタディ
感情表現を伴う多言語対話が可能な人型ロボットヘッドを3つの公共空間で数日間運用し、TAM2アンケートで受容性を評価。観光案内所や図書館では好意的に受け入れられたが、役所では対話意欲が低く、応答速度の遅さが課題と判明した。
原題: A Case Study on the Acceptance of a Humanoid Robotic Head Employed in Three Public Spaces / Marcel Heisler, Luca Randecker, Christian Becker-Asano
日本語で読む → - 論文VLN/農業ナビゲーションロボティクス
農業用視覚言語ナビゲーションのための走行可能性推定アラーム
農業シーンでのVLN-CEにおいて、カメラ画像の走行可能性を推定し、予測行動と矛盾する場合に警報を出すTEAモジュールを提案し、AgriVLNに統合して性能を向上させた。
原題: TEA-AgriVLN: Traversability Estimation Alarm for Agricultural Vision-and-Language Navigation / Xiaobei Zhao, Xingqi Lyu, Xin Chen 他
日本語で読む → - 論文歩行ロボティクス
停止して判断する:マッピング不要の四足点検のための遅延を考慮した自己受容的ナビゲーション基本動作
四足ロボットの階段頂上検出における制御ループの遅延がオーバーシュートを引き起こす問題を分析し、連続登攀ではなく「停止して判断する」リズムを提案して、オーバーシュートをほぼゼロに抑えた。
原題: Stop to Decide: Latency-Aware Proprioceptive Navigation Primitives for Mapping-Free Quadruped Inspection / Hanting Suo, Haonan Yan, Liang Wang 他
日本語で読む → - 論文制御統合制御
強化学習と最適制御を架橋する実行可能行動マッピング
強化学習の行動を最適制御問題の実行可能なパラメータ集合に写像するアルゴリズムを提案し、制約を厳密に満たしつつ柔軟な制御を実現する。ロボット卓球のリアルタイム動作計画で有効性を示した。
原題: Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping / Stefan Richter, Alberto Giammarino, Guillem Torrente 他
日本語で読む → - 論文SLAM/データセットロボティクス
Mag4D-SLAMデータセット:位置推定とマッピングのための反復走行マルチモーダル4D地磁気データセット
屋外大規模SLAM研究用に、LiDAR・カメラ・IMU・磁気センサ・GNSSを同期した18km以上の地磁気データセットを構築し、昼夜・往復走行での磁場再現性や位置識別性を解析した。
原題: Mag4D-SLAM Dataset: A Repeated-Traversal Multi-Modal 4D Geomagnetic Dataset for Localization and Mapping / Bibhutibhusan Nayak, Hyoseok Ju, Giseop Kim
日本語で読む → - 論文VPR/生涯学習ロボティクス
SLAM:忘却耐性と領域ロバストな生涯VPRのための構造化・局所化解析多様体適応
生涯視覚場所認識(VPR)における解析的クラス増分学習(ACIL)の領域シフト脆弱性を解決するため、不変多様体とスタイル分離によるドメイン整合、およびEKFとの同型性に基づく制御理論的枠組みSLAMを提案し、非定常データセットで性能を向上させた。
原題: SLAM: Structured and Localized Analytic Manifold Adaptation for Forgetting-Immune and Domain-Robust Lifelong VPR / Kenta Tsukahara, Kanji Tanaka, Rai Hisada
日本語で読む → - 論文継続的RL/自律レースロボティクス
自律レースにおける継続的RLによる汎化:RoboRacerプラットフォームでの検証
実世界データのみを用いて、継続的バックプロパゲーションに基づく継続的RLフレームワークを提案し、複数のトラックで汎用的なポリシーを訓練した後、15分以内の微調整で古典的制御器を上回る性能を達成した。
原題: Continual-RL for Generalization in Autonomous Racing on the RoboRacer Platform / Joel Siegert, Edoardo Ghignone, Michele Magno
日本語で読む → - 論文VLA/評価AI
空中MLLMエージェントのゼロショットミッションレベル評価
空中3D環境での長期的なタスクを評価するベンチマークMissionBenchを提案し、22のMLLMモデルが人間の84.4%に対し35%未満の成功率であることを示した。
原題: Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents / Suman Navaratnarajah, Taehyoung Kim, Jona Ruthardt 他
日本語で読む →