論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/8 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ナビゲーションロボティクス
OmniNav: 動的環境における堅牢な長期的目標ナビゲーション
動的環境での長期的な目標ナビゲーションを、シーン記憶の更新、信念修正、操作可能なエンドポイント選択を統合した因子化タスク状態推定として定式化し、頑健な探索と操作を実現するシステムを提案した。
原題: OmniNav: Robust Long-Horizon Target Navigation in Dynamic Environments / Yujie Tang, Meiling Wang, Jinhao Jiang 他
日本語で読む → - 論文データセット/マルチモーダルロボティクス
DYAD: 共在する人間支援のマルチモーダルデータセット
ギアボックス組立作業中に、訓練されたヘルパーがHoloLens 2装着者を支援する際の、言語的・物理的介入と作業者の要求・タスク状態・結果を同期記録したデータセットを構築し、支援プロセスの因果理解・モード予測・応答生成のベンチマークを提供した。
原題: DYAD: A Multimodal Dataset of Co-Located Human Assistance / Akhil Ajikumar, Mahya Qorbani, Sakib Reza 他
日本語で読む → - 論文HRIロボティクス
CALM: ロボット接近時の構成を考慮した人間介入境界
ロボットの腕の姿勢が人間の介入距離に与える影響を実験で調べ、構成に応じた介入境界を推定するモデルを提案した。
原題: CALM: Configuration-Aware Human Intervention Boundaries During Robot Approach / Xinting Gao, Sipu Zhu, Weimin Zhuang
日本語で読む → - 論文歩行/全身制御ロボティクス
推力レート入力による全身モデル予測制御を用いた飛行人型ロボットの反重力歩行
飛行人型ロボットが天井などの反重力環境で歩行できるよう、推力の時間微分を制御入力とする全身MPCを提案し、接触切替時の推力スパイクを防ぎつつ、接触力の下限を導入して実機実験で反重力歩行を実証した。
原題: Anti-Gravity Walking by a Flying Humanoid Robot via Thrust-Rate Input Whole-Body Model Predictive Control / Kazuki Sugihara, Kei Okada
日本語で読む → - 論文触覚/手術支援ロボティクス
シーングラフ駆動の触覚フィードバックによるロボット眼科手術の安全性向上:物理シミュレーションi OCTを用いて
ロボット眼科手術において、物理シミュレーションされたiOCT映像からシーングラフを構築し、その意味情報に基づいて触覚フィードバックを生成するシステムを提案。ユーザー実験で針の位置合わせ誤差を14%削減し、安全性を高める操作戦略の誘導を確認した。
原題: Scene Graph-Driven Haptic Feedback for Safety Enhancement in Robotic Ophthalmic Surgery via Physically Simulated iOCT / Danial Arbabi, Korab Hoxha, Angelo Henriques 他
日本語で読む → - 論文SLAMロボティクス
Functional-SLAM: オンライン機能シーングラフによるインタラクション認識マッピング
ロボットの細かいインタラクションに必要な機能関係をモデル化したオンラインSLAMフレームワークを提案し、機能シーングラフをリアルタイムに構築・維持する。
原題: Functional-SLAM: Interaction-Aware Mapping with Online Functional Scene Graphs / Xinggang Hu, Chenyangguang Zhang, Zihan Zhu 他
日本語で読む → - 論文VLAロボティクス
飛行を学ぶ:コンパクトなターゲット中心キューと強化学習による安定した視覚誘導UAVサーボ
RGB画像の代わりに軽量なターゲットセグメンテーションから得られる画像空間オフセットと相対深度、機体速度・重力投影を組み合わせた12次元観測でUAVの視覚サーボを強化学習し、カリキュラム学習で安定化と外乱頑健性を実現した。
原題: Learning to Fly: Stable Vision-Guided UAV Servoing with Compact Target-Centric Cues and Reinforcement Learning / Saurbh Singh Jamwal, Nived Chebrolu
日本語で読む → - 論文VLA/通信連携ロボティクス
ComVLA: 6G接続ロボティクスにおけるVLAモデルの通信認識型分割推論
言語指示に含まれる意味情報を利用して、VLAモデルの視覚トークン数を無線チャネル容量に適応させるフレームワークを提案し、計算量と遅延を削減しつつタスク成功率を維持した。
原題: ComVLA: Communication-Aware Split Inference for VLA Models in 6G-Connected Robotics / Boliang Liu, Wint Yi Poe, Jingyun Di 他
日本語で読む → - 論文ベンチマーク画像認識
NutriBench-Kitchen:栄養管理のための身体化AIベンチマーク
調理動画における栄養関連状態の追跡と知識に基づく計画を評価するベンチマークを提案し、既存の視覚言語モデルが人間性能に及ばないことを示した。
原題: NutriBench-Kitchen: Benchmarking Embodied AI for Nutrition Management / Yulin Wei, Xiangchen Wang, Jianhui Pan 他
日本語で読む → - 論文ゲーム理論cs.GT
未知の異種攻撃者速度情報を用いた到達回避ゲームにおける欺瞞戦略
攻撃者の速度が不確かな到達回避ゲームで、攻撃者が遅い速度の欺瞞戦略を用いて防御者を誤った判断に導き、完全情報ゲームより良い結果を得られることを示した。
原題: Deception in Reach-Avoid Game with Unknown Heterogeneous Attackers Speed Information / Xiangkai Wu, Shaolin Tan, Wei Wang 他
日本語で読む → - 論文通信機械学習
汎用セマンティックおよび目標指向通信のための基盤モデル
視覚言語基盤モデルと拡散モデルを活用し、低ビットレートでも汎化性と高忠実度を両立するセマンティック通信フレームワークFMSGOCを提案した。
原題: Foundation Models for Generalizable Semantic and Goal-Oriented Communication / Boliang Liu, Wint Yi Poe, Riccardo Trivisonno 他
日本語で読む → - 論文群制御ロボティクス
SMaRT-Tug: 物理ベースのタグボート・バージ協調操作のための構造化マルチエージェント強化学習
複数のタグボートがバージを協調して押す操作を、物理ベースのGPUシミュレータと構造化制御事前知識を組み合わせた分散型MAPPOで学習し、PIDや集中型PPOより高い性能とゼロショット一般化を実証した論文。
原題: SMaRT-Tug: Structured Multi-Agent Reinforcement Learning for Physics-Based Tugboat-Barge Collaborative Manipulation / Junkai Lu, Jiadong Zhao, Jiacheng Zhang 他
日本語で読む → - 論文模倣学習/データセットロボティクス
CosmoH2G: 複雑な空間動作を伴う物体操作のためのハンドからグリッパーへの転移データセットとベースライン手法
人間の手のデモンストレーションをロボットグリッパーに転移する際、複雑な空間動作(回転や反転を含む軌道)を扱えるようにするため、大規模なペアデータセットと2段階の生成フレームワークを提案した論文。
原題: CosmoH2G: A Hand-to-Gripper Transfer Dataset and Baseline Method for Object Manipulation with Complex Spatial Movements / Hongxiang Zhao, Mutian Xu, Zeyu Jin 他
日本語で読む → - 論文歩行ロボティクス
RoboDreamer: 予測状態空間モデルによる先読み型ヒューマノイド歩行
観測マスキングと蒸留を用いた2段階教師-学生フレームワークで、不完全なセンシング下でも安定したヒューマノイド歩行を実現する。
原題: RoboDreamer: Anticipatory Humanoid Locomotion with Predictive State-Space Models / Zhe Li, Yangyang Wei, Xichen Yuan 他
日本語で読む → - 論文姿勢制御ロボティクス
SO(3)上の特異点フリー誘導ベクトル場:設計者が指定する進行挙動を伴う手法
SO(3)上で特異点のない誘導ベクトル場を構築し、姿勢経路追従を実現する手法を提案した。経路に沿った進行速度を設計仕様として明示的に扱える点が特徴で、最小速度制約のあるプラットフォームにも適用可能である。
原題: Singularity-Free Guiding Vector Fields on SO(3) with Designer-Specified Progression Behavior / Jesus Bautista, Hector Garcia de Marina
日本語で読む → - 論文ナビゲーションロボティクス
人間を追跡するロボットのための地図制約を活用した追跡・ナビゲーション:運動状態推定と構造マップの融合
人追従ロボットが遮蔽で見失った際に、地図情報とグラフ探索を用いて目標の将来軌道を予測し、安全に追従を継続するシステムを提案した。
原題: Human-Aware Target Tracking and Navigation: Fusing Kinematic State Estimation with Structural Map Constraints / Sagar Gupta, Don Gideon, Seng W. Loke 他
日本語で読む → - 論文ワールドモデル計画ロボティクス
タスク成功を超えて:センシング劣化下におけるワールドモデル計画の段階別信頼性
ワールドモデル計画におけるセンシング劣化の影響を、表現・予測・計画・物理的結果の各段階で評価し、劣化の影響が段階間で非一様に伝播することを示した論文。
原題: Beyond Task Success: Stage-Wise Reliability of World Model Planning under Sensing Degradation / Geonmyeong Lee, Byoung-Tak Zhang
日本語で読む → - 論文形式手法/制御制御
重み付きイベント信号時相論理から時間に依存しない幾何制御への健全なコンパイル
時相論理仕様を時間に依存しない幾何学的制約に変換し、クロック異常に頑健なCPS制御を実現する新しい枠組みを提案した。
原題: Sound Compilation of Weighted Event Signal Temporal Logic to Timeless Geometric Control / Avinash Malik
日本語で読む → - 論文安全性/LLM/ヒューマノイドロボティクス
あなたのロボットが無視するまでどのくらい?人間とヒューマノイドの協調におけるLLMオーケストレータの安全性ベンチマーク
LLMを用いたロボット制御の安全性を評価する初のベンチマークを提案し、複数のLLMバックエンドのコンプライアンス違反率を測定した。
原題: How Long Until Your Robot Ignores You? A Safety Benchmark for LLM Orchestrators in Human-Humanoid Collaboration / Aulon Bajrami, Mohamed Elshamouty, Werner Kraus
日本語で読む → - 論文歩行ロボティクス
LLM生成仕様から学習する四足歩行
大規模言語モデルを用いて自然言語の歩行目標からパラメトリック時相論理仕様を自動生成し、それを報酬関数に変換して四足歩行ポリシーを強化学習で訓練する手法を提案した。
原題: From LLM-Generated Specifications to Learned Quadruped Locomotion / Merve Atasever, Keyan Azbijari, Cagan Bakirci 他
日本語で読む → - 論文溶接欠陥検出AI
マルチモーダルデータに基づく実時間ガスメタルアーク溶接の隅肉継手における説明可能な時間的注意機構を用いた欠陥検出
溶接中の画像と音声データを用いて、時間的注意機構を備えた深層学習モデルで内部欠陥を検出し、F1スコア0.99を達成。説明可能AIでモデルの判断根拠を解釈し、信頼性を向上させた。
原題: Explainable Temporal Attention-based Defect Detection For Fillet Joints in Real-Time Gas Metal Arc Welding Based on Multi-modal Data / Mobina Mobaraki, Mahyar Asadi, Klaske Van Heusden 他
日本語で読む → - 論文VLAロボティクス
OpenWAM: 体系的な世界行動モデル事前学習に向けたオープンでモジュール型の探求
世界行動モデルの設計空間をモジュール化し、制御実験を通じて設計原則を抽出・検証するオープンな研究基盤を構築した。
原題: OpenWAM: An Open, Modular Exploration Towards Systematic World-Action Model Pretraining / Yuran Wang, Siqiao Huang, Mingleyang Li 他
日本語で読む → - 論文sim2realロボティクス
自己受容感を軸にしたクロスモーダル事前学習による接触を伴う組立のゼロショットsim-to-real転移
シミュレーションと実機で差異の少ない自己受容感(関節位置・速度)を教師信号に、視覚と力覚の表現を学習し、実機での微調整なしで高精度な接触組立を実現する手法PACEを提案した。
原題: Zero-Shot Sim-to-Real Contact-Rich Assembly via Proprioception-Anchored Cross-Modal Pretraining / Yuhan Wang, Yurou Chen, Hongye Jiang 他
日本語で読む → - 論文行動生成ロボティクス
大規模離散方策:確率的反復スコアリングによる明示的行動モデリングの進展
行動方策を離散的な候補選択としてモデル化し、確率的な反復スコアリングで表現力を高める新しいフレームワークを提案。自動運転やロボット操作で連続生成モデルに匹敵する性能を示した。
原題: Large Discrete Policy: Advancing Explicit Behavior Modeling with Stochastic Iterative Scoring / Zhenxin Li, Nadine Chang, Xinglong Sun 他
日本語で読む → - 論文VLAロボティクス
ロボットポリシーにおける言語転移の測定:Cosmos3視覚言語行動ポリシーへのギリシャ語追加
英語中心のロボット基盤モデルにギリシャ語を追加する際、翻訳ではなく測定方法が重要であることを示し、誤った結論を導く指標を特定し、バイリンガル訓練が一貫した性能向上をもたらすことを明らかにした。
原題: Measuring Language Transfer in Robot Policies: Adding Greek to a Cosmos3 Vision-Language-Action Policy / Ayoub Kirouane, Georgios Giaples, Christos Petrocheilos
日本語で読む → - 論文群制御ロボティクス
大規模マルチロボットシステムにおけるステルスアクチュエータ攻撃下での分散型セキュア学習制御
マルチロボットシステム向けに、強化学習と分散モデル予測制御を統合し、悪意あるステルスなアクチュエータ攻撃に対抗する分散型セキュア学習制御フレームワークを提案した論文。
原題: Distributed Secure Learning Control for Large-scale Multirobots under Stealthy Actuator Attacks / Xinglong Zhang, Qingwen Ma, Cong Li 他
日本語で読む → - 論文AGIAI
人工汎用知能における適応的絡み合いゲームモジュール
相互作用する適応エージェントの集団行動を確率波方程式でモデル化し、中国株の日中取引データが適応的絡み合いゲームモードで82-94%説明できることを示した。AGIに適応的絡み合いゲームモジュールを組み込む必要性を主張する。
原題: Adaptive Entangled Game Modules in Artificial General Intelligence / Haochen Li, Xinshuai Guo, Jingdong Ouyang 他
日本語で読む → - 論文VLAロボティクス
ICI-VLA: 時空間的に整列したデモによる文脈内模倣を用いた視覚言語行動モデル
追加学習なしで、テスト時にデモを文脈として与えることで新しい操作タスクに適応できるVLAモデルの訓練・検索フレームワークを提案した。
原題: ICI-VLA: In-Context Imitation with Spatiotemporally Aligned Demonstrations for Vision-Language-Action Models / Songhua Yang, Ziyu Liu, Xuetao Li 他
日本語で読む → - 論文マルチエージェント強化学習制御
予測シールディングによる分散型安全マルチエージェント強化学習
複数ロボットが独立にタスクを実行する環境で、訓練時と異なる状態に直面しても安全に適応できるよう、予測シールディングとモデルベースの有限地平Q学習を組み合わせた分散型フレームワークを提案した。対称シナリオでのライブロックを緩和する通信不要のプロトコルも導入している。
原題: Decentralized Safe Multi-Agent Reinforcement Learning via Predictive Shielding / Yacine El Yamani, Hanna Krasowski, Elena Vanneaux
日本語で読む → - 論文マニピュレーションロボティクス
Dex-X: シミュレーションによるインタラクションを用いた人間のビデオからの視覚-触覚器用操作学習
人間のビデオデモから、シミュレーションで触覚情報を補完し、視覚と触覚を統合した器用な操作ポリシーを学習するフレームワークを提案。実機へのゼロショット転送を達成した。
原題: Dex-X: Learning Visual-Tactile Dexterous Manipulation From Human Videos with Simulated Interaction / Ruoqu Chen, Feixiang Ruan, Liu Cao 他
日本語で読む →