論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文3Dシーングラフ生成画像認識
DeWorldSG: ワールドモデル事前知識による深度認識3Dセマンティックシーングラフ生成
RGB-Dシーケンスから時間的に安定した3Dセマンティックシーングラフを生成するフレームワークを提案。物体を確率的3Dノードとして表現し、ワールドモデルの事前知識で関係性を補完することで精度を大幅に向上させた。
原題: DeWorldSG: Depth-Aware 3D Semantic Scene Graph Generation via World-Model Priors / Seok-Young Kim, Abdelrahman Elskhawy, Taewook Ha 他
日本語で読む → - 論文ワールドモデル機械学習
Valdi: 価値拡散ワールドモデル
拡散モデルを用いた不確実な未来予測と、オンラインMPCのための高速な潜在計画を両立するワールドモデルを提案。CarRacing環境での予備実験により、単一拡散ステップで決定論的MLPベースラインに匹敵する性能を示した。
原題: Valdi: Value Diffusion World Models / Christopher Lindenberg, Kashyap Chitta
日本語で読む → - 論文サイバーフィジカルシステム/セキュリティcs.CR
カメレオン:MLサロゲートによるメモリ破壊攻撃からのサイバーフィジカルシステムの回復
メモリ破壊攻撃を受けたCPSを、機械学習ベースのサロゲートでコンパートメントを置き換えることで、システムを停止させずに回復させるフレームワークを提案した。
原題: Chameleon: Recovering Cyber-Physical Systems from Memory Corruption Attacks via ML Surrogates / Mohsen Salehi, Karthik Pattabiraman
日本語で読む → - 論文自動運転/動作計画ロボティクス
学習された軌道プリミティブと確率的安全性評価を用いたリスク認識型動作計画
RBFネットワークで学習した軌道プリミティブと確率的衝突リスク評価を組み合わせ、都市部の自動運転における安全で効率的な動作計画を実現するフレームワークを提案した。
原題: Risk-Aware Motion Planning with Learned Trajectory Primitives and Probabilistic Safety Assessment / Marc Kaufeld, Dian Zhuang, Johannes Betz
日本語で読む → - 論文計画/世界モデルロボティクス
ACID: 逆動力学による行動整合性を用いた世界モデル計画
行動条件付き世界モデルによる計画時に、逆動力学モデルで予測遷移から逆算した行動が元の行動と一致することを計画コストに組み込むことで、実現可能性の高い計画を実現する手法を提案した。
原題: ACID: Action Consistency via Inverse Dynamics for Planning with World Models / Gawon Seo, Dongwon Kim, Suha Kwak
日本語で読む → - 論文自動運転レース/強化学習/モデル予測制御ロボティクス
自動運転レースにおける追い越し防止のための深層強化学習誘導モデル予測制御
自動運転レースで、後続の速い車に追い越されないよう防御する制御手法を提案。強化学習で防御軌道を生成し、モデル予測制御に組み込むことで、追い越しまでの時間を延ばしつつタイヤ力を効率的に使う。
原題: Deep Reinforcement-Learning-Guided Model Predictive Control for Preventing Overtakes in Autonomous Racing / Yufei Xi, Yijie Liao, Tulga Ersal
日本語で読む → - 論文手術ロボティクスロボティクス
SurgAM: ロボット自律性のための多モーダル特徴融合による手術アフォーダンスマップ予測
手術映像から吸引・クリッピング・牽引などの基本動作に適した領域を予測するアフォーダンスマップ手法を提案し、自己教師ありビジョントランスフォーマーと生成モデルの特徴を適応的に融合、階層的プロンプト学習とシーン誘導デコーダで精度を向上させた。公開データセットから新規データセットを構築し、ファントム実験で実用性も検証した。
原題: SurgAM: Surgical Affordance Map Prediction with Multimodal Feature Fusion for Robot Autonomy / Lei Song, Yonghao Long, Mengya Xu 他
日本語で読む → - 論文空中マニピュレーションロボティクス
空中マニピュレーション:接触、媒体結合、そしてレディネスの幾何学
空中ロボットの物理的相互作用を、飛行媒体との結合を考慮した「媒体認識型マニピュレーション」として再解釈し、生物とロボットの事例を整理して、冗長性によるタスク等価ファイバーを用いた幾何学的視点から将来の設計指針を提案するレビュー論文。
原題: Aerial Manipulation: Contact, Medium Coupling, and the Geometry of Readiness / Antonio Franchi
日本語で読む → - 論文ソーシャルロボット/認知症ケアロボティクス
Co-STAR: 認知症に対する自律ロボットによる認知刺激療法 -- 1週間の在宅研究
認知症患者9名を対象に、自律型ソーシャルロボットが在宅で認知刺激療法を提供する1週間の研究を実施し、高い参加率と家族の支援の重要性を示した。
原題: Co-STAR: Cognitive Stimulation Therapy by an Autonomous Robot for Dementia -- A One-Week In-Home Study / Emmanuel Akinrintoyo, Nicole Salomons
日本語で読む → - 論文データセット画像認識
SimBEV2X: マルチタスクV2X協調認識のための大規模データセットとデータ生成ツール
CARLAシミュレータ上で自動生成した大規模なV2X協調認識用データセットと生成ツールを提案。既存データセットより一桁大きい規模で、多様なセンサデータとグラウンドトゥルースを含む。
原題: SimBEV2X: A Large-Scale Dataset and Data Generation Tool for Multi-Task Vehicle-to-Everything Cooperative Perception / Goodarz Mehr, Sepideh Gohari, Montasir Abbas 他
日本語で読む → - 論文最適化/3Dプリンティングphysics.comp-ph
マルチマテリアル3Dプリンティングにおけるエンドツーエンド最適化に向けて
実験データから閉形式の構成則を抽出し、ニューラルネットワークと有限要素法を統合したエンドツーエンドの最適化フレームワークを提案。ソフトロボットグリッパーで材料分布とトポロジーの同時最適化を実証した。
原題: Towards end-to-end optimization in multimaterial 3D printing / Xue-Ling Luo, Steven Yang, Jingye Tan 他
日本語で読む → - 論文アニマトロニクス/顔機構設計ロボティクス
対話型アニマトロニクスロボットの顔機構の自動合成
2Dポートレートから3D顔を再構築し、衝突のない製造可能な内部機構を自動設計するアルゴリズムを提案。さらに、会話中の発話・傾聴行動を統合する双方向対話型顔運動合成フレームワークも開発した。
原題: Automated Synthesis of Facial Mechanisms for Conversational Animatronic Robots / Zongzheng Zhang, Zi Lin, Jiawen Yang 他
日本語で読む → - 論文VLA/航法ロボティクス
Exp2VLA: 専門家デモからのドローン航法のための視覚言語行動モデル
強化学習や遠隔操作などの専門家の行動を蒸留して、言語指示に従うドローン航法用のコンパクトなVLAモデルを微調整するパイプラインを提案した。
原題: Exp2VLA: Enabling Vision-Language-Action for Drone Navigation from Expert Demonstrations / Van Huyen Dang, Kabilesh Rajendran, Erdi Sayar 他
日本語で読む → - 論文シーン理解ロボティクス
3Dシーングラフ予測:部分観測環境からの階層モデル生成
ロボットが環境の一部を探索した際に、未探索部分を予測するための階層的な3Dシーングラフ生成フレームワークを提案した。部屋レイヤーとオブジェクトレイヤーを分離し、拡散モデルを用いて部屋のカテゴリ・床境界・移動可能性と、各室内のオブジェクト配置を予測する。
原題: 3D Scene Graph Prediction: Generating Hierarchical Models from Partially Observed Environments / Siyi Hu, Jared Strader, Hyungtae Lim 他
日本語で読む → - 論文VLA/操作ロボティクス
ハーネスVLA:メモリ誘導エージェントによる凍結VLAの信頼性ある操作プリミティブへの変換
凍結したVLAモデルを再試行可能な接触豊富なプリミティブとして活用し、解析的プリミティブと組み合わせることで、微調整なしに分布外の操作タスクでの成功率を大幅に向上させるフレームワークを提案した。
原題: Harness VLA: Steering Frozen VLAs into Reliable Manipulation Primitives via Memory-Guided Agents / Yixian Zhang, Huanming Zhang, Feng Gao 他
日本語で読む → - 論文VLAロボティクス
領域到達からインスタンスレベルの接地へ:視覚と言語によるナビゲーションの改善
VLNエージェントの最終位置の精度と対象物の可視性を評価する指標を導入し、最終段階のナビゲーションを改善するモジュールREALMを提案した。
原題: From Region Arrival to Instance-Level Grounding in Vision-and-Language Navigation / Xiangyu Shi, Ruoxi Yang, Wei Tao 他
日本語で読む → - 論文自動運転/シミュレーションロボティクス
エージェント駆動による自動運転のロングテールシミュレーション
自動運転の閉ループ評価のため、大規模言語モデルで制御される周辺エージェントを導入し、多様な指示に従うインタラクティブなロングテールシナリオを生成するフレームワークを提案した。
原題: Agent-driven Long-tail Simulation for Autonomous Driving / Junru Gu, Lijin Yang, Jianing Huang 他
日本語で読む → - 論文自動運転/横方向制御ロボティクス
自動運転車のための縦運動を考慮した横方向制御:ロバスト非線形制御フレームワーク
縦方向の速度・加速度変化を考慮した横方向制御のためのロバスト非線形制御フレームワークを提案し、パラメータ不確かさに対してLyapunov再設計とINDIの2つのロバスト制御手法を解析・検証した。
原題: Longitudinal-Motion-Aware Lateral Control for Autonomous Vehicles: A Robust Nonlinear Control Framework / Sixu Li, Nitesh Kumar, Reyshwanth Ganeshan 他
日本語で読む → - 論文ナビゲーションロボティクス
DA-Nav: 方向認識型の都市規模視覚言語ナビゲーション
市街地規模の屋外ナビゲーションを、商用ナビの方向指示を利用して、自己中心視画像上の離散的な空間接地問題として再構成し、軌道回復を可能にするフレームワークを提案した。
原題: DA-Nav: Direction-Aware City-Scale Vision-Language Navigation / Ye Yuan, Kehan Chen, Xinqiang Yu 他
日本語で読む → - 論文HRI/ベンチマークロボティクス
HRIBench:相互作用中心の人間ロボット協調のベンチマーク
人間とロボットの協調作業を評価するための新しいベンチマークを提案し、役割や時間的依存関係を明示したシナリオに基づいて、指示者・協力者・割り込み者の3つの役割を定義し、既存のVLAモデルが協調タスクで苦戦することを示した。
原題: HRIBench: Benchmarking Interaction-Centric Human-Robot Collaboration / Chang Liu, Jiawei Zhang, Tao Zhang 他
日本語で読む → - 論文制御ロボティクス
魚型ロボットの経路追従のための微分可能強化学習
魚型ロボットの運動制御と経路追従を、計算効率の良いシミュレーション環境とPID制御のゲインを学習する微分可能強化学習を用いて実現し、実機で検証した。
原題: Differentiable Reinforcement Learning for Path Tracking by an Agile Fish-Like Robot / Prashanth Chivkula, Kartik Loya, Venkata Ravindhra Reddy Varikuti 他
日本語で読む → - 論文シミュレーション画像認識
SPEAR: 写実的な具現化AI研究のためのシミュレータ
Unreal EngineをPythonから制御できる高速・高機能な写実シミュレータを提案し、多様なエージェント制御やデータ生成を実現した。
原題: SPEAR: A Simulator for Photorealistic Embodied AI Research / Mike Roberts, Renhan Wang, Rushikesh Zawar 他
日本語で読む → - 論文触覚ロボティクス
TacPrint: ヒトからロボットへの接触再現のためのウェアラブル指先触覚センサ
指先に装着する触覚センサTacPrintを開発し、容量変化から接触深さマップを推定する実-to-sim-to-realパイプラインを構築。触覚ガイドによる補償で把持・拭き取り成功率を大幅に向上させた。
原題: TacPrint: A Wearable Fingertip Tactile Sensor for Human-to-Robot Contact Reproduction / Yongxi Liu, Chaofan Zhang, Xingyu Zhang 他
日本語で読む → - 論文協調認識画像認識
HeteroPROMPT: リアルタイムかつプライバシー保護な異種協調認識フレームワーク
異なるセンサーやモデルを持つエージェント間の協調認識を、モジュール型プロンプトと軽量学習で特徴空間を統一し、プライバシーを保ちながらリアルタイムに実現するフレームワークを提案した。
原題: HeteroPROPMT: A Real-time and Privacy-Preserving Heterogeneous Collaborative Perception Framework / Armin Maleki, Hayder Radha
日本語で読む → - 論文データ生成AI
受動的ビデオから編集可能な体験へ:身体化知能のための物理的基盤を持つ体験合成
人間の操作ビデオをロボットが学習可能なデータに変換するフレームワークPegasusを提案。グラフベースの中間表現と物理検証器を用いて、身体性のギャップを埋める。
原題: From Passive Video to Editable Experience: Physically Grounded Experience Synthesis for Embodied Intelligence / Jia Luo
日本語で読む → - 論文協調認識cs.NI
車載センサとV2Xデータの融合が協調認識に与える影響(またはその限界)
自動運転車の協調認識において、車載センサとV2Xデータの融合が認識性能を向上させる一方、ゴースト車両の発生など新たな課題を引き起こすことを分析した論文。
原題: How the Fusion of Onboard Sensors and V2X Data can Improve (or not) the Cooperative Perception of Connected Automated Vehicles / Amir Mohammadisarab, Miguel Sepulcre, Luca Lusvarghi 他
日本語で読む → - 論文SLAMロボティクス
NeoSLAMの新実装とRatSLAMとの比較評価
NeoSLAMアルゴリズムをモジュール化されたROS2ベースのアーキテクチャで再実装し、リアルタイム実行を可能にした。また、複数データセットでRatSLAMと比較し、マッピング精度と軌跡再構成の性能を評価した。
原題: A New Implementation of NeoSLAM and a Comparative Evaluation with RatSLAM / Joao Victor T. Borges, Fabio Coelho, Paulo Padrao 他
日本語で読む → - 論文群制御HCI
FleetScape: 拡張現実サンドテーブルによる大規模ドローン群の空間的監視と制御
ドローン群の監視を空間的インタラクションとして捉え直し、MRサンドテーブルシステムを提案・評価した論文。
原題: FleetScape: A Mixed Reality Sandtable for Spatial Supervision and Control of Scalable Drone Fleets / Peisen Xu, Jérémie Garcia, Peter Cleveland 他
日本語で読む → - 論文SLAMロボティクス
PLED-VINS: 動的環境向け点・線イベントベース視覚慣性SLAM
動的環境でロバストな状態推定を実現するため、イベントカメラの時間統計に基づく特徴の信頼性評価と適応的重み付けを導入した視覚慣性SLAMフレームワークを提案した。
原題: PLED-VINS: A Point-Line Event-Based Visual Inertial SLAM for Dynamic Environments / Seunghun Lee, Jihun Nam, Dong-Uk Seo 他
日本語で読む → - 論文器用操作/sim2realロボティクス
現実ギャップを埋める:器用な力制御把持と操作のためのゼロショットsim-to-real展開
触覚とトルク情報を活用した強化学習により、シミュレーションのみで訓練した5本指ハンドの制御ポリシーを実機に直接展開し、把持力制御と物体の向き変更を実現した。
原題: Closing the Reality Gap: Zero-Shot Sim-to-Real Deployment for Dexterous Force-Based Grasping and Manipulation / Zhe Zhao, Zhibin Li, Yilin Ou 他
日本語で読む →