論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/19 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文SLAMロボティクス
高高度ナディア UAV 映像における単眼 SLAM システムの評価
単眼 SLAM システムを高高度の真下視映像でベンチマークし、環境や軌道スケールによる性能差を明らかにした。
原題: Evaluation of Monocular SLAM Systems on High-Altitude Nadir UAV Footage / Gašper Spagnolo, Matej Dobrevski, Danijel Skočaj
日本語で読む → - 論文神経科学/空間認知cs.NE
海馬の場所表現における空間エイリアシング低減に対するグリッド細胞の役割
境界ベクトル細胞のみでは対称な環境で場所の区別が困難になる問題に対し、グリッド細胞の信号を統合することで空間エイリアシングを94〜99%削減できることを示した論文。
原題: The Role of Grid Cells in Reducing Spatial Aliasing in Hippocampal Place Representations / Alexander Johnson, Obadah Ghizawi, Ali A. Minai
日本語で読む → - 論文制御ロボティクス
正しい抽象化を学ぶ:複雑なロボット制御のためのニューラル縮約ダイナミクス
高忠実度シミュレータの計算コストを避けるため、制御に重要な物理を保持した縮約状態を学習するニューラル縮約ダイナミクス(NRD)フレームワークを提案し、学習したモデル内でポリシーを訓練し、高忠実度シミュレータで検証する。地形適応型HMMWV追跡や車両・アームの目標到達タスクで有効性を示した。
原題: Learning the Right Abstraction: Neural Reduced Dynamics for Complex Robot Control / Harry Zhang, Dan Negrut
日本語で読む → - 論文動作生成cs.GR
EMODY Flow: 感情を考慮した音声駆動型全身動作生成
音声と感情ラベルから全身のジェスチャーと表情を生成する軽量フローマッチングフレームワークを提案し、感情の識別性を高める補助分類器で従来の感情無視問題を解決した。
原題: EMODY Flow: Emotion-Aware Audio-Driven Full-Body Motion Generation / Harsh Kumar Agarwal, Xavier Alameda-Pineda, Olivier Perrotin
日本語で読む → - 論文群制御ロボティクス
VLM-LLM推論と到達可能性解析による安全なマルチロボット協調
視覚付き四足歩行ロボットとカメラなし車両の異種チームで、VLMが環境を意味解釈しLLMがタスクを割り当て、ゾノトープ到達可能性ゲートで安全性を検証して協調ナビゲーションを実現する。
原題: Safe Multi-Robot Coordination via VLM-LLM Reasoning and Reachability Analysis / Mohamed Dwedar, Ahmad Hafez, Alexander Jesser 他
日本語で読む → - 論文ナビゲーションロボティクス
確率的保証付きオンライン確率的最短路ナビゲーションのためのオラクルとしてのダイクストラ法
ダイクストラ法が確率的遷移下でも正確な計画エンジンとして機能する条件を示し、それを利用したオンライン学習アルゴリズムDORAを提案。動的障害物との接触確率を予算内に抑えつつ、計算量を大幅に削減する。
原題: Dijkstra as an Oracle for Online Stochastic Shortest Path Navigation with Provable Guarantees / Mansur M. Arief, Ali Akarma, Ahmad Alfan Alfian Irfan
日本語で読む → - 論文群制御cs.MA
群分散計画を用いた並列生涯MAPFの理論的枠組み
生涯マルチエージェント経路探索問題において、RHCRの準最適性を理論的に証明し、それを基にエージェントをグループに分割して並列計画するGD-RHCRを提案し、性能を検証した。
原題: A Theoretical Framework for Parallel Lifelong MAPF Using Group Decentralized Planning / Alex DeWeese, Jiaoyang Li, Guannan Qu
日本語で読む → - 論文アフォーダンス予測画像認識
再現可能なマルチモーダル・アフォーダンス予測
アフォーダンス予測の評価・比較を困難にする問題を解決するため、実験プロトコルやデータセットなどを詳細に記録する「アフォーダンスシート」を提案し、再現可能なベンチマークと信頼性の高い評価を可能にした。
原題: Reproducible Multimodal Affordance Prediction / Tommaso Apicella, Alessio Xompero, Andrea Cavallaro
日本語で読む → - 論文LLM/設計自動化physics.optics
ナノフォトニクスにおける大規模言語モデルの包括的レビュー:サロゲートモデリングから自律設計へ
メタサーフェス設計における大規模言語モデル(LLM)の応用を、サロゲートモデルとエージェントシステムの2つの動作モードに分類してレビューし、将来のマルチモーダル基盤モデルへの展望を示した論文。
原題: A Comprehensive Review of Large Language Models for Nanophotonics: From Surrogate Modeling to Autonomous Design / Huanshu Zhang, Kegeng Tang, Lei Kang 他
日本語で読む → - 論文言語モデル機械学習
ループ型言語モデルにおける再帰計算の割り当て
ループ型言語モデルで、全層を繰り返すのではなく、ミキサー層のみを繰り返しFFNは一度だけ適用する「MixerLoop」を提案し、性能と計算コストのトレードオフを改善した。
原題: Allocating Recurrent Compute in Looped Language Models / Ruhai Lin, Yiyang Guo, Rui-Jie Zhu 他
日本語で読む → - 論文物体検出画像認識
熱画像におけるドローン検出のための合成データを用いた訓練
熱画像でのドローン検出において、合成データで初期学習し実データで微調整する戦略を検証し、少量の実データでも性能が向上することを示した。
原題: Training with synthetic data for drone detection in thermal imagery / Tanel Liiv, Sander Soodla, Nzamba Bignoumba 他
日本語で読む → - 論文全身制御ロボティクス
GigaBrain-WBC-0.5:環境との相互作用に頑健な全身制御のための行動世界モデル
ヒューマノイドの全身運動追跡制御において、環境との接触を考慮した行動世界モデルを提案し、不適切なコマンドや外乱に対して頑健な制御を実現した。
原題: GigaBrain-WBC-0.5: A Behavior World Model for Robust Whole-Body Control with Environment Interaction / Ziyang Cheng, Tianshu Tang, Jinxin Lan 他
日本語で読む → - 論文群制御ロボティクス
GuideFetch: 支援ロボット犬における並行ナビゲーションと物体回収のためのタスク調整フレームワーク
盲人ユーザーを案内するロボット犬と、コーヒーを回収して届ける別のロボット犬が並行して動作する状況を想定し、LLMを用いて計画を検証・実行する調整フレームワークを提案した。
原題: GuideFetch: A Task Coordination Framework for Concurrent Navigation and Object Retrieval in Assistive Robot Dogs / Qian Yin, Ruiping Liu, Kunyu Peng 他
日本語で読む → - 論文自動運転/安定性制御ロボティクス
自動運転レースにおける実世界テストのための安定性制御
自動運転レースで車両が限界性能に達した際の安定性を保つため、電子安定性制御、スリップ制御、カウンターステアシステムからなる統合安定性制御システムを提案し、実車実験で有効性を検証した。
原題: Stability Control for Real World Testing in Autonomous Racing / Phillip Pitschi, Simon Sagmeister, Frederik Werner 他
日本語で読む → - 論文VLA/安全保証ロボティクス
異種ロボットのための校正済み予測安全:行動条件付きJEPAフレームワークとモデルベース安全シールド
視覚言語行動ポリシーに実行時保証を追加するため、行動条件付きJEPA世界モデルで候補行動のタスク進捗と物理リスクを予測し、モデルベース安全シールドでフィルタリングするパイプラインを提案した。
原題: Calibrated Predictive Safety for Heterogeneous Robots: An Action-Conditioned JEPA Framework with Model-Based Safety Shields / Kaiming Zhong, Tianhua Liu, Yue Wang
日本語で読む → - 論文モデルベース強化学習AI
ニューロシンボリック世界モデルによるゼロショットタスク転送に向けて
報酬予測を潜在状態のシンボリックな部分に依存させる新しい世界モデルを提案し、同じシンボリック状態空間上の新しい報酬関数へ環境相互作用なしで適応できることを示した。
原題: Towards Zero-Shot Task Transfer with Neurosymbolic World Models / Isidoro Tamassia, Lennert De Smet, Giuseppe Marra
日本語で読む → - 論文軌道予測ロボティクス
ControlledShifts: 分布シフト下での軌道予測におけるロバスト性評価の標準化に向けて
軌道予測モデルの分布シフトに対するロバスト性を標準化して評価するフレームワークとベンチマークスイートを提案し、既存データセットを系統的に再分割して複数のシフトを生成し、統一的なロバスト性スコアでモデルを評価する。
原題: ControlledShifts: Towards Standardizing Robustness Evaluation in Trajectory Prediction Under Distribution Shifts / Ingrid navarro, Pablo Ortega-Kral, Yutong Duan 他
日本語で読む → - 論文サーベイ画像認識
基盤モデル時代における人間中心知能:サーベイ
基盤モデル時代の人間中心知能について、人間を観察対象・動的アクター・状況エージェントとして捉える6層のタクソノミーを導入し、方法論、代表的手法、データセット、課題を体系的にレビューしたサーベイ論文。
原題: Human-Centric Intelligence in the Era of Foundation Models: A Survey / Yang Chen, Tianqi Wang, Xiaorui Jiang 他
日本語で読む → - 論文プランニング機械学習
省略されたモードは稀な規則:連続コードワールドモデルにおけるサンプリング検証の危険法則
LLMが生成した実行可能なワールドモデルを古典的プランナーが探索する際、サンプリング検証が連続制御で危険であることを示し、モード境界で大きな後悔が生じることを実証した。
原題: An Omitted Mode Is a Rare Rule: The Sampling-Verification Danger Law in Continuous Code World Models / Javier Aguilar Martín
日本語で読む → - 論文群制御ロボティクス
信頼を場として捉える:車両ネットワークの巨視的表現
車両レベルの信頼評価を時空間連続場として表現するフレームワークを提案し、路側機の疎な観測から信頼場を再構成する深層学習手法を比較・評価した。
原題: Trust as a Field: A Macroscopic Representation for Vehicular Networks / Md Mahmudul Islam, Shaurya Agarwal
日本語で読む → - 論文群制御ロボティクス
配送アプリケーションにおけるマルチロボットタスク割り当てとルーティングのための二層アリコロニー最適化
配送用マルチロボットのタスク割り当てと経路計画を同時に最適化する二層アリコロニー最適化アルゴリズムを提案し、既存手法より総移動距離と完了時間を最大約18%削減した。
原題: Bi-Layer Ant Colony Optimization for Multi-Robot Task Allocation and Routing in Delivery Applications / Le Na Nguyen, Thanh Long Nguyen, Thanh Thao Ton Nu 他
日本語で読む → - 論文歩行ロボティクス
ウェイポイント誘導強化学習による実機サイズ双腕ロボットのロバストなブラキエーション
実機サイズの双腕ロボットで、エンドエフェクタの経路ウェイポイントを疎に指定して強化学習を行うことで、模倣学習データなしにロバストなブラキエーション(腕渡り)を実現した。シミュレーションと実機実験で、失敗回復を含む安定動作を確認した。
原題: Robust Brachiation on a Life-Sized Dual-Arm Robot Using Waypoint-Guided Reinforcement Learning / Ayumu Iwata, Kento Kawaharazuka, Keita Yoneda 他
日本語で読む → - 論文手術支援ロボティクス
AIベースの水晶体嚢切開術スキル転送のための予測的外科的経路の構築
外科医トレーニングの自動化を目指し、熟練医の動作軌跡から参照モデルを構築し、初心者の動作経路を改善するプラットフォームを提案。ARAS-Farabiデータセットと深層CNNを用いて、初心者の意図を保ちつつスキルを向上させる経路を生成する。
原題: Constructing Predictive Surgical Path for AI-based Capsulorhexis Skill Transfer / Mohammad Javad Ahmadi, Hamid D. Taghirad
日本語で読む → - 論文SLAM/エッジコンピューティングロボティクス
Jetson-ORB-SLAM3: エッジコンピューティングデバイス向け精度保持型GPU実装
低消費電力エッジデバイス上でORB-SLAM3を精度を保ったままGPUで高速化する実装を提案。GPU版ORBフロントエンドはCPU版とほぼ同一の特徴点を生成し、ループ閉じ込みもTensorRTで高速化。軌道精度はCPU版と同等であることを複数データセットで検証した。
原題: Jetson-ORB-SLAM3: Accuracy-Preserving GPU Implementation for Edge Computing Devices / Rajat Roy, Aditya Arun Kumar Yadav, Hardik Jain
日本語で読む → - 論文触覚/姿勢推定ロボティクス
物理情報に基づくスライディングウィンドウ粒子フィルタによる触覚のみを用いた手中6自由度物体姿勢推定の精緻化
視覚が使えない状況で、手のひらの触覚センサ情報のみを用いて、把持物体の6自由度姿勢を高精度に推定する手法を提案した論文。物理的な接触条件を考慮した粒子フィルタと時間的な情報統合により、従来法より精度が向上することを示した。
原題: Physics-Informed Sliding-Window Particle Filtering for Tactile-Only In-Hand 6-DoF Object Pose Refinement / Lingjun Shao, Ying Zhang, Xiangfei Li 他
日本語で読む → - 論文自動運転/VLAロボティクス
Geo-VLA: 地図セマンティクスの内在化による幾何認識型視覚言語行動計画
複雑な運転環境でのVLAモデルの計画性能を向上させるため、幾何学的な地図情報を学習時に内在化するプラグアンドプレイ型フレームワークGeo-VLAを提案した。推論時にはHD地図を不要とし、NAVSIM v1で単眼カメラVLAプランナーとして最高性能を達成した。
原題: Geo-VLA: Geometry-Aware Vision-Language-Action Planning via Internalization of Map Semantics / Ran Chen, Jiaxing Ren, Zhikun Zhang 他
日本語で読む → - 論文操作ロボティクス
エージェント型ロボティクスによる「Push-T」操作タスクの再考
LLMコーディングエージェントがデモデータなしでPush-Tタスクを解くアルゴリズムを生成し、拡散ポリシーより少ないステップで100%成功率を達成した。
原題: Revisiting the "Push-T" Robot Manipulation Task with Agentic Robotics / Shuangyu Xie, Kaiyuan Chen, Ken Goldberg
日本語で読む → - 論文ソフト外骨格/制御ロボティクス
空気圧駆動ソフト外骨格スーツのためのタスク非依存な動的支援制御戦略
空気圧アクチュエータの複雑なダイナミクスをハンマーシュタイン動的モデルで表現し、その逆モデルを制御ループに組み込むことで、ユーザーの意図推定に生理・力センサを必要とせず、タスク非依存で動的な支援を実現する制御戦略を提案した。手首用ソフト外骨格のテストリグで評価し、支援なしと比べて相互作用トルクを最大73%、主要筋の活性を最大47%削減した。
原題: A Task-Agnostic Control Strategy for Dynamic Assistance with Pneumatically Actuated Soft Exosuits / Anoush Sepehri, Zachary Huang, Raymond de Callafon 他
日本語で読む → - 論文手術ロボティクスロボティクス
ロボット支援手術におけるステレオ深度からの転移可能な器具-組織接触検出
ステレオ深度画像から器具と組織の接触を検出する手法を提案し、RGBベースの既存手法よりも高い転移性能を示した。
原題: Transferable Tool-Tissue Contact Detection from Stereo Depth in Robot-Assisted Surgery / Mingyeung Wu, Zhonghao Zhang, Hao Yang 他
日本語で読む → - 論文模倣学習/シミュレーションロボティクス
VERAGMIL: 模倣学習モデルによる粒状食品のすくい取りのための仮想環境
粒状食品を扱うロボット支援食事システムの訓練のため、高忠実度シミュレータとVRインターフェースを組み合わせたフレームワークを提案し、模倣学習モデルの性能を評価した。
原題: VERAGMIL: Virtual Environment for Scooping Granular Foods with Imitation Learning Models / Amanuel Ergogo, Diego Dall'Alba, Przemyslaw Korzeniowski
日本語で読む →