論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/5 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文生成モデル検証機械学習
敵対的系列による生成モデル内の暗黙的世界モデルの検証
チェスを題材に、生成モデルがルールに沿った手を生成できるか(健全性)を敵対的系列生成で検証し、訓練手法やデータ選択が健全性に与える影響を分析した。
原題: Verification of the Implicit World Model in a Generative Model via Adversarial Sequences / András Balogh, Márk Jelasity
日本語で読む → - 論文世界モデル機械学習
潜在行動による自己改善型世界モデリング
行動ラベルなしの状態列から、行動を潜在変数として扱い、順方向世界モデルと逆動力学モデルを交互に強化学習で自己改善するフレームワークSWIRLを提案。
原題: Self-Improving World Modelling with Latent Actions / Yifu Qiu, Zheng Zhao, Waylon Li 他
日本語で読む → - 論文交通制御/安全RL機械学習
不確実性を考慮した適合予測と世界モデル強化学習による安全な都市交通制御
予測の不確実性を適合予測で校正し、それを異常検知から安全な強化学習ポリシーまで一貫して伝播させる統合フレームワークSTREAM-RLを提案し、実データで高い安全性と低遅延を達成した。
原題: Safe Urban Traffic Control via Uncertainty-Aware Conformal Prediction and World-Model Reinforcement Learning / Joydeep Chandra, Satyam Kumar Navneet, Aleksandr Algazinov 他
日本語で読む → - 論文制約付き強化学習機械学習
制約付き強化学習のための確率的決定ホライズン
制約違反がホライズンを短縮する確率的決定ホライズン(SDH)を提案し、制約付きRLのオフポリシーかつ正則化アルゴリズムを開発した。
原題: Stochastic Decision Horizons for Constrained Reinforcement Learning / Nikola Milosevic, Leonard Franz, Daniel Haeufle 他
日本語で読む → - 論文医療AI/ワールドモデルAI
EHRWorld: 長期的な臨床経過をシミュレートする患者中心の医療ワールドモデル
電子カルテから構築した大規模縦断データセットEHRWorld-110Kを用い、因果的逐次パラダイムで訓練した患者中心の医療ワールドモデルEHRWorldを提案し、長期的な臨床シミュレーションの安定性と精度を向上させた。
原題: EHRWorld: A Patient-Centric Medical World Model for Long-Horizon Clinical Trajectories / Linjie Mu, Zhongzhen Huang, Yannian Gu 他
日本語で読む → - 論文モデルベース強化学習機械学習
再パラメータ化フローポリシー最適化
フローポリシーをモデルベース強化学習に組み込み、生成過程とダイナミクスをまとめて誤差逆伝播することで、高いサンプル効率と安定性を実現した手法を提案。
原題: Reparameterization Flow Policy Optimization / Hai Zhong, Zhuoran Li, Xun Wang 他
日本語で読む → - 論文世界モデル機械学習
行動条件付き予測系列ネットワークに現れる経路統合と物体位置の結合
リカレントネットワークが2次元のトークンシーンを走査し次のトークンを予測する課題を学習し、経路統合やトークンと位置の動的結合が創発することを示した。
原題: Path Integration and Object-Location Binding Emerge in an Action-Conditioned Predictive Sequence Network / Linda Ariel Ventura, Victoria Bosch, Tim C Kietzmann 他
日本語で読む → - 論文強化学習機械学習
選択モデル支援Q学習による遅延フィードバック収益管理
遅延フィードバックのある収益管理において、較正済み離散選択モデルを部分的世界モデルとして用いて学習目標の遅延成分を補完するQ学習を提案し、理論的収束保証とホテル予約データに基づく実験で有効性と限界を示した。
原題: Choice-Model-Assisted Q-learning for Delayed-Feedback Revenue Management / Owen Shen, Patrick Jaillet
日本語で読む → - 論文モデル量子化機械学習
ワールドモデルの量子化に関する実証研究
DINO-WMを例に、ワールドモデルの学習後量子化(PTQ)を体系的に評価し、低ビット化が計画性能やモジュール間の感度に与える影響を明らかにした。
原題: An Empirical Study of World Model Quantization / Zhongqian Fu, Tianyi Zhao, Kai Han 他
日本語で読む → - 論文安全性/エージェント自然言語
SafePred: 世界モデルによるコンピュータ操作エージェントの予測型ガードレール
コンピュータ操作エージェントの長期的リスクを事前に予測するため、世界モデルで将来の危険状態を推定し、現在の行動選択を安全な方向へ誘導する予測型ガードレールを提案した論文。
原題: SafePred: A Predictive Guardrail for Computer-Using Agents via World Models / Yurun Chen, Zeyi Liao, Ping Yin 他
日本語で読む → - 論文ワールドモデル機械学習
生成的可視コードによるモバイルワールドモデル
単一のVLMが次のGUI状態を実行可能なWebコードとして予測し、それをレンダリングすることで高忠実度なモバイルGUIワールドモデルを実現した研究。
原題: Generative Visual Code Mobile World Models / Woosung Koh, Sungjun Han, Segyu Lee 他
日本語で読む → - 論文ワールドモデル機械学習
ワールドモデルによるニューラルセイバーメトリクス:大規模言語モデルを用いたプレー・バイ・プレー予測モデリング
MLBの10年以上のトラッキングデータでLLMを継続事前学習し、野球のプレー・バイ・プレーを予測するワールドモデルを構築した研究。
原題: Neural Sabermetrics with World Model: Play-by-play Predictive Modeling with Large Language Model / Young Jin Ahn, Yiyang Du, Zheyuan Zhang 他
日本語で読む → - 論文自己教師あり学習機械学習
構造的不変性からの自己教師あり学習
自己教師あり学習における一対多写像問題に対処するため、潜在変数を導入し変分下界を導出。AdaSSLを提案し、因果表現学習や動画世界モデルで有効性を示した。
原題: Self-Supervised Learning from Structural Invariance / Yipeng Zhang, Hafez Ghaemi, Jungyoon Lee 他
日本語で読む → - 論文VLA機械学習
世界モデルによる実行可能な計画への生成動画のグラウンディング
生成動画を計画として使う際の物理的・時間的な不整合を、学習した行動条件付き世界モデルで潜在空間の軌道最適化により実行可能な行動列へ変換する手法を提案。
原題: Grounding Generated Videos in Feasible Plans via World Models / Christos Ziakas, Amir Bar, Alessandra Russo
日本語で読む → - 論文ゼロショット強化学習機械学習
ゼロショットオフポリシー学習
後継測度と定常密度比の理論的関連を利用し、報酬なしデータで訓練したエージェントがテスト時に追加学習なしで新タスクに適応できるゼロショット強化学習手法を提案。
原題: Zero-Shot Off-Policy Learning / Arip Asadulaev, Maksim Bobrin, Salem Lahlou 他
日本語で読む → - 論文強化学習機械学習
階層的ニューラルオプションと抽象世界モデルの同時学習
抽象世界モデルと階層的ニューラルオプションを同時に学習するAgentOWLを提案し、少ないデータでより多くのスキルを獲得できることを示した。
原題: Joint Learning of Hierarchical Neural Options and Abstract World Model / Wasu Top Piriyakulkij, Wolfgang Lehrach, Kevin Ellis 他
日本語で読む → - 論文VLAロボティクス
BusyBox:視覚言語行動モデルのアフォーダンス汎化を評価する物理ベンチマーク
スイッチやスライダーなど6モジュールを交換・回転できる物理ベンチマークBusyBoxを提案し、強いVLAモデルでも見た目が変わるとアフォーダンス汎化が難しいことを実証した。
原題: Benchmarking Affordance Generalization with BusyBox / Dean Fortier, Timothy Adamson, Tess Hellebrekers 他
日本語で読む → - 論文自動運転/軌道生成画像認識
MeanFuser: MeanFlowによる高速ワンショット多様体軌道生成と適応的再構成を用いたエンドツーエンド自動運転
ガウス混合ノイズとMeanFlowを組み合わせ、離散アンカーに依存せず高速かつロバストに軌道を生成するエンドツーエンド自動運転手法を提案。
原題: MeanFuser: Fast One-Step Multi-Modal Trajectory Generation and Adaptive Reconstruction via MeanFlow for End-to-End Autonomous Driving / Junli Wang, Yinan Zheng, Xueyi Liu 他
日本語で読む → - 論文VLAcs.SE
自律型水中ロボットソフトウェアの知覚における視覚言語モデルの評価
自律型水中ロボットの知覚モジュールに視覚言語モデルを適用し、水中ゴミ検出における性能と不確実性を評価した。
原題: Assessing Vision-Language Models for Perception in Autonomous Underwater Robotic Software / Muhammad Yousaf, Aitor Arrieta, Shaukat Ali 他
日本語で読む → - 論文3Dマッピングロボティクス
LatentAM: オンライン辞書学習によるリアルタイム大規模潜在ガウシアンアテンションマッピング
ストリーミングRGB-D観測からスケーラブルな潜在特徴マップを構築するオンライン3Dガウシアンスプラッティングフレームワークを提案。モデル非依存のオンライン辞書学習により、テスト時に様々なVLMとプラグアンドプレイで統合可能。
原題: LatentAM: Real-Time, Large-Scale Latent Gaussian Attention Mapping via Online Dictionary Learning / Junwoon Lee, Yulun Tian
日本語で読む → - 論文HRIロボティクス
没入型XRを用いた人間-ロボット相互作用研究の10年レビュー
2015〜2025年の社会ロボティクス研究を系統的にレビューし、XRが研究手段として十分活用されていない現状と課題を整理した。
原題: A Decade of Human-Robot Interaction Through Immersive Lenses: Reviewing Extended Reality as a Research Instrument in Social Robotics / André Helgert, Carolin Straßmann, Sabrina C. Eimler
日本語で読む → - 論文マニピュレーションロボティクス
DexEvolve: 進化的最適化によるロバストで多様な器用把持の合成
解析的に生成した把持候補を高忠実度シミュレータ上で非同期・勾配不要の進化的アルゴリズムにより改良し、多様で物理的に実行可能な把持を大規模合成する手法を提案。改良後の分布を拡散モデルに蒸留し実機展開を可能にした。
原題: DexEvolve: Evolutionary Optimization for Robust and Diverse Dexterous Grasp Synthesis / René Zurbrügg, Andrei Cramariuc, Marco Hutter
日本語で読む → - 論文マルチエージェント強化学習ロボティクス
Co-jump: 四足歩行ロボットのマルチエージェント強化学習による協調ジャンプ
2台の四足歩行ロボットが通信なしに同期して、単体では不可能な高さのジャンプを実現する協調制御を、マルチエージェント強化学習とカリキュラム学習で獲得した。
原題: Co-jump: Cooperative Jumping with Quadrupedal Robots via Multi-Agent Reinforcement Learning / Shihao Dong, Yeke Chen, Zeren Luo 他
日本語で読む → - 論文UAV意思決定/LLM制御/安全検証ロボティクス
SAGE-LLM:ファジィCBF検証とグラフ構造知識検索による安全で汎用性の高いUAV意思決定LLMコントローラ
UAVの動的意思決定において、LLMの出力をファジィ制御バリア関数で検証し、グラフ構造の知識検索でシーン適応を強化する、訓練不要の二層意思決定アーキテクチャを提案した。追跡・回避シナリオで安全性と汎化性能の向上を実証している。
原題: SAGE-LLM: Towards Safe and Generalizable LLM Controller with Fuzzy-CBF Verification and Graph-Structured Knowledge Retrieval for UAV Decision / Wenzhe Zhao, Yang Zhao, Ganchao Liu 他
日本語で読む → - 論文制御理論ロボティクス
学習されたラグランジュ潜在ダイナミクスの低次元制御と幾何学的構造
高次元ラグランジュ系に対し、構造保存型の低次元潜在ダイナミクスを学習し、その上で追従制御則を導出。安定性・収束性の解釈可能な条件を示し、劣駆動系にも拡張した。
原題: Reduced-order Control and Geometric Structure of Learned Lagrangian Latent Dynamics / Katharina Friedl, Noémie Jaquier, Seungyeon Kim 他
日本語で読む → - 論文経路計画ロボティクス
マルチ解像度3Dグリッド上での効率的な階層的任意角度経路計画
マルチ解像度の3Dボリュームマップを活用し、任意角度経路計画の最適性と完全性を保ちつつ計算効率を大幅に改善する手法を提案。実環境と合成環境での実験でサンプリングベース手法を上回る性能を示し、オープンソース化した。
原題: Efficient Hierarchical Any-Angle Path Planning on Multi-Resolution 3D Grids / Victor Reijgwart, Cesar Cadena, Roland Siegwart 他
日本語で読む → - 論文ソフトロボティクス/アート/感情認識ロボティクス
人間の感情を媒介としたソフトロボティクスアート:感情・ソフトロボティクス・芸術の交差点の探求
脳波のアルファ波から人間の感情を推定し、それをソフトロボットのキャラクターと花の動きにマッピングすることで、感情に反応する新しいソフトロボティクスアートを提案・実証した。
原題: Human Emotion-Mediated Soft Robotic Arts: Exploring the Intersection of Human Emotions, Soft Robotics and Arts / Saitarun Nadipineni, Chenhao Hong, Tanishtha Ramlall 他
日本語で読む → - 論文ナビゲーションロボティクス
OVerSeeC: 衛星画像と自然言語からのオープンボキャブラリ・コストマップ生成
衛星画像と自然言語の指示から、LLMとオープンボキャブラリ・セグメンテーションを組み合わせて、未知の地形やミッション固有の走行ルールに対応した実行可能なコストマップをゼロショットで生成するフレームワーク。
原題: OVerSeeC: Open-Vocabulary Costmap Generation from Satellite Images and Natural Language / Rwik Rana, Jesse Quattrociocchi, Dongmyeong Lee 他
日本語で読む → - 論文全身制御ロボティクス
事前学習と高速適応による汎用人型全身制御
人型ロボットの全身制御を、事前学習したポリシーに軽量な残差ポリシーを高速適応させることで、未知の動作にも安定して追従できるフレームワークFASTを提案した。
原題: General Humanoid Whole-Body Control via Pretraining and Fast Adaptation / Zepeng Wang, Jiangxing Wang, Shiqing Yao 他
日本語で読む → - 論文イベントカメラ/動作セグメンテーション画像認識
イベントカメラの法線フローを用いたリアルタイム動作セグメンテーション
イベントカメラの法線フローを中間表現として用い、グラフカットによるエネルギー最小化で動作セグメンテーションをリアルタイムに実行するフレームワークを提案した。
原題: Real-time Motion Segmentation with Event-based Normal Flow / Sheng Zhong, Zhongyang Ren, Xiya Zhu 他
日本語で読む →