論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文物理推論/LLM/強化学習機械学習
物理シミュレータ上での強化学習による物理オリンピック問題解決
物理シミュレータでランダムなシーンを生成し、合成の問答データを作ってLLMを強化学習で訓練し、実世界の物理ベンチマーク(IPhOなど)へのゼロショット転移を実証した論文。
原題: Solving Physics Olympiad via Reinforcement Learning on Physics Simulators / Mihir Prabhudesai, Aryan Satpathy, Yangmin Li 他
日本語で読む → - 論文群制御ロボティクス
音響浮揚ロボット群のためのジェスチャベース視覚学習モデル
ESP32-CAMとOpenCLIPを用いて手のジェスチャを認識し、音響浮揚ロボット群の触覚・音声・浮揚モダリティを切り替える直感的なインターフェースを提案した。
原題: A Gesture-Based Visual Learning Model for Acoustophoretic Interactions using a Swarm of AcoustoBots / Alex Lin, Lei Gao, Narsimlu Kemsaram 他
日本語で読む → - 論文ナビゲーションロボティクス
実世界学習に向けた漸進的残差強化学習による社会的ナビゲーション
エッジデバイス上で軽量に動作する漸進的残差強化学習(IRRL)を提案し、シミュレーションと実世界実験で未知環境への適応を実証した。
原題: Incremental Residual Reinforcement Learning Toward Real-World Learning for Social Navigation / Haruto Nagahisa, Kohei Matsumoto, Yuki Tomita 他
日本語で読む → - 論文連続体ロボット/適応制御ロボティクス
閉ループ協調型連続体ロボットのためのリアルタイム投影適応制御
複数の連続体アームが柔軟物体を把持して協調する閉ループ系に対し、未知パラメータをオンライン推定する適応制御を提案し、シミュレーションと実験で有効性を示した。
原題: Real-Time Projected Adaptive Control for Closed-Chain Co-Manipulative Continuum Robots / Rana Danesh, Farrokh Janabi-Sharifi, Farhad Aghili
日本語で読む → - 論文ナビゲーションロボティクス
MRReP: モバイルロボットナビゲーションのためのMRベース手描き参照経路編集インターフェース
MR環境でユーザーが手のジェスチャーで床に直接経路を描き、その経路をロボットのナビゲーションに反映させるインターフェースを提案し、従来の2Dインターフェースと比較して精度・操作性・負担の改善を実証した。
原題: MRReP: Mixed Reality-based Hand-drawn Reference Path Editing Interface for Mobile Robot Navigation / Takumi Taki, Masato Kobayashi, Yuki Uranishi
日本語で読む → - 論文群制御ロボティクス
COMB: ミツバチのための共通オープンモジュール型ロボットプラットフォーム
標準的な観察巣箱フレーム内で動作する、コンパクトでオープンソースのモジュール式メカトロニクスプラットフォームを提案し、生きたミツバチの巣内実験を可能にする。
原題: COMB: Common Open Modular robotic platform for Bees / Pranav Kedia, Marie Messerich, Tim Landgraf
日本語で読む → - 論文VLA/推論高速化画像認識
VLA-InfoEntropy: 学習不要の視覚注意情報エントロピーによるVLAモデルの推論高速化と成功率向上
視覚言語行動(VLA)モデルの推論を高速化するため、画像エントロピーと注意エントロピーを用いて重要領域を動的に選択し、冗長な視覚情報を削減する手法を提案した。
原題: VLA-InfoEntropy: A Training-Free Vision-Attention Information Entropy Approach for Vision-Language-Action Models Inference Acceleration and Success / Chuhang Liu, Yayun He, Zuheng Kang 他
日本語で読む → - 論文模倣学習ロボティクス
ロボットの文脈内模倣学習のための階層的時空間アクショントークナイザ
階層的なベクトル量子化と時空間情報を利用した新しいアクショントークナイザを提案し、模倣学習の性能を向上させた。
原題: A Hierarchical Spatiotemporal Action Tokenizer for In-Context Imitation Learning in Robotics / Fawad Javed Fateh, Ali Shah Ali, Murad Popattia 他
日本語で読む → - 論文模倣学習ロボティクス
HiPolicy: 階層型マルチ周波数アクションチャンキングによるポリシー学習
ロボットの模倣学習において、長期的な依存関係のモデリングと細かい閉ループ制御のトレードオフを解決するため、異なる周波数でアクション系列を予測する階層型マルチ周波数アクションチャンキングフレームワークを提案した。
原題: HiPolicy: Hierarchical Multi-Frequency Action Chunking for Policy Learning / Jiyao Zhang, Zimu Han, Junhan Wang 他
日本語で読む → - 論文歩行ロボティクス
選択的敵対的動作事前分布を用いたヒューマノイドロボットのマルチ歩容学習
ヒューマノイドロボットが歩行、行進、走行、階段昇降、跳躍の5つの歩容を統一的な強化学習フレームワークで習得する手法を提案。安定性重視の歩容にはAMPを適用し、動的歩容には適用しない選択的AMP戦略により、全歩容で性能が向上することを示した。
原題: Multi-Gait Learning for Humanoid Robots Using Reinforcement Learning with Selective Adversarial Motion Prior / Yuanye Wu, Keyi Wang, Linqi Ye 他
日本語で読む → - 論文自動運転/セキュリティロボティクス
クラウド支援自動運転システムの敵対的ロバスト性解析
クラウド支援自動運転の脆弱性を評価するため、実時間認識・制御・通信を統合したハードウェアインザループテストベッドを構築し、敵対的攻撃とネットワーク障害が認識性能と制御安定性に与える影響を分析した。
原題: Adversarial Robustness Analysis of Cloud-Assisted Autonomous Driving Systems / Maher Al Islam, Amr S. El-Wakeel
日本語で読む → - 論文生体信号推定ロボティクス
GEGLU-TransformerによるIMUからEMGへの推定と少数ショット適応
ウェアラブルロボティクス向けに、慣性計測ユニット(IMU)から筋電図(EMG)の筋活動包絡線を推定する適応的学習フレームワークを提案。TransformerエンコーダとGEGLU活性化関数を組み合わせ、被験者間の一般化と迅速な個人適応を実現した。
原題: GEGLU-Transformer for IMU-to-EMG Estimation with Few-Shot Adaptation / Miroljub Mihailovic, Luca Tonin, Stefano Tortora 他
日本語で読む → - 論文動作計画ロボティクス
フローモーションポリシー:フローマッチングモデルを用いたマニピュレータの動作計画
フローマッチングの生成モデルを用いて、マニピュレータの動作計画をオープンループで行うニューラルプランナーを提案。複数の候補経路を生成し、衝突判定後に最初の安全な経路を実行することで成功率と効率を向上させた。
原題: Flow Motion Policy: Manipulator Motion Planning with Flow Matching Models / Davood Soleymanzadeh, Xiao Liang, Minghui Zheng
日本語で読む → - 論文制御理論制御
ベクトル量子化による最小情報制御不変性
安全な制御に必要な最小の制御信号数を学習するベクトル量子化オートエンコーダを提案し、12次元クアッドローターでコードブックサイズを157倍削減しつつ不変性を維持することを示した。
原題: Minimal Information Control Invariance via Vector Quantization / Ege Yuceel, Teodor Tchalakov, Sayan Mitra
日本語で読む → - 論文ワールドモデルロボティクス
形態条件付けによるハードウェア非依存の四足歩行ワールドモデルに向けて
四足歩行ロボットのワールドモデルを、ロボットの形態情報を明示的に条件付けすることで、異なるハードウェア間でゼロショット汎化可能にする手法を提案した論文。
原題: Toward Hardware-Agnostic Quadrupedal World Models via Morphology Conditioning / Mohamad H. Danesh, Chenhao Li, Amin Abyaneh 他
日本語で読む → - 論文VLA/操作ロボティクス
SpatialVAM: 空間認識型マルチビュービデオ拡散によるデータ効率的なロボットポリシー
3D空間構造と時間変化を同時に捉えるため、空間認識型のマルチビューヒートマップビデオとRGBビデオを生成する初の3Dビデオ行動モデルを提案し、少数のデモで汎用的な操作を実現した。
原題: SpatialVAM:Spatial-Aware Multi-View Video Diffusion as a Data-Efficient Robot Policy / Peiyan Li, Yixiang Chen, Yuan Xu 他
日本語で読む → - 論文車両力学physics.soc-ph
古典的な車両力学における一般的な誤解について
古典的な車両力学で広く受け入れられている誤解を再検討し、その妥当性の範囲を明確にして、より正確な解釈を促す論文。
原題: On Common Misconceptions in Classical Vehicle Dynamics / Massimo Guiggiani
日本語で読む → - 論文SLAMロボティクス
GaussianFlow SLAM: GaussianFlowによる単眼ガウススプラッティングSLAM
単眼カメラからのSLAMにおいて、オプティカルフローを幾何学的な手がかりとして用い、ガウススプラッティングのマップ表現とカメラ姿勢の最適化をガイドする手法を提案。
原題: GaussianFlow SLAM: Monocular Gaussian Splatting SLAM Guided by GaussianFlow / Dong-Uk Seo, Jinwoo Jeon, Eungchang Mason Lee 他
日本語で読む → - 論文自動運転/インターフェース評価ロボティクス
外部人間機械インターフェースの評価方法の定義
自動運転車と他の道路利用者間のコミュニケーションを担う外部人間機械インターフェース(eHMI)を客観的に評価・比較するための、223項目からなる普遍的な評価方法を提案し、既存の4つの提案と運動学的動作のみのベースラインに適用してその有効性を示した論文。
原題: Defining an Evaluation Method for External Human-Machine Interfaces / Jose Gonzalez-Belmonte, Jaerock Kwon
日本語で読む → - 論文マニピュレーションロボティクス
ロボットマニピュレータの全身動的安全確保:CBFベース安全フィルタのための3Dポアソン安全関数
マニピュレータの全身衝突回避を、環境占有データからポアソン方程式を解いて単一の安全関数を合成し、実時間の安全フィルタで制約を課すことで実現する枠組みを提案した。
原題: Full-Body Dynamic Safety for Robot Manipulators: 3D Poisson Safety Functions for CBF-Based Safety Filters / Meg Wilkinson, Gilbert Bahati, Ryan M. Bena 他
日本語で読む → - 論文VLAロボティクス
マスク世界モデル:ロバストなロボット政策学習のための重要要素予測
動画生成事前学習に基づく世界モデルがロボット政策学習に有望だが、RGB予測は背景や照明などの無関係な要素に過適合しがち。本論文では、ピクセルではなくセマンティックマスクの進化を予測するマスク世界モデル(MWM)を提案し、幾何学的情報ボトルネックにより物理ダイナミクスと接触関係を捉えつつ視覚ノイズを除去。拡散ベースの政策ヘッドと統合し、LIBEROやRLBenchでSOTAを達成し、実世界実験でもロバスト性を示した。
原題: Mask World Model: Predicting What Matters for Robust Robot Policy Learning / Yunfan Lou, Xiaowei Chi, Xiaojie Zhang 他
日本語で読む → - 論文安全性ロボティクス
視覚言語行動の安全性:脅威、課題、評価、およびメカニズム
VLAモデルの安全性に関する包括的なサーベイを提供し、攻撃・防御・評価・展開の観点から脅威を整理した。
原題: Vision-Language-Action Safety: Threats, Challenges, Evaluations, and Mechanisms / Qi Li, Bo Yin, Weiqi Huang 他
日本語で読む → - 論文評価ベンチマークロボティクス
具現化エージェントシステムの統治・復旧・アップグレード安全性のためのベンチマーク
タスク成功率だけでなく、具現化AIシステムが能力境界を守り、ポリシーを強制し、安全に復旧し、監査可能で、人間の監視に応答するかなど、統治可能性を評価するベンチマークを提案した。
原題: EmbodiedGovBench: A Benchmark for Governance, Recovery, and Upgrade Safety in Embodied Agent Systems / Xue Qin, Simin Luan, John See 他
日本語で読む → - 論文群制御ロボティクス
PREVENT-JACK: 長尺連結重型車両群のためのコンテキストステアリング
長い連結重型車両(HAV)の群れを対象に、ジャックナイフ現象や衝突を防ぐ分散型制御手法を提案した。6つの局所行動を統合し、最大10台のトレーラーを持つ車両で検証し、デッドロックやライブロックの発生条件をシミュレーションで分析した。
原題: PREVENT-JACK: Context Steering for Swarms of Long Heavy Articulated Vehicles / Adrian Baruck, Michael Dubé, Christoph Steup 他
日本語で読む → - 論文オドメトリロボティクス
UNRIO: 不確実性を考慮したレーダー慣性オドメトリのための速度学習
生のmmWaveレーダーIQ信号から直接速度を推定する不確実性対応のレーダー慣性オドメトリシステムを提案し、従来の点群ベース手法より高精度を達成した。
原題: UNRIO: Uncertainty-Aware Velocity Learning for Radar-Inertial Odometry / Jui-Te Huang, Tinashu Huang, Anthony Rowe 他
日本語で読む → - 論文HRI/マルチエージェントロボティクス
M2HRI: LLM駆動のマルチモーダル・マルチエージェントフレームワークによるパーソナライズされた人機会話
各ロボットに個性と長期記憶を持たせ、文脈に応じた参加調整を行うマルチエージェントHRIフレームワークを提案し、ユーザー実験でその有効性を検証した。
原題: M2HRI: An LLM-Driven Multimodal Multi-Agent Framework for Personalized Human-Robot Interaction / Shaid Hasan, Breenice Lee, Sujan Sarker 他
日本語で読む → - 論文データセットロボティクス
場所カテゴリ分類のためのマルチモーダルパノラマ3D屋外データセット
森林、海岸、住宅地、都市部、駐車場などの場所カテゴリを分類するための、2種類のマルチモーダルなパノラマ3D屋外データセットを公開し、分類精度を比較した。
原題: Multi-modal panoramic 3D outdoor datasets for place categorization / Hojung Jung, Yuki Oto, Oscar M. Mozos 他
日本語で読む → - 論文群制御ロボティクス
異種ロボットチームのためのマルチエージェントPPOを用いた協調タスク・経路計画
異なる能力を持つロボット群による惑星探査任務を対象に、マルチエージェントPPOを用いてタスク割り当てと経路計画を協調的に行う学習ベースの手法を提案し、最適解との比較やオンライン再計画の性能を評価した。
原題: Collaborative Task and Path Planning for Heterogeneous Robotic Teams using Multi-Agent PPO / Matthias Rubio, Julia Richter, Hendrik Kolvenbach 他
日本語で読む → - 論文ナビゲーションロボティクス
迷走を止める:メタ認知推論による効率的な視覚言語ナビゲーション
基礎モデルを用いた訓練不要の視覚言語ナビゲーションエージェントに、空間記憶・履歴認識計画・反射的修正を統合したメタ認知機構を導入し、探索の停滞や冗長な再訪問を減らして効率と性能を向上させた。
原題: Stop Wandering: Efficient Vision-Language Navigation via Metacognitive Reasoning / Xueying Li, Feng Lyu, Hao Wu 他
日本語で読む → - 論文オフロード運転/軌道計画/VLMロボティクス
走行可能性の推論:言語誘導によるオフロード3D軌道計画
オフロード運転のための軌道計画において、視覚言語モデルと地形の幾何情報を組み合わせ、行動と整合した言語アノテーションと地形認識型の最適化手法を提案した。
原題: Reasoning About Traversability: Language-Guided Off-Road 3D Trajectory Planning / Byounggun Park, Soonmin Hwang
日本語で読む →