論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文強化学習機械学習
分位点結合フローマッチングによる分布強化学習
分布強化学習における条件付きフローマッチング批判器の損失がワッサーシュタイン距離と整合しない問題を解決するため、ソースとベルマン目標サンプルを分位点で整列させるFlowIQNを提案した。
原題: Quantile-Coupled Flow Matching for Distributional Reinforcement Learning / Michael Groom, Victor-Alexandru Darvariu, Lars Kunze 他
日本語で読む → - 論文視覚サーボロボティクス
カルマンフィルタによるモーメント損失補償を備えたUAVの画像ベース視覚サーボのための終端拘束モデル予測制御
UAVの画像ベース視覚サーボにおいて、終端拘束を導入したモデル予測制御とカルマンフィルタによる視覚特徴の予測を組み合わせ、入力・状態制約下での安定性と視覚情報欠落時の制御継続性を実現した。
原題: Terminal Constraint Model Predictive Control for Image-Based Visual Servoing of UAVs with Kalman Filter-Based Moment Loss Compensation / X. Wang, Y. Cao, W. L. W. Leong 他
日本語で読む → - 論文触覚ロボティクス
InvariantCloud: ロバストな6自由度触覚ポーズ追跡のための大域不変・一意インデックス点群フレームワーク
視覚ベース触覚センサの表面マーカー配置の大域不変性を利用し、累積ドリフトを抑えつつヨー回転推定を高精度化する6自由度ポーズ推定フレームワークを提案した。
原題: InvariantCloud: A Globally Invariant, Uniquely Indexed Point Cloud Framework for Robust 6-DoF Tactile Pose Tracking / Pengfei Ye, Yuxiang Ma, Yi Zhou 他
日本語で読む → - 論文歩行ロボティクス
モータ熱安全性と四脚歩行性能のバランスを学習する残差ポリシー
四脚ロボットのモータ過熱を防ぐため、熱モデルを強化学習に組み込み、通常ポリシーに熱状態に応じた補正を行う残差ポリシーを追加する二段階学習を提案。実機で13分以上の安定歩行を実証した。
原題: Learning to Balance Motor Thermal Safety and Quadrupedal Locomotion Performance with Residual Policy / Yuhang Wan, Weixian Lin, Letian Qian 他
日本語で読む → - 論文3次元復元画像認識
TriP: 三角形パズルによる頑健な並進平均化手法
カメラ位置復元のための並進平均化問題に対し、三角形の幾何から局所スケールを推定し、対数領域で同期させることで、外れ値に頑健で高精度な解法を提案した。
原題: TriP: A Triangle Puzzle Approach to Robust Translation Averaging / Zhekai Fan, Wanze Li, Jinxin Wang 他
日本語で読む → - 論文医療用ロボット/カテーテルロボティクス
磁気駆動カテーテルの集中曲げのための剛性最適化:勾配剛性下での操舵性維持
磁気駆動ソフトカテーテルにおいて、推進力伝達と近位集中曲げの両立を目指し、剛性分布を最適化した多セグメントカテーテルを提案。実験で安定した曲げと直進前進を実証した。
原題: Stiffness Optimization for Concentrated Bending in Magnetically Actuated Catheters: Maintaining Steerability under Gradient Stiffness / Jiewen Tan, Junnan Xue, Shing Shin Cheng 他
日本語で読む → - 論文群制御AI
ミッションを伝えれば群れが動く:Web-of-Dronesにおけるエージェント強化LLM推論
自然言語でミッションを指示するとUAV群が自律実行する、LLMベースの群制御フレームワークを提案・評価した論文。
原題: Say the Mission, Execute the Swarm: Agent-Enhanced LLM Reasoning in the Web-of-Drones / Andrea Iannoli, Lorenzo Gigli, Luca Sciullo 他
日本語で読む → - 論文遠隔操作ロボティクス
IMUモーションキャプチャによる人型ロボットのリアルタイム全身遠隔操作:Sim2SimとSim2Real検証
IMUベースのモーションキャプチャスーツで計測した人間の動作をUnitree G1人型ロボットに直接マッピングし、オフライン処理や学習を用いずに低遅延で全身遠隔操作するシステムを構築。シミュレーションと実機の両方で安定した動作再現を実証した。
原題: Real-Time Whole-Body Teleoperation of a Humanoid Robot Using IMU-Based Motion Capture with Sim2Sim and Sim2Real Validation / Hamza Ahmed Durrani, Suleman Khan
日本語で読む → - 論文逆強化学習機械学習
信頼領域逆強化学習:局所方策更新を用いた明示的双対上昇法
逆強化学習において、毎回RL問題を完全に解くことなく、信頼領域制約付きの局所更新で双対目的を明示的に最適化する手法を提案し、安定性と単調改善を両立した。
原題: Trust Region Inverse Reinforcement Learning: Explicit Dual Ascent using Local Policy Updates / Anish Diwan, Davide Tateo, Christopher E. Mower 他
日本語で読む → - 論文VLA解釈可能性ロボティクス
イベント基盤のスパースオートエンコーダによる視覚言語行動ポリシーの解釈
視覚言語行動(VLA)ポリシーの隠れ表現を、行動イベントに基づいてスパースオートエンコーダ(SAE)で分析し、閉ループ行動への因果効果を評価する解釈可能性パイプラインを提案した。
原題: Event-Grounded Sparse Autoencoders for Vision-Language-Action Policies / Xinchen Jin, Aditya Chatterjee, Pranav Kumar 他
日本語で読む → - 論文空中マニピュレーションロボティクス
空中マニピュレーションのためのクロスカップリングとレジーム依存ダイナミクスの学習
空中マニピュレータの残差ダイナミクスを適応的に学習する構造化エンコーダ・デコーダフレームワークを提案し、実機実験で予測精度とMPC追従性能を向上させた。
原題: Learning Cross-Coupled and Regime Dependent Dynamics for Aerial Manipulation / Rishabh Dev Yadav, Samaksh Ujjawal, Sihao Sun 他
日本語で読む → - 論文対称性/ロボット学習ロボティクス
ここにもあそこにも対称性、組み合わせてどこにでも:ロボティクスにおけるクロス空間対称性合成
ロボットの構造とタスクに由来する複数の対称性を同時に活用するためのフレームワークを提案し、双腕ロボットの実験で汎化性能の向上を示した。
原題: Symmetries Here and There, Combined Everywhere: Cross-space Symmetry Compositions in Robotics / Loizos Hadjiloizou, Rodrigo Pérez-Dattari, Noémie Jaquier
日本語で読む → - 論文自動運転/交通行動ロボティクス
自動運転車と人間運転車に対する割り込み許容ギャップの差異:Waymoオープンモーションデータセットからの証拠
Waymoの実世界高速道路データを用いて、人間ドライバーが自動運転車の前では人間運転車の前よりも短い車間距離で割り込む傾向があることを統計的に示した論文。
原題: Cut-In Gap Acceptance Toward Autonomous vs. Human-Driven Vehicles: Evidence from the Waymo Open Motion Dataset / Abdulaziz Alhuraish, Yuhang Wang, Hao Zhou
日本語で読む → - 論文VLAロボティクス
ECHO: 視覚言語行動モデルのための連続階層メモリ
長期的な操作タスクにおけるVLAモデルの性能を向上させるため、経験を階層的に整理する連続メモリフレームワークECHOを提案。双曲オートエンコーダでメモリを木構造に組織化し、効率的な検索と合成を実現。
原題: ECHO: Continuous Hierarchical Memory for Vision-Language-Action Models / Yanbin Hu, Jin Cui, Jiayi Lu 他
日本語で読む → - 論文3D再構成画像認識
IVGT: 暗黙的視覚幾何トランスフォーマーによるニューラルシーン表現
カメラポーズが未知の多視点画像から、連続的で一貫した3D幾何と外観を暗黙的にモデル化する手法を提案。SDFと色を予測する軽量デコーダを用いて、任意の3D位置での空間クエリを可能にし、メッシュ再構成や新規視点合成など多様なタスクで高い性能を示した。
原題: IVGT: Implicit Visual Geometry Transformer for Neural Scene Representation / Yuqi Wu, Tianyu Hu, Wenzhao Zheng 他
日本語で読む → - 論文物体検出画像認識
RT-DETRにおけるResNetバックボーンのベンチマーク:環境条件下での深さと正則化の影響
競技ロボティクス向けに、RT-DETRで円形物体検出を行う際、ResNetバックボーンの深さとドロップアウト率が照明や背景の変化にどう影響するかを比較評価した論文。
原題: Benchmarking ResNet Backbones in RT-DETR: Impact of Depth and Regularization under environmental conditions / Pamela Barboza, Víctor Castelli, Belén Pereira 他
日本語で読む → - 論文プラズマ制御ロボティクス
任意センサーサブセットによる動的プラズマ形状制御
トカマクのプラズマ形状制御を強化学習で行い、センサー故障に頑健で動的な形状追従を実現した。
原題: Dynamic Plasma Shape Control with Arbitrary Sensor Subsets / D. Sorokin, M. Stokolesov, A. Granovskiy 他
日本語で読む → - 論文自動運転/安全性検証ロボティクス
自動運転車両テストのための責任帰属型敵対的シナリオ学習
自動運転システムの安全性検証において、衝突がシステムの欠陥によるものか交通上の不可避な衝突かを区別するため、責任帰属を敵対的シナリオ生成に組み込んだフレームワークCARSを提案した。
原題: Learning Responsibility-Attributed Adversarial Scenarios for Testing Autonomous Vehicles / Yizhuo Xiao, Haotian Yan, Ying Wang 他
日本語で読む → - 論文VLAロボティクス
ConsisVLA-4D:ロボット操作のための効率的な3D知覚と4D推論における時空間一貫性の向上
本論文は、ロボット操作のための視覚言語行動モデルにおいて、3D知覚と4D推論の時空間一貫性を向上させる統一フレームワークConsisVLA-4Dを提案する。
原題: ConsisVLA-4D: Advancing Spatiotemporal Consistency in Efficient 3D-Perception and 4D-Reasoning for Robotic Manipulation / Wei Li, Jizhihui Liu, Li Yixing 他
日本語で読む → - 論文安全性ロボティクス
TAIL-Safe: 模倣学習ポリシーのためのタスク非依存な安全監視
模倣学習ポリシーが安全に動作できる状態の集合を学習し、逸脱時に回復動作を行う安全監視手法を提案した論文。
原題: TAIL-Safe: Task-Agnostic Safety Monitoring for Imitation Learning Policies / Riad Ahmed, Momotaz Begum
日本語で読む → - 論文sim2realロボティクス
ゼロショットSim-to-Realロボット学習:リアクティブキャッチングにおける巧みな操作の研究
ドメインランダム化の新しい手法DRISを提案し、複数のランダム化インスタンスを同時に扱うことでロボットのポリシーを強化し、ゼロショットでの実機転送を実現した。
原題: Zero-Shot Sim-to-Real Robot Learning: A Dexterous Manipulation Study on Reactive Catching / Kejia Ren, Gaotian Wang, Andrew S. Morgan 他
日本語で読む → - 論文システムアーキテクチャロボティクス
Jiao: 混合臨界性ロボティクスにおける隔離とカスタマイゼーションの橋渡し
安全制御とユーザーアプリを共有マルチコアで統合する際、エンドユーザーがシステム知識なしにロボットを変更できるよう、ハードウェア隔離とパラメータ同期を組み合わせたアーキテクチャを提案し、ジッタを大幅に削減した。
原題: Jiao: Bridging Isolation and Customization in Mixed Criticality Robotics / James Yen, Zhibai Huang, Zhixiang Wei 他
日本語で読む → - 論文歩行ロボティクス
内在ダイナミクスヘッドによる四足歩行の動力学認識型制御
四足歩行ロボットの制御ポリシーに、状態からトルクへの動力学を学習するヘッドを併設し、その予測性に基づく報酬でより効率的で滑らかな歩行を実現する訓練フレームワークを提案した。シミュレーションと実機で効果を検証し、トルク効率や動作率などの改善を確認した。
原題: Dynamics Aware Quadrupedal Locomotion via Intrinsic Dynamics Head / Aman Arora, Nalini Ratha
日本語で読む → - 論文自動運転/リスクマップロボティクス
部分観測環境における自動運転のための統合リスクマップ学習
自動運転における遮蔽によるリスクを、交通流リスクと衝突リスクを統合したリスクマップとしてモデル化・学習し、拡散モデルによる敵対的シナリオ生成も組み合わせて、部分観測下でのリスク認識計画を実現した。
原題: Learning A Unified Risk Map for Autonomous Driving in Partially Observable Environments / Jie Jia, Yaofeng Su, Zeyu Bao 他
日本語で読む → - 論文VLAロボティクス
「イエスマン症候群」:身体化ロボットエージェントにおける棄権のベンチマーキング
身体化ロボットのための視覚言語モデルが、曖昧・物理的に不可能・誤った前提に基づく指示を認識して棄権する能力を評価するベンチマーク「RoboAbstention」を提案した。
原題: The Yes-Man Syndrome: Benchmarking Abstention in Embodied Robotic Agents / Doguhan Yeke, Elif Su Temirel, Ananth Shreekumar 他
日本語で読む → - 論文ナビゲーションロボティクス
言語から論理へ:VLMに基づく安全ナビゲーションのための理論的アーキテクチャ
自然言語の安全規則をSignal Temporal Logic (STL)仕様に変換し、Vision-Language Models (VLMs)を用いて屋外環境での自律ナビゲーションを安全に導く理論的アーキテクチャを提案した。
原題: From Language to Logic: A Theoretical Architecture for VLM-Grounded Safe Navigation / Kristy Sakano, Kalonji Harrington, Mumu Xu
日本語で読む → - 論文ロボティクス/物理情報NNロボティクス
同心チューブロボットの形状再構成のための少数ショット物理情報ニューラルネットワーク
Cosseratロッド方程式を組み込んだ物理情報ニューラルネットワーク(PINN)を用いて、少数の観測データから6自由度の同心チューブロボットの形状やねじれなどの運動学的状態を高精度に推定する手法を提案した。
原題: Few-Shot Physics-Informed Neural Network for Shape Reconstruction of Concentric-Tube Robots / Navid Feizi, Filipe C. Pedrosa, Rajni V. Patel 他
日本語で読む → - 論文安全性ロボティクス
実行するか否か:デモから学習した視覚運動ポリシーの安全性の確保
模倣学習で学習した視覚運動ポリシーに対し、状態空間内の特定領域から実行保証を提供する安全指標を提案し、Nagumoの条件を用いて安全性を検証する手法を実証した。
原題: To Do or Not to Do: Ensuring the Safety of Visuomotor Policies Learned from Demonstrations / Riad Ahmed, Moniruzzaman Akash, Momotaz Begum
日本語で読む → - 論文遠隔操作ロボティクス
視覚ベース遠隔操作のための生成的予測ディスプレイに向けて:既製ビデオモデルのゼロショットベンチマーク
通信遅延による遠隔操作の性能低下を補うため、既製の生成ビデオモデルをゼロショットで用いた短期的な未来フレーム予測のベンチマークを実施し、現状のモデルでは低誤差・非発散・リアルタイム性を同時に満たせないことを示した。
原題: Towards Generative Predictive Display for Vision-Based Teleoperation: A Zero-Shot Benchmark of Off-the-Shelf Video Models / Aws Khalil, Jaerock Kwon
日本語で読む → - 論文歩行ロボティクス
コンプライアント足部を備えた4脚ロボットのエネルギー効率的な歩行
4脚ロボットの足にバネなどの柔軟性を持たせ、強化学習で歩行制御を学習させたところ、適度な硬さのバネがエネルギー消費を約17%削減できることをシミュレーションと実機で示した論文。
原題: Energy-Efficient Quadruped Locomotion with Compliant Feet / Pramod Pal, Shishir Kolathaya, Ashitava Ghosal
日本語で読む →