論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
WorldVLN: 空中視覚言語ナビゲーションのための自己回帰的世界行動モデル
空中VLNを予測駆動の世界行動問題として捉え、自己回帰ビデオバックボーンで世界状態遷移を予測し、実行可能なウェイポイント行動に直接デコードする初のモデルWorldVLNを提案。2段階訓練と強化学習により、ベンチマークで12%以上の成功率向上を達成し、実ドローンへのゼロショット転送も実証。
原題: WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation / Baining Zhao, Jiacheng Xu, Weicheng Feng 他
日本語で読む → - 論文VLA/強化学習機械学習
結果が分岐する箇所を学習する:確率的チャンクマスキングによる効率的なVLA強化学習
VLAポリシーの強化学習において、勾配計算が時間の大部分を占める問題に対し、軌道内で成功と失敗が分岐するフェーズのみに勾配計算を割り当てる確率的チャンクマスキング(PCM)を提案した。
原題: Learn Where Outcomes Diverge: Efficient VLA RL via Probabilistic Chunk Masking / Vaidehi Bagaria, Nikshep Grampurohit, Pulkit Verma
日本語で読む → - 論文模倣学習/手術支援ロボティクス
開腹手術におけるロボット支援のための模倣学習:縫合追従動作における複数ポリシーの評価
開腹手術での縫合補助動作(掴む・引く・離す)を対象に、4種類の模倣学習ポリシーを比較評価し、π0が最も高い性能とデータ効率を示した。
原題: Imitation Learning for Robot Assistance in Open Surgery: A Multi-Policy Evaluation on Suture Following / Xucheng Wang, Zhizhou Yang, Xiaoman Zhang 他
日本語で読む → - 論文群制御ロボティクス
マルチロボット持続監視における最悪ケース重み付き遅延の最小化:理論と強化学習に基づく解法
重み付きグラフ上でのマルチロボット持続監視問題を扱い、無限時間地平線での最悪ケース重み付き遅延を最小化する軌道設計を提案。尾部性能指標を導入し、強化学習を用いた解法とベンチマークを提供する。
原題: Minimizing Worst-Case Weighted Latency for Multi-Robot Persistent Monitoring: Theory and RL-Based Solutions / Weizhen Wang, Ziheng Wang, Jianping He 他
日本語で読む → - 論文マニピュレーションロボティクス
MonoDuo: 1本のロボットアームで両腕ポリシーを学習する
単腕ロボットのデモと人間の協調動作から、両腕ロボットの操作ポリシーを学習するフレームワークを提案。合成デモにより未見の両腕ロボット構成へのゼロショット転移を実現した。
原題: MonoDuo: Using One Robot Arm to Learn Bimanual Policies / Sandeep Bajamahal, Lawrence Yunliang Chen, Toru Lin 他
日本語で読む → - 論文自動運転/リスクマップロボティクス
部分観測環境における自動運転のための統合リスクマップ学習
自動運転における遮蔽によるリスクを、交通流リスクと衝突リスクを統合したリスクマップとしてモデル化・学習し、拡散モデルによる敵対的シナリオ生成も組み合わせて、部分観測下でのリスク認識計画を実現した。
原題: Learning A Unified Risk Map for Autonomous Driving in Partially Observable Environments / Jie Jia, Yaofeng Su, Zeyu Bao 他
日本語で読む → - 論文自己折り畳みロボット/3Dプリンティングロボティクス
受動駆動型自己折り畳みロボットの3Dプリンティングと機能モジュール統合
平らな3Dプリント導電性PLAシートに弾性バンドを通して自己折り畳みさせる手法を提案し、電子部品や磁石を配置した状態から立体構造を形成。折り角度を予測するモデルを導出し、キューブやグリッパー、腱駆動指などの応用を実証した。
原題: 3D Printing of Passively Actuated Self-Folding Robots with Integrated Functional Modules / Gaolin Ge, Qifeng Yang, Haoran Lu 他
日本語で読む → - 論文マニピュレーションロボティクス
ロボットによる机の整理:環境制約を活用した異種物体操作のためのマルチプリミティブ手法
机の上にある剛体・変形物体を収集や積み重ねなどの目的に応じて整理するタスク指向フレームワークを提案し、環境制約を利用した複数の操作プリミティブとタスクプランナーを統合した。
原題: Robotic Desk Organization: A Multi-Primitive Approach to Manipulating Heterogeneous Objects via Environmental Constraints / Yi Dong, Yangjun Liu, Jinjun Duan 他
日本語で読む → - 論文物体検出画像認識
複数の視覚スペクトルにおけるドローン画像を用いた軍事目標検出の比較分析
ドローン画像の軍事目標検出において、グレースケール、熱画像、暗視、オブスキュラ視覚など様々な環境を模擬したデータセットを作成し、YOLOv11-smallモデルで検出性能を比較評価した研究。
原題: Comparative Analysis of Military Detection Using Drone Imagery Across Multiple Visual Spectrums / Sourov Roy Shuvo, Prajwal Panth, Rajesh Chowdhury 他
日本語で読む → - 論文医療ロボティクスロボティクス
自己感知型腱ループによる腱-シース機構のヒステリシスモデリングと補償
柔軟内視鏡ロボットの腱-シース機構における構成依存のヒステリシスを、近位側で張力を計測できる二重ループ構造(SSTL)を用いて学習ベースで推定し、フィードフォワード制御で補償する手法を提案した。
原題: SSTL: Self-Sensing Tendon Loop for Hysteresis Modeling and Compensation in Tendon-Sheath Mechanisms / Myeongbo Park, Junhyun Park, Ihsan Ullah 他
日本語で読む → - 論文ナビゲーションワールドモデル画像認識
アンカー付きエピポーラガイダンスによるドリフト耐性ナビゲーションワールドモデル
逐次ロールアウトによるノイズ蓄積と幾何学的ドリフトを防ぐため、疎な未来アンカーを予測し、その間のフレームを生成する新しいワールドモデルを提案。双方向エピポーラ幾何でアンカーを拘束し、長期的な視覚品質と幾何的一貫性を向上させた。
原題: Drift-Resistant Navigation World Model with Anchored Epipolar Guidance / Po-Chien Luan, Zimin Xia, Wuyang Li 他
日本語で読む → - 論文データセット画像認識
HumanNet:100万時間の人間中心ビデオ学習のスケーリング
人間の身体活動を大規模に捉えた100万時間のビデオコーパスを構築し、データキュレーション手法と視覚言語行動モデルの継続学習による有効性を示した論文。
原題: HumanNet: Scaling Human-centric Video Learning to One Million Hours / Yufan Deng, Daquan Zhou
日本語で読む → - 論文マルチエージェント強化学習/自動運転機械学習
歩行者行動の不確実性下での安全な自動運転のためのマルチエージェント強化学習
自動運転車と歩行者をマルチエージェント強化学習で同時訓練し、現実的な横断行動を生成して安全性評価を向上させる手法を提案した。
原題: Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behavioral Uncertainty / Prakash Aryan, Kaushik Raghupathruni, Timo Kehrer 他
日本語で読む → - 論文強化学習/制御ロボティクス
滑らかな連続制御のための暗黙的アクションチャンキング
強化学習の高周波振動制御問題を解決するため、実行ウィンドウと価値ウィンドウの二重設計による暗黙的アクションチャンキング手法DWSを提案し、滑らかで安全な制御を実現した。
原題: Implicit Action Chunking for Smooth Continuous Control / Bosun Liang, Shuo Pei, Zirui Chen 他
日本語で読む → - 論文計画ロボティクス
信念空間における軌道ツリーの最適化:モデル予測制御からタスク・動作計画への応用
部分観測ロボット計画問題において、逐次軌道ではなく分岐を持つ軌道ツリーを信念空間で最適化する手法を提案し、MPCとTAMPの両方で有効性を示した。
原題: Optimizing Trajectory-Trees in Belief Space: An Application from Model Predictive Control to Task and Motion Planning / Camille Phiquepal, Marc Toussaint
日本語で読む → - 論文サロゲートモデル/流体力学/自動運転ロボティクス
水陸両用環境における自律地上車両のリアルタイム流体力推定のための幾何認識サロゲートモデル
高忠実度CFDデータで訓練したニューラルネットワークサロゲートを用い、車両の形状・水深・流向に応じた流体力をリアルタイム(0.9ms未満)で予測する手法を提案。実車の渡水試験で抗力の速度二乗則や浮力の水深線形性を再現した。
原題: Geometry-Aware Surrogate for Real-Time Hydrodynamics Estimation of Autonomous Ground Vehicles in Amphibious Environments / Ammar Waheed, Luke Gallantree, Zohaib Hasnain
日本語で読む → - 論文ベンチマークロボティクス
WorldArena 2.0:モダリティ・機能・プラットフォームにわたる身体化ワールドモデルベンチマークの拡張
身体化ワールドモデルの評価を、視覚のみから視触覚へ、政策評価から強化学習環境としての利用へ、シミュレータから実ロボットへと拡張したベンチマークを提案した。
原題: WorldArena 2.0: Extending Embodied World Model Benchmarking on Modality, Functionality and Platform / Yu Shang, Yinzhou Tang, Yiding Ma 他
日本語で読む → - 論文模倣学習ロボティクス
HumanEgo: 人間の一人称視点動画数分からのゼロショットロボット学習
人間の一人称視点動画からロボット操作スキルをゼロショットで転移するフレームワークを提案。手と物体の相互作用をエンティティレベルで表現し、フローマッチングポリシーと補助損失で学習することで、ロボットデータ不要で高効率な学習を実現した。
原題: HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos / Zhi Wang, Botao He, Kelin Yu 他
日本語で読む → - 論文自動運転/安全支援ロボティクス
VLMを用いた二輪車安全運転支援システム
二輪車の事故リスク低減のため、視覚言語モデルとセグメンテーションを組み合わせてリスクマップを生成し、二輪車の動特性に合わせたプランナーで安全な運転行動を推薦するシステムを提案した。
原題: VLM-Based Advanced Rider Assistance System for Motorcycle Safety / Mohamed Elnoor, Francesca Baldini, Ananya Trivedi 他
日本語で読む → - 論文UAV探索/経路計画ロボティクス
LMPath: 言語を介した事前知識と経路生成による航空探索
UAVの探索ミッションにおいて、言語モデルと衛星画像を用いて対象物が存在しそうな領域を事前に推定し、その情報に基づいて効率的な飛行経路を生成するパイプラインを提案した。
原題: LMPath: Language-Mediated Priors and Path Generation for Aerial Exploration / Jonathan A. Diller, Fernando Cladera, Camillo J. Taylor 他
日本語で読む → - 論文連続体ロボットロボティクス
回転リング対を用いた力応答を調整可能な磁気連続体ロボットの設計
外部磁場を制御せずに先端の磁気応答をオンライン調整できる新しい連続体ロボットを提案し、最大33.8mmのたわみと高精度なモデルを示した。
原題: Design of Magnetic Continuum Robots with Tunable Force Response Using Rotational Ring Pairs / Alex Sayres, Giovanni Pittiglio
日本語で読む → - 論文群制御ロボティクス
オクルージョンに基づく小型ロボット群による障害物回避物体輸送
群ロボットが障害物で遮られた目標への物体輸送を、サブゴール形成により可能にする分散型戦略を提案し、シミュレーションでその有効性を示した。
原題: Occlusion-Based Object Transportation Around Obstacles With a Swarm of Miniature Robots / Breno Cunha Queiroz, Daniel MacRae
日本語で読む → - 論文移動把持ロボティクス
動的環境における可視性を考慮した移動把持
限られた視野を持つ移動ロボットが、動的で未知の環境で安全に物体を把持するための統合システムを提案。低レベルの全身プランナーと高レベルの行動木プランナーを組み合わせ、シミュレーションと実機で有効性を実証した。
原題: Visibility-Aware Mobile Grasping in Dynamic Environments / Tianrun Hu, Anxing Xiao, David Hsu 他
日本語で読む → - 論文ハプティクス/リハビリテーションロボティクス
精密な力生成の学習を促進するための有形仮想オブジェクトのダイナミクス操作
脳卒中後のリハビリテーションにおける精密な力制御の訓練を改善するため、仮想バネの力-伸び関係を非線形(ガウス型や非対称ガウス型)に操作し、その効果を健康な被験者50名で検証した。
原題: Manipulating Tangible Virtual Object Dynamics to Promote Learning of Precision Force Generation / Alberto Garzás-Villar, Alba Riera-Cardona, Alexis Derumigny 他
日本語で読む → - 論文群制御cs.CY
具現化マルチエージェントシステムにおける同意連鎖の劣化:AIエージェントガバナンスとロボット倫理の橋渡し
複数のロボットが連携してタスクを委譲する際に、人間の同意がどのように劣化・崩壊するかを分析する枠組み「同意連鎖劣化(CCD)」と、それを監視する3層ガバナンスアーキテクチャ「CoRVE」を提案した論文。
原題: Consent Chain Degradation in Embodied Multi-Agent Systems: Bridging the Gap Between AI Agent Governance and Robot Ethics / Mehmet Haklidir
日本語で読む → - 論文マニピュレーションロボティクス
想像された未来から実行可能な行動へ:ロボット操作のための潜在行動の混合
ビデオ生成モデルによる未来予測をロボット操作に活用する際、予測フレームを直接ポリシーに渡すのではなく、複数の逆動力学モデルを用いて潜在行動の混合表現に変換する制御指向インターフェースMoLAを提案し、シミュレーションと実機で性能向上を確認した。
原題: From Imagined Futures to Executable Actions: Mixture of Latent Actions for Robot Manipulation / Yajie Li, Bozhou Zhang, Chun Gu 他
日本語で読む → - 論文階層制御制御
不変性による安全性、リファインメントによる活性:階層制御の協調設計のための異種契約フレームワーク
階層制御アーキテクチャにおいて、連続時間の安全性と離散時間の活性を異種のassume-guarantee契約で統一的に扱い、層間の協調を形式的に保証するフレームワークを提案し、ハイブリッド蓄電システムで検証した。
原題: Safety by Invariance, Liveness through Refinement: Heterogeneous Contract Framework for Co-Design of Layered Control / Yoshinari Takayama, Alessio Iovine, Bart Besselink 他
日本語で読む → - 論文自動運転/VLAロボティクス
SafeAlign-VLA: リスク認識型自動運転のための負例強化安全整合フレームワーク
自動運転向けVLAモデルに負例(危険シナリオ)を活用した安全整合フレームワークを提案し、カウンターファクチュアルな軌道生成とグループ相対方策最適化により衝突率を低減した。
原題: SafeAlign-VLA: A Negative-Enhanced Safe Alignment Framework for Risk-Aware Autonomous Driving / Kefei Tian, Yuansheng Lian, Kai Yang 他
日本語で読む → - 論文制御/蒸留ロボティクス
拡散モデルを用いた動的ニューラルクープマン蒸留によるリアルタイムロボット制御
拡散モデルの反復ノイズ除去による遅延を解消するため、多段階推論を単一パスに蒸留しつつ多様性を保つフレームワークを提案し、D4RLベンチマークと実機で高速な閉ループ制御を実証した。
原題: Dynamic Neural Koopman Distillation for Real-Time Robot Control Using Diffusion Models / Lei Zheng, Peiqi Yu, Zengqi Peng 他
日本語で読む → - 論文歩行ロボティクス
四足壁面歩行ロボット向けの高負荷密度・接着力制御可能な電磁永久磁石足
四足ロボットが鉄磁性面を登るための、高負荷密度で接着力を制御できる電磁永久磁石足を提案し、最大1000N以上の接着力と200:1以上の荷重比を実現した。
原題: High-Load-Density Electro-Permanent Magnetic Foot with Controllable Adhesion for Quadruped Wall-Climbing Robots / An Li, Bo Tao, I-Ming Chen 他
日本語で読む →