論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
TGM-VLA: タスク誘導ミックスアップによるサンプリング効率とロバスト性を高めたロボット操作
ロボットの模倣学習において、キーフレームサンプリングの冗長性と時間分布の不均衡を解消し、暗い物体の視認性を高める色反転投影と、タスク指示に応じて点群とアクションヒートマップを融合するタスク誘導ミックスアップを導入し、RLBenchとCOLOSSEUMで高い成功率を達成した。
原題: TGM-VLA: Task-Guided Mixup for Sampling-Efficient and Robust Robotic Manipulation / Fanqi Pu, Lei Jiang, Wenming Yang
日本語で読む → - 論文屋内ナビゲーション画像認識
FlatLands: 単一視点からの生成的フロアマップ補完
一人称視点の単一画像から周囲の床の完全なメートル法走行可能マップを生成するためのデータセットとベンチマークを提案し、様々な手法を比較した。
原題: FlatLands: Generative Floormap Completion From a Single Egocentric View / Subhransu S. Bhattacharjee, Dylan Campbell, Rahul Shome
日本語で読む → - 論文自動運転/世界モデル機械学習
DreamerAD: 潜在世界モデルによる自動運転のための効率的な強化学習
動画拡散モデルのサンプリングを100ステップから1ステップに圧縮し80倍高速化した潜在世界モデルで、自動運転の強化学習を安全かつ高頻度に訓練可能にした。
原題: DreamerAD: Efficient Reinforcement Learning via Latent World Model for Autonomous Driving / Pengxuan Yang, Yupeng Zheng, Deheng Qian 他
日本語で読む → - 論文オドメトリロボティクス
KISS-IMU: 運動バランス学習と不確実性認識推論による自己教師あり慣性オドメトリ
LiDARベースのICPとポーズグラフ最適化を教師信号として用い、IMUのみを自己教師ありで学習する慣性オドメトリ手法を提案。運動バランス学習と不確実性に基づく適応重み付けにより、多様な環境でのロバスト性を実現した。
原題: KISS-IMU: Self-supervised Inertial Odometry with Motion-balanced Learning and Uncertainty-aware Inference / Jiwon Choi, Hogyun Kim, Geonmo Yang 他
日本語で読む → - 論文マニピュレーションロボティクス
部分観測下での言語誘導把持:現場点検・保守における移動操作のための手法
脚式移動マニピュレータが部分観測下で言語指示に基づき物体を把持するパイプラインを提案し、現場の点検・保守シナリオで成功率を向上させた。
原題: Language-Guided Grasping under Partial Observation for Mobile Manipulation in Field Inspection and Maintenance / Dilermando Almeida, Juliano Negri, Guilherme Lazzarini 他
日本語で読む → - 論文VLAcs.CR
TRAP: 敵対的パッチによるVLAのCoT推論ハイジャック
CoT推論を行うVLAモデルに対し、テーブルクロスなどの敵対的パッチを用いて推論経路を操作し、指示とは異なる危険な行動を引き起こす攻撃手法を提案した。
原題: TRAP: Hijacking VLA CoT-Reasoning via Adversarial Patches / Zhengxian Huang, Wenjun Zhu, Haoxuan Qiu 他
日本語で読む → - 論文アフォーダンス推定ロボティクス
ロバストなアフォーダンス推定のための結合粒子フィルタ
把持可能領域と移動可能領域を推定する2つの粒子フィルタを結合し、相互に情報交換させることで、照明不足や混雑環境でも高精度にアフォーダンスを推定する手法を提案した。
原題: Coupled Particle Filters for Robust Affordance Estimation / Patrick Lowin, Vito Mengers, Oliver Brock
日本語で読む → - 論文群制御ロボティクス
IndoorR2X: LLM駆動計画による屋内ロボット対全機器連携
屋内環境のIoTセンサーと移動ロボットを統合し、LLMによる計画でマルチロボットのタスク効率を高めるベンチマークとシミュレーションフレームワークを提案した。
原題: IndoorR2X: Indoor Robot-to-Everything Coordination with LLM-Driven Planning / Fan Yang, Soumya Teotia, Shaunak A. Mehta 他
日本語で読む → - 論文マニピュレーションロボティクス
皮質ポリシー:ロボット操作のための二重ストリームビュートランスフォーマー
静的視点と動的視点の二つのストリームを統合するビュートランスフォーマーを提案し、3D空間理解と動的適応を向上させてロボット操作の性能を大幅に改善した。
原題: Cortical Policy: A Dual-Stream View Transformer for Robotic Manipulation / Xuening Zhang, Qi Lv, Xiang Deng 他
日本語で読む → - 論文制御理論math.OC
ギブス変分原理によるセンサベース制御の基本原理限界
部分観測下のフィードバック制御における最小期待コストの下界を、ギブス変分原理を用いて導出し、自己無撞着な改良により厳密な数値限界を計算する手法を提案した。
原題: Fundamental Limits for Sensor-Based Control via the Gibbs Variational Principle / Vincent Pacelli, Evangelos A. Theodorou
日本語で読む → - 論文自動運転/強化学習ロボティクス
強化学習に基づく動的ルックアヘッド距離を用いた自動運転レース用ピュア・パースート
自動運転レースにおいて、古典的なピュア・パースート制御のルックアヘッド距離をPPO強化学習で動的に調整するハイブリッド制御手法を提案し、シミュレーションと実車で性能を検証した。
原題: Dynamic Lookahead Distance via Reinforcement Learning-Based Pure Pursuit for Autonomous Racing / Mohamed Elgouhary, Amr S. El-Wakeel
日本語で読む → - 論文ナビゲーションロボティクス
視覚基盤モデルはナビゲーションできるか?ゼロショット実世界評価と教訓
5つの最先端視覚ナビゲーションモデルを2つのロボットと屋内・屋外5環境で実世界評価し、成功率以外に経路品質・衝突・環境変化への頑健性を分析して3つの系統的限界を明らかにした。
原題: Can Vision Foundation Models Navigate? Zero-Shot Real-World Evaluation and Lessons Learned / Maeva Guerrier, Karthik Soma, Jana Pavlasek 他
日本語で読む → - 論文マニピュレーション画像認識
デジタルツイン駆動の繊維分類と異物認識による自動選別システム
デジタルツインとVLMを組み合わせ、双腕ロボットが衣類を把持・検査・分類し異物も検出する自動選別システムを構築し、9種のVLMを223シーンで評価した。
原題: Digital Twin Driven Textile Classification and Foreign Object Recognition in Automated Sorting Systems / Serkan Ergun, Tobias Mitterer, Hubert Zangl
日本語で読む → - 論文マニピュレーションロボティクス
MemoAct: アトキンソン=シフリン記憶モデルに着想を得たロボットマニピュレーション向け階層的記憶拡張ポリシー
人間の記憶モデルに倣い、感覚・短期・長期の階層的記憶を組み合わせてロボットのマニピュレーションを記憶依存タスクで高精度化するポリシーを提案し、新ベンチマークで有効性を示した。
原題: MemoAct: Atkinson-Shiffrin-Inspired Hierarchical Memory-Augmented Policy for Robotic Manipulation / Liufan Tan, Jiale Li, Gangshan Jing
日本語で読む → - 論文ヒューマノイド/移動操作ロボティクス
Cybo-Waiter: ヒューマノイド全身移動操作のための物理エージェントフレームワーク
VLMプランを検証可能なタスクプログラムに変換し、3D幾何学的監視でループを閉じるヒューマノイドエージェントフレームワークを提案。移動と操作を統合し、長期的なタスク実行の堅牢性を向上させる。
原題: Cybo-Waiter: A Physical Agentic Framework for Humanoid Whole-Body Locomotion-Manipulation / Peng Ren, Haoyang Ge, Chuan Qi 他
日本語で読む → - 論文VLM/空間推論/動作計画ロボティクス
ロボット動作に対するVLMの空間推論能力の評価:動作嗜好を考慮したロボット計画への一歩
視覚言語モデル(VLM)がロボットの動作計画に必要な空間推論(物体との距離や経路スタイルなどの嗜好)をどの程度理解できるかを、4つの最新VLMと4つの質問方法で評価した。
原題: Evaluating VLMs' Spatial Reasoning Over Robot Motion: A Step Towards Robot Planning with Motion Preferences / Wenxi Wu, Jingjing Zhang, Martim Brandão
日本語で読む → - 論文飛行制御/外乱抑制ロボティクス
GustPilot: 風外乱に強いクアッドロータ航法のための階層型DRL-INDIフレームワーク
深層強化学習による速度指令生成とINDI制御による外乱抑制を組み合わせ、50gの小型ドローンで風のある環境でも高い成功率を実現した。
原題: GustPilot: A Hierarchical DRL-INDI Framework for Wind-Resilient Quadrotor Navigation / Amir Atef Habel, Roohan Ahmed Khan, Fawad Mehboob 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
医療通訳ロボットのジェスチャー生成のためのオープンソースLLMを用いた視覚言語システム
医療通訳ロボット向けに、同意や指示などの発話行為を検出し対応するジェスチャーを生成する、プライバシー保護型の視覚言語フレームワークを提案。オープンソースのLLMと数発プロンプティングを用い、新規データセットとユーザー評価で有効性を示した。
原題: Vision-Language System using Open-Source LLMs for Gestures in Medical Interpreter Robots / Thanh-Tung Ngo, Emma Murphy, Robert J. Ross
日本語で読む → - 論文ナビゲーションロボティクス
経路条件付き強化学習による長距離ナビゲーションのための局所計画
参照経路を文脈として与えられた強化学習ベースの局所ナビゲーション方策を提案し、経路が高品質なときは効率を大幅に改善し、劣化・欠如時もベースライン性能を維持することを示した。
原題: Path-conditioned Reinforcement Learning-based Local Planning for Long-Range Navigation / Mateo Haro, Julia Richter, Fan Yang 他
日本語で読む → - 論文模倣学習/自動運転ロボティクス
補正行動拡張とマルチスケール模倣学習による歩道自動運転の実現
歩道向け小型モビリティの自動運転制御を、補正行動データの追加とマルチスケール模倣学習アーキテクチャにより強化し、実世界での堅牢性と汎化性を向上させた。
原題: Learning Sidewalk Autopilot from Multi-Scale Imitation with Corrective Behavior Expansion / Honglin He, Yukai Ma, Brad Squicciarini 他
日本語で読む → - 論文位置推定ロボティクス
ベイズ学習と深層平滑化を統合した慣性航法の高精度化
慣性/GNSS統合航法の後処理精度を高めるため、古典的な2フィルタ平滑化にTransformerベースのニューラルネットを組み合わせ、共分散行列の修正と平滑化誤差への補正をベイズ枠組み内で学習するフレームワークBLENDSを提案した。実データで最大63%の水平位置精度向上を確認。
原題: Bayesian Learning-Enhanced Navigation with Deep Smoothing for Inertial-Aided Navigation / Nadav Cohen, Itzik Klein
日本語で読む → - 論文自動運転/オフロード/運動力学適応ロボティクス
VertiAdaptor: 垂直障害地形のためのオンライン運動力学適応
オフロード環境での自動運転向けに、標高と意味的埋め込みを統合し、関数エンコーダを用いて地形認識型の運動力学モデルと計画を実現するオンライン適応フレームワークを提案。学習済み空間での最小二乗計算により未知環境へ高速適応し、予測精度と適応時間を改善。
原題: VertiAdaptor: Online Kinodynamics Adaptation for Vertically Challenging Terrain / Tong Xu, Chenhui Pan, Aniket Datar 他
日本語で読む → - 論文群制御ロボティクス
ネットワークコーディングをマルチロボットシステムに導入:無線通信上の自律システムの相互作用研究
無線通信の遅延や損失に対応するため、適応的ネットワークコーディングをマルチロボットシステムに適用し、協調位置推定と安全な追い越しの事例で有効性を示した。
原題: Bringing Network Coding into Multi-Robot Systems: Interplay Study for Autonomous Systems over Wireless Communications / Anil Zaher, Kiril Solovey, Alejandro Cohen
日本語で読む → - 論文VLA画像認識
PRISM: 実世界小売環境向け身体性視覚言語モデルのためのマルチビュー・マルチ能力動画データセット
スーパーでの一人称・三人称・360度視点の動画27万サンプルを収集し、空間・物理・身体行動の知識を問う20以上のタスクで視覚言語モデルを微調整するデータセットを構築した。
原題: PRISM: A Multi-View Multi-Capability Retail Video Dataset for Embodied Vision-Language Models / Amirreza Rouhi, Parikshit Sakurikar, Satya Sai Reddy 他
日本語で読む → - 論文マニピュレーションロボティクス
DexGrasp-Zero: 形態整合型ポリシーによるゼロショット異種エンボディ器用把持
異なる多指ハンド間でゼロショット転移可能な器用把持ポリシーを提案。解剖学的ノードと直交運動プリミティブを用いた形態整合グラフ表現と、物理特性注入機構を備えたグラフ畳み込みネットワークにより、未見のハンドへの汎化を実現。
原題: DexGrasp-Zero: A Morphology-Aligned Policy for Zero-Shot Cross-Embodiment Dexterous Grasping / Yuliang Wu, Yanhan Lin, WengKit Lao 他
日本語で読む → - 論文マニピュレーションロボティクス
HyReach: 未知の雑然環境における視覚誘導型ハイブリッドマニピュレータのリーチング
剛体と軟体を組み合わせた連続体マニピュレータで、視覚と3D再構成に基づく動作計画により、未見の雑然環境でも2cm以下の誤差で対象物に到達できるシステムを実現した。
原題: HyReach: Vision-Guided Hybrid Manipulator Reaching in Unseen Cluttered Environments / Shivani Kamtikar, Kendall Koe, Justin Wasserman 他
日本語で読む → - 論文生涯学習/模倣学習機械学習
SPREAD: 生涯模倣学習のための部分空間表現蒸留
生涯模倣学習において、特異値分解を用いてタスク間のポリシー表現を低ランク部分空間で整列させ、幾何構造を保ちながら知識転移と忘却防止を実現する手法を提案した。
原題: SPREAD: Subspace Representation Distillation for Lifelong Imitation Learning / Kaushik Roy, Giovanni D'urso, Nicholas Lawrance 他
日本語で読む → - 論文航法/状態推定ロボティクス
支援慣性航法システムのチュートリアル:リー群理論的手法による現代的扱い
リー群の枠組みを用いて、慣性計測と補助情報を融合する支援慣性航法システムの幾何学的設計法を解説したチュートリアル論文。
原題: Tutorial on Aided Inertial Navigation Systems: A Modern Treatment Using Lie-Group Theoretical Methods / Soulaimane Berkane
日本語で読む → - 論文データ生成ロボティクス
RADAR: 意味的計画と自律的因果環境リセットによる閉ループロボットデータ生成
VLMによるタスク生成とGNN方策、自動成功判定、FSMによる環境リセットを組み合わせ、人手を介さずロボット操作データを収集し続ける閉ループシステムを提案。
原題: RADAR: Closed-Loop Robotic Data Generation via Semantic Planning and Autonomous Causal Environment Reset / Yongzhong Wang, Keyu Zhu, Yong Zhong 他
日本語で読む → - 論文自動運転/安全性ロボティクス
VLAベース運転システムのための安全ケースパターン:SimLingoからの洞察
VLAベースの自動運転システム向けに、安全ケース設計手法RAISEを提案し、SimLingoの事例で安全性主張の構築を実証した論文。
原題: Safety Case Patterns for VLA-based driving systems: Insights from SimLingo / Gerhard Yu, Fuyuki Ishikawa, Oluwafemi Odu 他
日本語で読む →