論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文自動運転画像認識
VECTOR-Drive: 密結合された視覚言語と軌道エキスパートルーティングによるエンドツーエンド自動運転
エンドツーエンド自動運転のための、視覚言語モデルと軌道予測を密結合したVLAフレームワークを提案し、共有アテンションとセマンティックルーティングにより高い運転スコアを達成した。
原題: VECTOR-Drive: Tightly Coupled Vision-Language and Trajectory Expert Routing for End-to-End Autonomous Driving / Rui Zhao, Jianlin Yu, Zhenhai Gao 他
日本語で読む → - 論文自動運転/3Dラベリング/VLM画像認識
視覚言語モデルを用いた車両情報推定による自動運転向け3Dラベリングの改善
自動運転の3Dラベリング精度向上のため、視覚言語モデルで車両のメーカー・モデル・世代を推定し、正確な3Dバウンディングボックス寸法を出力する手法を提案。手動ラベリングの時間削減と品質向上を実証した。
原題: Improving 3D Labeling in Self-Driving by Inferring Vehicle Information using Vision Language Models / Steven Chen, Shivesh Khaitan, Nemanja Djuric
日本語で読む → - 論文設計最適化ロボティクス
運動学的構造に基づくロボット設計最適化のためのQUBO定式化フレームワーク:ロボットハンドのケーススタディ
ロボット設計最適化を量子アニーリング向けのQUBO問題として定式化するフレームワークを提案し、ロボットハンドの設計問題に適用して実現可能性を検証した。
原題: A QUBO Formulation Framework for Kinematic Structure-Based Robot Design Optimization: A Robotic Hand Case Study / HyoJae Kang, Yeong Jae Park, Jeongdo Ahn 他
日本語で読む → - 論文自動運転/シナリオ生成ロボティクス
時空間論理によるニューロシンボリックシナリオ生成の誘導
自動運転の安全性評価のため、時空間論理仕様を満たす重要シナリオを拡散モデルで生成するフレームワークSTRELGenを提案。
原題: Guiding Neuro-Symbolic Scenario Generation with Spatio-Temporal Logic / Lorenzo Bonin, Francesco Giacomarra, Luca Bortolussi 他
日本語で読む → - 論文バイマニュアル操作ロボティクス
CUBic: 協調型統一バイマニュアル知覚・制御フレームワーク
両腕ロボットの操作を統一的な知覚モデリング問題として捉え、共有トークン表現と拡散ポリシーにより腕の独立性と協調を構造的に実現するフレームワークを提案した。
原題: CUBic: Coordinated Unified Bimanual Perception and Control Framework / Xingyu Wang, Pengxiang Ding, Jingkai Xu 他
日本語で読む → - 論文VLAロボティクス
PhysBrain 1.0 技術報告書
大規模な人間の一人称視点ビデオから物理的常識を抽出し、視覚言語行動モデルとロボット制御ポリシーに転移する手法を提案し、複数のベンチマークで最高性能を達成した。
原題: PhysBrain 1.0 Technical Report / Shijie Lian, Bin Yu, Xiaopeng Lin 他
日本語で読む → - 論文ナビゲーションロボティクス
Q-SpiRL: 適応的ロボットナビゲーションのための量子スパイキング強化学習
量子スパイキングニューラルネットワークを用いた強化学習フレームワークを提案し、動的環境でのロボットナビゲーション性能を評価した。
原題: Q-SpiRL: Quantum Spiking Reinforcement Learning for Adaptive Robot Navigation / Mohamed Khair Altrabulsi, Nouhaila Innan, Alberto Marchisio 他
日本語で読む → - 論文自動運転ロボティクス
フローマッチングによる自動運転の直接制御ポリシー学習
自動運転向けに、加速度と曲率プロファイルで定義される制御軌道を直接出力するフローマッチングプランナーを提案。BEVラスタを条件とし、少数のODE積分ステップで制御系列を生成し、実時間クローズドループ再計画を可能にする。
原題: Learning Direct Control Policies with Flow Matching for Autonomous Driving / Marcello Ceresini, Federico Pirazzoli, Andrea Bertogalli 他
日本語で読む → - 論文サーベイロボティクス
ロボット学習のためのワールドモデル:包括的サーベイ
ロボット学習におけるワールドモデルの役割と進化を体系的にレビューし、ポリシー学習、シミュレーション、評価への応用や課題を整理したサーベイ論文。
原題: World Model for Robot Learning: A Comprehensive Survey / Bohan Hou, Gen Li, Jindou Jia 他
日本語で読む → - 論文VLAロボティクス
ElegantVLA: 効率的な視覚言語行動モデルのための思考タイミング学習
VLAモデルの計算コストを削減するため、制御ステップごとに計算量を動的に調整するプラグイン型の位相適応推論フレームワークを提案。
原題: ElegantVLA: Learning When to Think for Efficient Vision-Language-Action Models / Ye Li, Huanan Liu, Kangye Ji 他
日本語で読む → - 論文模倣学習ロボティクス
時空間最適輸送注意機構による接触リッチ操作の視覚-触覚模倣学習
接触を伴う操作タスクにおいて、視覚・力覚・位置情報の3モーダルを融合する際に、最適輸送に基づく注意機構を導入し、接触前後の文脈に応じた安定した特徴選択を実現する模倣学習手法を提案した。
原題: Spacetime Optimal-Transport Attention for Visuo-Haptic Imitation Learning of Contact-Rich Manipulation / Yue Feng, Weicheng Huang, I-Ming Chen
日本語で読む → - 論文空中マニピュレーションロボティクス
空中マニピュレーションのためのクロスカップリングとレジーム依存ダイナミクスの学習
空中マニピュレータの残差ダイナミクスを適応的に学習する構造化エンコーダ・デコーダフレームワークを提案し、実機実験で予測精度とMPC追従性能を向上させた。
原題: Learning Cross-Coupled and Regime Dependent Dynamics for Aerial Manipulation / Rishabh Dev Yadav, Samaksh Ujjawal, Sihao Sun 他
日本語で読む → - 論文ロボット学習/強化学習ロボティクス
TMRL: 拡散タイムステップ変調による事前学習が効率的なポリシー微調整のための探索を可能にする
ロボットポリシーの事前学習と強化学習による微調整を橋渡しする統一フレームワークを提案。事前学習時に拡散ノイズを注入し、微調整時にタイムステップを動的調整することで探索を制御し、複雑な操作タスクの実機微調整を1時間以内で成功させる。
原題: TMRL: Diffusion Timestep-Modulated Pretraining Enables Exploration for Efficient Policy Finetuning / Matthew M. Hong, Jesse Zhang, Anusha Nagabandi 他
日本語で読む → - 論文安全性ロボティクス
任意の不確実性下での分布的ロバスト安全性:安全フィルタリングアプローチ
非線形システムの確率的安全性を、分布の曖昧さがある状況で保証する手法を提案。バックアップベースの安全フィルタリングとWasserstein曖昧集合を用いた分布的ロバスト最適化を組み合わせ、切り替え時間の1次元探索とサンプリングベースの検証で安全性を確保する。
原題: Distributionally Robust Safety Under Arbitrary Uncertainties: A Safety Filtering Approach / Daniel M. Cherenson, Haejoon Lee, Taekyung Kim 他
日本語で読む → - 論文嗅覚ナビゲーション/継続学習機械学習
成長・剪定・凍結ネットワーク:嗅覚ナビゲーションのための適応的・継続的学習手法
嗅覚ナビゲーションの非定常環境に対応するため、ポリシーの層を成長・剪定・凍結しながら継続学習する適応的フレームワークを提案し、乱流プルーム追跡で94%の成功率を達成した。
原題: Grow-Prune-Freeze Networks: Adaptive & Continual Learning Technique for Olfactory Navigation / Kordel K. France, Ovidiu Daescu
日本語で読む → - 論文衝突回避ロボティクス
ベルンシュタイン多項式近似による衝突回避のための幾何認識制御バリア関数
不規則な形状のロボットや障害物に対して、ベルンシュタイン多項式符号付き距離場を用いた幾何認識CBFを提案し、単一・複数ロボットの衝突回避を効率的に実現した。
原題: Geometry-Aware Control Barrier Functions for Collision Avoidance via Bernstein Polynomial Approximations / Siwon Jo, Yanze Zhang, Yupeng Yang 他
日本語で読む → - 論文VLA/検証画像認識
Pre-VLA: 信頼性の高い視覚言語行動・ワールドモデル展開のための先制ランタイム検証
VLAモデルや生成ワールドモデルの行動生成の不確実性に対処するため、物理実行や想像の前に行動の妥当性を検証する統一ランタイム検証アーキテクチャを提案した。
原題: Pre-VLA: Preemptive Runtime Verification for Reliable Vision-Language-Action and World-Model Rollouts / Zhen Sun, Yongjian Guo, Haoran Sun 他
日本語で読む → - 論文ナビゲーションロボティクス
TARIC: 遮断された意味的手がかり下でのメモリ拡張型・走行可能性認識屋外視覚言語ナビゲーション
屋外視覚言語ナビゲーションにおいて、意味的手がかりが途切れる状況でも、走行可能性を考慮した実行可能なガイダンスを維持する統合フレームワークを提案。3Dキューメモリと不確実性を考慮した読み出し機構により、長期的な手がかり欠如フェーズでも安定したナビゲーションを実現する。
原題: TARIC: Memory-Augmented Traversability-Aware Outdoor VLN under Interrupted Semantic Cues / Tianle Zeng, Hanjing Ye, Jianwei Peng 他
日本語で読む → - 論文遠隔操作/データ収集ロボティクス
COBALT: スマートフォンを用いたクラウドベース遠隔操作によるロボット学習のクラウドソーシング
スマートフォンなどの一般的なデバイスを用いて、複数ユーザーが同時に遠隔操作でロボットのデモデータを収集できるプラットフォームを提案し、模倣学習のための大規模データ収集を低コストで実現した。
原題: COBALT: Crowdsourcing Robot Learning via Cloud-Based Teleoperation with Smartphones / Ayush Agarwal, Ansh Gandhi, Jeremy A. Collins 他
日本語で読む → - 論文VLAロボティクス
AwareVLN: 自己認識による視覚言語ナビゲーションの推論
視覚と言語によるナビゲーションにおいて、エージェントの状態とタスクの進捗を理解する自己認識推論機構を導入し、エンドツーエンドで高性能なナビゲーションを実現した。
原題: AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation / Wenxuan Guo, Xiuwei Xu, Yichen Liu 他
日本語で読む → - 論文移動ロボットロボティクス
STRロボット:シミュレーションから実機への自律移動ロボットの設計
既存の機械プラットフォームを基に、シミュレーションで開発した制御・自己位置推定・自律ナビゲーションシステムを実機に実装し、その有効性を検証した論文。
原題: STR Robot: Design of an Autonomous Mobile Robot from Simulation to Reality / Vinh Nguyen, Gia-Uy Le, Tien-Dat Nguyen 他
日本語で読む → - 論文物体検出ロボティクス
UAV検出のためのデュアルインターバル動作手がかりによる自己運動とターゲットダイナミクスの分離
UAV映像での物体検出において、ホモグラフィによるグローバルモーション補償と短期的・長期的な動作手がかりを統合する軽量な動作誘導注意機構を提案し、自己運動の影響を抑えて検出精度を向上させた。
原題: Decoupling Ego-Motion from Target Dynamics via Dual-Interval Motion Cues for UAV Detection / Liuyang Wang, Feitian Zhang
日本語で読む → - 論文能動知覚/安全制御ロボティクス
制御バリア関数による3Dガウススプラッティング場における競合認識型能動知覚と制御
3Dガウススプラッティングで表現された環境において、安全性と情報獲得の競合を扱う能動知覚・制御フレームワークを提案。CBFによる安全制約と知覚バリア関数による視点選択を統合したQPで解決する。
原題: Conflict-Aware Active Perception and Control in 3D Gaussian Splatting Fields via Control Barrier Functions / Amirhossein Mollaei Khass, Athanasios Cosse, Vivek Pandey 他
日本語で読む → - 論文マニピュレーションロボティクス
オンライン慣性推定と凸レンチ最適化による産業用双腕ボックスハンドリング
未知の質量・重心を持つ箱を双腕ロボットで安定に持ち上げるため、接触力から慣性をオンライン推定し、摩擦制約付きのSOCPで力を最適化する手法を提案・実機検証した。
原題: Industrial Dual-Arm Box Handling via Online Inertial Estimation and Convex Wrench Optimization / Kenzhi Iskandar Wong, Lin Yang, Qian Ying Lee 他
日本語で読む → - 論文模倣学習/拡散ポリシー/説明可能性ロボティクス
SADP: 基盤モデル生成デモから学習するサブゴール認識拡散ポリシーによる説明可能なロボット
基盤モデルでサブゴール注釈付きデモを自動生成し、そのデータで拡散ポリシーを訓練することで、ロボットが実行中のサブタスクを説明可能にしつつ成功率も向上させる手法を提案した。
原題: SADP: Subgoal-Aware Diffusion Policy for Explainable Robots Learned from Foundation Model Generated Demonstrations / Site Hu, Takato Horii
日本語で読む → - 論文自動運転ロボティクス
SARAD: LLMベースの衝突予測を備えた安全意識型ハイブリッド強化学習による自動運転
自動運転の意思決定において、LLMと強化学習を組み合わせ、衝突予測モジュールを導入して安全性と効率性を両立させる新しいフレームワークを提案した。
原題: SARAD: LLM-Based Safety-Aware Hybrid Reinforcement Learning with Collision Prediction for Autonomous Driving / Kangyu Wu, Peng Cui, Guoxi Chen 他
日本語で読む → - 論文VLA画像認識
LocateAnything: 並列ボックスデコードによる高速・高品質な視覚言語グラウンディング
視覚言語モデルによる物体検出・グラウンディングを、ボックス座標を並列に一度でデコードする方式に変え、推論速度と精度を両立させた。
原題: LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding / Shihao Wang, Shilong Liu, Yuanguo Kuang 他
日本語で読む → - 論文人間ロボット協調ロボティクス
材料・組立不確実性下での組積造建設における適応的人間ロボット協調
ロボットと人間が協調してレンガ積みを行う際、プロジェクタによる誘導とレーザースキャンによる位置補正を組み合わせ、材料ばらつきや累積誤差に適応するワークフローを提案・実証した。
原題: Adaptive Human-Robot Collaboration for Masonry Construction Under Material and Assembly Uncertainty / Jutang Gao, Arash Adel
日本語で読む → - 論文ドローン制御ロボティクス
完全駆動型航空機の制御:モデルベースとセンサベースの動的逆変換の比較
完全駆動型ヘキサロータにおいて、モデルベースの幾何学的NDIとセンサベースのINDIを比較し、パラメータ誤差や外乱に対するロバスト性の違いを実験的に検証した。
原題: Control of Fully Actuated Aerial Vehicles: A Comparison of Model-based and Sensor-based Dynamic Inversion / Ali Sidar Yilmaz, Buday Turan, Lukas Pries 他
日本語で読む → - 論文ソフトロボティクス/空気圧制御ロボティクス
BiPneu: ソフトロボットのための双極圧空気圧システムの設計と制御
ソフトロボット用に、正負両圧力を高精度・高速に調整できる多チャンネル空気圧システムBiPneuを提案し、ヒステリシス付きデュアルモードスライディングモード制御によりPIDやMPCより優れた追従性能を実証した。
原題: BiPneu: Design and Control of a Bipolar-Pressure Pneumatic System for Soft Robots / Yu Mei, Xinyu Zhou, Vedant Naik 他
日本語で読む →