論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文POMDP計画ロボティクス
オープンループPOMDP簡略化と正式な性能保証を伴う再計画の安全なスキップ
POMDPの計算困難性に対処するため、オープンループとクローズドループ計画を適応的に切り替える枠組みを提案し、性能保証付きで再計画をスキップする手法を開発した。
原題: Open-loop POMDP Simplification and Safe Skipping of Replanning with Formal Performance Guarantees / Da Kong, Vadim Indelman
日本語で読む → - 論文ローカライゼーションロボティクス
ビジョンベース自律ドローンレースのための二重ポーズグラフ意味的ローカライゼーション
ドローンレースの過酷な条件下で、オドメトリと意味的検出を融合した二重ポーズグラフ構造により、ロバストなリアルタイム自己位置推定を実現した。
原題: Dual Pose-Graph Semantic Localization for Vision-Based Autonomous Drone Racing / David Perez-Saura, Miguel Fernandez-Cortizas, Alvaro J. Gaona 他
日本語で読む → - 論文双腕操作ロボティクス
マルチエージェント・インコンテキスト学習による双腕ロボット操作
標準のLLMを微調整なしで双腕操作に適用するため、リーダー・フォロワー型のマルチエージェント枠組みで動作空間を分割し、TWINベンチマークで高い成功率を達成した。
原題: Bimanual Robot Manipulation via Multi-Agent In-Context Learning / Alessio Palma, Indro Spinelli, Vignesh Prasad 他
日本語で読む → - 論文触覚ロボティクス
多感覚指先触覚フィードバックのための柔らかく軽量な布ベース空気圧インターフェース
布ベースの空気圧アクチュエータを用いて、軽量で装着可能な指先触覚デバイスを開発し、接触形状、方向性スライド、振動周波数の3つの触覚モードを高精度で分類できることを示した。
原題: A soft and lightweight fabric-based pneumatic interface for multimodal fingertip tactile feedback / Rui Chen, Daniele Leonardis, Antonio Frisoli
日本語で読む → - 論文自動運転/計画ロボティクス
大規模モデルの推論とリアルタイム制御を橋渡しするエージェント型高速・低速計画
大規模言語モデルの推論と実時間制御を階層的に統合する枠組みを提案し、CARLA実験でMPC単独やA*誘導MPCと比べて外乱下での横偏差を最大45%削減、完了時間を12%以上短縮した。
原題: Bridging Large-Model Reasoning and Real-Time Control via Agentic Fast-Slow Planning / Jiayi Chen, Shuai Wang, Guangxu Zhu 他
日本語で読む → - 論文レーダー/スキャンマッチングロボティクス
RCSを考慮した4Dレーダーのガウスモデリングとスキャンマッチング
4Dミリ波レーダーの点群に対し、RCS情報をガウスモデルに組み込み、スキャンマッチングの精度向上を図った研究。
原題: 4D Radar Gaussian Modeling and Scan Matching with RCS / Fernando Amodeo, Luis Merino, Fernando Caballero
日本語で読む → - 論文教育/ロボティクスphysics.ed-ph
錆びた空飛ぶロボット:STM32マイコン上でリアルタイム動作するロボティクススタック全体を学ぶ9ECTS修士課程
修士課程のプロジェクト型授業で、ロボティクスの基本パイプライン(動力学、状態推定、制御、計画)を、制約の強い計算機上で直接実装し、実際にロボットを飛行させることを通じて学ぶ。ブラックボックスなソフトウェアを避け、Rust言語を用いてPC上でのシミュレーションとSTM32上での実機展開を行う。
原題: Rusty Flying Robots: Learning a Full Robotics Stack with Real-Time Operation on an STM32 Microcontroller in a 9 ECTS MS Course / Wolfgang Hoenig, Christoph Scherer, Khaled Wahba
日本語で読む → - 論文強化学習ロボティクス
長期的ロボットタスクのための一般化可能な密な報酬
LLMとVLMを用いてタスク進捗を認識する外部報酬と、ポリシーの自己確信度に基づく内部報酬を組み合わせた密な報酬フレームワークVLLRを提案し、長期的タスクにおけるRL微調整を手動報酬設計なしで改善した。
原題: Generalizable Dense Reward for Long-Horizon Robotic Tasks / Silong Yong, Stephen Sheng, Carl Qi 他
日本語で読む → - 論文人間参加型CPS/エージェントAIAI
エージェント型ドライビングコーチ:エージェント型AIを活用した人間参加型サイバーフィジカルシステムの堅牢性と決定性
大規模言語モデルを用いたエージェント型AIを人間参加型のサイバーフィジカルシステムに適用する際の非決定性問題に対し、リアクターモデルに基づくアプローチを提案し、ドライビングコーチの事例で評価した。
原題: Agentic Driving Coach: Robustness and Determinism of Agentic AI-Powered Human-in-the-Loop Cyber-Physical Systems / Deeksha Prahlad, Daniel Fan, Hokeun Kim
日本語で読む → - 論文3Dシーン理解画像認識
PLAF: ピクセル単位の言語整合特徴抽出による効率的な3Dシーン理解
2Dでピクセル単位の高精度な言語整合特徴を抽出し、冗長性を削減する効率的な保存・検索方式を設計することで、オープンボキャブラリ3Dシーン理解を実現するフレームワークを提案した。
原題: PLAF: Pixel-wise Language-Aligned Feature Extraction for Efficient 3D Scene Understanding / Junjie Wen, Junlin He, Fei Ma 他
日本語で読む → - 論文オドメトリロボティクス
BIEVR-LIO: バンプ画像強化ボクセルマップによる堅牢なLiDAR-慣性オドメトリ
LiDAR-慣性オドメトリの精度低下や発散を防ぐため、ボクセルごとの高さ画像として表面を表現する高解像度マップと、幾何学的に情報量の多い領域に焦点を当てた点サンプリング戦略を提案した。
原題: BIEVR-LIO: Robust LiDAR-Inertial Odometry through Bump-Image-Enhanced Voxel Maps / Patrick Pfreundschuh, Turcan Tuna, Cedric Le Gentil 他
日本語で読む → - 論文自動運転/VLA画像認識
UniDriveVLA:自動運転のための理解・知覚・行動計画の統合
自動運転向けのVLAモデルにおいて、空間知覚と意味推論の競合を解消するため、Mixture-of-Transformersによる専門家分離を導入した統合モデルUniDriveVLAを提案し、nuScenesとBench2Driveで最先端性能を達成した。
原題: UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving / Yongkang Li, Lijun Zhou, Sixu Yan 他
日本語で読む → - 論文自動運転/ベンチマークロボティクス
EagleVision: 高速自動運転レースにおけるクロスドメイン知覚のためのマルチタスクベンチマーク
高速自動運転レース向けに、LiDARベースの3D検出と軌道予測を統合したマルチタスクベンチマークを新たに構築し、都市・シミュレータ・実レース間のドメイン転移性能を評価した。
原題: EagleVision: A Multi-Task Benchmark for Cross-Domain Perception in High-Speed Autonomous Racing / Zakhar Yagudin, Murad Mebrahtu, Ren Jin 他
日本語で読む → - 論文VLAロボティクス
ProGAL-VLA: 予測的推論による視覚言語行動モデルの接地整合
視覚言語行動モデルが指示を無視する問題に対し、3Dエンティティ中心グラフとシンボリックサブゴール計画、接地整合損失を導入し、指示感度と曖昧さ検出を向上させた。
原題: ProGAL-VLA: Grounded Alignment through Prospective Reasoning in Vision-Language-Action Models / Nastaran Darabi, Amit Ranjan Trivedi
日本語で読む → - 論文MRインタラクションHCI
ポイント&グラスプ:確率的キューの統合による手の届かない物体の柔軟な選択
MR環境で手の届かない物体を選択する際、ポインティング方向と握りジェスチャを確率的に統合する新しい手法を提案し、精度と速度を向上させた。
原題: Point & Grasp: Flexible Selection of Out-of-Reach Objects Through Probabilistic Cue Integration / Xuejing Luo, Hee-Seung Moon, Christian Holz 他
日本語で読む → - 論文拡散ポリシー/非同期実行ロボティクス
DiscreteRTC: 離散拡散ポリシーは自然な非同期実行器である
離散拡散ポリシーが本来持つインペインティング能力を活用し、非同期実行を実現する新しいポリシー「DiscreteRTC」を提案。連続的なRTCと比べて、追加コードなしで実装でき、推論コストも削減しつつ、動的タスクでの成功率が向上することを示した。
原題: DiscreteRTC: Discrete Diffusion Policies are Natural Asynchronous Executors / Pengcheng Wang, Kaiwen Hong, Chensheng Peng 他
日本語で読む → - 論文リアルタイムシステム制御
Raspberry Pi 5上のPREEMPT_RT LinuxにおけるUAV飛行制御ワークロードのスケジューリング解析
Raspberry Pi 5上でPREEMPT_RT Linuxカーネルを用いたUAV飛行制御のリアルタイム性を解析し、標準カーネルでは9ms超の遅延が発生するのに対し、PREEMPT_RTにより最悪遅延を88%削減して225マイクロ秒未満に抑えられることを示した。
原題: Scheduling Analysis of UAV Flight Control Workloads on PREEMPT_RT Linux Using a Raspberry Pi 5 / Luiz Giacomossi, Håkan Forsberg, Ivan Tomasic 他
日本語で読む → - 論文群制御ロボティクス
MLLM駆動のセンシング・通信・計算によるマルチロボットネットワークの進展:包括的サーベイ
マルチモーダル大規模言語モデル(MLLM)を用いて、複数ロボットの協調タスクにおけるセンシング・通信・計算を統合最適化する手法を包括的に調査した論文。
原題: Advancing Multi-Robot Networks via MLLM-Driven Sensing, Communication, and Computation: A Comprehensive Survey / Hyun Jong Yang, Howon Lee, Kyuhong Shim 他
日本語で読む → - 論文器用操作ロボティクス
HANDFUL: 資源を考慮した逐次把持条件付き器用操作
器用なロボットハンドで、最初の把持を維持しながら次の操作タスクを実行する逐次操作を学習するフレームワークを提案し、指の使用を資源とみなして資源を考慮した把持を探索する。
原題: HANDFUL: Sequential Grasp-Conditioned Dexterous Manipulation with Resource Awareness / Ethan Foong, Yunshuang Li, Hao Jiang 他
日本語で読む → - 論文SLAM/協調マッピングロボティクス
MR.ScaleMaster: クラウドソースの単眼ビデオからのスケール一貫性のある協調マッピング
単眼カメラ映像をクラウドソースで集めて協調的に3次元再構成する際に生じるスケール崩壊とスケールドリフトという2つの問題を解決するシステムを提案した。
原題: MR.ScaleMaster: Scale-Consistent Collaborative Mapping from Crowd-Sourced Monocular Videos / Hyoseok Ju, Giseop Kim
日本語で読む → - 論文VLA/操作ロボティクス
移動してから操作する:人間らしいロボット操作のための行動フェーズ分割
ロボット操作を粗い移動フェーズと接触が重要な操作フェーズに分離するVLAフレームワークを提案し、RoboTwin2ベンチマークで従来手法より高い成功率を達成した。
原題: Move-Then-Operate: Behavioral Phasing for Human-Like Robotic Manipulation / Haoming Xu, Lei Lei, Jie Gu 他
日本語で読む → - 論文安全制御/強化学習制御
敵対的強化学習による最大ロバスト制御バリア関数の合成と展開
一般の非線形システムに対して、動的計画法とQ関数を用いた新しいロバスト制御バリア関数を提案し、敵対的強化学習で合成・展開する手法を導入した。
原題: Synthesis and Deployment of Maximal Robust Control Barrier Functions through Adversarial Reinforcement Learning / Donggeon David Oh, Duy P. Nguyen, Haimin Hu 他
日本語で読む → - 論文意図予測ロボティクス
制御情報を活用した学習によるオンライン意図予測
自律システムの目標状態をリアルタイムで推定するオンライン意図予測フレームワークを提案。逆最適制御とシフトする地平線戦略を用い、時間変化する意図や未知パラメータに対応する。
原題: Online Intention Prediction via Control-Informed Learning / Tianyu Zhou, Zihao Liang, Zehui Lu 他
日本語で読む → - 論文触覚ロボティクス
MFE: 力・圧力・温熱フィードバックを備えた多感覚ハンド外骨格
力、圧力、温熱の3種類の触覚フィードバックを提供するハンド外骨格MFEを開発し、遠隔操作システムに統合して、変形物体の操作や温度識別が可能なことをユーザー実験で実証した。
原題: MFE: A Multimodal Hand Exoskeleton with Interactive Force, Pressure and Thermo-haptic Feedback / Ziyuan Tang, Yitian Guo, Chenxi Xiao
日本語で読む → - 論文空間グラウンディングAI
GIST: インテリジェント意味トポロジーによるマルチモーダル知識抽出と空間グラウンディング
小売店や倉庫などの複雑な環境向けに、携帯端末の点群から意味的に注釈されたナビゲーショントポロジーを構築するパイプラインを提案し、意味検索や位置特定などの下流タスクで有効性を示した。
原題: GIST: Multimodal Knowledge Extraction and Spatial Grounding via Intelligent Semantic Topology / Shivendra Agrawal, Bradley Hayes
日本語で読む → - 論文強化学習/報酬整形ロボティクス
ファジィ論理に基づく適応的報酬整形によるロバスト強化学習
ファジィ論理を用いて人間の知識を報酬設計に組み込み、状態に応じて報酬を適応的に調整する手法を提案。ドローン競技タスクで収束の高速化と性能ばらつきの低減を実証した。
原題: Fuzzy Logic Theory-based Adaptive Reward Shaping for Robust Reinforcement Learning (FARS) / Hürkan Şahin, Van Huyen Dang, Erdi Sayar 他
日本語で読む → - 論文計画・強化学習ロボティクス
運動学から動力学へ:物理的に実行可能なハイブリッド計画の学習による洗練
ハイブリッドプランナーが生成した一次(運動学的)計画を、強化学習を用いて二次(動的)制約を満たす物理的に実行可能な軌道へと洗練する手法を提案した論文。
原題: From Kinematics to Dynamics: Learning to Refine Hybrid Plans for Physically Feasible Execution / Lidor Erez, Shahaf S. Shperberg, Ayal Taitler
日本語で読む → - 論文全身制御ロボティクス
BAT: オンライン方策切替による俊敏性と安定性の両立 - 長期的全身ヒューマノイド制御
長期的な全身動作タスクで俊敏性と安定性を両立するため、2つの補完的な強化学習方策をオンラインで切り替えるフレームワークBATを提案し、シミュレーションと実機で有効性を示した。
原題: BAT: Balancing Agility and Stability via Online Policy Switching for Long-Horizon Whole-Body Humanoid Control / Donghoon Baek, Sang-Hun Kim, Sehoon Ha
日本語で読む → - 論文制御ロボティクス
スタイン変分不確実性適応モデル予測制御
非線形動的システムの潜在パラメータ不確実性に対して、スタイン変分推論を用いてタスク依存の不確実性分布を粒子近似し、ロバスト性と性能のトレードオフを改善する制御器を提案した。
原題: Stein Variational Uncertainty-Adaptive Model Predictive Control / Hrishikesh Sathyanarayan, Ian Abraham
日本語で読む → - 論文動作生成画像認識
EgoFlow: 勾配誘導フローマッチングによる自己中心視6DoF物体動作生成
自己中心視映像から物体の6DoF動作を生成するフローマッチングフレームワークを提案し、物理的制約を勾配として組み込むことで衝突回避と滑らかな動作を実現した。
原題: EgoFlow: Gradient-Guided Flow Matching for Egocentric 6DoF Object Motion Generation / Abhishek Saroha, Huajian Zeng, Xingxing Zuo 他
日本語で読む →