論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/1/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御ロボティクス
CHORAL: 異種ロボット群の安全で効率的な経路計画のための走行性を考慮した計画手法
偵察飛行から得た意味地図を用いて各ロボットの走行能力を考慮し、異種ロボット群の巡回経路とタスク割当を同時に計画する枠組みを提案。
原題: CHORAL: Traversal-Aware Planning for Safe and Efficient Heterogeneous Multi-Robot Routing / David Morilla-Cabello, Eduardo Montijano
日本語で読む → - 論文マニピュレーションロボティクス
STORM: ロボットマニピュレーションのためのスロットベースのタスク認識物体中心表現
凍結した視覚基盤モデルにタスク認識スロットを追加し、物体中心表現を効率的に学習することで、マニピュレーションの制御性能と視覚変化への汎化を向上させる手法を提案。
原題: STORM: Slot-based Task-aware Object-centric Representation for robotic Manipulation / Alexandre Chapin, Emmanuel Dellandréa, Liming Chen
日本語で読む → - 論文VLA評価ベンチマークロボティクス
グレートマーチ100:身体性AIエージェント評価のための100の詳細指向タスク
ロボット学習の評価に向けて、多様な相互作用とロングテール行動を網羅する100の詳細設計タスク「GM-100」を提案し、複数のVLAモデルの性能差を明確に評価できることを示した。
原題: The Great March 100: 100 Detail-oriented Tasks for Evaluating Embodied AI Agents / Ziyu Wang, Chenyuan Liu, Yushun Xiang 他
日本語で読む → - 論文マニピュレーションロボティクス
汎化可能な幾何学的事前知識と再帰スパイキング特徴学習によるヒューマノイドロボットマニピュレーション
視覚言語モデルに軽量な2D幾何学的バイアスを組み込み、再帰スパイキングネットワークで時空間一貫性を学習することで、未見環境での汎化と少ない実演からのデータ効率的な動作生成を実現した。
原題: Generalizable Geometric Prior and Recurrent Spiking Feature Learning for Humanoid Robot Manipulation / Xuetao Li, Wenke Huang, Mang Ye 他
日本語で読む → - 論文テレオペレーションロボティクス
静的タスクだけでは不十分:VRとSpaceMouseによる静的・動的テレオペレーションタスクの比較研究
VRコントローラとSpaceMouseを静的・動的タスクで比較し、VRが成功率・作業時間・主観的負荷で優れることを示し、動的タスク向けVRインタフェースを公開した。
原題: Static Is Not Enough: A Comparative Study of VR and SpaceMouse in Static and Dynamic Teleoperation Tasks / Yijun Zhou, Muhan Hou, Kim Baraka
日本語で読む → - 論文3Dモデル検索画像認識
OSCAR: 言語プロンプトと単一画像からのオープンセットCAD検索
言語プロンプトと1枚の画像から、未ラベルの3Dモデルデータベースを検索して対応するCADモデルを訓練なしで見つける手法を提案。
原題: OSCAR: Open-Set CAD Retrieval from a Language Prompt and a Single Image / Tessa Pulli, Jean-Baptiste Weibel, Peter Hönig 他
日本語で読む → - 論文ナビゲーションロボティクス
GPS途絶時ナビゲーションを強化する脳模倣型情報融合手法
スパイキングニューラルネットワークを用いてGPS/INS融合ネットワークを構築し、GPS途絶時でも慣性センサから高精度に位置推定する手法を提案した。
原題: A brain-inspired information fusion method for enhancing robot GPS outages navigation / Yaohua Liu, Hengjun Zhang, Binkai Ou
日本語で読む → - 論文自動運転/安全検証ロボティクス
バリア証明を用いた自動運転車の形式的な安全保証
バリア証明と解釈可能な衝突指標(TTC)を組み合わせ、SMTソルバで安全性を検証する適応制御を提案。実データで危険な相互作用を最大40%削減した。
原題: Formal Safety Guarantees for Autonomous Vehicles using Barrier Certificates / Oumaima Barhoumi, Mohamed H Zaki, Sofiène Tahar
日本語で読む → - 論文マニピュレーションロボティクス
Mixture-of-Experts拡散ポリシーによるロボットマニピュレーションスキルの抽象化
拡散ポリシーをマルチタスクに拡張するため、直交スキル基底を学習し、スティッキールーティングで必要な専門家のみを活性化するMixture-of-Expertsポリシーを提案。シミュレーションと実機で高い成功率と低推論コストを実現。
原題: Abstracting Robot Manipulation Skills via Mixture-of-Experts Diffusion Policies / Ce Hao, Xuanran Zhai, Yaohua Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
HumanoidVLM: 視覚言語ガイドによるインピーダンス制御で接触の多いヒューマノイドマニピュレーション
視覚言語モデルとRAGを用いて、一人称視覚画像からタスクに適したインピーダンスパラメータと把持設定を選択し、Unitree G1ヒューマノイドの柔軟な操作を実現した。
原題: HumanoidVLM: Vision-Language-Guided Impedance Control for Contact-Rich Humanoid Manipulation / Yara Mahmoud, Yasheerah Yaqoot, Miguel Altamirano Cabrera 他
日本語で読む → - 論文点群処理画像認識
低遅延空間データ伝送のためのリアルタイムLiDAR点群高密度化
複数のLiDAR入力と高解像度カラー画像を組み合わせ、CNNによるジョイントバイラテラルフィルタでリアルタイムに高密度深度マップを生成する手法を提案した。
原題: Real-Time LiDAR Point Cloud Densification for Low-Latency Spatial Data Transmission / Kazuhiko Murasaki, Shunsuke Konagai, Masakatsu Aoki 他
日本語で読む → - 論文義手制御ロボティクス
人工神経網とスライディングモード制御を組み合わせた義手手首のハイブリッド制御
人工神経網とスライディングモード制御を組み合わせ、腱駆動ソフト連続手首の高速応答と計算負荷低減を実現する制御器を開発し、シミュレーションと実験で検証した。
原題: A Hybrid Model-based and Data-based Approach Developed for a Prosthetic Hand Wrist / Shifa Sulaiman, Francesco Schetter, Mehul Menon 他
日本語で読む → - 論文マニピュレーションロボティクス
UMI-FT:実環境でのコンプライアントマニピュレーション
指先に6軸力覚センサを搭載したハンドヘルドデータ収集デバイスUMI-FTを開発し、力加減が重要な接触作業を実世界デモから学習できる適応型コンプライアンス方策を訓練した。
原題: In-the-Wild Compliant Manipulation with UMI-FT / Hojung Choi, Yifan Hou, Chuer Pan 他
日本語で読む → - 論文ロボティクス/倉庫自動化ロボティクス
最大容量のグリッド型ストレージにおけるロバストな順不同取出し
グリッド型自動倉庫で、取出し順が保存時に想定した順序から最大k個ずれる場合でも、荷物の移動が不要になる条件を理論的に示し、その配置を計算する手法を提案した論文。
原題: Robust Out-of-Order Retrieval for Grid-Based Storage at Maximum Capacity / Tzvika Geft, William Zhang, Jingjin Yu 他
日本語で読む → - 論文ウェアラブル操作インターフェースロボティクス
Glove2UAV: 直感的なUAV操作のためのウェアラブルIMUグローブ
手と指のジェスチャーでUAVを直感的に操作するIMUグローブを開発し、速度閾値超過時に振動触覚警告を提示する。シミュレーションと実機飛行でリアルタイム性とコマンド実行の安定性を検証した。
原題: Glove2UAV: A Wearable IMU-Based Glove for Intuitive Control of UAV / Amir Habel, Ivan Snegirev, Elizaveta Semenyakina 他
日本語で読む → - 論文視覚オドメトリ画像認識
キーフレームベースのフィードフォワード視覚オドメトリ
視覚基盤モデルを用いた視覚オドメトリに強化学習で適応的にキーフレームを選択する手法を導入し、計算効率と精度を向上させた。
原題: Keyframe-Based Feed-Forward Visual Odometry / Weichen Dai, Wenhan Su, Da Kong 他
日本語で読む → - 論文sim2realロボティクス
MATTERIX:ロボティクス支援化学実験室自動化のためのデジタルツイン
化学実験室の高忠実度デジタルツインを構築するGPU加速マルチスケールロボットシミュレーションフレームワークを提案し、ロボット操作・粉体/液体動力学・熱伝達・化学反応を統合してsim-to-real転移を実証した。
原題: MATTERIX: toward a digital twin for robotics-assisted chemistry laboratory automation / Kourosh Darvish, Arjun Sohal, Abhijoy Mandal 他
日本語で読む → - 論文End-to-End自動運転画像認識
見るものを減らして運転を改善:基盤モデルの確率的パッチ選択による汎化可能なEnd-to-End自動運転
基盤モデルから抽出したパッチ特徴の冗長性を削減するため、ランダムに一部のパッチをマスクして学習するStochastic-Patch-Selectionを提案し、分布外シナリオでの自動運転性能を平均6.2%向上させた。
原題: See Less, Drive Better: Generalizable End-to-End Autonomous Driving via Foundation Models Stochastic Patch Selection / Amir Mallak, Erfan Aasi, Shiva Sreeram 他
日本語で読む → - 論文3D物体検出/センサーフュージョン画像認識
LCF3D: 自動運転における3D物体検出のための堅牢でリアルタイムなレイトカスケード融合フレームワーク
RGB画像の2D検出とLiDAR点群の3D検出をレイト融合とカスケード融合で組み合わせ、LiDARの誤検出を除去しつつ見逃しを回復する3D物体検出フレームワークを提案。
原題: LCF3D: A Robust and Real-Time Late-Cascade Fusion Framework for 3D Object Detection in Autonomous Driving / Carlo Sgaravatti, Riccardo Pieroni, Matteo Corno 他
日本語で読む → - 論文マルチエージェント強化学習ロボティクス
構造化・非構造化空域における間隔確保のためのTransformerベースマルチエージェント強化学習
相対極座標状態空間でTransformerエンコーダを訓練し、多様な交通パターンと交差角に適応する航空機の間隔確保手法を提案。単一エンコーダ構成が深い構成より優れ、衝突リスクをほぼゼロにした。
原題: Transformer-based Multi-agent Reinforcement Learning for Separation Assurance in Structured and Unstructured Airspaces / Arsyi Aziz, Peng Wei
日本語で読む → - 論文3D検出画像認識
単眼Pseudo-LiDAR 3D検出における深度バックボーンと意味的手がかりの系統的評価
単眼画像からPseudo-LiDARを生成して3D物体検出を行う際、深度推定モデルや外観・意味的特徴の付加が精度に与える影響をKITTIで系統的に評価した。深度バックボーンの選択と幾何学的忠実性が性能を支配し、意味的特徴の追加効果は限定的であることを示した。
原題: Systematic Evaluation of Depth Backbones and Semantic Cues for Monocular Pseudo-LiDAR 3D Detection / Samson Oseiwe Ajadalu
日本語で読む → - 論文手術計画・VLM評価自然言語
SurgGoal: 目標充足可能性による手術計画評価の再考
手術計画の正しさを専門家定義の目標充足可能性で評価するベンチマークを提案し、従来の類似度指標が有効な計画を誤って低評価し無効な計画を見逃すことを示した。
原題: SurgGoal: Rethinking Surgical Planning Evaluation via Goal-Satisfiability / Ruochen Li, Kun Yuan, Yufei Xia 他
日本語で読む → - 論文世界モデル評価ロボティクス
Wow, wo, val! 具現化世界モデル評価のためのチューリングテスト
ロボット操作データ609件を用い、動画基盤モデルを世界モデルとして評価する5能力・22指標のベンチマークを提案し、人間の選好との相関0.93超を達成した。
原題: Wow, wo, val! A Comprehensive Embodied World Model Evaluation Turing Test / Chun-Kai Fan, Xiaowei Chi, Xiaozhu Ju 他
日本語で読む → - 論文キャリブレーション/自動ラベリングロボティクス
4D-CAAL: 自動運転のための4Dレーダー・カメラキャリブレーションと自動ラベリング
4Dレーダーとカメラのキャリブレーションを効率化するため、チェッカーボードとコーナーリフレクターを組み合わせた二目的ターゲットと、カメラのセグメンテーションをレーダー点群に転送する自動ラベリング手法を提案した。
原題: 4D-CAAL: 4D Radar-Camera Calibration and Auto-Labeling for Autonomous Driving / Shanliang Yao, Zhuoxiao Li, Runwei Guan 他
日本語で読む → - 論文VLAロボティクス
RoboReward: ロボティクス向け汎用視覚言語報酬モデル
実ロボットの大規模データセットから報酬モデル用データセットとベンチマークを構築し、4B/8Bの視覚言語報酬モデルを訓練。短期的なロボットタスクで大規模VLMを上回る性能を達成し、実機強化学習に適用した。
原題: RoboReward: General-Purpose Vision-Language Reward Models for Robotics / Tony Lee, Andrew Wagenmaker, Karl Pertsch 他
日本語で読む → - 論文マルチエージェントナビゲーションロボティクス
ORION: オプション正則化深層強化学習による協調マルチエージェントオンラインナビゲーション
不完全な事前地図を持つ環境で、複数エージェントがオンライン観測を共有しながら分散的に協調し、経路最適性と地図不確実性の低減を両立する深層強化学習フレームワークORIONを提案。
原題: ORION: Option-Regularized Deep Reinforcement Learning for Cooperative Multi-Agent Online Navigation / Shizhe Zhang, Jingsong Liang, Zhitao Zhou 他
日本語で読む → - 論文世界モデル制御
ロボティクスにおける動画生成モデル:応用・研究課題・将来展望
動画生成モデルをロボティクスの世界モデルとして活用する研究をサーベイし、模倣学習や強化学習などへの応用と課題を整理した。
原題: Video Generation Models in Robotics -- Applications, Research Challenges, Future Directions / Zhiting Mei, Tenny Yin, Ola Shorinwa 他
日本語で読む → - 論文群制御ロボティクス
動的で複雑な群構造のためのフロッキング行動
仮想重心の概念に基づき、UAV群の数と編隊を動的に制御できるフロッキングアルゴリズムを提案し、シミュレーションと実機実験で複雑な編隊・軌道でも簡便に実現できることを示した。
原題: Flocking behavior for dynamic and complex swarm structures / Carmen D. R. Pita-Romero, Pedro Arias-Perez, Miguel Fernandez-Cortizas 他
日本語で読む → - 論文ヒューマノイドロボティクス
Fauna Sprout:軽量で親しみやすく開発者向けのヒューマノイドロボット
安全で表現力豊かな人間環境での長期運用を目指し、軽量・柔軟制御・VRテレオペを統合した開発者向けヒューマノイドプラットフォームSproutを提案。
原題: Fauna Sprout: A lightweight, approachable, developer-ready humanoid robot / Fauna Robotics, :, Diego Aldarondo 他
日本語で読む → - 論文制御/MPC制御
状態・入力依存の不確かさに対する学習ベースの縮小外乱不変チューブ
状態と入力に依存する不確かさの下で、チューブMPCに使える縮小外乱不変チューブを学習で構築し、データが増えるほどチューブが狭まりつつ安全性を保証する手法を提案した。
原題: Learning-Based Shrinking Disturbance-Invariant Tubes for State- and Input-Dependent Uncertainty / Abdelrahman Ramadan, Sidney Givigi
日本語で読む →