論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
アフォーダンス誘導による包み込み把持デモンストレーション:ピンチ把持が不可能な嵌合部品の非破壊分解に向けて
複雑な嵌合部品のロボット分解において、ピンチ把持が不可能な場合に多指包み込み把持が必要となるが、2Dカメラ映像のみでは教示が困難。そこで物理シミュレーションで包み込み把持候補を事前生成し、把持品質を色勾配で可視化するアフォーダンステンプレートを用いた遠隔操作手法を提案し、実機実験で有効性を検証した。
原題: Affordance-Guided Enveloping Grasp Demonstration Toward Non-destructive Disassembly of Pinch-Infeasible Mating Parts / Masaki Tsutsumi, Takuya Kiyokawa, Gen Sako 他
日本語で読む → - 論文ナビゲーション画像認識
Context-Nav: 文脈駆動探索と視点対応3D空間推論によるインスタンスナビゲーション
テキスト指示に基づき、同じカテゴリの物体の中から正しいインスタンスへ到達するナビゲーション手法を提案。文脈全体を探索の事前情報として活用し、視点対応の3D空間検証で候補を確認する。
原題: Context-Nav: Context-Driven Exploration and Viewpoint-Aware 3D Spatial Reasoning for Instance Navigation / Won Shik Jang, Ue-Hwan Kim
日本語で読む → - 論文医療ロボティクスロボティクス
RAG-RUSS: 頸動脈自律検査のための検索拡張型ロボット超音波システム
臨床ワークフローに沿って頸動脈検査を自律実行し、現在の段階と次の動作を説明可能な検索拡張型ロボット超音波フレームワークを提案した。
原題: RAG-RUSS: A Retrieval-Augmented Robotic Ultrasound for Autonomous Carotid Examination / Dianye Huang, Ziping Cong, Nassir Navab 他
日本語で読む → - 論文地図生成ロボティクス
B²F-Map: ベイズBスプライン融合によるクラウドソース型地図生成
単眼カメラと低精度GNSS/IMUを搭載した量産車両からのデータを用いて、レーン線の高精細地図を生成するパイプラインを提案。Bスプラインをガウス分布に従う制御点で表現し、異なる密度の軌跡をベイズ的に融合する新手法を導入した。
原題: B$^2$F-Map: Crowd-sourced Mapping with Bayesian B-spline Fusion / Yiping Xie, Yuxuan Xia, Erik Stenborg 他
日本語で読む → - 論文軌道予測画像認識
エンドポイント認識モデリングによるリアルタイムストリーミング軌道予測
自動運転のための連続的な軌道予測手法を提案し、過去の予測情報を活用して精度を保ちつつ、推論遅延を大幅に削減した。
原題: Streaming Real-Time Trajectory Prediction Using Endpoint-Aware Modeling / Alexander Prutsch, David Schinagl, Horst Possegger
日本語で読む → - 論文自動運転ロボティクス
LAD-Drive: 言語と軌道を橋渡しする行動認識拡散トランスフォーマー
自動運転向けに、高レベルの意図と低レベルの空間計画を構造的に分離し、行動認識拡散デコーダを用いて安全で運動学的に実現可能な軌道を生成するフレームワークを提案した。
原題: LAD-Drive: Bridging Language and Trajectory with Action-Aware Diffusion Transformers / Fabian Schmidt, Karol Fedurko, Markus Enzweiler 他
日本語で読む → - 論文手術支援ロボットロボティクス
「はさみを渡して」:衝突回避機能を備えた手術器具受け渡し用双腕手術支援ロボット
手術中に看護師が器具を渡す負担を軽減するため、視覚言語モデルとリアルタイム障害物距離認識を統合し、動的環境でも衝突なく器具を受け渡せる双腕ロボットシステムを提案した。
原題: Give me scissors: Collision-Free Dual-Arm Surgical Assistive Robot for Instrument Delivery / Xuejin Luo, Shiquan Sun, Runshi Zhang 他
日本語で読む → - 論文群制御ロボティクス
非同期センサ融合によるマルチロボットの分散協調自己位置推定
GPSの使えない環境で、各ロボットが拡張カルマンフィルタで局所的に自己位置推定しつつ、通信可能なときだけ計測情報を共有する分散協調測位フレームワークを提案。静的ランドマークと他ロボットを併用し、非同期・異なるサンプリングレートのセンサにも対応する。
原題: Decentralized Cooperative Localization for Multi-Robot Systems with Asynchronous Sensor Fusion / Nivand Khosravi, Niusha Khosravi, Mohammad Bozorg 他
日本語で読む → - 論文空中マニピュレーションロボティクス
空中連続体マニピュレータのためのひずみパラメータ化連成動力学とデュアルカメラ視覚サーボ
空中連続体マニピュレータの動的モデリングと視覚サーボ制御を提案。ひずみパラメータ化CosseratロッドモデルとUAV剛体モデルを統合し、デュアルカメラIBVSで視野制限を克服する。
原題: Strain-Parameterized Coupled Dynamics and Dual-Camera Visual Servoing for Aerial Continuum Manipulators / Niloufar Amiri, Farrokh Janabi-Sharifi
日本語で読む → - 論文計画/強化学習ロボティクス
GraSP-STL: オフライン目標条件付き強化学習によるゼロショット信号時相論理計画のためのグラフベースフレームワーク
オフラインデータのみを用いて、未見のSTL仕様を満たす制御戦略をゼロショットで合成するグラフ探索ベースのフレームワークを提案した。
原題: GraSP-STL: A Graph-Based Framework for Zero-Shot Signal Temporal Logic Planning via Offline Goal-Conditioned Reinforcement Learning / Ancheng Hou, Ruijia Liu, Xiang Yin
日本語で読む → - 論文飛行ロボットロボティクス
知覚を考慮したクワッドローターのウェイポイント飛行における時間最適計画
クワッドローターの時間最適軌道計画に、視覚的状態推定の品質を考慮した知覚制約を統合する新しい最適化フレームワークを提案した。
原題: Perception-Aware Time-Optimal Planning for Quadrotor Waypoint Flight / Chao Qin, Jiaxu Xing, Rudolf Reiter 他
日本語で読む → - 論文VLAロボティクス
ProFocus: 視覚と言語によるナビゲーションにおける能動的知覚と焦点化推論
VLNエージェントの非効率な視覚処理と無差別な履歴利用を改善するため、LLMとVLMの協調による訓練不要のフレームワークProFocusを提案。能動的知覚で必要な視覚情報を特定し、BD-MCTSで高価値な経路点に焦点を当てた推論を行う。
原題: ProFocus: Proactive Perception and Focused Reasoning in Vision-and-Language Navigation / Wei Xue, Mingcheng Li, Xuecheng Wu 他
日本語で読む → - 論文ナビゲーションロボティクス
CHOP: 反実仮想的な人間の嗜好ラベルによる視運動ナビゲーションポリシーの障害物回避改善
視運動ナビゲーションポリシーを、反実仮想的な軌道に対する人間の嗜好ラベルで微調整し、安全性と障害物回避を人間の直感に合わせる手法を提案した。
原題: CHOP: Counterfactual Human Preference Labels Improve Obstacle Avoidance in Visuomotor Navigation Policies / Gershom Seneviratne, Jianyu An, Vaibhav Shende 他
日本語で読む → - 論文オドメトリロボティクス
SE(3)-LIO: SE(3)多様体上の同時分布ポーズによる滑らかなIMU伝播を用いた高精度・高ロバストなLiDAR-慣性オドメトリ
本論文では、IMU伝播をSE(3)多様体上で行い、回転変化を並進に適切に反映させるとともに、予測ポーズ間の相関を考慮した不確かさを運動補償に組み込むことで、LiDAR-慣性オドメトリの精度とロバスト性を向上させる手法を提案している。
原題: SE(3)-LIO: Smooth IMU Propagation With Jointly Distributed Poses on SE(3) Manifold for Accurate and Robust LiDAR-Inertial Odometry / Gunhee Shin, Seungjae Lee, Jei Kong 他
日本語で読む → - 論文ナビゲーションロボティクス
SignNav: 大規模屋内環境における標識を活用した意味的視覚ナビゲーション
標識の意味的手がかりを解釈して目的地へ移動する新しいナビゲーションタスクSignNavを提案し、空間・時間認識トランスフォーマー(START)モデルで80%の成功率を達成した。
原題: SignNav: Leveraging Signage for Semantic Visual Navigation in Large-Scale Indoor Environments / Jian Sun, Yuming Huang, He Li 他
日本語で読む → - 論文模倣学習ロボティクス
視覚的推論を用いた文脈内模倣学習
ロボットが少数のデモから新しいタスクを適応学習する際、視覚的な推論トレースをプロンプトに追加し、行動予測と推論過程を同時に学習するフレームワークを提案。シミュレーションと実世界で成功率と汎化性能が向上した。
原題: ICLR: In-Context Imitation Learning with Visual Reasoning / Toan Nguyen, Weiduo Yuan, Songlin Wei 他
日本語で読む → - 論文世界モデル/計画画像認識
8トークンでの計画:潜在世界モデルのためのコンパクトな離散トーカナイザー
観測をわずか8トークンに圧縮する離散トーカナイザーを提案し、世界モデルを用いた計画の計算コストを大幅に削減して実時間制御を可能にした。
原題: Planning in 8 Tokens: A Compact Discrete Tokenizer for Latent World Model / Dongwon Kim, Gawon Seo, Jinsung Lee 他
日本語で読む → - 論文検出・追跡ロボティクス
極限的スパース環境下におけるLiDARベースの教師なし複数UAV検出・追跡
非反復走査の固体LiDARで1スキャンあたり1-2点しか得られない超スパースな空中UAV検出・追跡を、教師なしクラスタリングと確率的データ同定で実現した研究。
原題: Unsupervised LiDAR-Based Multi-UAV Detection and Tracking Under Extreme Sparsity / Nivand Khosravi, Rodrigo Ventura, Meysam Basiri
日本語で読む → - 論文自動運転/世界モデル画像認識
DynFlowDrive: フローベース動的世界モデルによる自動運転
拡散フローで運転行動に応じたシーン状態の遷移を学習する潜在世界モデルを提案し、安定性を考慮した軌道選択で自動運転の計画信頼性を向上させた。
原題: DynFlowDrive: Flow-Based Dynamic World Modeling for Autonomous Driving / Xiaolu Liu, Yicong Li, Song Wang 他
日本語で読む → - 論文四足歩行ロボティクス
四足ロボットの斜面歩行におけるエネルギー予測
四足ロボットの野外でのエネルギー消費を、傾斜角と進行方向に基づく簡易モデルで予測する手法を提案し、実地検証でその有効性を示した論文。
原題: Energy Prediction on Sloping Ground for Quadruped Robots / Mohamed Ounally, Cyrille Pierre, Johann Laconte
日本語で読む → - 論文自動運転ロボティクス
運動学を考慮した潜在世界モデルによるデータ効率的な自動運転
自動運転のための世界モデルに車両の運動学情報を組み込み、潜在状態の遷移を物理的に意味のある動きに基づかせることで、サンプル効率と運転性能を向上させた。
原題: Kinematics-Aware Latent World Models for Data-Efficient Autonomous Driving / Jiazhuo Li, Linjiang Cao, Qi Liu 他
日本語で読む → - 論文ドローン飛行ロボティクス
イベントカメラを用いた混雑環境でのクアッドローター飛行のための近似模倣学習
イベントカメラの高周波データをシミュレーションする計算コストを回避するため、表現学習と方策探索を分離し、オフラインデータで表現を学習後、軽量な状態情報のみで方策を微調整する近似模倣学習を提案。訓練時間を28倍短縮し、実機でも有効性を実証した。
原題: Approximate Imitation Learning for Event-based Quadrotor Flight in Cluttered Environments / Nico Messikommer, Jiaxu Xing, Leonard Bauersfeld 他
日本語で読む → - 論文表現学習機械学習
時間的抽象化による前向き・後向き表現のスペクトル整合
連続制御における前向き・後向き表現の低ランク学習で生じるスペクトル不整合を、時間的抽象化がローパスフィルタとして働き緩和することを理論的・実験的に示した研究。
原題: Spectral Alignment in Forward-Backward Representations via Temporal Abstraction / Seyed Mahdi B. Azad, Jasper Hoffmann, Iman Nematollahi 他
日本語で読む → - 論文VLA/操作/継続学習ロボティクス
AtomicVLA: ロボットにおける原子スキル学習の可能性を解き放つ
長期的・多段階のロボット操作タスクを扱うため、タスク計画・原子スキル抽象化・細粒度アクションを統合的に生成するフレームワークAtomicVLAを提案。スキル誘導型Mixture-of-Expertsによりスケーラブルな原子スキルライブラリを構築し、継続学習も可能にした。
原題: AtomicVLA: Unlocking the Potential of Atomic Skill Learning in Robots / Likui Zhang, Tao Tang, Zhihao Zhan 他
日本語で読む → - 論文SLAMロボティクス
TRGS-SLAM: ぼやけ・ローリングシャッター・ノイズを含む熱画像のためのIMU支援ガウススプラッティングSLAM
熱カメラの劣化(モーションブラー、ローリングシャッター歪み、固定パターンノイズ)に対処するため、3Dガウススプラッティングに基づく熱慣性SLAMシステムを提案し、実世界の高速・高ノイズ熱データで正確なトラッキングを実現した。
原題: TRGS-SLAM: IMU-Aided Gaussian Splatting SLAM for Blurry, Rolling Shutter, and Noisy Thermal Images / Spencer Carmichael, Katherine A. Skinner
日本語で読む → - 論文VLA/量子化機械学習
DyQ-VLA: 身体化視覚言語行動モデルのための時間動的認識量子化
VLAモデルの推論コストを削減するため、時間的な感度に応じてビット幅を動的に切り替える量子化フレームワークDyQ-VLAを提案した。
原題: DyQ-VLA: Temporal-Dynamic-Aware Quantization for Embodied Vision-Language-Action Models / Zihao Zheng, Hangyu Cao, Sicheng Tian 他
日本語で読む → - 論文全身制御ロボティクス
Rhythm: 双ヒューマノイドのインタラクティブ全身制御学習
人間の動作データから2体のヒューマノイドが抱擁やダンスなどの全身協調動作を実機で行えるようにする統合フレームワークを提案。
原題: Rhythm: Learning Interactive Whole-Body Control for Dual Humanoids / Hongjin Chen, Wei Zhang, Pengfei Li 他
日本語で読む → - 論文VLA/エッジ・クラウド協調推論cs.DC
RAPID: 多様なVLAモデルのための冗長性認識・互換性最適なエッジ・クラウド分割推論
VLAモデルの推論コスト削減のため、冗長性を考慮し互換性を最適化したエッジ・クラウド分割推論フレームワークRAPIDを提案し、最大1.73倍の高速化を実現した。
原題: RAPID: Redundancy-Aware and Compatibility-Optimal Edge-Cloud Partitioned Inference for Diverse VLA Models / Zihao Zheng, Sicheng Tian, Hangyu Cao 他
日本語で読む → - 論文VLAロボティクス
最適化としての生成的制御:適応的で堅牢なロボット制御のための時間無条件フローマッチング
行動生成を軌道積分ではなく反復最適化として扱う時間無条件フレームワークGeCOを提案し、状態の難易度に応じて計算量を適応させ、OOD検出も可能にした。
原題: Generative Control as Optimization: Time Unconditional Flow Matching for Adaptive and Robust Robotic Control / Zunzhe Zhang, Runhan Huang, Yicheng Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
Bi-HIL: サブタスク進行率とキーフレームメモリを用いた双方向制御に基づくマルチモーダル階層模倣学習による長時間の接触を伴うロボット操作
長時間の接触を伴うロボット操作を安定化するため、サブタスク進行率とキーフレームメモリを統合した双方向制御ベースの階層模倣学習フレームワークを提案し、実機タスクで有効性を検証した。
原題: Bi-HIL: Bilateral Control-Based Multimodal Hierarchical Imitation Learning via Subtask-Level Progress Rate and Keyframe Memory for Long-Horizon Contact-Rich Robotic Manipulation / Thanpimon Buamanee, Masato Kobayashi, Yuki Uranishi
日本語で読む →