論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
受動ローラーによる異方性摩擦変調を用いたロボット巧緻操作
指先に受動ローラーを備え、制動や旋回により接触摩擦と拘束方向を変調できる指先を設計し、把持内の滑りや回転など多様な巧緻操作を実現した。
原題: Robotic Dexterous Manipulation via Anisotropic Friction Modulation using Passive Rollers / Ethan Fisk, Taeyoon Lee, Shenli Yuan
日本語で読む → - 論文運動計画ロボティクス
非微分平坦システム向け連続安全性保証付き高速スプライン時間最適運動計画
分離超平面の決定を最適制御問題から分離し、線形システムや二次計画で解くことで、障害物回避のための非凸制約を線形化し、計算時間を最大60%削減しつつ連続的な安全性を保証する手法を提案した。
原題: Accelerated Spline-Based Time-Optimal Motion Planning with Continuous Safety Guarantees for Non-Differentially Flat Systems / Dries Dirckx, Jan Swevers, Wilm Decré
日本語で読む → - 論文群制御ロボティクス
UMBRELLA: 動的時相論理タスク下での不確実性を考慮したマルチロボットリアクティブ協調
動的で移動する目標を含む協調タスクを、不確実性を明示的にモデル化しつつ、時相論理の制約を満たすようにマルチロボットを協調させるフレームワークを提案。MCTSと不確実性を考慮したロールアウトを組み合わせ、CVaRを最小化する。
原題: UMBRELLA: Uncertainty-aware Multi-robot Reactive Coordination under Dynamic Temporal Logic Tasks / Qisheng Zhao, Meng Guo, Hengxuan Du 他
日本語で読む → - 論文制御機械学習
再帰型ニューラルネットワークモデリングによる安全な学習ベース非線形モデル予測制御に向けて
非線形モデル予測制御(NMPC)のオンライン計算負荷を軽減するため、予測ホライズン全体でパラメータを共有する逐次ニューラルポリシーを提案し、安全性を保証するオンライン評価とフォールバック機構を組み合わせた。
原題: Towards Safe Learning-Based Non-Linear Model Predictive Control through Recurrent Neural Network Modeling / Mihaela-Larisa Clement, Mónika Farsang, Agnes Poks 他
日本語で読む → - 論文深度補完ロボティクス
ToFormer: 軽量ToFカメラのための大規模シナリオ深度補完に向けて
短距離ToFカメラの計測範囲を拡張するため、大規模シーン向けの深度補完フレームワークを提案。実データセットLASER-ToFを構築し、センサ特性を考慮したネットワークで高精度な深度補完を実現した。
原題: ToFormer: Towards Large-scale Scenario Depth Completion for Lightweight ToF Camera / Juncheng Chen, Tiancheng Lai, Xingpeng Wang 他
日本語で読む → - 論文群制御ロボティクス
不確実性下での学習統合型マルチロボットタスク計画
未知の物体位置を学習で推定しつつ、モデルベース計画で長期的なチーム協調を実現するマルチロボットタスク計画手法を提案。シミュレーションと実機で有効性を実証した。
原題: Multi-Robot Learning-Informed Task Planning Under Uncertainty / Abhish Khanal, Abhishek Paudel, Hung Pham 他
日本語で読む → - 論文組立/スキルグラフロボティクス
スキルグラフ表現を用いたロボット組立の自律的統合と改善
ロボット組立システムの統合と性能改善を自動化するフレームワークを提案。スキルグラフ表現により、意味レベルでの計画と実行を結びつけ、データ収集と閉ループ改善を可能にする。
原題: Autonomous Integration and Improvement of Robotic Assembly using Skill Graph Representations / Peiqi Yu, Philip Huang, Chaitanya Chawla 他
日本語で読む → - 論文マニピュレーションロボティクス
構造化プランナーとしてのワールドモデル:ロボット操作のための疎な未来予測
密な未来予測の冗長性と誤差蓄積を避けるため、キネマティクスに基づく疎な構造化フレームを予測するワールドモデルを提案し、視覚プランニングと運動制御を橋渡しする。
原題: Beyond Dense Futures: World Models as Structured Planners for Robotic Manipulation / Minghao Jin, Mozheng Liao, Mingfei Han 他
日本語で読む → - 論文自動運転ロボティクス
エンドツーエンド自律運転の時代:ルールベース運転から大規模運転モデルへの移行
自律運転のモジュール型パイプラインからエンドツーエンド学習システムへの移行を分析し、Tesla FSDやRivianなどの実例を通じて、大規模運転モデルが主流戦略となる過程を論じた論文。
原題: The Era of End-to-End Autonomy: Transitioning from Rule-Based Driving to Large Driving Models / Eduardo Nebot, Julie Stephany Berrio Perez
日本語で読む → - 論文歩行ロボティクス
ADAPT: 適応的二重投影アーキテクチャによる知覚的踏破
人型ロボットの複雑な3D環境での移動のため、水平標高マップと垂直距離マップの二重投影で環境を表現し、センシング範囲を学習可能な行動として扱うことで、高速移動時は広く、障害物の多い場面では狭く知覚範囲を適応させる手法を提案した。
原題: ADAPT: Adaptive Dual-projection Architecture for Perceptive Traversal / Shuo Shao, Tianchen Huang, Wei Gao 他
日本語で読む → - 論文SLAM画像認識
実世界でのDROID-SLAM:不確実性を考慮した動的環境対応RGB SLAM
動的環境で頑健なリアルタイムRGB SLAMシステムを提案し、多視点の視覚特徴の不一致から画素ごとの不確実性を推定して追跡と再構築を改善した。
原題: DROID-SLAM in the Wild / Moyang Li, Zihan Zhu, Marc Pollefeys 他
日本語で読む → - 論文自動運転ロボティクス
自動運転のための意味的監視層:低遅延異常検出におけるVLMの配備前実現可能性調査
自動運転車の安全対策として、ピクセルレベルの検出では捉えられない文脈依存の異常を監視する意味的監視層を提案し、量子化VLMを1-2Hzで動作させて異常を検出し、フェイルセーフに切り替える方式の実現可能性を評価した。
原題: A Semantic Observer Layer for Autonomous Vehicles: Pre-Deployment Feasibility Study of VLMs for Low-Latency Anomaly Detection / Kunal Runwal, Swaraj Gajare, Daniel Adejumo 他
日本語で読む → - 論文動作計画ロボティクス
CSSDF-Net: 構成空間距離場のニューラル陰関数表現に基づく安全な動作計画
構成空間で連続的な符号付き距離場を学習し、関節空間での距離と勾配を提供することで、安全制約付き軌道最適化やMPCに統合し、未学習環境でもゼロショットで衝突回避を可能にする手法を提案した。
原題: CSSDF-Net: Safe Motion Planning Based on Neural Implicit Representations of Configuration Space Distance Field / Haohua Chen, Yixuan Zhou, Yifan Zhou 他
日本語で読む → - 論文HRI/視覚言語モデルロボティクス
MERGE: 人間とロボットの相互作用におけるマルチアクターイベント推論とグラウンディングのための誘導型視覚言語モデル
動的な人間とロボットのグループ相互作用において、アクター、物体、イベントを状況に応じてグラウンディングするシステムMERGEを提案。軽量な知覚パイプラインでVLMを選択的に呼び出し、効率と推論能力を両立し、新規データセットで性能を向上させた。
原題: MERGE: Guided Vision-Language Models for Multi-Actor Event Reasoning and Grounding in Human-Robot Interaction / Joerg Deigmoeller, Nakul Agarwal, Stephan Hasler 他
日本語で読む → - 論文触覚/遠隔操作ロボティクス
HapCompass: 接触の多いロボット遠隔操作のための回転式触覚デバイス
単一の線形共振アクチュエータを機械的に回転させて2次元の方向手がかりを提示する低コストなウェアラブル触覚デバイスを提案し、遠隔操作タスクの成功率向上・時間短縮・接触力低減を実証した。
原題: HapCompass: A Rotational Haptic Device for Contact-Rich Robotic Teleoperation / Xiangshan Tan, Jingtian Ji, Tianchong Jiang 他
日本語で読む → - 論文VLA/強化学習ロボティクス
SmoothVLA: 内在的滑らかさ最適化による物理的制約へのVLAモデル整合
ロボット操作のためのVLAモデルに対し、軌道の滑らかさを内在報酬として組み込んだ強化学習フレームワークを提案し、タスク性能と物理的実現性を両立させた。
原題: SmoothVLA: Aligning Vision-Language-Action Models with Physical Constraints via Intrinsic Smoothness Optimization / Jiashun Li, Xiaoyu Shi, Hong Xie 他
日本語で読む → - 論文マルチエージェント強化学習画像認識
支援動作の学習:マルチエージェント強化学習による物理基盤の人間-人間制御
人間同士の支援動作(力のやり取りを伴う)を物理シミュレータ上でマルチエージェント強化学習により模倣する手法を提案し、支援者と被支援者の双方のポリシーを協調学習させることで、従来手法では困難だった支援動作の追跡を可能にした。
原題: Learning to Assist: Physics-Grounded Human-Human Control via Multi-Agent Reinforcement Learning / Yuto Shibata, Kashu Yamazaki, Lalit Jayanti 他
日本語で読む → - 論文VLAロボティクス
すべての特徴が平等ではない:視覚言語行動モデルの機構的研究
視覚言語行動(VLA)モデルがマルチモーダル入力を行動に変換する仕組みを、活性化注入やスパースオートエンコーダなどを用いて分析し、視覚経路が行動生成を支配し、言語の重要性はタスク構造に依存することを明らかにした。
原題: Not All Features Are Created Equal: A Mechanistic Study of Vision-Language-Action Models / Bryce Grant, Xijia Zhao, Peng Wang
日本語で読む → - 論文ナビゲーションロボティクス
eNavi: 低照度屋内移動ロボットナビゲーションのためのイベントベース模倣ポリシー
イベントカメラとRGBを融合した模倣学習ポリシーを提案し、低照度環境での人物追従ナビゲーションの堅牢性を向上させた。
原題: eNavi: Event-based Imitation Policies for Low-Light Indoor Mobile Robot Navigation / Prithvi Jai Ramesh, Kaustav Chanda, Krishna Vinod 他
日本語で読む → - 論文自己再設計ロボティクス
運動学的自己破壊による自己再設計ロボット
ロボットが自身の身体を動的に再設計する手法を提案。冗長なリンクを自己破壊して除去し、移動性能を向上させる。
原題: Robots that redesign themselves through kinematic self-destruction / Chen Yu, Sam Kriegman
日本語で読む → - 論文データセット/ベンチマークロボティクス
LARD 2.0: 自律着陸システムのための拡張データセットとベンチマーキング
自律着陸システムの物体検出モデル訓練用データセットLARDを拡張し、多様な画像ソースの追加や現実的なシナリオへの改良、複数滑走路環境でのベンチマークフレームワークを提供した論文。
原題: LARD 2.0: Enhanced Datasets and Benchmarking for Autonomous Landing Systems / Yassine Bougacha, Geoffrey Delhomme, Mélanie Ducoffe 他
日本語で読む → - 論文ビジョンシステム画像認識
惑星探査ローバーのための深層学習支援ビジョンシステム
惑星探査ローバー向けに、リアルタイム認識とオフライン地形再構成を組み合わせたビジョンシステムを提案し、月面画像での距離推定精度を評価した。
原題: Deep Learning Aided Vision System for Planetary Rovers / Lomash Relia, Jai G Singla, Amitabh 他
日本語で読む → - 論文群制御ロボティクス
シーン適応型具現化知能に基づくマルチAUVアドホックネットワークによるマルチターゲット追跡
動的で帯域制約のある水中環境で、AUVを具現化エージェントとして統合し、シーン適応型MARLアルゴリズムによりマルチターゲット追跡を実現する新しいアーキテクチャを提案した。
原題: Multi-AUV Ad-hoc Networks-Based Multi-Target Tracking Based on Scene-Adaptive Embodied Intelligence / Kai Tian, Jialun Wang, Chuan Lin 他
日本語で読む → - 論文場所認識画像認識
4DRaL: 知識蒸留による4DレーダーとLiDARを橋渡しする場所認識
4Dレーダーの場所認識性能を向上させるため、高性能なLiDARベースのモデルを教師として知識蒸留を用いるフレームワーク4DRaLを提案した。
原題: 4DRaL: Bridging 4D Radar with LiDAR for Place Recognition using Knowledge Distillation / Ningyuan Huang, Zhiheng Li, Zheng Fang
日本語で読む → - 論文自動運転ロボティクス
ユーザーは走行速度を指定できるか? Bench2Drive-Speed: 所望速度条件付き自動運転のためのベンチマークとベースライン
自動運転において、ユーザーが希望する速度や追い越し可否を指定できるようにするためのベンチマークとデータセット、ベースラインモデルを提案した論文。
原題: Can Users Specify Driving Speed? Bench2Drive-Speed: Benchmark and Baselines for Desired-Speed Conditioned Autonomous Driving / Yuqian Shao, Xiaosong Jia, Langechuan Liu 他
日本語で読む → - 論文状態推定ロボティクス
無人地上車両ナビゲーションのためのハイブリッドニューラル支援アンセンテッドカルマンフィルタ
慣性センサとGNSSの融合に用いるUKFのノイズ共分散を、シミュレーションデータのみで訓練した深層ニューラルネットワークが実測値から予測するハイブリッド推定手法を提案し、3データセットで位置精度を向上させた。
原題: A Hybrid Neural-Assisted Unscented Kalman Filter for Unmanned Ground Vehicle Navigation / Gal Versano, Itzik Klein
日本語で読む → - 論文医用画像処理ロボティクス
ACCURATE: ロバストな適応的二視点推定に基づく任意形状連続体の再構成
X線画像からガイドワイヤやカテーテルなどの任意形状の連続体を高精度に3次元再構成するフレームワークを提案した。
原題: ACCURATE: Arbitrary-shaped Continuum Reconstruction Under Robust Adaptive Two-view Estimation / Yaozhi Zhang, Shun Yu, Yugang Zhang 他
日本語で読む → - 論文物体検出画像認識
解釈可能な物体検出と信頼できるマルチモーダルAIのためのKolmogorov-Arnoldネットワークと視覚言語基盤モデルを用いたYOLOv10
YOLOv10の検出信頼度を、幾何学的・意味的特徴に基づいてKolmogorov-Arnoldネットワークでモデル化し、信頼性の解釈可能な可視化を実現した。さらに、BLIPによるシーン記述でマルチモーダルなインターフェースを提供する。
原題: YOLOv10 with Kolmogorov-Arnold networks and vision-language foundation models for interpretable object detection and trustworthy multimodal AI in computer vision perception / Marios Impraimakis, Daniel Vazquez, Feiyu Zhou
日本語で読む → - 論文ハンド/把持ロボティクス
PHANTOMハンド:腱駆動型劣駆動ハンドにおける精密運動学とコンプライアント把持の統合
腱駆動型劣駆動ハンドの運動学的予測不能性と非線形力伝達を解決するため、6アクチュエータ・15自由度のモジュラーハンドを開発し、解析的運動学と力学補償モデルを統合して精密な指先制御と安定把持を両立した。
原題: PHANTOM Hand / Teng Yan, Jiongxu Chen, Qixiang Hua 他
日本語で読む → - 論文軌道予測ロボティクス
後悔せず修正せよ:軌道予測における微分可能シミュレーションの落とし穴を避ける
自動運転の軌道予測で、微分可能な閉ループシミュレーションが将来情報の漏洩による近道学習を起こす問題を指摘し、計算グラフを切断した非微分可能なリセッティングホライズンロールアウトを提案して、真の回復行動を学習させる。
原題: Rectify, Don't Regret: Avoiding Pitfalls of Differentiable Simulation in Trajectory Prediction / Harsh Yadav, Christian Bohn, Tobias Meisen
日本語で読む →