論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/1/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文運動プリミティブロボティクス
ロボティクスにおける運動プリミティブ:包括的サーベイ
ロボットの運動制御に用いられる運動プリミティブの主要な枠組みを年代順に整理し、その長所・短所と応用例を体系的にまとめたサーベイ論文。
原題: Movement Primitives in Robotics: A Comprehensive Survey / Nolan B. Gutierrez, Joseph M. Cloud, William J. Beksi
日本語で読む → - 論文知識グラフロボティクス
ロボットの知識駆動型ミッション設計手法
ROS 2システムに知識グラフを導入し、自律ロボットミッションの効率と知能を高める設計手法を提案。Gazeboでの捜索救助シミュレーションで有効性を実証した。
原題: A Methodology for Designing Knowledge-Driven Missions for Robots / Guillermo GP-Lenza, Carmen DR. Pita-Romero, Miguel Fernandez-Cortizas 他
日本語で読む → - 論文自己適応ロボティクス
SUNSET:ROSベースの自己適応のためのセンサフュージョン意味セグメンテーション例題
ROS2上で動作するセンサフュージョン意味セグメンテーションパイプラインを例題として提供し、故障注入により自己適応アプローチの評価を可能にする。
原題: SUNSET - A Sensor-fUsioN based semantic SegmEnTation exemplar for ROS-based self-adaptation / Andreas Wiedholz, Rafael Paintner, Alwin Hoffmann 他
日本語で読む → - 論文VLAロボティクス
V-VLAPS: 価値誘導型ビジョン・言語・行動モデルプランニング
VLAモデルの計画に軽量な価値ヘッドを追加し、モンテカルロ木探索を高価値な分岐へ誘導することで、長期タスクや分布シフト下での性能を改善する手法を提案。
原題: V-VLAPS: Value-Guided Planning for Vision-Language-Action Models / Ke Ren, Ali Salamatian, Kieran Pattison 他
日本語で読む → - 論文マニピュレーションロボティクス
どこを触り、どう接触するか:幾何認識型sim-to-realマニピュレーションのための階層型RL-MPCフレームワーク
接触を伴う巧みな操作を「どこを触るか(幾何)」と「どう動かすか(接触力学)」に階層化し、高レベルRLが接触意図を予測、低レベル接触陰的MPCが接触モードを最適化する枠組みを提案。多様な形状の押し操作や回転・反転、環境支援型の再配置で、少ないデータ(エンドツーエンド比1/10)で高成功率とゼロショットsim-to-real転移を実現した。
原題: Where to Touch, How to Contact: A Hierarchical RL-MPC Framework for Geometry-Aware Sim-to-Real Manipulation / Zhixian Xie, Yu Xiang, Michael Posa 他
日本語で読む → - 論文マニピュレーションロボティクス
DextER: 身体性推論による言語駆動型巧みな把持生成
指リンクと物体表面の接触を中間表現として自己回帰的に生成し、言語指示に沿った多指ハンドの把持姿勢を高精度に合成する手法を提案。
原題: DextER: Language-driven Dexterous Grasp Generation with Embodied Reasoning / Junha Lee, Eunha Park, Minsu Cho
日本語で読む → - 論文予測機械学習
観測から予測へ:高速道路のオン/オフランプにおける車線変更予測のためのLSTM
高速道路のオン/オフランプ領域に注目し、ExiDドローン車両軌跡データセットを用いて多層LSTMモデルを訓練し、車線変更を予測する手法を提案。最大4秒先までの予測で、オン/オフランプ領域では約76%、一般高速道路区間では94%の精度を達成した。
原題: From Observation to Prediction: LSTM for Vehicle Lane Change Forecasting on Highway On/Off-Ramps / Mohamed Abouras, Catherine M. Elias
日本語で読む → - 論文触覚HCI
遠隔触診におけるしこりの硬さを再現するハイブリッド軟質触覚ディスプレイ
硬いプラットフォームと4×4の軟質空気圧触覚ディスプレイを組み合わせ、軟組織下の硬いしこりを提示する手法を提案し、12名の実験で検出精度が50%から95%以上に向上することを示した。
原題: A Hybrid Soft Haptic Display for Rendering Lump Stiffness in Remote Palpation / Pijuan Yu, Anzu Kawazoe, Alexis Urquhart 他
日本語で読む → - 論文歩行ロボティクス
PUMA: 知覚駆動型統合足場事前分布による機動性拡張四足パルクール
視覚知覚と足場の事前分布を単一段階の学習に統合し、地形特徴から自己中心的な極座標足場を推定して四足ロボットのパルクールを実現するフレームワークを提案。
原題: PUMA: Perception-driven Unified Foothold Prior for Mobility Augmented Quadruped Parkour / Liang Wang, Kanzhong Yao, Yang Liu 他
日本語で読む → - 論文sim2realロボティクス
VLMが自動生成するビヘイビアツリーと能動知覚によるReal2Sim
VLMが自然言語指示から不足する物理パラメータを特定し、ビヘイビアツリーを自動生成して接触を伴うロボット動作で効率的に推定するReal2Simフレームワークを提案。
原題: Real2Sim via Active Perception with Behavior Trees Automatically Generated by VLMs / Alessandro Adami, Sebastian Zudaire, Ruggero Carli 他
日本語で読む → - 論文VLAセキュリティcs.CR
SilentDrift: アクションチャンキングを悪用したVLAモデルへのステルスバックドア攻撃
VLAモデルのアクションチャンキングとデルタポーズ表現に潜む脆弱性を突き、Smootherstep関数とキーフレーム戦略で検知困難なバックドア攻撃を実現した研究。
原題: SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-Action Models / Bingxin Xu, Yuzhang Shang, Binghui Wang 他
日本語で読む → - 論文自己位置推定ロボティクス
自律バスケットボールロボットのためのリアルタイム自己位置推定フレームワーク
バスケットボール競技用ロボットがコート床面の視覚情報のみから自己位置を推定できるよう、古典的手法と学習ベース手法を統合したハイブリッドアルゴリズムを提案した。
原題: Real-Time Localization Framework for Autonomous Basketball Robots / Naren Medarametla, Sreejon Mondal
日本語で読む → - 論文農業ロボティクスロボティクス
イチゴ収穫ロボットの視覚ベース早期故障診断と自己回復
イチゴ収穫ロボットの把持ミスや滑りを視覚で早期に検出し、自己回復するフレームワークを提案。把持位置ずれを補正し、空掴みや滑りを予測して収穫を中断・再試行する。
原題: Vision-Based Early Fault Diagnosis and Self-Recovery for Strawberry Harvesting Robots / Meili Sun, Chunjiang Zhao, Lichao Yang 他
日本語で読む → - 論文ナビゲーションロボティクス
人工ポテンシャル関数を用いた3次元環境におけるフィードバックベース移動ロボットナビゲーション
球や円柱障害物のある3次元空間で、多項式ナビゲーション関数を構築し、目標点に唯一の極小値を持つ条件を解析した。数値シミュレーションで有効性を検証した。
原題: Feedback-Based Mobile Robot Navigation in 3-D Environments Using Artificial Potential Functions Technical Report / Ro'i Lang, Elon Rimon
日本語で読む → - 論文V2I/デジタルツイン画像認識
CD-TWINSAFE: シーン理解と安全性を実現するV2I技術向けROS対応デジタルツイン
車載のステレオカメラと認識・測位スタックから得た情報を4G経由でインフラ側に送り、Unreal Engine 5上のデジタルツインでシーンを再現しつつ安全警告を車両に返すV2Iアーキテクチャを提案・検証した論文。
原題: CD-TWINSAFE: A ROS-enabled Digital Twin for Scene Understanding and Safety Emerging V2I Technology / Amro Khaled, Farah Khaled, Omar Riad 他
日本語で読む → - 論文強化学習機械学習
RN-D: オンポリシー強化学習のための離散化カテゴリカルアクター
連続制御のオンポリシー強化学習において、ガウス分布アクターの代わりに各行動次元を離散ビン上の分布として表現するカテゴリカルアクターと正則化ネットワークを組み合わせ、ベンチマークで最先端性能を達成した。
原題: RN-D: Discretized Categorical Actors for On-Policy Reinforcement Learning / Yuexin Bian, Jie Feng, Tao Wang 他
日本語で読む → - 論文ナビゲーションAI
昆虫に着想を得た視覚的ポイントゴールナビゲーション
昆虫の脳構造(キノコ体と中心複合体)を模倣し、衝突学習による適応的な障害物回避と経路最適化を実現するナビゲーションモデルを開発。標準ベンチマークで最先端モデルと同等の成功率をはるかに低い計算コストで達成した。
原題: Insect-inspired Visual Point-goal Navigation / Yihe Lu, Barbara Webb
日本語で読む → - 論文VLAロボティクス
実用的なVLA基盤モデル
9種類の双腕ロボットから約2万時間の実世界データを収集し、4つのロボットプラットフォームで評価した汎用性の高いVLA基盤モデルLingBot-VLAを開発した。
原題: A Pragmatic VLA Foundation Model / Wei Wu, Fan Lu, Yunnan Wang 他
日本語で読む → - 論文HRIロボティクス
高齢者が運動コーチロボットに求めるフィードバックの頻度
高齢者向け運動コーチロボットの言語・非言語フィードバックの頻度を変えた動画を評価してもらい、一方の頻度が他方の知覚にも影響することを示した。
原題: Older Adults' Preferences for Feedback Cadence from an Exercise Coach Robot / Roshni Kaushik, Reid Simmons
日本語で読む → - 論文軌道予測ロボティクス
SKETCH: 長期的な船舶軌道予測のための意味的キーポイント条件付け
将来の軌道を高レベルの次キーポイント(NKP)で条件付けし、長期予測を大域的意図決定と局所運動モデリングに分解することで、船舶軌道の長期的な予測精度を向上させた研究。
原題: SKETCH: Semantic Key-Point Conditioning for Long-Horizon Vessel Trajectory Prediction / Linyong Gan, Zimo Li, Wenxin Xu 他
日本語で読む → - 論文強化学習セキュリティロボティクス
バックドアが部分観測性と出会うとき:実世界強化学習への攻撃
実世界の強化学習ではLiDARやオドメトリなど制御不能な補助状態が混在するため、条件付き拡散で確率的トリガー分布を学習し、視覚パッチによるバックドア攻撃を安定して発動させる手法を提案した。
原題: When Backdoors Meet Partial Observability: Attacking Real-World Reinforcement Learning / Tairan Huang, Qingqing Ye, Yulin Jin 他
日本語で読む → - 論文触覚ロボティクス
TouchGuide: 触覚ガイダンスによる視覚運動ポリシーの推論時ステアリング
事前学習済みの視覚運動ポリシーの生成過程に、触覚に基づく接触物理モデルで介入し、接触を伴う繊細な操作を高精度化する手法を提案。低コストな触覚データ収集系TacUMIも開発した。
原題: TouchGuide: Inference-Time Steering of Visuomotor Policies via Touch Guidance / Zhemeng Zhang, Jiahua Ma, Xincheng Yang 他
日本語で読む → - 論文ソフトロボティクス/トポロジー最適化ロボティクス
SimTO:特注ソフトロボットグリッパのための二段階シミュレーション駆動トポロジー最適化フレームワーク
接触リッチな把持シミュレーションから荷重ケースを自動抽出し、トポロジー最適化で対象物の形状に特化したソフトグリッパを設計する二段階フレームワークを提案。
原題: SimTO: A two-stage, simulation-driven topology optimization framework for bespoke soft robotic grippers / Kurt Enkera, Josh Pinskier, Marcus Gallagher 他
日本語で読む → - 論文深度推定画像認識
ニューラル放射輝度場によるベイズ単眼深度精密化
単眼深度推定の粗い推定をNeRFの深度情報とベイズ融合し、高周波の細部を反復的に補う枠組みMDENeRFを提案。
原題: Bayesian Monocular Depth Refinement via Neural Radiance Fields / Arun Muthukkumar
日本語で読む → - 論文手術ロボティクスロボティクス
手術把持・牽引のための教師ありMixture-of-Experts
ステレオ内視鏡画像と150件未満のデモのみで、位相構造を持つ手術操作を学習する教師ありMoEアーキテクチャを提案し、腸管把持・牽引タスクで汎用VLAを上回る性能と分布外頑健性を示した。
原題: Supervised Mixture-of-Experts for Surgical Grasping and Retraction / Lorenzo Mazza, Ariel Rodriguez, Rayan Younis 他
日本語で読む → - 論文歩行制御
脚式ロボットの歩行制御におけるモデル予測パス積分制御のためのサンプリング戦略設計
脚式ロボットの歩行制御にMPPIを適用する際のサンプリング戦略を体系的に検討し、非構造化法とスプライン法を比較して制御の滑らかさや性能への影響を明らかにした。
原題: Sampling Strategy Design for Model Predictive Path Integral Control on Legged Robot Locomotion / Chuyuan Tao, Fanxin Wang, Haolong Jiang 他
日本語で読む → - 論文安全強化学習機械学習
ナイトメア・ドリーマー:危険状態を夢見て先回りする安全強化学習
学習した世界モデルで将来の安全違反を予測し、それを避けるように行動計画を立てるモデルベース安全強化学習手法を提案。画像入力のみで安全性と効率を大幅に改善した。
原題: Nightmare Dreamer: Dreaming About Unsafe States And Planning Ahead / Oluwatosin Oseni, Shengjie Wang, Jun Zhu 他
日本語で読む → - 論文位置推定画像認識
惑星探査の地空ロボットチーム向けドメイン汎化クロスビュー位置推定のための視覚基盤モデル
視覚基盤モデルによるセマンティックセグメンテーションと大量の合成データを活用し、地上ローバーが限られた視野の単眼RGB画像から航空マップ上で自己位置を推定するクロスビュー二重エンコーダ手法を提案。実世界の探査アナログ施設で取得したデータセットも公開した。
原題: Vision Foundation Models for Domain Generalisable Cross-View Localisation in Planetary Ground-Aerial Robotic Teams / Lachlan Holden, Feras Dayoub, Alberto Candela 他
日本語で読む → - 論文変形物体操作ロボティクス
SCOPE: 変形可能な線状物体の計画的な進化のための滑らかな凸最適化
変形可能な線状物体(DLO)のモデリングと操作のための高速な凸近似フレームワークSCOPEを提案し、シミュレーションで滑らかな形状軌道生成を実証した。
原題: SCOPE: Smooth Convex Optimization for Planned Evolution of Deformable Linear Objects / Ali Jnadi, Hadi Salloum, Yaroslav Kholodov 他
日本語で読む → - 論文マニピュレーションロボティクス
電子機器の協調的双腕ロボット分解のためのグラフベース適応計画(eGRAP)
視覚・動的計画・双腕実行を統合し、電子機器を自律分解するeGRAPを提案。HDDで高い成功率と効率的なサイクルタイムを実証。
原題: Graph-Based Adaptive Planning for Coordinated Dual-Arm Robotic Disassembly of Electronic Devices (eGRAP) / Adip Ranjan Das, Maria Koskinopoulou
日本語で読む →