論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/1/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御ロボティクス
Judgelight: 閉部分歩行の圧縮によるマルチエージェント経路探索の軌道レベル事後最適化
学習ベースのMAPFソルバが生成した実行可能だが無駄な動きを含む軌道に対し、閉部分歩行を圧縮して冗長な動きを除去する事後最適化手法を提案し、ILPで厳密に解くことでコストを約20%削減した。
原題: Judgelight: Trajectory-Level Post-Optimization for Multi-Agent Path Finding via Closed-Subwalk Collapsing / Yimin Tang, Sven Koenig, Erdem Bıyık
日本語で読む → - 論文マニピュレーションロボティクス
ジャストインタイム情報木:可操作度を考慮した漸近最適動作計画
サンプリングベースの動作計画を改良し、エッジ接続とサンプリング密度を動的に調整して初期経路を高速に発見しつつ、可操作度と軌道コストのバランスを取るJIT*を提案した。
原題: Just in time Informed Trees: Manipulability-Aware Asymptotically Optimized Motion Planning / Kuanqi Cai, Liding Zhang, Xinwen Su 他
日本語で読む → - 論文フィールドマッピングロボティクス
テイラー展開によるロボットフィールドマッピングの位置推定誤差補正:ガウス過程を用いた手法
ガウス過程によるフィールドマッピングで、ロボットの位置推定誤差が予測精度を低下させる問題に対し、カーネル関数の微分可能性を利用した2次補正アルゴリズムを提案し、シミュレーションで精度と計算効率の向上を示した。
原題: A Taylor Series Approach to Correct Localization Errors in Robotic Field Mapping using Gaussian Processes / Muzaffar Qureshi, Tochukwu Elijah Ogri, Kyle Volle 他
日本語で読む → - 論文自動運転ロボティクス
多目的自動運転のパレート空間を学習する:モジュール式データ駆動アプローチ
自然な走行軌跡データから安全性・効率性・インタラクションのトレードオフを学習し、パレート最適な運転状態を特定する枠組みを提案。TGSIMデータで検証し、パレート最適状態は稀であることを示した。
原題: Learning the Pareto Space of Multi-Objective Autonomous Driving: A Modular, Data-Driven Approach / Mohammad Elayan, Wissam Kontar
日本語で読む → - 論文深度推定画像認識
UAV林業における樹枝の深度推定のゴールドスタンダードに向けて:深層ステレオマッチング手法のベンチマーク
8つのステレオ深度推定手法を4つの標準ベンチマークと新規の樹枝データセットでゼロショット評価し、DEFOMが植生環境で最も頑健であることを示した。
原題: Towards Gold-Standard Depth Estimation for Tree Branches in UAV Forestry: Benchmarking Deep Stereo Matching Methods / Yida Lin, Bing Xue, Mengjie Zhang 他
日本語で読む → - 論文モジュラーロボットロボティクス
変形可能な四辺形モジュールロボットの自己再構成計画
変形可能な四辺形モジュールロボットのための、安定した接続を保証する自己再構成計画アルゴリズムを提案し、物理プラットフォームで実現可能性を示した。
原題: Self-Reconfiguration Planning for Deformable Quadrilateral Modular Robots / Jie Gu, Hongrun Gao, Zhihao Xia 他
日本語で読む → - 論文模倣学習ロボティクス
PALM: 知覚アライメントによる局所視覚運動ポリシーの汎化性向上
操作ポリシーを大域的な粗い部分と局所的な細かい部分に分け、局所レベルで視覚的注目と固有受容感覚表現を揃えることで、追加の入力やデータ収集なしに分布外環境への汎化性能を高めた研究。
原題: PALM: Enhanced Generalizability for Local Visuomotor Policies via Perception Alignment / Ruiyu Wang, Zheyu Zhuang, Danica Kragic 他
日本語で読む → - 論文筋電位/意図検出ロボティクス
ReactEMG Stroke:健常者から脳卒中患者への筋電位意図検出の少数ショット適応
健常者の大規模sEMGデータで事前学習したモデルを、脳卒中患者ごとの少量データで微調整することで、キャリブレーション負担を減らしつつ意図検出精度と頑健性を向上させる手法を提案した。
原題: ReactEMG Stroke: Healthy-to-Stroke Few-shot Adaptation for sEMG-Based Intent Detection / Runsheng Wang, Katelyn Lee, Xinyue Zhu 他
日本語で読む → - 論文VLAロボティクス
AC^2-VLA: 行動文脈を考慮した適応的計算による効率的なロボットマニピュレーション
VLAモデルの推論における時間・空間・深さ方向の冗長性に着目し、行動文脈に基づいて計算を適応的に再利用・削減するフレームワークを提案。密なモデルと同等の成功率を保ちつつ最大1.79倍の高速化とFLOPs29.4%削減を実現した。
原題: AC^2-VLA: Action-Context-Aware Adaptive Computation in Vision-Language-Action Models for Efficient Robotic Manipulation / Wenda Yu, Tianshi Wang, Fengling Li 他
日本語で読む → - 論文マニピュレーションロボティクス
ロボットマニピュレータ作業のための動的手ジェスチャ認識
ロボットマニピュレータの各作業に特定のジェスチャを割り当て、ガウス混合モデルに基づく教師なし学習で動的な変形に対応しながらリアルタイムに認識する手法を提案した。
原題: Dynamic Hand Gesture Recognition for Robot Manipulator Tasks / Dharmendra Sharma, Peeyush Thakur, Sandeep Gupta 他
日本語で読む → - 論文触覚ロボティクス
TouchGuide: 触覚ガイダンスによる視覚運動ポリシーの推論時ステアリング
事前学習済みの視覚運動ポリシーの生成過程に、触覚に基づく接触物理モデルで介入し、接触を伴う繊細な操作を高精度化する手法を提案。低コストな触覚データ収集系TacUMIも開発した。
原題: TouchGuide: Inference-Time Steering of Visuomotor Policies via Touch Guidance / Zhemeng Zhang, Jiahua Ma, Xincheng Yang 他
日本語で読む → - 論文マニピュレーションロボティクス
DemoBot:第三者視点の人間動画から器用な両手マニピュレーションを効率的に学習
1本の注釈なしRGB-D動画から両腕多指ロボットの操作スキルを獲得する学習フレームワークを提案し、動きの事前分布と強化学習を組み合わせて長期的な両手組み立てタスクを実現した。
原題: DemoBot: Efficient Learning of Bimanual Manipulation with Dexterous Hands From Third-Person Human Videos / Yucheng Xu, Xiaofeng Mao, Elle Miller 他
日本語で読む → - 論文軽航空機ドローンロボティクス
光を活用した軽航空機マイクロドローンの航続時間とナビゲーションの向上
ヘリウム気球型の軽航空機マイクロドローンに太陽電池と光ビーコン航法を統合し、エネルギー収穫と単一光源への自律ナビゲーションを実現した研究。
原題: Exploiting Light To Enhance The Endurance and Navigation of Lighter-Than-Air Micro-Drones / Harry Huang, Talia Xu, Marco Zúñiga Zamalloa
日本語で読む → - 論文VLAセキュリティcs.CR
SilentDrift: アクションチャンキングを悪用したVLAモデルへのステルスバックドア攻撃
VLAモデルのアクションチャンキングとデルタポーズ表現に潜む脆弱性を突き、Smootherstep関数とキーフレーム戦略で検知困難なバックドア攻撃を実現した研究。
原題: SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-Action Models / Bingxin Xu, Yuzhang Shang, Binghui Wang 他
日本語で読む → - 論文UAV/情報計画ロボティクス
離散ガウス過程表現を用いたUAV雑草マッピングのための能動的情報計画
UAVによる雑草マッピングにおいて、ガウス過程の離散化手法の違いが地図品質とミッション性能に与える影響を調査し、情報に基づく経路計画を実装した研究。
原題: Active Informative Planning for UAV-based Weed Mapping using Discrete Gaussian Process Representations / Jacob Swindell, Marija Popović, Riccardo Polvara
日本語で読む → - 論文VLA画像認識
Fast-ThinkAct: 言語化可能な潜在プランニングによる効率的な視覚-言語-行動推論
推論トレースを潜在的な思考連鎖に蒸留し、推論VLAの推論遅延を最大89.3%削減しつつ長期的プランニングや適応性能を維持する手法を提案。
原題: Fast-ThinkAct: Efficient Vision-Language-Action Reasoning via Verbalizable Latent Planning / Chi-Pin Huang, Yunze Man, Zhiding Yu 他
日本語で読む → - 論文HRIロボティクス
高齢者が運動コーチロボットに求めるフィードバックの頻度
高齢者向け運動コーチロボットの言語・非言語フィードバックの頻度を変えた動画を評価してもらい、一方の頻度が他方の知覚にも影響することを示した。
原題: Older Adults' Preferences for Feedback Cadence from an Exercise Coach Robot / Roshni Kaushik, Reid Simmons
日本語で読む → - 論文VLAロボティクス
実用的なVLA基盤モデル
9種類の双腕ロボットから約2万時間の実世界データを収集し、4つのロボットプラットフォームで評価した汎用性の高いVLA基盤モデルLingBot-VLAを開発した。
原題: A Pragmatic VLA Foundation Model / Wei Wu, Fan Lu, Yunnan Wang 他
日本語で読む → - 論文物体検出画像認識
SOTIF条件下での2D物体検出における大規模視覚言語モデルの比較評価
自動運転の安全設計で重要となるSOTIF条件下での2D物体検出について、10種類の大規模視覚言語モデルをベンチマークデータセットで評価し、従来の専用検出器と性能を比較した。
原題: A Comparative Evaluation of Large Vision-Language Models for 2D Object Detection under SOTIF Conditions / Ji Zhou, Yilin Ding, Yongqi Zhao 他
日本語で読む → - 論文VLAロボティクス
視覚プロンプトを用いた視覚-言語-行動モデルによるオフロード自動運転
オフロード自動運転向けに、セマンティックセグメンテーションを視覚プロンプトとして使い自己整合性付き思考連鎖で推論するVLAフレームワークOFF-EMMAを提案し、軌道計画精度を改善した。
原題: A Vision-Language-Action Model with Visual Prompt for OFF-Road Autonomous Driving / Liangdong Zhang, Yiming Nie, Haoyang Li 他
日本語で読む → - 論文VLAロボティクス
デモンストレーション不要のLLMエージェントによるロボット制御
ソフトウェア開発用のLLMエージェントフレームワークをそのままロボット操作に適用し、デモやファインチューニングなしでLIBEROなどで高い成功率を達成した。
原題: Demonstration-Free Robotic Control via LLM Agents / Brian Y. Tsui, Alan Y. Fang, Tiffany J. Hwu
日本語で読む → - 論文分散ロボティクスロボティクス
BlazeAIoT: エッジ・フォグ・クラウドを横断する分散ロボティクス向けモジュール型多層プラットフォーム
エッジ・フォグ・クラウドにまたがる分散ロボティクスを統合するモジュール型プラットフォームBlazeAIoTを提案し、ナビゲーションや大規模メッセージ処理のシナリオでリアルタイム性能を検証した。
原題: BlazeAIoT: A Modular Multi-Layer Platform for Real-Time Distributed Robotics Across Edge, Fog, and Cloud Infrastructures / Cedric Melancon, Julien Gascon-Samson, Maarouf Saad 他
日本語で読む → - 論文sim2realロボティクス
サイバーフィジカルモビリティラボにおけるゼロショットMARLベンチマーク
シミュレーション・デジタルツイン・実機を統合したCPM Lab上で、MARLによる自動運転車両の運動計画ポリシーのゼロショットsim-to-real転送を評価する再現可能なベンチマークを提案し、性能劣化の要因を分析した。
原題: Zero-Shot MARL Benchmark in the Cyber-Physical Mobility Lab / Julius Beerwerth, Jianye Xu, Simon Schäfer 他
日本語で読む → - 論文マニピュレーションロボティクス
SPINEグリッパ: ねじれ受動機構による受動モード遷移グリッパ
単一アクチュエータで、入力トルクの大きさに応じて把持と双方向の連続的な手先回転を自動的に切り替える受動グリッパを提案し、機構モデルと実験で有効性を示した。
原題: SPINE Gripper: A Twisted Underactuated Mechanism-based Passive Mode-Transition Gripper / JaeHyung Jang, JunHyeong Park, Joong-Ku Lee 他
日本語で読む → - 論文制御/LLMロボティクス
宇宙機制御のための自律推論:グループ相対方策最適化を用いた大規模言語モデルフレームワーク
推論可能な大規模言語モデルとグループ相対方策最適化(GRPO)を組み合わせ、線形系から宇宙機の姿勢制御まで多様な制御問題で安定化方策を学習する手法を提案した。
原題: Autonomous Reasoning for Spacecraft Control: A Large Language Model Framework with Group Relative Policy Optimization / Amit Jain, Richard Linares
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
WaveMan: ヒューマノイドロボットのためのミリ波による部屋規模の人間インタラクション知覚
ミリ波センシングを用いて、ユーザーの位置に依存せずプライバシーを守りながら部屋規模で人間のインタラクションを認識するシステムを提案し、未学習の位置でも高精度を実現した。
原題: WaveMan: mmWave-Based Room-Scale Human Interaction Perception for Humanoid Robots / Yuxuan Hu, Kuangji Zuo, Boyu Ma 他
日本語で読む → - 論文触覚HCI
遠隔触診におけるしこりの硬さを再現するハイブリッド軟質触覚ディスプレイ
硬いプラットフォームと4×4の軟質空気圧触覚ディスプレイを組み合わせ、軟組織下の硬いしこりを提示する手法を提案し、12名の実験で検出精度が50%から95%以上に向上することを示した。
原題: A Hybrid Soft Haptic Display for Rendering Lump Stiffness in Remote Palpation / Pijuan Yu, Anzu Kawazoe, Alexis Urquhart 他
日本語で読む → - 論文航空管制/強化学習機械学習
オンライン行動スタッキングによる航空管制の強化学習性能向上
強化学習で航空管制を学習する際、推論時に基本行動を組み合わせて複合的な管制指示を生成するオンライン行動スタッキングを提案し、小さな行動空間でも実用的な性能を実現した。
原題: Online Action-Stacking Improves Reinforcement Learning Performance for Air Traffic Control / Ben Carvell, George De Ath, Eseoghene Benjamin 他
日本語で読む → - 論文強化学習セキュリティロボティクス
バックドアが部分観測性と出会うとき:実世界強化学習への攻撃
実世界の強化学習ではLiDARやオドメトリなど制御不能な補助状態が混在するため、条件付き拡散で確率的トリガー分布を学習し、視覚パッチによるバックドア攻撃を安定して発動させる手法を提案した。
原題: When Backdoors Meet Partial Observability: Attacking Real-World Reinforcement Learning / Tairan Huang, Qingqing Ye, Yulin Jin 他
日本語で読む → - 論文sim2realロボティクス
データ駆動型テラメカニクスによる月面ローバー向けリアルタイムシミュレータ
月面ローバーの走行を高忠実度で再現するため、実験とシミュレーションから得たデータで滑りと沈下の回帰モデルを構築し、リアルタイムで動作するテラメカニクスシミュレータを実現した。
原題: Data-Driven Terramechanics Approach Towards a Realistic Real-Time Simulator for Lunar Rovers / Jakob M. Kern, James M. Hurrell, Shreya Santra 他
日本語で読む →