論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/1/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文オフライン強化学習機械学習
ロバストなスタイル整合下での高品質行動のオフライン強化学習
サブ軌跡ラベルによるスタイル監督を用いたオフライン強化学習において、スタイルとタスク性能の両立を図るSCIQLを提案し、従来手法より優れた性能を示した。
原題: Offline Reinforcement Learning of High-Quality Behaviors Under Robust Style Alignment / Mathieu Petitbois, Rémy Portelas, Sylvain Lamprier
日本語で読む → - 論文群制御cond-mat.soft
形態がもたらす群れの凝集:設計の偶発性への対処からスイートスポット、そして豊かな表現力へ
ロボットの物理的設計を利用した形態計算において、自己整列強度の調整が光走性タスクの成功率に劇的に影響することを実験とシミュレーションで示し、スイートスポットの存在と多様な集団行動の表現可能性を明らかにした。
原題: Aggregating swarms through morphology handling design contingencies: from the sweet spot to a rich expressivity / Jeremy Fersula, Nicolas Bredeche, Olivier Dauchot
日本語で読む → - 論文飛行制御ロボティクス
LOONG: 障害物環境におけるMAVのオンライン時間最適自律飛行
混雑環境でMAVが高速に飛ぶため、模倣学習で時間配分を加速した時間最適軌道生成と、可変ホライズンで安全飛行回廊制約を扱うMPCCを統合し、実機で最高18m/sを達成した。
原題: LOONG: Online Time-Optimal Autonomous Flight for MAVs in Cluttered Environments / Xin Guan, Fangguo Zhao, Qianyi Wang 他
日本語で読む → - 論文タスク計画/安全性ロボティクス
PROTEA: ロボットのタスク計画と実行を安全に守る
LLMを審判として使う防御機構PROTEAを提案し、基盤モデルベースのロボットタスク計画に対する敵対的攻撃への耐性を評価・強化する。
原題: PROTEA: Securing Robot Task Planning and Execution / Zainab Altaweel, Mohaiminul Al Nahian, Jake Juettner 他
日本語で読む → - 論文VLAロボティクス
視覚言語行動モデルのための安定した言語ガイダンス
VLAモデルが言語の言い回しの変化に弱い「モダリティ崩壊」を解決するため、意味意図と視覚的アフォーダンスを分離する確率的フレームワークRSSを提案し、敵対的な言語摂動下でも頑健な操作性能を実現した。
原題: Stable Language Guidance for Vision-Language-Action Models / Zhihao Zhan, Yuhao Chen, Jiaying Zhou 他
日本語で読む → - 論文ナビゲーションロボティクス
AION:二重ポリシー強化学習による屋内飛行物体ゴールナビゲーション
屋内でドローンが未知環境を探索し、指定された物体へ自律的に到達するための、探索と到達を別々のポリシーに分けた強化学習フレームワークを提案した論文。
原題: AION: Aerial Indoor Object-Goal Navigation Using Dual-Policy Reinforcement Learning / Zichen Yan, Yuchen Hou, Shenao Wang 他
日本語で読む → - 論文ニューロモルフィック/障害物検出ロボティクス
イベントベース異種情報処理によるオンライン視覚的障害物検出と位置推定
ANNとSNNを組み合わせたハイブリッド構成で、静的特徴とイベントセンサの動的情報を並行処理し、未モデル障害物の検出・位置推定を省リソースで行う枠組みを提案。
原題: Event-based Heterogeneous Information Processing for Online Vision-based Obstacle Detection and Localization / Reza Ahmadvand, Sarah Safura Sharif, Yaser Mike Banad
日本語で読む → - 論文触覚ロボティクス
SandWorm: 粒状媒体中で動作するスクリュー駆動ロボットのためのイベントベース視触覚知覚と能動振動
粒状媒体中で動くスクリュー駆動ロボットに、振動する弾性体とイベントカメラを組み合わせた視触覚センサを搭載し、地中の物体認識や力推定、パイプライン浚渫などの作業を実現した。
原題: SandWorm: Event-based Visuotactile Perception with Active Vibration for Screw-Actuated Robot in Granular Media / Shoujie Li, Changqing Guo, Junhao Gong 他
日本語で読む → - 論文VLAロボティクス
RoboBrain 2.5:奥行きを見据え、時間を心に刻む
深度認識に基づく3D空間推論と、時間的な進捗予測を統合した次世代の身体性AI基盤モデルを提案し、複雑なマニピュレーションの精度と実行認識を向上させた。
原題: RoboBrain 2.5: Depth in Sight, Time in Mind / Huajie Tan, Enshen Zhou, Zhiyu Li 他
日本語で読む → - 論文シーン生成画像認識
SceneFoundry: インタラクティブな無限3D世界の生成
言語プロンプトから、関節付き家具を含むアパート規模の物理的に実現可能な3D環境を拡散モデルで自動生成し、ロボット学習用のシーンを提供するフレームワーク。
原題: SceneFoundry: Generating Interactive Infinite 3D Worlds / ChunTeng Chen, YiChen Hsu, YiWen Liu 他
日本語で読む → - 論文ドローン認識/レーダーphysics.app-ph
μDopplerTag: 協調的マイクロドップラータグによるCNNベースのドローン認識
ドローンのブレードに共振型電磁ステッカーを取り付け、固有のマイクロドップラー署名を生成することで、CNNを用いて低SNR環境下でも高精度に機種識別する手法を提案した。
原題: {\mu}DopplerTag: CNN-Based Drone Recognition via Cooperative Micro-Doppler Tagging / O. Yerushalimov, D. Vovchuk, A. Glam 他
日本語で読む → - 論文キャリブレーションロボティクス
DST-Calib: 二重経路・自己教師あり・ターゲット不要のLiDAR-カメラ外部キャリブレーションネットワーク
LiDARとカメラの外部キャリブレーションを、専用ターゲットや高精度正解ラベルなしでオンライン実行できる自己教師ありネットワークを提案。両側データ拡張と差分マップ構築により、汎化性能と精度を向上させた。
原題: DST-Calib: A Dual-Path, Self-Supervised, Target-Free LiDAR-Camera Extrinsic Calibration Network / Zhiwei Huang, Yanwei Fu, Yi Zhou 他
日本語で読む → - 論文歩行ロボティクス
ヒューマノイド制御における大規模事前学習と効率的ファインチューニングの橋渡し
オフポリシーSACによる大規模事前学習でヒューマノイド歩行を実機ゼロショット展開し、モデルベース手法で新環境に安全にファインチューニングする枠組みを提案。
原題: Towards Bridging the Gap between Large-Scale Pretraining and Efficient Finetuning for Humanoid Control / Weidong Huang, Zhehan Li, Hangxin Liu 他
日本語で読む → - 論文探査/ナビゲーションロボティクス
FARE: 高速・低速エージェント型ロボット探査
LLMによる大域的推論と強化学習による局所制御を組み合わせ、未知環境を効率的に探査する階層型フレームワークを提案し、実機の大規模建物環境で検証した。
原題: FARE: Fast-Slow Agentic Robotic Exploration / Shuhao Liao, Xuxin Lv, Jeric Lew 他
日本語で読む → - 論文LiDARオドメトリロボティクス
回転駆動型LiDARシステムのための高精度キャリブレーションと堅牢なLiDAR慣性オドメトリ
回転するLiDARのモータとLiDAR間のキャリブレーション手法と、特徴の少ない領域でも適応的にダウンサンプリングと地図解像度を調整して堅牢に自己位置推定するLiDAR慣性オドメトリを提案した。
原題: Accurate Calibration and Robust LiDAR-Inertial Odometry for Spinning Actuated LiDAR Systems / Zijie Chen, Xiaowei Liu, Yong Xu 他
日本語で読む → - 論文VLA画像認識
DTP: 視覚言語行動モデルのための簡便かつ効果的な妨害トークン枝刈りフレームワーク
VLAモデルがタスク無関係領域の画像トークンに過剰に注意する問題を解決するため、動的に検出・枝刈りするプラグアンドプレイのDTPフレームワークを提案し、タスク成功率を改善した。
原題: DTP: A Simple yet Effective Distracting Token Pruning Framework for Vision-Language Action Models / Chenyang Li, Jieyuan Liu, Bin Li 他
日本語で読む → - 論文sim2realロボティクス
ニューラルスタイル変換に基づくエンドツーエンドの実例ベースsim-to-real強化学習方策転移とロボット切断への応用
画像処理のニューラルスタイル変換を再解釈し、未ペア・未ラベルの実世界データから訓練データを合成することで、強化学習方策のsim-to-real転移を実現する手法を提案し、未知材料のロボット切断に適用して有効性を示した。
原題: End-to-end example-based sim-to-real RL policy transfer based on neural stylisation with application to robotic cutting / Jamie Hathaway, Alireza Rastegarpanah, Rustam Stolkin
日本語で読む → - 論文歩行ロボティクス
GPO: 脚式ロボットの移動と全身制御のための成長型方策最適化
初期段階で行動空間を制限し徐々に拡大する時変行動変換を導入することで、トルクベース制御の脚式ロボットの強化学習を安定化・高性能化する手法GPOを提案し、四足・六足ロボットで実機ゼロショット展開まで検証した。
原題: GPO: Growing Policy Optimization for Legged Robot Locomotion and Whole-Body Control / Shuhao Liao, Peizhuo Li, Xinrong Yang 他
日本語で読む → - 論文制御/MPC制御
状態・入力依存の不確かさに対する学習ベースの縮小外乱不変チューブ
状態と入力に依存する不確かさの下で、チューブMPCに使える縮小外乱不変チューブを学習で構築し、データが増えるほどチューブが狭まりつつ安全性を保証する手法を提案した。
原題: Learning-Based Shrinking Disturbance-Invariant Tubes for State- and Input-Dependent Uncertainty / Abdelrahman Ramadan, Sidney Givigi
日本語で読む → - 論文合成データ生成ロボティクス
Nimbus: 具現化知能向け統合合成データ生成フレームワーク
ナビゲーションとマニピュレーションの合成データ生成パイプラインを統合し、非同期実行と動的スケジューリングでスループットを2〜3倍向上させるフレームワークを提案。
原題: Nimbus: A Unified Embodied Synthetic Data Generation Framework / Zeyu He, Yuchang Zhang, Yuanzhen Zhou 他
日本語で読む → - 論文逆ゲーム/ベイズ推論機械学習
高次元マルチモーダル観測を用いたベイズ逆ゲーム
複数エージェントの非協力ゲームにおいて、観測データから隠れた目的関数の事後分布を近似ベイズ推論で推定し、安全な意思決定を可能にするフレームワークを提案。
原題: Bayesian Inverse Games with High-Dimensional Multi-Modal Observations / Yash Jain, Xinjie Liu, Lasse Peters 他
日本語で読む → - 論文マルチエージェント強化学習ロボティクス
隣接エージェント行動推定によるマルチエージェント強化学習
各エージェントが局所情報のみから隣接エージェントの行動を推定する軽量モジュールを導入し、明示的な行動共有なしに協調方策を学習するTD3互換のフレームワークを提案。双腕ロボットの協調物体持ち上げタスクで有効性を実証した。
原題: Multiagent Reinforcement Learning with Neighbor Action Estimation / Zhenglong Luo, Zhiyong Chen, Aoxiang Liu
日本語で読む → - 論文VLAロボティクス
視覚言語モデルによる園芸ロボットのタスク計画
VLMが異種データを能動的に照会してロボットのタスク計画を導くモジュール式フレームワークを提案し、作物モニタリングのベンチマークで性能を評価した。
原題: Visual-Language-Guided Task Planning for Horticultural Robots / Jose Cuaran, Kendall Koe, Aditya Potnis 他
日本語で読む → - 論文マニピュレーションロボティクス
タスク関連特徴を際立たせる:ロボットマニピュレーションの汎化を高めるオブジェクト中心表現
画像を物体ごとのスロット表現にまとめるSBOCRを導入し、照明・テクスチャ・妨害物の変化に対するマニピュレーション方策の汎化性能をシミュレーションと実機で比較評価した。
原題: Spotlighting Task-Relevant Features: Object-Centric Representations for Better Generalization in Robotic Manipulation / Alexandre Chapin, Bruno Machado, Emmanuel Dellandréa 他
日本語で読む → - 論文自動運転ロボティクス
MTDrive: 自動運転のためのマルチターン対話型強化学習
MLLMと強化学習を組み合わせ、環境フィードバックに基づいて軌道を反復的に改善するマルチターン枠組みを提案し、NAVSIMで優れた性能を示した。
原題: MTDrive: Multi-turn Interactive Reinforcement Learning for Autonomous Driving / Xidong Li, Mingyu Guo, Chenchao Xu 他
日本語で読む → - 論文移動ロボット経路追従ロボティクス
速度・加速度制約を考慮した動的ウィンドウ純追従法
純追従法を速度空間で再定式化し、速度・加速度制約を陽に考慮することで、オーバーシュートを抑えて経路追従精度を向上させる手法DWPPを提案した。
原題: DWPP: Dynamic Window Pure Pursuit Considering Velocity and Acceleration Constraints / Fumiya Ohnishi, Masaki Takahashi
日本語で読む → - 論文世界モデル画像認識
ロボット制御のための因果的世界モデリング
行動と視覚変化の因果関係を学習する自己回帰拡散フレームワークLingBot-VAを提案し、長期マニピュレーションや実環境での汎化性能を実証した。
原題: Causal World Modeling for Robot Control / Lin Li, Qihang Zhang, Yiming Luo 他
日本語で読む → - 論文VLAロボティクス
AIR-VLA: 空中マニピュレーションのための視覚-言語-行動システム
空中マニピュレーションに特化した初のVLAベンチマークを構築し、物理シミュレーション環境と3000件の遠隔操作デモデータセットを公開して、既存VLAモデルの性能と限界を評価した。
原題: AIR-VLA: Vision-Language-Action Systems for Aerial Manipulation / Jianli Sun, Bin Tian, Qiyao Zhang 他
日本語で読む → - 論文タスクプランニングロボティクス
ゼロ知識タスクプランニングへの言語ベースアプローチ
タスク固有の知識なしに目標達成の行動列を生成する「ゼロ知識タスクプランニング」を定式化し、LLMで自然言語指示をサブタスクに分解してビヘイビアツリーを生成・実行中に修正する手法を提案した。
原題: Towards Zero-Knowledge Task Planning via a Language-based Approach / Liam Merz Hoffmeister, Brian Scassellati, Daniel Rakita
日本語で読む → - 論文sim2real画像認識
Sim2real画像変換による固定カメラデータからの視点ロバスト方策
固定カメラの実世界データとシミュレーションを組み合わせ、未見の視点でも頑健に動作するロボットマニピュレーション方策を実現する画像変換手法MANGOを提案。
原題: Sim2real Image Translation Enables Viewpoint-Robust Policies from Fixed-Camera Datasets / Jeremiah Coholich, Justin Wit, Robert Azarcon 他
日本語で読む →