論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文制御理論math.OC
ギブス変分原理によるセンサベース制御の基本原理限界
部分観測下のフィードバック制御における最小期待コストの下界を、ギブス変分原理を用いて導出し、自己無撞着な改良により厳密な数値限界を計算する手法を提案した。
原題: Fundamental Limits for Sensor-Based Control via the Gibbs Variational Principle / Vincent Pacelli, Evangelos A. Theodorou
日本語で読む → - 論文ヒューマノイド動作生成機械学習
PhysMoDPO: 選好最適化による物理的に妥当なヒューマノイド動作生成
全身制御器(WBC)を訓練に組み込み、拡散モデルが生成する動作を物理法則とテキスト指示の両方に適合させる選好最適化フレームワークを提案し、シミュレーションと実機G1ヒューマノイドで有効性を示した。
原題: PhysMoDPO: Physically-Plausible Humanoid Motion with Preference Optimization / Yangsong Zhang, Anujith Muraleedharan, Rikhat Akizhanov 他
日本語で読む → - 論文物体位置推定ロボティクス
地図より記憶を:再構成なしの3D物体位置推定
3Dシーン再構成を行わず、姿勢付きRGB-Dキーフレームのみを記憶して視覚言語モデルで候補を絞り、必要時に奥行き逆投影と多視点融合で対象の3D位置を推定する手法を提案。
原題: Memory Over Maps: 3D Object Localization Without Reconstruction / Rui Zhou, Xander Yap, Jianwen Cao 他
日本語で読む → - 論文VLA画像認識
動的環境における汎化可能なロボットマニピュレーションに向けて
動的環境でのロボット操作のための大規模データセットDOMINOとベンチマークを構築し、動きを考慮したVLAモデルPUMAを提案した論文。
原題: Towards Generalizable Robotic Manipulation in Dynamic Environments / Heng Fang, Shangru Li, Shuhan Wang 他
日本語で読む → - 論文3D再構成画像認識
FTSplat: フィードフォワード三角形スプラッティングネットワーク
多視点画像から直接三角形メッシュを生成するフィードフォワード型の3D再構成手法を提案し、シミュレーションに即利用可能なモデルを単一パスで生成する。
原題: FTSplat: Feed-forward Triangle Splatting Network / Xiong Jinlin, Li Can, Shen Jiawei 他
日本語で読む → - 論文支援ロボット/インタラクションロボティクス
制御なき制御:自律型支援ロボットの暗黙的インタラクションパラダイムの定義
自律支援ロボットの操作をユーザーの自然な行動手がかりで調整する「暗黙的制御」というインタラクションパラダイムを、2つの設計事例の質的フィードバック分析から定義し、設計ガイドラインを導出した。
原題: Control Without Control: Defining Implicit Interaction Paradigms for Autonomous Assistive Robots / Janavi Gupta, Kavya Puthuveetil, Dimitra Tsakona 他
日本語で読む → - 論文物体検出画像認識
解釈可能な物体検出と信頼できるマルチモーダルAIのためのKolmogorov-Arnoldネットワークと視覚言語基盤モデルを用いたYOLOv10
YOLOv10の検出信頼度を、幾何学的・意味的特徴に基づいてKolmogorov-Arnoldネットワークでモデル化し、信頼性の解釈可能な可視化を実現した。さらに、BLIPによるシーン記述でマルチモーダルなインターフェースを提供する。
原題: YOLOv10 with Kolmogorov-Arnold networks and vision-language foundation models for interpretable object detection and trustworthy multimodal AI in computer vision perception / Marios Impraimakis, Daniel Vazquez, Feiyu Zhou
日本語で読む → - 論文自動運転画像認識
BEVLM: LLMの意味知識をBird's-Eye View表現に蒸留する
LLMの意味理解能力をBEV表現に統合し、自動運転の空間推論と安全性を向上させるフレームワークを提案した。
原題: BEVLM: Distilling Semantic Knowledge from LLMs into Bird's-Eye View Representations / Thomas Monninger, Shaoyuan Xie, Qi Alfred Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
HandelBot: 巧みなロボット政策の高速適応による実世界ピアノ演奏
シミュレーションで訓練した多指ハンド政策を、構造的調整と残差強化学習の2段階で実機に高速適応させ、両手ピアノ演奏を実現した。
原題: HandelBot: Real-World Piano Playing via Fast Adaptation of Dexterous Robot Policies / Amber Xie, Haozhi Qi, Dorsa Sadigh
日本語で読む → - 論文マニピュレーションロボティクス
ヒューマノイドロボットのための多指力覚制御
触覚センサから推定した力情報を用いて、胴体・腕・手首・指の動きを適応させ、物体との安定接触を維持する多指力覚制御手法を提案。
原題: Multifingered force-aware control for humanoid robots / Pasquale Marra, Gabriele M. Caddeo, Ugo Pattacini 他
日本語で読む → - 論文マニピュレーションロボティクス
DexHiL:巧みな操作のための視覚-言語-行動モデル事後学習における人間参加型フレームワーク
腕と多指ハンドの協調操作を可能にする人間参加型フレームワークを提案し、実行中の人間による修正を活用した事後学習で成功率を平均25%向上させた。
原題: DexHiL: A Human-in-the-Loop Framework for Vision-Language-Action Model Post-Training in Dexterous Manipulation / Yifan Han, Zhongxi Chen, Yuxuan Zhao 他
日本語で読む → - 論文sim2realロボティクス
分割型ポート・ハミルトニアン系の並列シミュレーションのための早期終了可能なエネルギー安全反復結合
分割された受動サブシステム間の結合で生じる擬似エネルギー注入を防ぐため、波動座標でのDouglas-Rachford分裂に基づく早期終了可能なエネルギー安全結合手法を提案し、有限反復でも離散受動性を保証する。
原題: Early-Terminable Energy-Safe Iterative Coupling for Parallel Simulation of Partitioned Port-Hamiltonian Systems / Qi Wei, Jianfeng Tao, Hongyu Nie 他
日本語で読む → - 論文ナビゲーションロボティクス
AERR-Nav: ゼロショット物体ナビゲーションのための適応的探索・回復・回想戦略
未知の多階建て環境でのゼロショット物体ナビゲーションを改善するため、ロボットの状態を動的に切り替える適応的戦略と、高速・低速思考モードを備えた探索状態を提案した。
原題: AERR-Nav: Adaptive Exploration-Recovery-Reminiscing Strategy for Zero-Shot Object Navigation / Jingzhi Huang, Junkai Huang, Haoyang Yang 他
日本語で読む → - 論文軌道生成ロボティクス
動的環境における衝突回避軌道のオンライン生成
任意の幾何学的経路を、ジャーク制限を満たす滑らかな軌道にオンラインで変換し、動的環境での停止安全性を保証する手法を提案。
原題: Online Generation of Collision-Free Trajectories in Dynamic Environments / Nermin Covic, Bakir Lacevic
日本語で読む → - 論文群制御ロボティクス
IndoorR2X: LLM駆動計画による屋内ロボット対全機器連携
屋内環境のIoTセンサーと移動ロボットを統合し、LLMによる計画でマルチロボットのタスク効率を高めるベンチマークとシミュレーションフレームワークを提案した。
原題: IndoorR2X: Indoor Robot-to-Everything Coordination with LLM-Driven Planning / Fan Yang, Soumya Teotia, Shaunak A. Mehta 他
日本語で読む → - 論文連続体ロボット/モデル低次元化/制御ロボティクス
連続体ロボットの精密制御のためのアクチュエータ対応スペクトル部分多様体の学習
制御入力を状態表現に組み込んだ制御拡張スペクトル部分多様体(caSSM)を提案し、腱駆動型連続体ロボットの高次元非線形ダイナミクスを低次元モデル化。実機で開ループ予測誤差を40%、MPCでの追従誤差を52%削減した。
原題: Learning Actuator-Aware Spectral Submanifolds for Precise Control of Continuum Robots / Paul Leonard Wolff, Hugo Buurmeijer, Luis Pabon 他
日本語で読む → - 論文ロボットアート/計画ロボティクス
IMPASTO: モデルベース計画と学習された力学モデルを統合したロボット油絵再現
ロボットが油絵の画像列から筆の軌道や力、色を推論して再現するシステムを提案。学習したピクセル力学モデルとモデル予測制御を統合し、自己対戦のみで学習する。
原題: IMPASTO: Integrating Model-Based Planning with Learned Dynamics Models for Robotic Oil Painting Reproduction / Yingke Wang, Hao Li, Yifeng Zhu 他
日本語で読む → - 論文場所認識画像認識
4DRaL: 知識蒸留による4DレーダーとLiDARを橋渡しする場所認識
4Dレーダーの場所認識性能を向上させるため、高性能なLiDARベースのモデルを教師として知識蒸留を用いるフレームワーク4DRaLを提案した。
原題: 4DRaL: Bridging 4D Radar with LiDAR for Place Recognition using Knowledge Distillation / Ningyuan Huang, Zhiheng Li, Zheng Fang
日本語で読む → - 論文能動的知覚ロボティクス
I-Perceive: 言語指示に基づく能動的知覚のための基盤モデル
ロボットが言語指示に従って視点を能動的に調整する能動的知覚の基盤モデルを提案し、大規模環境でのオープンエンドな指示に応じたカメラ視点予測を実現した。
原題: I-Perceive: A Foundation Model for Active Perception with Language Instructions / Yongxi Huang, Zhuohang Wang, Wenjing Tang 他
日本語で読む → - 論文ニューロシンボリック/安全ルール学習ロボティクス
World2Rules: 航空安全ルールを学習するニューロシンボリックフレームワーク
航空の実世界マルチモーダルデータから、安全を司る明示的なルールを学習するニューロシンボリックフレームワークを提案。ニューラルモデルで候補の記号的事実を生成し、帰納論理プログラミングで検証・統合することで、解釈可能で堅牢な一階述語論理ルールを獲得する。
原題: World2Rules: A Neuro-Symbolic Framework for Learning World-Governing Safety Rules for Aviation / Haichuan Wang, Jay Patrikar, Sebastian Scherer
日本語で読む → - 論文世界モデル画像認識
ThinkJEPA:大規模視覚言語推論モデルで潜在世界モデルを強化
VLMの長期的な意味推論とJEPAの密な動力学モデリングを二重時間経路で統合し、手の操作軌道予測の精度を向上させた研究。
原題: ThinkJEPA: Empowering Latent World Models with Large Vision-Language Reasoning Model / Haichao Zhang, Yijiang Li, Shwai He 他
日本語で読む → - 論文軌道最適化ロボティクス
cuNRTO: GPU高速化による非線形ロバスト軌道最適化
不確実性下でのロバスト軌道最適化をCUDA上で高速化するcuNRTOを提案し、二つの動的最適化アーキテクチャで最大139.6倍の高速化を実現した。
原題: cuNRTO: GPU-Accelerated Nonlinear Robust Trajectory Optimization / Jiawei Wang, Arshiya Taj Abdul, Evangelos A. Theodorou
日本語で読む → - 論文VLAロボティクス
RoboMME:ロボット汎用ポリシーの記憶能力を評価・理解するベンチマーク
長期的・履歴依存的な操作タスクにおけるVLAモデルの記憶機構を評価するため、16タスクからなる標準ベンチマークと14種の記憶拡張VLAを構築し、記憶表現の有効性がタスク依存であることを示した。
原題: RoboMME: Benchmarking and Understanding Memory for Robotic Generalist Policies / Yinpei Dai, Hongze Fu, Jayjun Lee 他
日本語で読む → - 論文意味的ナビゲーションロボティクス
移動ロボットの意味的ナビゲーションのための推論システム
意味的概念に基づく環境モデルを構築し、関係データベースとKnowRobを用いた2つの推論システムを比較して、移動ロボットでの実装を示した。
原題: Reasoning Systems for Semantic Navigation in Mobile Robots / Jonathan Crespo, Ramón Barber, O. M. Mozos 他
日本語で読む → - 論文群制御ロボティクス
SPARC: 空間認識型経路計画 - 注意深いエージェント通信による実現
マルチロボット経路計画において、ロボット間の距離情報を注意機構に組み込むことで、混雑環境での通信効率を高め、最大128台へのスケーラブルな経路計画を実現した論文。
原題: SPARC: Spatial-Aware Path Planning via Attentive Agent Communication / Sayang Mu, Xiangyu Wu, Bo An
日本語で読む → - 論文自動運転/オフロード/運動力学適応ロボティクス
VertiAdaptor: 垂直障害地形のためのオンライン運動力学適応
オフロード環境での自動運転向けに、標高と意味的埋め込みを統合し、関数エンコーダを用いて地形認識型の運動力学モデルと計画を実現するオンライン適応フレームワークを提案。学習済み空間での最小二乗計算により未知環境へ高速適応し、予測精度と適応時間を改善。
原題: VertiAdaptor: Online Kinodynamics Adaptation for Vertically Challenging Terrain / Tong Xu, Chenhui Pan, Aniket Datar 他
日本語で読む → - 論文空間推論ロボティクス
エゴから世界へ:強化学習による身体化システムにおける協調的空間推論
複数のエージェントが異なる視点から環境を認識する問題を扱い、視覚言語モデルが視点を融合して空間推論を行うためのベンチマークE2Wと、強化学習を用いたフレームワークCoRLを提案した。
原題: Ego to World: Collaborative Spatial Reasoning in Embodied Systems via Reinforcement Learning / Heng Zhou, Li Kang, Yiran Qin 他
日本語で読む → - 論文エッジAI/ハードウェアアクセラレータロボティクス
Gleanmer: リアルタイム3Dガウス占有マッピング用6mW SoC
エッジ向けの高精細3D占有マップ構築を低消費電力で実現するため、ガウス分布を用いたマップ表現に特化したアクセラレータを備えたSoCを設計・実装した。アルゴリズムとハードウェアの協調最適化により、マップ構築・クエリのエネルギーを最大63%・81%削減し、16nm CMOSで6mW以下でリアルタイム動作を達成した。
原題: Gleanmer: A 6 mW SoC for Real-Time 3D Gaussian Occupancy Mapping / Zih-Sing Fu, Peter Zhi Xuan Li, Sertac Karaman 他
日本語で読む → - 論文歩行ロボティクス
反作用ホイールを用いた低重力二足ホッピングロボットの動的モデリングと姿勢制御
月や小惑星などの低重力環境でのホッピング移動中に生じる姿勢不安定を、内部の反作用ホイールで能動的に補正する二足ホッピングロボットを提案し、シミュレーションで姿勢誤差を大幅に低減できることを示した。
原題: Dynamic Modeling and Attitude Control of a Reaction-Wheel-Based Low-Gravity Bipedal Hopper / Shriram Hari, M Venkata Sai Nikhil, R Prasanth Kumar
日本語で読む → - 論文マニピュレーションロボティクス
球面調和関数による効率的なハイブリッドSE(3)等変ビジュモータフローポリシー:ロボット操作への応用
球面調和表現を用いてSO(3)等変性を保証しつつ、点群と画像のハイブリッド視覚モダリティを動的に融合する特徴強調モジュールを導入し、高速サンプリングと安定した等変学習を両立するE3Flowを提案した。シミュレーションと実機で有効性を検証し、成功率と推論速度の向上を実証した。
原題: Efficient Hybrid SE(3)-Equivariant Visuomotor Flow Policy via Spherical Harmonics for Robot Manipulation / Qinglun Zhang, Shen Cheng, Tian Dan 他
日本語で読む →