論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
ARISTOハンド:微細操作のためのセンシング駆動型遠位過伸展
腱駆動ロボットハンドに能動的な遠位過伸展とハイブリッド指先センシングを統合し、薄い物体の把持・操作性能を向上させた。
原題: ARISTO Hand: Sensing-Driven Distal Hyperextension for Fine-Grained Manipulation / Aaron Kim, Dong Ho Kang, Mark Helwig 他
日本語で読む → - 論文VLAロボティクス
PriorVLA: 事前知識を保持した視覚言語行動モデルの適応
事前学習済みの視覚言語行動モデルを下流タスクに適応させる際、事前知識を保持しつつ効率的に活用するフレームワークPriorVLAを提案。凍結した事前エキスパートと適応エキスパートを組み合わせ、パラメータ更新を25%に抑えつつ、分布外や少数サンプル設定で高い性能を達成。
原題: PriorVLA: Prior-Preserving Adaptation for Vision-Language-Action Models / Xinyu Guo, Bin Xie, Wei Chai 他
日本語で読む → - 論文群制御ロボティクス
部分既知環境下でのヘテロロボットチームのための偵察支援計画
地上ロボットの移動コストを削減するため、偵察用ドローンが情報収集を支援する計画フレームワークを提案し、情報利得に基づく行動刈り込みとグラフニューラルネットワークによる高速化を実現した。
原題: Scout-Assisted Planning for Heterogeneous Robot Teams under Partially Known Environments / Hoang-Dung Bui, Abhish Khanal, Raihan Islam Arnob 他
日本語で読む → - 論文強化学習機械学習
オフダイナミクス強化学習のためのクロスドメインエネルギー誘導拡散生成
遷移ダイナミクスが異なる環境間で、ソースデータセットからターゲット領域のポリシーを学習する際に、エネルギー誘導を用いて軌道レベルの拡散生成を行い、ターゲット領域に適応した合成データを生成する手法CEDGEを提案した。
原題: Cross-Domain Energy-Guided Diffusion Generation for Off-Dynamics Reinforcement Learning / Yu Yang, Yihong Guo, Anqi Liu 他
日本語で読む → - 論文制御/学習ロボティクス
不確かなシステムのための安全な能動的連続クープマン学習:収縮性保証付き
クープマンモデルをオンラインで安全に適応学習させる枠組みSACKを提案し、収縮則による理論的収束保証と能動学習によるデータ効率向上を実現した。
原題: SACK : Safe Active Continual Koopman Learning for Uncertain Systems with Contractive Guarantees / Chandan Kumar Sah, Rajpal Singh, Jishnu Keshavan
日本語で読む → - 論文自動実験/ソフトウェアアーキテクチャAI
NIMO Controller: Model Context Protocolに基づく自動運転ラボオーケストレータ
自己運転ラボ(SDL)のソフトウェアを、AIエージェントにも対応した標準化されたインターフェースで構築するため、Model Context Protocol(MCP)に基づくアーキテクチャとオーケストレータ「NIMO Controller」を提案し、色合わせSDLのケーススタディで実証した。
原題: NIMO Controller: a self-driving laboratory orchestrator based on the Model Context Protocol / Naruki Yoshikawa, Ryo Tamura
日本語で読む → - 論文マニピュレーションロボティクス
SkiP: ロボット操作の効率化のためのスキップと精密化のタイミング
模倣学習のポリシーが毎ステップ予測するのをやめ、動作が単調な区間はスキップし、接触や把持などの重要区間だけを高解像度で予測する新しい手法を提案。動作の複雑さを自動検出して区間を分割し、実行ステップを15〜40%削減しつつ成功率を維持・向上させる。
原題: SkiP: When to Skip and When to Refine for Efficient Robot Manipulation / Mingtong Dai, Guanqi Peng, Yongjie Bai 他
日本語で読む → - 論文経路計画ロボティクス
経路ベースセンサのためのベイジアンネットワーク:通信不能環境における情報収集と経路計画
経路に沿った観測結果(例:危険検知の有無)から事象の空間分布を推定するベイジアンネットワーク手法を提案し、情報利得を最大化する経路計画を行う。
原題: Bayesian Networks for Path-Based Sensors: Gathering Information and Path Planning in Communication Denied Environments / Alkesh K. Srivastava, George P. Kontoudis, Donald Sofge 他
日本語で読む → - 論文触覚ロボティクス
EITと空気圧を組み合わせたハイブリッドロボット皮膚による高精度な力分布再構成
3Dプリントとスプレーコーティングで作製した、電気インピーダンス断層撮影(EIT)と空気圧触覚センシングを組み合わせたロボット皮膚を提案し、力の再構成精度を向上させた。
原題: EIT-Pneumatic Hybrid Robotic Skin for Practical and Accurate Force Map Reconstruction / Junhwi Cho, Sunggyu Bae, Junghyeon Ma 他
日本語で読む → - 論文視覚言語ナビゲーションロボティクス
SEDualVLN: 空間強化デュアルシステムによる視覚言語ナビゲーション
視覚言語ナビゲーションの性能を高めるため、空間認識を強化した2つのシステム(VLMとMLLM)を組み合わせたフレームワークを提案し、VLN-CEベンチマークで最高性能を達成した。
原題: SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation / Jingzhi Huang, Junkai Huang, Wenxuan Song 他
日本語で読む → - 論文VLAロボティクス
DyGRO-VLA: 動的グループ化残差最適化による視覚言語行動モデルのクロスタスクスケーリング
視覚言語行動モデルの汎用性を高めるため、情報理論に基づくクロスタスク表現学習と動的残差最適化を組み合わせた二段階最適化フレームワークを提案した。
原題: DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization / Sixu Lin, Yunpeng Qing, Litao Liu 他
日本語で読む → - 論文自動運転/LLMAI
プロンプトから舗装路へ、時間を越えて:エージェント型シーンから計画への推論における時間的接地
自動運転の高次シーン解釈と計画にLLM/LMMを使う際、時間的接地の欠如が問題となる。本研究では、エージェント間通信に時間的条件付けを導入した3つのプランナーアーキテクチャをBDD-Xデータセットで評価し、時間的接地の効果を検証した。
原題: From Prompts to Pavement Through Time: Temporal Grounding in Agentic Scene-to-Plan Reasoning / Ahmed Y. Gado, Omar Y. Goba, Alaa Hassanein 他
日本語で読む → - 論文エッジAI/GEMMアクセラレーションcs.DC
Tempus: Versal AI Edge向け時間スケーラブルでリソース非依存のGEMMストリーミングフレームワーク
AMD Versal AI Edge SoC上で、固定の16コア計算ブロックと反復グラフ実行によりGEMMを時間的にスケーリングするフレームワークを提案し、空間スケーリングの限界を克服して高効率な推論を実現した。
原題: Tempus: A Temporally Scalable Resource-Invariant GEMM Streaming Framework for Versal AI Edge / M. Grailoo, J. Núñez-Yáñez
日本語で読む → - 論文強化学習/着陸ロボティクス
荒れた海面への視覚に基づく機敏な着陸
強化学習を用いて、移動する海上プラットフォームへのマルチローターの自律着陸を、プラットフォームの状態推定なしで視覚特徴のみから実現する手法を提案した。
原題: Vision-Based Agile Landing on Turbulent Waters / Dimosthenis Angelis, Leonard Bauersfeld, Davide Scaramuzza 他
日本語で読む → - 論文マニピュレーションロボティクス
RoboFlow4D: リアルタイムフロー誘導ロボット操作のための軽量フローワールドモデル
視覚観察とテキスト指示から3Dフローを直接予測し、動作生成を誘導する軽量なエンドツーエンドのフローワールドモデルを提案し、シミュレーションと実世界で操作成功率と計算効率を向上させた。
原題: RoboFlow4D: A Lightweight Flow World Model Toward Real-Time Flow-Guided Robotic Manipulation / Sixu Lin, Junliang Chen, Huaiyuan Xu 他
日本語で読む → - 論文報酬学習ロボティクス
ピクセルを超えて:少数のデモから実世界ロボットの不変報酬を学習する
少数のデモンストレーションから、視覚的な変化に不変な記号的報酬関数を学習するフレームワークを提案し、実世界の位置・視点・物体の変化に対してゼロショットで汎化することを示した。
原題: Beyond Pixels: Learning Invariant Rewards for Real-World Robotics From a Few Demonstrations / Tengye Xu, Yangting Sun, Ziju Shen 他
日本語で読む → - 論文データセットロボティクス
GA3T: 不均一な環境における異種ロボットチームのための地上・空中地形走行可能性データセット
地上ロボットと空中ロボットの協調認識のための実世界データセットを構築し、多様な不整地環境での地形走行可能性評価を可能にした。
原題: GA3T: A Ground-Aerial Terrain Traversability Dataset for Heterogeneous Robot Teams in Unstructured Environments / Siwei Cai, Knut Peterson, Quan Tran 他
日本語で読む → - 論文VLAロボティクス
FineVLA: 操縦可能な視覚言語行動ポリシーのための細粒度命令整合
ロボットタスクの実行方法に関する細かい指示(腕、方向、接触領域など)をVLAモデルに学習させるためのデータセットとベンチマーク、およびポリシーを構築した。
原題: FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies / Xintong Hu, Xuhong Huang, Jinyu Zhang 他
日本語で読む → - 論文VLAロボティクス
EvoScene-VLA: アクションデコーダ内でシーン信念を進化させ、チャンク化ロボット制御を実現
ロボットのアクションによって変化するシーン状態を、チャンク間で持続的に更新するVLAポリシーを提案し、シミュレーションと実機で成功率を向上させた。
原題: EvoScene-VLA: Evolving Scene Beliefs Inside the Action Decoder for Chunked Robot Control / Chushan Zhang, Ruihan Lu, Jinguang Tong 他
日本語で読む → - 論文マニピュレーションロボティクス
反応から予測へ:エージェント型タスクグラフによるロボット操作の予防的障害回復
操作タスクを有向タスクグラフでモデル化し、実行前に予測的リカバリ分岐を追加することで、障害発生時に再計画なしで即座に対応するエージェントシステムAgentChordを提案した。
原題: From Reaction to Anticipation: Proactive Failure Recovery through Agentic Task Graph for Robotic Manipulation / Sheng Xu, Ruixing Jin, Huayi Zhou 他
日本語で読む → - 論文マニピュレーションロボティクス
MonoDuo: 1本のロボットアームで両腕ポリシーを学習する
単腕ロボットのデモと人間の協調動作から、両腕ロボットの操作ポリシーを学習するフレームワークを提案。合成デモにより未見の両腕ロボット構成へのゼロショット転移を実現した。
原題: MonoDuo: Using One Robot Arm to Learn Bimanual Policies / Sandeep Bajamahal, Lawrence Yunliang Chen, Toru Lin 他
日本語で読む → - 論文群制御ロボティクス
AirBender: 二重UAVによる曲げ可能物体の適応的輸送
この論文では、2台のUAVが協調して曲げ可能な物体を軌道に沿って輸送するための適応制御器を提案し、物体の弾性特性を事前に知らなくても安定した追従を実現する。
原題: AirBender: Adaptive Transportation of Bendable Objects Using Dual UAVs / Jiawei Xu, Longsen Gao, Rafael Fierro 他
日本語で読む → - 論文ナビゲーションロボティクス
より遠くを見る:住宅建物内での社会的に配慮したナビゲーションシステム
住宅の廊下を移動する配達ロボットが、人から8メートル以上離れた時点で車線変更を行う「プロアクティブレーンチェンジ」動作を導入し、従来の短距離での回避行動と比較して、安全性・滑らかさ・丁寧さの認識が向上することをユーザー調査で示した。
原題: Look Further: Socially-Compliant Navigation System in Residential Buildings / Akira Shiba, Marina Obata, Nathan Kau 他
日本語で読む → - 論文シミュレーションロボティクス
SubTGraph: ロボット自律性検証のための制御可能なトポロジー変動を備えた大規模地下環境合成
地下環境の大規模シミュレーションベンチマークを生成するフレームワークSubTGraphを提案し、ユーザー指定の構造制約からダイクストラ法を用いて多様な地下世界を手続き的に合成する。
原題: SubTGraph: Large-Scale Subterranean Environment Synthesis with Controllable Topological Variability for Robotic Autonomy Validation / F. Labra Caso, A. Saradagi, S. Fredriksson 他
日本語で読む → - 論文群制御制御
動的エージェント参加を伴うマルチエージェント編隊の分散非一様スケーリング制御
編隊の形状を軸ごとに異なる比率でスケーリングしつつ、新しいエージェントを動的に編隊に加えるための分散制御フレームワークを提案した論文。
原題: Distributed Non-Uniform Scaling Control of Multi-Agent Formation with Dynamic Agent Joining / Tao He, Gangshan Jing
日本語で読む → - 論文ワールドモデル機械学習
stable-worldmodel: 再現可能なワールドモデル研究と評価のためのプラットフォーム
ワールドモデル研究の断片化を解消するため、高速データ層、標準ベースライン実装、多様な評価環境を備えたオープンソースプラットフォームを提案した。
原題: stable-worldmodel: A Platform for Reproducible World Modeling Research and Evaluation / Lucas Maes, Quentin Le Lidec, Luiz Facury 他
日本語で読む → - 論文触覚/運動推定ロボティクス
TacSE3: 低テクスチャ視触覚画像からの等変SE(3)運動推定による把持内追跡と補償
低テクスチャの視触覚画像からSE(3)上の剛体運動を推定するパイプラインを提案し、把持内の物体追跡と外乱補償に応用した。
原題: TacSE3: Equivariant SE(3) Motion Estimation from Low-Texture Visuotactile Images for In-Gripper Tracking and Compensation / Zhongyuan Liao, Junzhe Wang, Qingyang Liu 他
日本語で読む → - 論文CAD生成画像認識
CADTestsによるテキストからCADへの評価
テキストからCADモデルを生成するタスクの評価手法を提案し、CADTestBenchというテストベースのベンチマークを導入した。
原題: Text-to-CAD Evaluation with CADTests / Dimitrios Mallis, Marco Wang, Ahmet Serdar Karadeniz 他
日本語で読む → - 論文シーングラフ生成ロボティクス
RGBのみを用いた屋内移動ロボットのための能動的3Dシーングラフ生成
深度センサーを使わずRGBカメラのみで3Dシーングラフを能動的に構築するフレームワークを提案し、探索計画と認識を統合した。
原題: RGB-only Active 3D Scene Graph Generation for Indoor Mobile Robots / Giorgia Modi, Davide Buoso, Giuseppe Averta 他
日本語で読む → - 論文ロボット制御/生成モデル機械学習
WarmPrior: 時間的先験情報によるフローマッチングポリシーの直線化
ロボット操作タスクにおいて、ガウス分布の代わりに最近の行動履歴から構築した時間的先験分布を生成ポリシーのソース分布として用いることで、成功率が向上することを示した論文。
原題: WarmPrior: Straightening Flow-Matching Policies with Temporal Priors / Sinjae Kang, Chanyoung Kim, Kaixin Wang 他
日本語で読む →