論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAAI
Action QFormer: 行動監視下での構造化表現形成による視覚言語行動モデルの性能向上
視覚言語行動モデルにおいて、行動監視が継承したマルチモーダル表現を形成する役割を分析し、クエリベースのインターフェースを導入して行動に適した表現を再構成することで、ゼロショットsim-to-realナビゲーションの成功率を大幅に向上させた。
原題: Action QFormer: Structured Representation Shaping under Action Supervision in Vision-Language-Action Models / Yufeng Ji, Wenhao Tang, Haoyi Niu 他
日本語で読む → - 論文軌道最適化astro-ph.IM
HELIOS: LLM駆動の自律間接軌道最適化エージェント
低推力軌道最適化の間接法を自動化するLLMベースのエージェントを提案。自然言語の物理問題からPMPの記号的導出、コード生成、数値解法までを人間の介入なしで実行する。
原題: HELIOS: An LLM-Driven Autonomous Indirect Trajectory Optimization Agent / An-yi Huang
日本語で読む → - 論文3Dマッピングロボティクス
ニューラルLiDARバンドル調整
LiDAR NeRFにおけるボリュームサンプリング密度の重要性を理論・実証的に示し、効率的なサンプリングに基づくLiDAR地図と姿勢の同時最適化アルゴリズムを提案した。
原題: Neural LiDAR Bundle Adjustment / Chin Yung Anson Hon, Kaicheng Zhang, Sen Wang
日本語で読む → - 論文水中ロボット/強化学習/sim2realロボティクス
CORAL-AUV: CFD指向の強化学習による自律型水中ビークル制御
CFDデータから学習したサロゲート抗力モデルを強化学習に組み込み、実機の6自由度AUVにゼロショットで適用可能な制御ポリシーを初めて実証した。従来の簡易物理モデルと比較して、エネルギー消費31%削減、移動時間11%短縮、誤差19%低減を達成した。
原題: CORAL-AUV: CFD Oriented Reinforcement Learning for Autonomous Underwater Vehicles / Steven Roche, Milo Van Mooy, Nathan McGuire 他
日本語で読む → - 論文マニピュレーションロボティクス
ACE: ゼロショットワークフロー推論による身体的操作のためのエージェント制御
テーブル上のピックアンドプレース操作を自然言語指示からゼロショットで実行するフレームワークACEを提案。ワークフロー推論と視覚接地・再利用可能なプリミティブを組み合わせ、実行失敗を検出して適応する。
原題: ACE: Agentic Control for Embodied Manipulation via Zero-shot Workflow Reasoning / Iok Tong Lei, QianZhi Li, Ying Jie Yap 他
日本語で読む → - 論文群制御ロボティクス
ADMMに基づく四脚ロボット群による協調運搬のための安全制約付き分散NMPC
四脚ロボット群による協調運搬を対象に、ADMMを用いて分散型非線形モデル予測制御(DNMPC)を構築し、高次制御バリア関数で安全制約を課した。シミュレーションと実機実験で有効性を示し、中央集権型と比べて計算時間を最大23%削減した。
原題: ADMM-Based Safety-Critical Distributed NMPC for Cooperative Transportation by Quadrupedal Robots / Ruturaj S. Sambhus, Kapi Ketan Mehta, Yicheng Zeng 他
日本語で読む → - 論文姿勢推定画像認識
DAP-Pose: 深い時間的整合と物理認識型クロスモーダルセンサ融合による頑健な姿勢推定
視覚・慣性・GNSSのマルチモーダルセンサを統合し、時間的非同期を潜在空間で整合させ、物理的制約を導入することで、複雑環境下でも頑健で高精度な姿勢推定を実現するエンドツーエンドモデルを提案した。
原題: DAP-Pose: Deep Temporal Alignment and Physics-aware Cross-modal Sensor Fusion for Robust Pose Estimation / Jianhan Lin, Yuchu Qin, Jiateng Yuan 他
日本語で読む → - 論文臭気源探索ロボティクス
反応と認知の融合:自然環境における臭気源位置特定のためのハイブリッド認知戦略
乱流環境での臭気源探索に対し、生物模倣の反応的行動と確率的認知を組み合わせたハイブリッド戦略を提案し、検出トリガーによる切り替え機構で探索効率を向上させる。
原題: Merging Reaction to Cognition: A Hybrid Cognitive Strategy for Odour Source Localisation in Natural Environments / Hugo Magalhães, Rui Baptista, Lino Marques
日本語で読む → - 論文交通衝突予測ロボティクス
HERMES: 信号交差点における交通衝突予測のための異種エッジ関係マルチヘッド埋め込みSSM注意機構
信号交差点での交通衝突リスクを、車両と歩行者の異種ノードと関係別エッジを持つ時系列シーングラフ分類としてモデル化し、SSMを組み込んだ注意機構付きグラフニューラルネットワークHERMESを提案・評価した。
原題: HERMES: Heterogeneous Edge-Relational Multi-Head Embedded SSM Attention for Traffic Conflict Prediction at Signalized Intersections / Md Monzurul Islam, Subasish Das
日本語で読む → - 論文自動運転/VLMロボティクス
成果指向蒸留:自動運転におけるVLM推論を進化させる教師-学生フレームワーク
自動運転のためのVLM推論を改善する教師-学生フレームワークを提案。教師モデルが反射的推論でラベルなしのゼロショット汎化を実現し、学生モデルが蒸留で推論能力を獲得、推論を軌道生成に活用する。
原題: Outcome-Guided Distillation: A Teacher-Student Framework to Advance VLM Reasoning in Autonomous Driving / Zeyu Dong, Yimin Zhu, Yu Wu 他
日本語で読む → - 論文データセットロボティクス
ACME: 多文化・多形態の社会的ナビゲーションデータセット
ロボットと人間の共有空間での移動を理解するため、5カ国8拠点で7種類のロボットを用いて収集した、多文化・多形態の社会的ナビゲーションデータセットを紹介する。
原題: ACME: A Multi-Cultural, Multi-Embodiment Social-Navigation Dataset / Shashank Rao Marpally, Allan Wang, Atharva Ghotavadekar 他
日本語で読む → - 論文コンプライアンス制御ロボティクス
プラグ・アンド・プレイで準拠:任意方向のコンプライアンス軸を持つオンライン可変インピーダンスのためのモジュール式フレームワーク
ROSコントロールエコシステムを拡張し、異なるマニピュレータ間で共通インターフェースを保ちながらコンプライアンス制御を実装できるプラグインベースのロボット非依存フレームワークを提案した。
原題: Plug, Play, and Comply: A Modular Framework for Online Variable Impedance with Arbitrarily Oriented Compliance Axes / Mihael Simonič, Xiaocong Li
日本語で読む → - 論文タスク計画ロボティクス
GaP: 変動的オートメーションタスクのためのグラフとしてのポリシーを用いたマルチエージェント自己学習ハーネス
ロボットの信頼性を高めるため、エージェント型コーディングと解釈可能なロボットプログラミングを組み合わせ、タスクをグラフ構造で表現して自己学習する手法を提案した。
原題: GaP: A Graph-as-Policy Multi-Agent Self-Learning Harness For Variational Automation Tasks / Kaiyuan Chen, Shuangyu Xie, Letian Fu 他
日本語で読む → - 論文義手/筋電制御/触覚フィードバックロボティクス
生体模倣型筋電触手義手:センサレス物体検出と振動触覚フィードバックの統合
筋電信号で制御される触手形状の義手を開発し、モーター電流の傾き解析によるセンサレス物体検出と振動触覚フィードバックを統合した。応答時間77ms、物体検出成功率90%以上を達成し、ユーザーが触手の折りたたみ位置を識別できることを実証した。
原題: A Biomimetic Myoelectric Tentacle Prosthesis with Sensorless Object Detection and Vibrotactile Feedback / Gabrielle Marion, Olivier Lecompte, Amandine Gesta 他
日本語で読む → - 論文マニピュレーションロボティクス
Seg2Grasp: ビンピッキングにおける堅牢なモジュール式吸着把持
ビンピッキングのためのモジュール式パイプラインSeg2Graspを提案。セグメンテーション、把持点計算、分類の3段階で構成し、未知の物体や複雑な環境でも高い把持成功率を実現する。
原題: Seg2Grasp: A Robust Modular Suction Grasping in Bin Picking / Hye-Jung Yoon, Juno Kim, Yesol Park 他
日本語で読む → - 論文知覚/シーングラフ画像認識
ジャストインタイムシーングラフ成長:長時間ロボティクスにおける知覚飽和への対抗
この論文は、ロボットの長時間タスク実行中に生じる知覚の飽和問題を解決するため、タスクに応じて必要な部分だけを動的に活性化する3Dシーングラフ構築手法JITOMAを提案している。
原題: Just-In-Time Scene Graph Growth: Combating Perceptual Saturation in Long-Horizon Robotics / Yue Chang, Rufeng Chen, Yifan Tian 他
日本語で読む → - 論文宇宙ロボティクス/制御ロボティクス
AI強化モデル予測制御による安全かつ適応的なランデブー・近傍運用
宇宙機のランデブー・近傍運用を対象に、モデル予測制御とデータ駆動の適応層を組み合わせ、敵対的環境下で安全かつ適応的な軌道制御を実現する枠組みを提案した。
原題: AI-Augmented Model Predictive Control for Safe and Adaptive Rendezvous and Proximity Operations / Luca Sportelli, Tyler Barr, Cagri Kilic 他
日本語で読む → - 論文VLAロボティクス
ガイド付きアクションフロー:フローマッチング型視覚言語行動ポリシーのためのQガイド推論
事前学習済みのフローマッチング型VLAポリシーを凍結したまま、学習済みのアクション批評家を用いて推論時にサンプリングをガイドし、ロボット操作の成功率を向上させる手法を提案した。
原題: Guided Action Flow: Q-Guided Inference for Flow-Matching Vision-Language-Action Policies / Liuhaichen Yang, Zhuang Jiang, Chenchao Sheng 他
日本語で読む → - 論文4D再構成画像認識
SM4RT: 4D再構成のための構造化モーション幾何学の学習
単眼RGBビデオから、物体の剛体運動をSE(3)のモーションベースに分解して表現し、3D再構成と構造化された動きの知覚をエンドツーエンドで行うTransformerモデルを提案した。
原題: SM4RT: Learning Structured Motion Geometry for 4D Reconstruction / Shing Ho J. Lin, Wenzhao Zheng, Dong Zhuo 他
日本語で読む → - 論文自動運転/制御ロボティクス
実世界の冬季運転シナリオにおける衝突回避のための創発的自律ドリフト
ドリフト可能な非線形モデル予測制御(MPC)を開発し、冬季の危険シナリオ(氷上での道路逸脱や対向車衝突回避)でドリフトが安全に有効であることを示した。
原題: Emergent Autonomous Drifting for Collision Avoidance in Real-World Winter Driving Scenarios / Elliot Weiss, Michael Thompson, Thomas Lew 他
日本語で読む → - 論文操作ロボティクス
NEO: 一度NeRF化すれば何度でも編集可能な連続物体操作フレームワーク
言語指示によるNeRF編集をロボット操作に統合し、物体除去や把持配置実験で既存手法より優れた視覚的・幾何的一貫性を実現した。
原題: NEO: NeRF It Once, Edit It Many Times for Continuous Object Manipulation / Mikołaj Zieliński, David Hall, Dominik Belter 他
日本語で読む → - 論文模倣学習/操作ロボティクス
MoMo: 時空間アクションのトークン化によるロボット操作の動作モード制御
ロボット操作の実行スタイル(動作モード)をタスクから分離して学習し、指示に応じて動作の速さや滑らかさを変えられる2段階の模倣学習フレームワークMoMoを提案した。
原題: MoMo: Dial Motion Mode in Robot Manipulation with Spatiotemporal Action Tokenization / Yuhan Hu, Hugues Thomas, Peide Huang 他
日本語で読む → - 論文マニピュレーションロボティクス
TransGraspNet: 透明実験器具の物理的・幾何学的に一貫した操作
透明な実験用ガラス器具の把持を安全に行うため、境界・表面・物理の一貫性を考慮したフレームワークを提案し、実ロボットでの性能を実証した。
原題: TransGraspNet: Physically and Geometrically Consistent Manipulation of Transparent Labware / Hailing Hu, Mingyi Zhu, Yiquan An 他
日本語で読む → - 論文実験自動化ロボティクス
低コストで拡張可能な実験室自動化:デジタルツイン統合型ロボットプラットフォームによる自律液体分注(RAINBOT)
市販の3Dプリンタを改造した低コスト液体分注ロボットを開発し、ブラウザベースのデジタルツインで遠隔監視・操作を可能にした。色付き溶液の混合実験で精度を実証し、自動実験設計フレームワークと連携させた。
原題: Scalable Low-Cost Laboratory Automation: A Digital Twin-Integrated Robotic Platform for Autonomous Liquid Handling (RAINBOT) / Mohamed Rami Ayeche, Souhil Sid, Ahyen Mostofa 他
日本語で読む → - 論文自動運転/モデル予測制御ロボティクス
優先度バイアス付き階層スラックを用いた自動運転のためのリアルタイム規則認識非線形MPC
自動運転の運動計画において、安全・規則・快適性・効率の競合をリアルタイムで解決しつつ監査可能にするため、重み付き階層スラック非線形モデル予測制御(W-SQP)を提案した。9つの運転規則ファミリーを4層の共有スラック非線形計画に組み込み、10Hzで再計画し、Waymoデータセットで評価した。
原題: Real-Time Rulebook-Aware Nonlinear MPC for Autonomous Driving with Priority-Biased Tiered Slacks / Hadi Hajieghrary, Benedikt Walter, Chaitanya Shinde 他
日本語で読む → - 論文モーションプランニングロボティクス
ホモトピーを考慮した参照経路不要のコリドー生成
事前の参照経路に依存せず、凸集合のグラフ上でコリドーを直接生成するフレームワークを提案し、ホモトピー類の探索を改善した。
原題: Homotopy-Aware Corridor Generation without Predefined Reference Paths / Haoze Dong, Minghan Li, Meng Guo 他
日本語で読む → - 論文メタ学習/ダイナミクスモデリング機械学習
MetaKoopman: 分布シフト下での構造化ダイナミクスモデリングのためのコープマン作用素のベイズメタ学習
コープマン作用素にベイズメタ学習を適用し、分布シフト下での非線形ダイナミクスを線形潜在表現でモデル化・予測する手法を提案。雪や氷などの厳しい条件下での自動運転トラック・トレーラー実験で有効性を実証した。
原題: MetaKoopman: Bayesian Meta-Learning of Koopman Operators for Modeling Structured Dynamics under Distribution Shifts / Mahmoud Selim, Sriharsha Bhat, Karl H. Johansson
日本語で読む → - 論文触覚センサロボティクス
テンセグリティロボット向け6軸接触力推定を実現するスケーラブルなオープンソース視触覚センサ
テンセグリティロボット用に、エラストマーシェルとカメラを組み合わせた軽量な視触覚センサを開発し、ニューラルネットワークで6軸の力とトルクを推定。静的・動的実験で精度を確認し、実機での接地検出にも成功した。
原題: Scalable Open-Source Visuotactile Sensor for 6-Axis Contact Wrench Estimation in Tensegrity Robots / Wenzhe Tong, Jonathan Mi, Xili Yi 他
日本語で読む → - 論文ナビゲーションロボティクス
HAM-VLN: 階層的エージェント記憶を活用したゼロショット視覚言語ナビゲーション
ロボットが未知環境で指示に従って移動する際、画像や地図の代わりにエージェント自身が書き込む永続的な世界グラフを記憶として使い、次の行動選択と同じLLM呼び出しで記憶も更新することで、長期的なナビゲーションの記憶・推論ボトルネックを解消した。追加のLLM呼び出しなしで文脈長を65%以上削減しつつ、複数のナビゲーションベンチマークで最高性能を達成した。
原題: HAM-VLN: Harnessing Hierarchical Agentic Memory for Zero-Shot Vision-and-Language Navigation / An Liu, Bingxi Liu, Hongyu Ding 他
日本語で読む → - 論文軌道予測制御
COLREGsを考慮した最適計画による船舶軌道予測
船舶の軌道予測を、A*探索と数値最適化を組み合わせた最適計画問題として解く手法を提案した。周囲の船舶の現在位置・速度・目的地のみから高速に予測できる。
原題: Vessel Trajectory Prediction using COLREGs-aware Optimal Planning / David Kaikkonen, Fredrik Ljungberg, Erik Frisk
日本語で読む →