論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御ロボティクス
干渉下のマルチロータ航空中継ネットワークのための通信認識NMPC
マルチロータ航空機の中継通信において、姿勢とアンテナ指向性を考慮した通信認識制御フレームワークを提案し、干渉下でのリンク品質を大幅に向上させた。
原題: Communications-Aware NMPC for Multi-Rotor Aerial Relay Networks Under Jamming Interference / Giuseppe Silano, Daniel Bonilla Licea, Davide Liuzza 他
日本語で読む → - 論文群制御ロボティクス
不確実性下での学習統合型マルチロボットタスク計画
未知の物体位置を学習で推定しつつ、モデルベース計画で長期的なチーム協調を実現するマルチロボットタスク計画手法を提案。シミュレーションと実機で有効性を実証した。
原題: Multi-Robot Learning-Informed Task Planning Under Uncertainty / Abhish Khanal, Abhishek Paudel, Hung Pham 他
日本語で読む → - 論文軌道最適化ロボティクス
DRAFTO: ロボットマニピュレータのための分離縮小空間と適応的実現可能性修復を用いた軌道最適化
滑らかさ、安全性、関節限界、タスク要件を考慮した軌道最適化アルゴリズムDRAFTOを提案し、関節限界の実現可能性を扱うために最適化を分離し、高効率で信頼性の高い軌道生成を実現した。
原題: DRAFTO: Decoupled Reduced-space and Adaptive Feasibility-repair Trajectory Optimization for Robotic Manipulators / Yichang Feng, Xiao Liang, Minghui Zheng
日本語で読む → - 論文3D再構成画像認識
FTSplat: フィードフォワード三角形スプラッティングネットワーク
多視点画像から直接三角形メッシュを生成するフィードフォワード型の3D再構成手法を提案し、シミュレーションに即利用可能なモデルを単一パスで生成する。
原題: FTSplat: Feed-forward Triangle Splatting Network / Xiong Jinlin, Li Can, Shen Jiawei 他
日本語で読む → - 論文ロボットアート/計画ロボティクス
IMPASTO: モデルベース計画と学習された力学モデルを統合したロボット油絵再現
ロボットが油絵の画像列から筆の軌道や力、色を推論して再現するシステムを提案。学習したピクセル力学モデルとモデル予測制御を統合し、自己対戦のみで学習する。
原題: IMPASTO: Integrating Model-Based Planning with Learned Dynamics Models for Robotic Oil Painting Reproduction / Yingke Wang, Hao Li, Yifeng Zhu 他
日本語で読む → - 論文マニピュレーションロボティクス
RMBench:記憶依存型ロボットマニピュレーションのベンチマークと政策設計への洞察
記憶を必要とするロボット操作タスクを体系的に評価する9タスクのシミュレーションベンチマークRMBenchと、明示的記憶モジュールを持つ操作政策Mem-0を提案し、既存政策の記憶限界と設計指針を明らかにした。
原題: RMBench: Memory-Dependent Robotic Manipulation Benchmark with Insights into Policy Design / Tianxing Chen, Yuran Wang, Mingleyang Li 他
日本語で読む → - 論文VLA画像認識
HiMemVLN:階層的記憶システムによるオープンソースゼロショット視覚言語ナビゲーションの信頼性向上
オープンソースLLMを用いた視覚言語ナビゲーションにおける「ナビゲーション健忘」問題を分析し、階層的記憶システムを導入することで性能を約2倍に改善した研究。
原題: HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System / Kailin Lyu, Kangyi Wu, Pengna Li 他
日本語で読む → - 論文VLA/エッジクラウド協調cs.DC
RoboECC: VLAモデルのための多要素対応エッジ・クラウド協調配置
VLAモデルの推論コストを削減するため、モデル構造とネットワーク状態を考慮したエッジ・クラウド協調配置フレームワークRoboECCを提案し、最適な分割点の特定と帯域変動への適応により最大3.28倍の高速化を実現した。
原題: RoboECC: Multi-Factor-Aware Edge-Cloud Collaborative Deployment for VLA Models / Zihao Zheng, Hangyu Cao, Jiayu Chen 他
日本語で読む → - 論文自動運転/安全性ロボティクス
VLAベース運転システムのための安全ケースパターン:SimLingoからの洞察
VLAベースの自動運転システム向けに、安全ケース設計手法RAISEを提案し、SimLingoの事例で安全性主張の構築を実証した論文。
原題: Safety Case Patterns for VLA-based driving systems: Insights from SimLingo / Gerhard Yu, Fuyuki Ishikawa, Oluwafemi Odu 他
日本語で読む → - 論文VLAロボティクス
OmniGuide:汎用ロボットポリシーを強化する万能ガイダンス場
3D基盤モデルやVLMなどの多様なガイダンスを微分可能なエネルギー関数として表現し、VLAモデルの行動サンプリングを誘導することで、複雑な操作タスクの成功率と安全性を向上させるフレームワーク。
原題: OmniGuide: Universal Guidance Fields for Enhancing Generalist Robot Policies / Yunzhou Song, Long Le, Yong-Hyun Park 他
日本語で読む → - 論文触覚ロボティクス
MuxGel:空間多重化と深層再構成による視覚・触覚の同時デュアルモーダルセンシング
チェッカーボード状の被膜で触覚領域と透明窓を交互に配置し、単一カメラで外部視覚と接触触覚を同時取得するGelSight型センサを提案。U-Net再構成で密な視覚・触覚信号を復元する。
原題: MuxGel: Simultaneous Dual-Modal Visuo-Tactile Sensing via Spatially Multiplexing and Deep Reconstruction / Zhixian Hu, Zhengtong Xu, Sheeraz Athar 他
日本語で読む → - 論文マニピュレーションロボティクス
TransDex: 透明物体の巧みな操作のための点群再構成による視触覚ポリシーの事前学習
透明物体操作時の自己遮蔽や深度ノイズに対処するため、Transformerベースの自己教師あり点群再構成で事前学習した3D視触覚融合ポリシーを提案し、実機実験で既存手法を上回る性能を示した。
原題: TransDex: Pre-training Visuo-Tactile Policy with Point Cloud Reconstruction for Dexterous Manipulation of Transparent Objects / Fengguan Li, Yifan Ma, Chen Qian 他
日本語で読む → - 論文ナビゲーションロボティクス
視覚基盤モデルはナビゲーションできるか?ゼロショット実世界評価と教訓
5つの最先端視覚ナビゲーションモデルを2つのロボットと屋内・屋外5環境で実世界評価し、成功率以外に経路品質・衝突・環境変化への頑健性を分析して3つの系統的限界を明らかにした。
原題: Can Vision Foundation Models Navigate? Zero-Shot Real-World Evaluation and Lessons Learned / Maeva Guerrier, Karthik Soma, Jana Pavlasek 他
日本語で読む → - 論文宇宙機ランデブーロボティクス
マルチエージェント・マルチビュー実験およびデジタルツインランデブー(MMEDR-Autonomous)フレームワークの現状
軌道上サービスやデブリ除去などの自律ランデブー・ドッキングを目指し、学習ベースの光学航法と強化学習による誘導、ハードウェアインザループ試験を統合したフレームワークMMEDR-Autonomousを提案し、その現状と課題を報告する。
原題: Current state of the multi-agent multi-view experimental and digital twin rendezvous (MMEDR-Autonomous) framework / Logan Banker, Michael Wozniak, Mohanad Alameer 他
日本語で読む → - 論文ソフトロボティクスロボティクス
蒸気による環境適応型ロボットの機能化
環境中の材料を蒸気で利用し、現場で紡糸したウェブを機能化する手法を提案。PVDF繊維をポリピロールで被覆し、光吸収性を実証した。
原題: Functionalization of Situated Robots via Vapour / Kadri-Ann Pankratov, Leonid Zinatullin, Adele Metsniit 他
日本語で読む → - 論文操作ロボティクス
EmboAlign: ビデオ生成と構成的制約の整合によるゼロショット操作
ビデオ生成モデルの出力を、推論時に視覚言語モデルが生成する構成的制約で整合させ、物理的に妥当なロボット軌道を生成するデータ不要のフレームワークを提案した。
原題: EmboAlign: Aligning Video Generation with Compositional Constraints for Zero-Shot Manipulation / Gehao Zhang, Zhenyang Ni, Payal Mohapatra 他
日本語で読む → - 論文VLA画像認識
生成モデルは空間を理解している:暗黙の3D事前知識を活用したシーン理解
動画生成モデルが内部に持つ暗黙の3D構造・物理の事前知識を抽出し、マルチモーダル大規模言語モデルに組み込むことで、明示的な3D教師なしに空間推論や操作タスクの性能を高めるフレームワークVEGA-3Dを提案した。
原題: Generation Models Know Space: Unleashing Implicit 3D Priors for Scene Understanding / Xianjin Wu, Dingkang Liang, Tianrui Feng 他
日本語で読む → - 論文操作学習ロボティクス
Act-Observe-Rewrite: マルチモーダルコーディングエージェントによるロボット操作の文脈内ポリシー学習
LLMエージェントが試行錯誤の観察から失敗を診断し、実行可能なPythonコードを書き換えることで、勾配更新やデモなしにロボット操作ポリシーを改善するフレームワークを提案した。
原題: Act-Observe-Rewrite: Multimodal Coding Agents as In-Context Policy Learners for Robot Manipulation / Vaishak Kumar
日本語で読む → - 論文歩行ロボティクス
リプシッツ制約付きポリシーによるヒューマノイドのタスク指定コンプライアンス境界
ヒューマノイドの強化学習において、タスク空間の剛性上限をポリシーのヤコビアンに対する状態依存のリプシッツ制約としてマッピングする異方性リプシッツ制約付きポリシー(ALCP)を提案し、歩行安定性と衝撃耐性を向上させた。
原題: Task-Specified Compliance Bounds for Humanoids via Lipschitz-Constrained Policies / Zewen He, Yoshihiko Nakamura
日本語で読む → - 論文マニピュレーションロボティクス
曲面制約付きオフライン変形と接触認識オンラインポーズ投影による安全なロボット軌道実行
曲面に沿った繰り返し工具動作を安全に実行するため、オフラインで曲面に適合する参照軌道を生成し、オンラインで接触力と姿勢制約を考慮して軌道ずれを補正する2段階フレームワークを提案した。
原題: Surface-Constrained Offline Warping with Contact-Aware Online Pose Projection for Safe Robotic Trajectory Execution / Farong Wang, Sai Swaminathan, Fei Liu
日本語で読む → - 論文自動運転ロボティクス
エンドツーエンド自律運転の時代:ルールベース運転から大規模運転モデルへの移行
自律運転のモジュール型パイプラインからエンドツーエンド学習システムへの移行を分析し、Tesla FSDやRivianなどの実例を通じて、大規模運転モデルが主流戦略となる過程を論じた論文。
原題: The Era of End-to-End Autonomy: Transitioning from Rule-Based Driving to Large Driving Models / Eduardo Nebot, Julie Stephany Berrio Perez
日本語で読む → - 論文安全制御/部分観測ロボティクス
部分観測下の安全臨界制御:到達回避POMDPと信念空間制御の融合
信念空間で目標到達・情報収集・安全を分離する階層型制御アーキテクチャを提案し、リアルタイムな二次計画法で解くことで、非ガウス信念でも安全とタスク成功率を向上させた。
原題: Safety-critical Control Under Partial Observability: Reach-Avoid POMDP meets Belief Space Control / Matti Vahs, Joris Verhagen, Jana Tumova
日本語で読む → - 論文センサキャリブレーション画像認識
拡散LiDARの空間キャリブレーション
拡散型LiDARの各画素のフットプリントと空間感度を推定し、RGB画像との対応を取るキャリブレーション手法を提案した。
原題: Spatial Calibration of Diffuse LiDARs / Nikhil Behari, Ramesh Raskar
日本語で読む → - 論文農業ロボット/物体検出画像認識
注釈から検出へ:移動農業ロボットによる圃場でのブドウ幹位置特定のための自律的かつ堅牢なフレームワーク
限られたラベル付きデータで頑健なマルチモーダル検出器を訓練するための注釈から検出へのフレームワークを提案し、実際のブドウ園で幹検出と位置特定を実証した。
原題: An Annotation-to-Detection Framework for Autonomous and Robust Vine Trunk Localization in the Field by Mobile Agricultural Robots / Dimitrios Chatziparaschis, Elia Scudiero, Brent Sams 他
日本語で読む → - 論文アフォーダンス推論画像認識
arg-VU: ロボット手術の視覚理解のための物理認識3D幾何によるアフォーダンス推論
3Dガウシアンスプラッティングと拡張位置ベースダイナミクスを組み合わせ、変形する手術組織の物理的に整合したアフォーダンス推論を実現するフレームワークを提案。
原題: arg-VU: Affordance Reasoning with Physics-Aware 3D Geometry for Visual Understanding in Robotic Surgery / Nan Xiao, Yunxin Fan, Farong Wang 他
日本語で読む → - 論文動作計画ロボティクス
CSSDF-Net: 構成空間距離場のニューラル陰関数表現に基づく安全な動作計画
構成空間で連続的な符号付き距離場を学習し、関節空間での距離と勾配を提供することで、安全制約付き軌道最適化やMPCに統合し、未学習環境でもゼロショットで衝突回避を可能にする手法を提案した。
原題: CSSDF-Net: Safe Motion Planning Based on Neural Implicit Representations of Configuration Space Distance Field / Haohua Chen, Yixuan Zhou, Yifan Zhou 他
日本語で読む → - 論文HRI/視覚言語モデルロボティクス
MERGE: 人間とロボットの相互作用におけるマルチアクターイベント推論とグラウンディングのための誘導型視覚言語モデル
動的な人間とロボットのグループ相互作用において、アクター、物体、イベントを状況に応じてグラウンディングするシステムMERGEを提案。軽量な知覚パイプラインでVLMを選択的に呼び出し、効率と推論能力を両立し、新規データセットで性能を向上させた。
原題: MERGE: Guided Vision-Language Models for Multi-Actor Event Reasoning and Grounding in Human-Robot Interaction / Joerg Deigmoeller, Nakul Agarwal, Stephan Hasler 他
日本語で読む → - 論文材料特性推定画像認識
SLAT-Phys: 構造化3D潜在表現からの高速材料特性場予測
単一のRGB画像から3Dアセットの材料特性場(ヤング率、密度、ポアソン比)を直接推定するエンドツーエンド手法を提案。事前学習済み3D生成モデルの潜在表現を活用し、軽量デコーダで高速かつ高精度な予測を実現。
原題: SLAT-Phys: Fast Material Property Field Prediction from Structured 3D Latents / Rocktim Jyoti Das, Dinesh Manocha
日本語で読む → - 論文全身制御/モーションリターゲティングロボティクス
追跡を簡単に:ヒューマノイド全身制御のためのニューラルモーションリターゲティング
人間の動作データをヒューマノイドロボットに転写する際の非凸最適化問題を、運動分布の学習として再定式化し、VAEクラスタリングと強化学習によるデータ精製とCNN-Transformerによる非自己回帰的生成で関節跳躍や自己衝突を抑える手法NMRを提案。
原題: Make Tracking Easy: Neural Motion Retargeting for Humanoid Whole-body Control / Qingrui Zhao, Kaiyue Yang, Xiyu Wang 他
日本語で読む → - 論文触覚/遠隔操作ロボティクス
HapCompass: 接触の多いロボット遠隔操作のための回転式触覚デバイス
単一の線形共振アクチュエータを機械的に回転させて2次元の方向手がかりを提示する低コストなウェアラブル触覚デバイスを提案し、遠隔操作タスクの成功率向上・時間短縮・接触力低減を実証した。
原題: HapCompass: A Rotational Haptic Device for Contact-Rich Robotic Teleoperation / Xiangshan Tan, Jingtian Ji, Tianchong Jiang 他
日本語で読む →