論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
FD-VLA:接触の多いマニピュレーションのための力蒸留視覚言語行動モデル
力センサを使わずに、視覚と言語から力覚を蒸留してVLAモデルに組み込み、接触を伴う器用な操作を可能にする手法を提案。
原題: FD-VLA: Force-Distilled Vision-Language-Action Model for Contact-Rich Manipulation / Ruiteng Zhao, Wenshuo Wang, Yicheng Ma 他
日本語で読む → - 論文模倣学習ロボティクス
軌道ではなく意図を模倣せよ
模倣学習において、行動の意図と実行の詳細を周波数空間でのマルチスケールトークン化により分離し、意図トークンを用いた転移と適応を可能にする手法MINTを提案。
原題: Mimic Intent, Not Just Trajectories / Renming Huang, Chendong Zeng, Wenjing Tang 他
日本語で読む → - 論文3D形状補完画像認識
LaS-Comp: 潜在空間と幾何空間の一貫性を利用したゼロショット3D形状補完
3D基盤モデルの幾何学的事前知識を活用し、学習なしで多様な部分観測から3D形状を補完する手法を提案。明示的な置換と暗黙的な精緻化の2段階設計で高精度な補完を実現した。
原題: LaS-Comp: Zero-shot 3D Completion with Latent-Spatial Consistency / Weilong Yan, Haipeng Li, Hao Xu 他
日本語で読む → - 論文ソフトロボティクス/触覚ロボティクス
剛性とセンシングを調整可能なロボット果実:果物のリアルな物理ツイン開発手法に向けて
キウイの繊維強化空気圧式フィジカルツインを試作し、熟度に応じた剛性を高精度に再現できること、把持力のセンシングが可能なことを示した。
原題: Robotic Fruits with Tunable Stiffness and Sensing: Towards a Methodology for Developing Realistic Physical Twins of Fruits / Saitarun Nadipineni, Keshav Pandiyan, Kaspar Althoefer 他
日本語で読む → - 論文占有格子地図ロボティクス
2次元占有格子におけるベイズ対数オッズとデンプスター結合則の等価性と相違
占有格子地図作成において、ベイズ対数オッズとデンプスター結合則を公平に比較する手法を提案し、シミュレーションと実LiDARデータで評価した。
原題: Equivalence and Divergence of Bayesian Log-Odds and Dempster's Combination Rule for 2D Occupancy Grids / Tatiana Berlenko, Kirill Krinkin
日本語で読む → - 論文身体性質問応答ロボティクス
FAST-EQA: グローバル・ローカル領域関連性を活用した効率的な身体性質問応答
質問に関連する領域を特定して探索を効率化し、視覚メモリ上のChain-of-Thought推論で高速に回答する身体性質問応答フレームワークを提案。
原題: FAST-EQA: Efficient Embodied Question Answering with Global and Local Region Relevancy / Haochen Zhang, Nirav Savaliya, Faizan Siddiqui 他
日本語で読む → - 論文sim2realロボティクス
MolmoSpaces:ロボットナビゲーションとマニピュレーションのための大規模オープンエコシステム
23万以上の多様な屋内環境と13万の物体アセットを備え、MuJoCoやIsaacなど複数シミュレータで使えるオープンなロボットベンチマーク基盤を構築し、実機との高い相関を示した。
原題: MolmoSpaces: A Large-Scale Open Ecosystem for Robot Navigation and Manipulation / Yejin Kim, Wilbert Pumacay, Omar Rayyan 他
日本語で読む → - 論文マニピュレーションロボティクス
NovaPlan: 閉ループ動画言語計画によるゼロショット長期的マニピュレーション
VLMと動画生成を組み合わせ、生成動画から物体キーポイントと人間の手の姿勢を抽出してロボット動作に変換する階層的フレームワークを提案。訓練や実演なしで長期的な組立作業やエラー回復を実現した。
原題: NovaPlan: Zero-Shot Long-Horizon Manipulation via Closed-Loop Video Language Planning / Jiahui Fu, Junyu Nan, Lingfeng Sun 他
日本語で読む → - 論文意味セグメンテーションロボティクス
インスタンス誘導によるロボット意味セグメンテーションのための教師なしドメイン適応
3Dマップから多視点一貫性のある擬似ラベルを生成し、基盤モデルのゼロショットインスタンスセグメンテーションで補正することで、実環境でのロボットの意味セグメンテーションを教師なしで適応させる手法を提案。
原題: Instance-Guided Unsupervised Domain Adaptation for Robotic Semantic Segmentation / Michele Antonazzi, Lorenzo Signorelli, Matteo Luperto 他
日本語で読む → - 論文VLA画像認識
DriveWorld-VLA: 自動運転のための視覚-言語-行動と潜在空間世界モデルの統合
VLAと世界モデルを潜在空間で統合し、行動条件付きの想像を特徴量レベルで行う自動運転フレームワークを提案。NAVSIMなどで最高性能を達成。
原題: DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving / Feiyang jia, Lin Liu, Ziying Song 他
日本語で読む → - 論文sim2realロボティクス
実世界クラフトランナーにおける協調・競合チームプレイ
シミュレーションと実機ロボットからなるシステムを構築し、マルチエージェント強化学習で協調・競合方策を効率的に学習させ、OODSIでsim2realギャップを軽減して実世界タスクを実現した。
原題: Cooperative-Competitive Team Play of Real-World Craft Robots / Rui Zhao, Xihui Li, Yizheng Zhang 他
日本語で読む → - 論文車両制御制御
インテリジェントタイヤを活用した全輪操舵車両の横方向追従制御
スマートタイヤ技術と分布定数系タイヤモデルを統合し、低速時の微細シミー現象を抑制しつつ力制御で経路追従を実現する全輪操舵車両の出力フィードバック横方向制御手法を提案した。
原題: Lateral tracking control of all-wheel steering vehicles with intelligent tires / Luigi Romano, Ole Morten Aamo, Jan Åslund 他
日本語で読む → - 論文群制御cs.MA
無人地上車両のためのオントロジー駆動型動的知識ベース
無人地上車両(UGV)の戦術エッジでの状況認識と自律意思決定を向上させるため、オントロジー駆動型の動的知識ベースを構築し、4台のUGVチームによる監視ミッションで有効性を検証した。
原題: An Ontology-driven Dynamic Knowledge Base for Uninhabited Ground Vehicles / Hsan Sandar Win, Andrew Walters, Cheng-Chew Lim 他
日本語で読む → - 論文飛行管理/不確実性推定ロボティクス
AAM航空機向けカルマンフィルタベースの飛行管理システムモデリング
AAM機の飛行管理システムをカルマンフィルタでモデル化し、シグモイド関数で測定ノイズ共分散を調整することで不確実性伝播を適応的に推定する手法を提案。実ADS-Bデータで検証し、到着時刻予測精度76%を達成した。
原題: Kalman Filtering Based Flight Management System Modeling for AAM Aircraft / Balram Kandoria, Aryaman Singh Samyal
日本語で読む → - 論文マニピュレーションロボティクス
HybridFlow:ロボットマニピュレーションのための2ステップ生成ポリシー
MeanFlowの1ステップ生成とReFlowの精密化を組み合わせた3段階・2NFEの生成ポリシーを提案し、拡散ポリシーより8倍高速で成功率も15〜25%向上させた。
原題: HybridFlow: A Two-Step Generative Policy for Robotic Manipulation / Zhenchen Dong, Jinna Fu, Jiaming Wu 他
日本語で読む → - 論文3D再構成/NeRFロボティクス
惑星探査のための高忠実度3D再構成
NeRFとGaussian Splattingを統合し、ローバのrosbagデータから自動で高精細かつ幾何的に一貫した3D環境再構成を行うパイプラインを構築した。
原題: High-fidelity 3D reconstruction for planetary exploration / Alfonso Martínez-Petersen, Levin Gerdes, David Rodríguez-Martínez 他
日本語で読む → - 論文群制御ロボティクス
モジュール型飛行システムのためのダウンウォッシュを考慮した構成最適化
多数の同型モジュール型飛行ロボットに対し、モジュール間のダウンウォッシュ干渉を制約として考慮しつつ、タスクに応じた組み立て構成を生成・最適選択するフレームワークを提案した。
原題: Downwash-aware Configuration Optimization for Modular Aerial Systems / Mengguang Li, Heinz Koeppl
日本語で読む → - 論文VLAロボティクス
Action-to-Actionフローマッチング:固有感覚履歴を起点とした高速ロボット方策
ランダムノイズではなく過去の固有感覚行動を起点にフローマッチングで行動生成する方策を提案し、1ステップ推論と高い汎化性能を実現した。
原題: Action-to-Action Flow Matching / Jindou Jia, Gen Li, Xiangyu Chen 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
TextOp: テキストでリアルタイムに動くヒューマノイドの動作生成と制御
テキスト指示を逐次受け取りながら、上位の拡散モデルで動作軌道を生成し下位の追従制御で実機ヒューマノイドを動かす、対話的に指示変更できる枠組みを提案した。
原題: TextOp: Real-time Interactive Text-Driven Humanoid Robot Motion Generation and Control / Weiji Xie, Jiakun Zheng, Jinrui Han 他
日本語で読む → - 論文マニピュレーション制御
インフラ運用保守における関節部品のロボットマニピュレーションのためのエネルギー考慮型強化学習
インフラ点検・保守で扉やバルブなどの関節部品を操作する際に、消費エネルギーを制約付きマルコフ決定過程で明示的に扱い、PointNetベースの汎用知覚と制約付きSoft Actor-Criticで省エネかつ高成功率な操作を実現した。
原題: Energy-Aware Reinforcement Learning for Robotic Manipulation of Articulated Components in Infrastructure Operation and Maintenance / Xiaowen Tao, Yinuo Wang, Haitao Ding 他
日本語で読む → - 論文VLA画像認識
ABot-M0: 行動多様体学習によるロボットマニピュレーションのためのVLA基盤モデル
異種ロボットデータを統合した大規模データセットUniACTを構築し、行動が低次元多様体上に存在するという仮説に基づくAction Manifold Learningで効率的なVLA基盤モデルを実現した。
原題: ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning / Yandan Yang, Shuang Zeng, Tong Lin 他
日本語で読む → - 論文マニピュレーションロボティクス
FlowCorrect: ロボットマニピュレーションのための生成フローポリシーの効率的な対話的修正
展開時に人間がVRで短い修正動作を与えるだけで、フローマッチング方策を再学習なしに局所適応させ、失敗事例の成功率を80%に改善する手法を提案。
原題: FlowCorrect: Efficient Interactive Correction of Generative Flow Policies for Robotic Manipulation / Edgar Welte, Yitian Shi, Rosa Wolf 他
日本語で読む → - 論文VLA画像認識
WaterVideoQA:マルチモーダルエージェントによるASV中心の知覚と規則準拠推論
水上航行環境に特化した大規模動画QAベンチマークWaterVideoQAと、マルチエージェント神経記号システムNaviMindを提案し、ASVの認知・推論能力を評価・向上させる。
原題: WaterVideoQA: ASV-Centric Perception and Rule-Compliant Reasoning via Multi-Modal Agents / Runwei Guan, Shaofeng Liang, Ningwei Ouyang 他
日本語で読む → - 論文自動運転/運動計画ロボティクス
自動運転の倫理における視点の考慮:車両運動計画における集合的リスク
自動運転車の運動計画において、自車視点だけでなく全道路利用者の視点を考慮した集合的リスク最小化戦略を提案し、それが人間の運転行動と整合しつつ交通全体のリスク低減に有効であることを示した。
原題: Considering Perspectives for Automated Driving Ethics: Collective Risk in Vehicular Motion Planning / Leon Tolksdorf, Arturo Tejada, Christian Birkner 他
日本語で読む → - 論文医療ロボティクスロボティクス
経皮的拡張気管切開における自動ロボット針穿刺システム
電磁センサと適応制約制御を用いたロボットマニピュレータにより、経皮的拡張気管切開の針穿刺を自動化し、マネキン実験で位置誤差1.7mm・角度偏差4.13度を達成した。
原題: Automated Robotic Needle Puncture for Percutaneous Dilatational Tracheostomy / Yuan Tang, Bruno V. Adorno, Brendan A. McGrath 他
日本語で読む → - 論文協調知覚ロボティクス
協調知覚による遮蔽リスク軽減の実証分析
遮蔽された道路利用者によるリスクを評価する新指標RTLを提案し、V2X普及率の非線形な効果を分析。非対称通信で低普及率でも高いリスク軽減を実現。
原題: An Empirical Analysis of Cooperative Perception for Occlusion Risk Mitigation / Aihong Wang, Tenghui Xie, Fuxi Wen 他
日本語で読む → - 論文義手ロボティクス
DigiArm:タイピングタスク向けの高機能な3Dプリント義手
キーボード入力やピアノ演奏など細かい指の動きを可能にする、低コストで軽量な3Dプリント義手を開発し、その有効性を実証した。
原題: DigiArm: An Anthropomorphic 3D-Printed Prosthetic Hand with Enhanced Dexterity for Typing Tasks / Dean Zadok, Tom Naamani, Yuval Bar-Ratson 他
日本語で読む → - 論文sim2realロボティクス
SPARR: 実世界の非対称残差を組み合わせたシミュレーション方策による組立
シミュレーションで訓練した基本方策と実世界で学習する残差方策を組み合わせ、sim-to-realギャップを埋めて組立タスクの成功率とサイクルタイムを改善した手法。
原題: SPARR: Simulation-based Policies with Asymmetric Real-world Residuals for Assembly / Yijie Guo, Iretiayo Akinola, Lars Johannsmeier 他
日本語で読む → - 論文VLAロボティクス
Joint-Aligned Latent Action: 実世界データからのスケーラブルなVLA事前学習に向けて
人間の操作動画から逆動力学と実行動に整合する潜在行動を学習し、大規模なVLA事前学習を可能にするフレームワークJALAを提案。
原題: Joint-Aligned Latent Action: Towards Scalable VLA Pretraining in the Wild / Hao Luo, Ye Wang, Wanpeng Zhang 他
日本語で読む → - 論文触覚ロボティクス
二足歩行ロボットのための柔らかい表面を持つ視覚ベース触覚センサ
柔らかい変形層と視覚センサを組み合わせた足裏触覚センサを開発し、接触位置・姿勢、せん断、圧力中心、地形分類を推定して、二足歩行ロボットのバランス制御と地形認識を向上させた。
原題: Soft Surfaced Vision-Based Tactile Sensing for Bipedal Robot Applications / Jaeeun Kim, Junhee Lim, Yu She
日本語で読む →