論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
意図と実行のギャップを活用:視覚運動ポリシーにおける暗黙的インピーダンスの学習
遠隔操作のマスタ指令とスレーブ応答のズレをノイズではなく力覚情報として活用し、意図クローニングにより暗黙的なインピーダンス制御を実現する枠組みを提案した。
原題: Mind the Gap: Learning Implicit Impedance in Visuomotor Policies via Intent-Execution Mismatch / Cuijie Xu, Shurui Zheng, Zihao Su 他
日本語で読む → - 論文VLAロボティクス
SA-VLA: 空間認識型フローマッチングによる視覚-言語-行動強化学習
フローマッチング型VLAポリシーの強化学習適応時に空間的帰納バイアスが失われる問題に対し、空間表現の融合・幾何学的進捗に基づく密報酬・空間条件付き探索戦略を組み合わせ、空間分布シフト下での汎化性能を高める手法を提案。
原題: SA-VLA: Spatially-Aware Flow-Matching for Vision-Language-Action Reinforcement Learning / Xu Pan, Zhenglin Wan, Xingrui Yu 他
日本語で読む → - 論文マルチモーダルHRIロボティクス
音声・感情・動作を統合するVLMベースのヒューマノイドロボット向けエッジ展開可能なマルチモーダルフレームワーク
VLMを基盤に、音声・表情・ジェスチャーを感情的に一貫させて生成するフレームワークSeM²を提案し、知識蒸留によりエッジ上でも95%の性能を維持するSeM²_eを実装した。
原題: Bridging Speech, Emotion, and Motion: a VLM-based Multimodal Edge-deployable Framework for Humanoid Robots / Songhua Yang, Xuetao Li, Xuanye Fei 他
日本語で読む → - 論文人ロボット対話ロボティクス
内的発話と永続メモリによる因子分解推論:根拠に基づく人とロボットの対話
対話型ロボット支援のため、意図認識・メモリ・内的発話・クエリ生成などをモジュール化し、根拠に基づく応答と検証可能な意思決定を実現する認知アーキテクチャJANUSを提案した。
原題: Factored Reasoning with Inner Speech and Persistent Memory for Evidence-Grounded Human-Robot Interaction / Valerio Belcamino, Mariya Kilina, Alessandro Carfì 他
日本語で読む → - 論文マニピュレーションロボティクス
実行履歴に着目した拡散ポリシーによる長期的ロボット操作における多峰性行動の曖昧性解消
ロボットの実行履歴を視覚空間に投影して拡散ポリシーの条件に加えることで、長期タスクで観測が似ていても行動が異なる曖昧さを解消し、背景の乱れにも頑健にした手法を提案。
原題: Trace-Focused Diffusion Policy for Multi-Modal Action Disambiguation in Long-Horizon Robotic Manipulation / Yuxuan Hu, Xiangyu Chen, Chuhao Zhou 他
日本語で読む → - 論文医療ロボティクスロボティクス
頸椎手術支援のための協調操作ロボットシステムに関する初期実験フィードバック
頸椎手術のドリル作業を支援する協調操作ロボットシステムについて、8名の外科医が14回のドリルを行い、計画軌道に対する位置・姿勢の誤差を評価した。
原題: Primary Experimental Feedback on a Co-manipulated Robotic System for Assisted Cervical Surgery / Seifeddine Sellemi, Abdelbadia Chaker, Tanguy Vendeuvre 他
日本語で読む → - 論文触覚ロボティクス
実時間人間-ロボット協調のための分散マルチモーダルセンシングによる人間活動認識
IMU付きデータグローブと視覚触覚センサを組み合わせ、ロボットとの接触を伴う手の活動を認識するHARシステムを提案し、オフライン・リアルタイム・実協調シナリオで高精度を実証した。
原題: A Distributed Multi-Modal Sensing Approach for Human Activity Recognition in Real-Time Human-Robot Collaboration / Valerio Belcamino, Nhat Minh Dinh Le, Quan Khanh Luu 他
日本語で読む → - 論文SLAMロボティクス
トポロジー情報を活用したマルチセッション自己位置推定と地図構築
訪問済み環境での再観測に対応するため、ポーズグラフのトポロジーを解析して低接続領域を検出し、地図構築とループ閉じ込みを選択的に実行するマルチセッションフレームワークを提案。
原題: Multi-session Localization and Mapping Exploiting Topological Information / Lorenzo Montano-Olivan, Julio A. Placed, Luis Montano 他
日本語で読む → - 論文形式手法ロボティクス
ロボット政策学習と検証における形式手法:現状技術と将来展望に関するサーベイ
ロボット学習における形式手法の活用を政策学習と政策検証の2つの柱で整理し、代表的手法のスケーラビリティや表現力を比較して、安全性と正確性の向上への貢献をまとめたサーベイ。
原題: Formal Methods in Robot Policy Learning and Verification: A Survey on Current Techniques and Future Directions / Anastasios Manganaris, Vittorio Giammarino, Ahmed H. Qureshi 他
日本語で読む → - 論文ソフトロボティクス/外乱オブザーバロボティクス
固有感覚型水中ソフト可変翼における外乱オブザーバによる流れ推定と外乱抑制
ヒレの湾曲を固有感覚として読み取り、外乱オブザーバで流れの迎角変動を推定し、ソフト翼の揚力応答の外乱を抑制する制御手法を提案・実験検証した。
原題: Gust Estimation and Rejection with a Disturbance Observer for Proprioceptive Underwater Soft Morphing Wings / Tobias Cook, Leo Micklem, Huazhi Dong 他
日本語で読む → - 論文自動運転ロボティクス
UniMotion: シミュレーション・予測・計画を統合するモーションフレームワーク
自動運転における運動シミュレーション・予測・計画を単一のTransformerモデルで統合し、Waymoデータセットで高い性能と汎化を示した研究。
原題: UniMotion: A Unified Motion Framework for Simulation, Prediction and Planning / Nan Song, Junzhe Jiang, Jingyu Li 他
日本語で読む → - 論文3D物体検出/4Dレーダーロボティクス
HyperDet: ハイパー4Dレーダー点群による3D物体検出
LiDARを訓練時のみ用いて4Dレーダー点群を時空間蓄積・前景生成・ドップラー整合拡張で強化し、推論時はレーダーのみで標準3D検出器を高精度化する枠組み。
原題: HyperDet: 3D Object Detection with Hyper 4D Radar Point Clouds / Yichun Xiao, Runwei Guan, Jin Jin 他
日本語で読む → - 論文VLAロボティクス
EgoActor: 視覚言語モデルによるヒューマノイドロボットの空間認識型一人称視点行動へのタスク計画の接地
一人称視覚言語モデルEgoActorを提案し、高レベル指示から歩行・頭部動作・操作コマンドを直接予測してヒューマノイドの知覚と実行をリアルタイムに統合する。
原題: EgoActor: Grounding Task Planning into Spatial-aware Egocentric Actions for Humanoid Robots via Visual-Language Models / Yu Bai, MingMing Yu, Chaojie Li 他
日本語で読む → - 論文3D形状補完画像認識
LaS-Comp: 潜在空間と幾何空間の一貫性を利用したゼロショット3D形状補完
3D基盤モデルの幾何学的事前知識を活用し、学習なしで多様な部分観測から3D形状を補完する手法を提案。明示的な置換と暗黙的な精緻化の2段階設計で高精度な補完を実現した。
原題: LaS-Comp: Zero-shot 3D Completion with Latent-Spatial Consistency / Weilong Yan, Haipeng Li, Hao Xu 他
日本語で読む → - 論文VLAロボティクス
ProAct: 構造認識型能動応答のためのベンチマークとマルチモーダルフレームワーク
75タスク・91,581アノテーションからなる能動エージェント用ベンチマークProAct-75を構築し、タスクグラフとMLLMを活用したベースラインProAct-Helperを提案した。
原題: ProAct: A Benchmark and Multimodal Framework for Structure-Aware Proactive Response / Xiaomeng Zhu, Fengming Zhu, Weijie Zhou 他
日本語で読む → - 論文マニピュレーションロボティクス
FlowCorrect: ロボットマニピュレーションのための生成フローポリシーの効率的な対話的修正
展開時に人間がVRで短い修正動作を与えるだけで、フローマッチング方策を再学習なしに局所適応させ、失敗事例の成功率を80%に改善する手法を提案。
原題: FlowCorrect: Efficient Interactive Correction of Generative Flow Policies for Robotic Manipulation / Edgar Welte, Yitian Shi, Rosa Wolf 他
日本語で読む → - 論文群制御ロボティクス
雑然環境における四足ロボットチームの役割適応型協調フォーメーション計画
リーダー・フォロワー型のフォーメーション制御に動的な役割交代と部分目標計画を組み合わせ、仮想バネダンパと障害物回避層で四足ロボット群が複雑環境を柔軟に隊列を崩しながら衝突回避しつつ移動できる枠組みを提案した。
原題: Role-Adaptive Collaborative Formation Planning for Team of Quadruped Robots in Cluttered Environments / Magnus Norén, Marios-Nektarios Stamatopoulos, Avijit Banerjee 他
日本語で読む → - 論文安全計画制御
環境変化に強い安全計画:生成的事前分布とロバスト共形予測の融合
交通密度などの観測可能なパラメータで分布シフトを捉える条件付き拡散モデルを学習し、オンラインで合成データを生成して共形予測とモデル予測制御を組み合わせることで、環境変化下でも確率的な安全保証を維持する計画手法を提案した。
原題: When Environments Shift: Safe Planning with Generative Priors and Robust Conformal Prediction / Kaizer Rahaman, Jyotirmoy V. Deshmukh, Ashish R. Hota 他
日本語で読む → - 論文sim2realロボティクス
タンゴは二人で踊る:ロボット倉庫における注文スケジューリングとマルチエージェント経路探索の統合シミュレータ
ロボット倉庫の注文スケジューリングと経路探索を分離せず統合し、物理制約や障害回復も考慮したシミュレータWareRoverを提案。既存手法が現実的な制約下で苦戦することを示した。
原題: It Takes Two to Tango: A Holistic Simulator for Joint Order Scheduling and Multi-Agent Path Finding in Robotic Warehouses / Haozheng Xu, Wenhao Li, Zifan Wei 他
日本語で読む → - 論文強化学習機械学習
PolicyFlow: 連続正規化フローを用いた強化学習のための方策最適化
PPOに連続正規化フロー(CNF)方策を組み込み、全軌道の尤度評価を避けて速度場の変化で重要度比を近似する新手法を提案し、多様な環境で有効性を示した。
原題: PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning / Shunpeng Yang, Ben Liu, Hua Chen
日本語で読む → - 論文群制御ロボティクス
SkySim: 大規模言語モデルによるドローン群の自然言語制御のためのROS2ベースシミュレーション環境
LLMによる高レベル計画と人工ポテンシャル場による安全フィルタを分離し、自然言語でドローン群を安全に制御できるROS2/Gazeboシミュレータを提案・検証した。
原題: SkySim: A ROS2-based Simulation Environment for Natural Language Control of Drone Swarms using Large Language Models / Aditya Shibu, Marah Saleh, Mohamed Al-Musleh 他
日本語で読む → - 論文空中マニピュレーションロボティクス
Tilt-X: 傾斜・伸縮可能な連続マニピュレータによる柔軟な空中マニピュレーション
傾斜機構・伸縮ステージ・ケーブル駆動連続アームを統合した空中マニピュレータを開発し、プロペラ後流の影響を避けつつ広い作業空間を実現した。
原題: Tilt-X: Enabling Compliant Aerial Manipulation through a Tiltable-Extensible Continuum Manipulator / Anuraj Uthayasooriyan, Krishna Manaswi Digumarti, Jack Breward 他
日本語で読む → - 論文深度補完画像認識
OASIS-DC: スパース統合単眼擬似深度の出力レベル整合による汎化可能な深度補完
単眼基盤モデルの相対深度をスパースな距離計測で校正して擬似メトリック深度事前分布を作り、それを洗練ネットワークで補正することで、ラベルが極端に少ない状況でも高精度な深度補完を実現した。
原題: OASIS-DC: Generalizable Depth Completion via Output-level Alignment of Sparse-Integrated Monocular Pseudo Depth / Jaehyeon Cho, Jhonghyun An
日本語で読む → - 論文歩行ロボティクス
移動プラットフォーム上での四脚ロボットの学習ベース適応制御による能動的安定化
6自由度で動くプラットフォーム上で四脚ロボットを安定させるため、自己平衡ポリシーと状態推定器を組み合わせた学習ベース手法を提案し、従来手法より優れた性能を示した。
原題: Learning-based Adaptive Control of Quadruped Robots for Active Stabilization on Moving Platforms / Minsung Yoon, Heechan Shin, Jeil Jeong 他
日本語で読む → - 論文姿勢推定制御
点群と速度センサを用いたTSE(3)上の有限時間安定姿勢推定
剛体の位置・姿勢・速度を、機体上の点群と速度計測から有限時間で収束させる全状態オブザーバを、SE(3)上で特異点なく設計した研究。
原題: Finite-time Stable Pose Estimation on TSE(3) using Point Cloud and Velocity Sensors / Nazanin S. Hashkavaei, Abhijit Dongare, Neon Srinivasu 他
日本語で読む → - 論文ビジュアルサーボロボティクス
テクスチャなし物体に対するキーポイントベースEKFを用いた知覚・制御結合ビジュアルサーボ
テクスチャのない物体に対して、学習ベースのキーポイント検出と拡張カルマンフィルタを組み合わせ、知覚と制御を閉ループで統合することで、遮蔽などに頑健なビジュアルサーボを実現した。
原題: Perception-Control Coupled Visual Servoing for Textureless Objects Using Keypoint-Based EKF / Allen Tao, Jun Yang, Stanko Oparnica 他
日本語で読む → - 論文VLAロボティクス
ロボットの失敗検出と推論のための自己洗練型視覚言語モデル
ロボットの失敗検出と推論をマルチタスクの自己洗練プロセスとして定式化し、疎な二値ラベルと少数の詳細な推論アノテーションを組み合わせて学習するARMORを提案。推論時には複数の洗練軌跡から自信度の高い予測を選択し、失敗検出率と推論性能で従来手法を大幅に上回る。
原題: Self-Refining Vision Language Model for Robotic Failure Detection and Reasoning / Carl Qi, Xiaojie Wang, Silong Yong 他
日本語で読む → - 論文ロボット学習ロボティクス
LeRobot: エンドツーエンドロボット学習のためのオープンソースライブラリ
ロボット学習の全スタックを統合したオープンソースライブラリLeRobotを提案し、実世界ロボット向けのハードウェア対応と最新アルゴリズムの効率的実装を提供する。
原題: LeRobot: An Open-Source Library for End-to-End Robot Learning / Remi Cadene, Simon Aliberts, Francesco Capuano 他
日本語で読む → - 論文自動運転データセットロボティクス
HetroD: 異種交通環境における自動運転のための高忠実度ドローンデータセットとベンチマーク
歩行者・自転車・二輪車などが混在する異種交通環境を対象に、ドローンで収集した大規模データセットと、予測・計画・シミュレーションの標準ベンチマークを構築した。
原題: HetroD: A High-Fidelity Drone Dataset and Benchmark for Autonomous Driving in Heterogeneous Traffic / Yu-Hsiang Chen, Wei-Jer Chang, Christian Kotulla 他
日本語で読む → - 論文VLAロボティクス
Sci-VLA: 科学実験の長期的タスクのためのエージェント型VLA推論プラグイン
科学実験の長期的タスクにおいて、VLAモデルが苦手とする原子タスク間の遷移をLLMエージェントが推論・補完し、追加学習なしで複合タスクを実行可能にする推論プラグインを提案。
原題: Sci-VLA: Agentic VLA Inference Plugin for Long-Horizon Tasks in Scientific Experiments / Yiwen Pang, Bo Zhou, Changjin Li 他
日本語で読む →