論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
ハイブリッド零空間制御による極限動作生成:直線経路追従への応用
マニピュレータが直線経路に沿って移動できる距離を最大化する「極限動作生成」を提案。RLとモデルベース制御を切り替えるハイブリッド制御と拡散モデルによる初期姿勢サンプリングで、従来比27%の経路長延長を達成した。
原題: Extreme Motion Generation via Hybrid Null-Space Control for Straight-Line Path Following / Xinyi Yuan, Weiwei Wan, Kensuke Harada
日本語で読む → - 論文マニピュレーションロボティクス
L-SDPPO: 車両内ロボット操作のためのスパイキング拡散ポリシーのポリシー最適化
宇宙船内でのロボット操作を低エネルギーで実現するため、スパイキング拡散ポリシーを強化学習で最適化する手法を提案した。
原題: L-SDPPO: Policy Optimization of Spiking Diffusion Policy for Intra-vehicular Robotic Manipulation / Liwen Zhang, Dong Zhou, Guanghui Sun 他
日本語で読む → - 論文マニピュレーションロボティクス
目的を持った流れ:潜在アクション誘導フローマッチングによるロボット操作ポリシー
ロボット操作の行動クローニングにおいて、フローマッチングの初期分布を潜在アクションモデルで適応的に選択するLAFMを提案し、実世界とベンチマークで性能を大幅に向上させた。
原題: Flowing With Purpose: Latent Action Guided Flow Matching Policies For Robotic Manipulation / Bruno Machado, Alexandre Chapin, Emmanuel Dellandrea 他
日本語で読む → - 論文マニピュレーションロボティクス
ロボット操作のための行動効果メモリ事前学習
視覚と行動の履歴から時間的表現を学習する事前学習フレームワークAEMを提案し、部分観測下での操作性能を向上させた。
原題: Action-Effect Memory Pretraining for Robot Manipulation / Yijing Zhou, Qiwei Liang, Sitong Zhuang 他
日本語で読む → - 論文マニピュレーションロボティクス
記号的プランニングと残差オペレータ学習による逆操作
ロボット操作タスクの逆操作を、デモから抽出した記号的オペレータと強化学習による残差制御を組み合わせたハイブリッドフレームワークで実現する論文。
原題: Inverse Manipulation through Symbolic Planning and Residual Operator Learning / Yigit Yildirim, Giuseppe Rauso, Riccardo Caccavale 他
日本語で読む → - 論文マニピュレーションロボティクス
Trans2Occ: 透明物体のボクセル占有推定と把持 - シミュレーションから実世界へ
単一RGB画像から透明物体のボクセル占有を直接予測し、シミュレーションで大規模学習したモデルを実ロボットに微調整なしで適用して把持を実現する枠組みを提案した。
原題: Trans2Occ: Voxel Occupancy Estimation and Grasp for Transparent Objects from Simulation to Reality / Yixuan Yang, Sha Zhang, Rui Li 他
日本語で読む → - 論文マニピュレーションロボティクス
非落下行動空間における安定した把持内操作の学習
器用な操作スキルを物理・制御理論の知識で分解し、強化学習を効率化・安定化する手法を提案した論文。
原題: Learning Stable In-Grasp Manipulation in a Non-Dropping Action Space / Ha Thang Long Doan, Hikaru Arita, Kazuto Nakashima 他
日本語で読む → - 論文マニピュレーションロボティクス
InDex: 意図条件付き腕-手協調による器用操作のためのVLAモデル強化
VLAモデルを器用な手の操作に適応させるため、把握意図を導入し、到達動作と手の軌道生成を分離するフレームワークInDexを提案した。
原題: InDex: Empowering VLA Models with Intent-Conditioned Arm-Hand Coordination for Dexterous Manipulation / Chuanke Pang, Junyi Huang, Zhijun Zhao 他
日本語で読む → - 論文マニピュレーションロボティクス
ロボット操作のための自由形式選好学習
人間が自然言語で選好軸を定義し、軸ごとにペア比較を行うことで、言語条件付き報酬モデルを学習し、複数の品質次元を最適化するポリシーを訓練する手法を提案。長期的な操作タスクで従来法より大幅に性能向上。
原題: Freeform Preference Learning for Robotic Manipulation / Marcel Torne, Anubha Mahajan, Abhijnya Bhat 他
日本語で読む → - 論文マニピュレーションロボティクス
動きから触覚を見る:触覚運動相関を用いた統一モダリティ認識視触覚ポリシー
接触を伴う操作において、触覚センサの画像から過渡的運動と累積運動の相関を利用して細かい接触状態を識別する新しい触覚表現を提案し、視覚と触覚の効果的な融合を実現するポリシーを開発した。
原題: Seeing Touch from Motion: A Unified Modality-Aware Visuo-Tactile Policy with Tactile Motion Correlation / Shengqi Xu, Guojin Zhong, Yang Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
KPGrasp: 器用な把持生成のためのスケーラブルなキーポイントフローマッチング
接触損失やテスト時の接触ベースの改良に頼らず、大規模データから器用な把持の事前分布を学習するフローマッチングフレームワークを提案した。
原題: KPGrasp: Scalable Keypoint Flow Matching for Dexterous Grasp Generation / Yuansen Huang, Jiayi Chen, Haoran Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
行動プロンプト方策:操作のためのデモンストレーションをプロンプトとして活用
単一の人間のデモンストレーションをプロンプトとして用い、推論時に新しいタスクを実行できるロボットのパラダイムを提案。新しいアーキテクチャ、データ収集インターフェース、評価ベンチマークを導入し、微調整なしで新しいスキルを教える柔軟な方法を示した。
原題: Behavior Prompting Policy: Demonstrations as Prompts for Manipulation / Austin Patel, Ben Pekarek, Joel Enrique Castro Hernandez 他
日本語で読む → - 論文マニピュレーションロボティクス
意味と運動学を橋渡しする:ゼロショットロボット操作のためのモジュール型フレームワーク
視覚言語モデルと運動計画をモジュール化して組み合わせ、訓練なしで言語指示によるロボット操作を実現するフレームワークを提案した。
原題: Bridging Semantics and Kinematics: A Modular Framework for Zero-Shot Robotic Manipulation / Ali Alabbas, Dipshikha Das, Camillo Murgia 他
日本語で読む → - 論文空中マニピュレーションロボティクス
AIR-VLA+: 非対称MoEを備えたカスケード二重アクションデコーダによる空中ロボットの移動と操作の分離
空中マニピュレーションのためのフローマッチング行動生成アーキテクチャを提案し、カスケード型の操作・移動デコーダと非対称MoEにより、UAVの移動とアーム操作の表現結合問題を解決した。
原題: AIR-VLA+: Decoupling Movement and Manipulation via Cascaded Dual-Action Decoders with Asymmetric MoE for Aerial Robots / Jianli Sun, Bin Tian, Qiyao Zhang 他
日本語で読む → - 論文歩行/マニピュレーションロボティクス
腕と歩行の制御を統合するスパイキングニューラルアーキテクチャ
スパイキングニューラルネットワークを用いて、ヒューマノイドの腕の力制御と二足歩行を統合する制御システムを提案し、シミュレーションで動作を実証した。
原題: A Spiking Neural Architecture for Coordinating Arm and Locomotor Control / Lea Steffen, Kathryn Simone, Graeme Damberger 他
日本語で読む → - 論文マニピュレーションロボティクス
分散生成AIモデルを用いた人ロボット協調操作のための対話型フレームワーク
ローカル言語モデルと視覚言語モデルをROS 2ベースの実行スタックに統合し、自由形式のユーザー指示からピック・プレース・ハンドオーバーなどの操作を生成する対話型フレームワークを提案。ウェブダッシュボードで意図と接地結果を可視化し、操作前に明示的な確認を要求する。
原題: A Conversational Framework for Human-Robot Collaborative Manipulation with Distributed Generative AI models / Arash Ghasemzadeh Kakroudi, Roel Pieters
日本語で読む → - 論文マニピュレーションロボティクス
UMI-Bench 1.0: UMIデータを用いた卓上ロボット操作のためのオープンで再現可能な実世界ベンチマーク
UMIスタイルの操作ポリシーを実世界で標準評価する初のベンチマークを提案し、データ収集から評価までの統一プロトコルを提供する。
原題: UMI-Bench 1.0: An Open and Reproducible Real-World Benchmark for Tabletop Robotic Manipulation with UMI Data / Shi Jin, Yuntian Wang, Yuhui Duan 他
日本語で読む → - 論文マニピュレーションロボティクス
KRVF: エッジモバイルマニピュレーションのためのソース認識型セマンティックボクセル世界表現
エッジ計算環境でのモバイルマニピュレーション向けに、占有・色・意味情報・時間的新鮮度・情報源を符号化したタスク指向ボクセル表現KRVFを提案し、ROS 2実装でオンラインRGB-D観測をロボットのタスク用メモリに変換する。
原題: KRVF: A Source-Aware Semantic Voxel World Representation for Edge Mobile Manipulation / Runfeng Ling
日本語で読む → - 論文マニピュレーションロボティクス
SARM2: 自己改善型ロボット操作のためのマルチタスク段階認識報酬モデリング
長期的なロボット操作タスクにおいて、行動クローニングに依存せず、自己ロールアウトからポリシーを改善するための、段階推定器とMMoE価値ヘッドを組み合わせたマルチタスク報酬モデルRMと、それを用いた自己改善フレームワークSPIRALを提案した。
原題: SARM2: Multi-Task Stage Aware Reward Modeling for Self Improving Robotic Manipulation / Qianzhong Chen, Hau Zheng, Justin Yu 他
日本語で読む → - 論文マニピュレーションロボティクス
VICX: ビデオ生成とインコンテキストオペレータネットワークによる汎用ロボット操作
凍結したビデオ生成モデルで視覚プランを生成し、それを実行可能な軌道に変換するインコンテキストオペレータネットワークを提案。クロスタスク・クロスエンボディ汎化を実現。
原題: VICX: Generalizable Robot Manipulation via Video Generation and In-Context Operator Network / Song Chen, Linyan Xiang, Ying Zhou 他
日本語で読む → - 論文モバイルマニピュレーションロボティクス
DynaMOMA: 動的物体のモバイル操作のための把持姿勢の瞬時予測
動的物体を移動しながら把持するために、アンカーベース拡散モデルで短期的な把持軌道を予測し、全身強化学習ポリシーと統合するフレームワークを提案。シミュレーションと実機で有効性を実証。
原題: DynaMOMA: Instantaneous Prediction of Grasp Poses for Mobile Manipulation of Dynamic Objects / Zhinan Yu, Junyan Xu, Jiazhao Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
KITE: 運動学と相互作用の分離によるゼロショット異種ロボット間操作
ロボット間の操作ポリシー汎化を実現するため、タスク推論と身体固有の運動制御を分離し、接触パターンに基づく潜在意図表現で橋渡しする手法KITEを提案。新しい身体への適応は運動学モデルからアクションデコーダを学習するだけで済み、デモデータ再収集不要でゼロショット転送を達成。
原題: KITE: Decoupling Kinematics and Interaction for Zero-Shot Cross-Embodiment Manipulation / Qianxu Wang, Kuan Fang
日本語で読む → - 論文マニピュレーションロボティクス
THREAD: 環境認識拡散モデルによるハイブリッド剛軟マニピュレータの軌道計画
狭い開口部を通すような閉塞環境での操作を可能にする、拡散モデルを用いたハイブリッド剛軟マニピュレータ用の軌道計画手法を提案。物理に基づく損失で剛軟セグメントの連成を考慮し、シミュレーションで訓練、実機転移も実証。
原題: THREAD: Trajectory Planning for Hybrid Rigid-Soft Manipulators with Environment-Aware Diffusion / Shivani Kamtikar, Pranav Asthana, Naveen Kumar Uppalapati 他
日本語で読む → - 論文マニピュレーションロボティクス
FAWAM: 力覚を考慮した世界行動モデルによる閉ループ接触リッチ操作
接触を伴う操作タスクにおいて、力覚情報を認識・予測・実行時補正の3段階で活用するモデルを提案し、成功率を大幅に向上させた。
原題: FAWAM: Force-Aware World Action Models for Closed-Loop Contact-Rich Manipulation / Haotian He, Zeyu Yan, Qipeng Liu 他
日本語で読む → - 論文VLA/移動マニピュレーションロボティクス
グループ別誤差が重要:11自由度移動マニピュレーションのための視覚言語行動モデルのファインチューニング
異種の関節グループを持つ移動マニピュレータ向けにVLAモデルをファインチューニングする際、総MSEが低いチェックポイントが実機で最良とは限らないことを示し、グループ別誤差がより信頼できる選択指標であると主張する論文。
原題: Per-Group Error, Not Total MSE: Fine-Tuning Vision-Language-Action Models for 11-DoF Mobile Manipulation / Pau Montagut Bofi, Mario García Blasco, Tessa Pulli 他
日本語で読む → - 論文マニピュレーションロボティクス
DexCompose: 単一の手による多タスク操作のための巧みなポリシー再利用
既存の巧みな操作ポリシーを再利用し、指レベルのアクション所有権に基づく役割認識型残差構成フレームワークを提案。2つの事前学習済みポリシーを組み合わせて、単一の手で複数のタスクを実行する。
原題: DexCompose: Reusing Dexterous Policies for Multi-Task Manipulation with a Single Hand / Dihong Huang, Zhenyu Wei, Zhuxiu Xu 他
日本語で読む → - 論文マニピュレーションロボティクス
KEMO: 長期的ロボット操作のためのイベント駆動キーフレームメモリとVLAポリシー
長期的なロボット操作において、過去の重要な状態変化をキーフレームとして自動選択・記憶し、VLAポリシーに統合する軽量なプラグインメモリフレームワークKEMOを提案。実機の双腕操作タスクで成功率を大幅に向上させた。
原題: KEMO: Event-Driven Keyframe Memory for Long-Horizon Robot Manipulation with VLA Policies / Yihan Zeng, Minghao Ye, Yiyuan Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
物理情報アイコナールケージングによる全身操作計画
物体を囲むロボット形状の脱出時間をアイコナール方程式でモデル化し、物理情報ニューラルネットワークで近似することで、接触モデルに依存しない頑健な全身操作計画を実現した。
原題: Physics-Informed Eikonal Caging for Whole-Arm Manipulation Planning / Yan Zhang, Yiming Li, Yifei Dong 他
日本語で読む → - 論文マニピュレーションロボティクス
巧みな操作のための相互作用ダイナミクス
本論文は、器用なマニピュレーションを相互作用ダイナミクスの問題として捉え、接触力や安全制約を考慮したオフセットフリーの制御アーキテクチャを提案し、QPベースのリアルタイム制御を実現した。
原題: Interaction Dynamics for Dexterous Manipulation / Yongyan Cao
日本語で読む → - 論文マニピュレーションロボティクス
CoStream: 単純な行動の合成による汎用的な複雑操作の実現
複雑な操作タスクを、基盤モデルと多様なセンシングを組み合わせた複数の単純な行動(意味的・予測的・反応的)に分解し、それらをSE(3)インターフェース上で合成することで、高精度と汎用性を両立するフレームワークを提案した。
原題: CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation / Haonan Chen, Yuxiang Ma, Stephen Tian 他
日本語で読む →