論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
分散生成AIモデルを用いた人ロボット協調操作のための対話型フレームワーク
ローカル言語モデルと視覚言語モデルをROS 2ベースの実行スタックに統合し、自由形式のユーザー指示からピック・プレース・ハンドオーバーなどの操作を生成する対話型フレームワークを提案。ウェブダッシュボードで意図と接地結果を可視化し、操作前に明示的な確認を要求する。
原題: A Conversational Framework for Human-Robot Collaborative Manipulation with Distributed Generative AI models / Arash Ghasemzadeh Kakroudi, Roel Pieters
日本語で読む → - 論文マニピュレーションロボティクス
KITE: 運動学と相互作用の分離によるゼロショット異種ロボット間操作
ロボット間の操作ポリシー汎化を実現するため、タスク推論と身体固有の運動制御を分離し、接触パターンに基づく潜在意図表現で橋渡しする手法KITEを提案。新しい身体への適応は運動学モデルからアクションデコーダを学習するだけで済み、デモデータ再収集不要でゼロショット転送を達成。
原題: KITE: Decoupling Kinematics and Interaction for Zero-Shot Cross-Embodiment Manipulation / Qianxu Wang, Kuan Fang
日本語で読む → - 論文マニピュレーションロボティクス
THREAD: 環境認識拡散モデルによるハイブリッド剛軟マニピュレータの軌道計画
狭い開口部を通すような閉塞環境での操作を可能にする、拡散モデルを用いたハイブリッド剛軟マニピュレータ用の軌道計画手法を提案。物理に基づく損失で剛軟セグメントの連成を考慮し、シミュレーションで訓練、実機転移も実証。
原題: THREAD: Trajectory Planning for Hybrid Rigid-Soft Manipulators with Environment-Aware Diffusion / Shivani Kamtikar, Pranav Asthana, Naveen Kumar Uppalapati 他
日本語で読む → - 論文マニピュレーションロボティクス
DexFuture: 両手巧緻ツール使用のための階層的未来状態視覚運動ターゲティング
高次元の手の構成と複雑な手-ツール-物体ダイナミクスを扱う両手巧緻ツール使用タスクにおいて、デモンストレーションや遅い計画に依存せずに未来の参照軌道を生成する階層的システムを提案した。
原題: DexFuture: Hierarchical Future-State Visuomotor Targeting for Bimanual Dexterous Tool Use / Runfa Blark Li, Kuang-Ting Tu, Nikola Raicevic 他
日本語で読む → - 論文マニピュレーションロボティクス
記号的プランニングと残差オペレータ学習による逆操作
ロボット操作タスクの逆操作を、デモから抽出した記号的オペレータと強化学習による残差制御を組み合わせたハイブリッドフレームワークで実現する論文。
原題: Inverse Manipulation through Symbolic Planning and Residual Operator Learning / Yigit Yildirim, Giuseppe Rauso, Riccardo Caccavale 他
日本語で読む → - 論文VLA/移動マニピュレーションロボティクス
グループ別誤差が重要:11自由度移動マニピュレーションのための視覚言語行動モデルのファインチューニング
異種の関節グループを持つ移動マニピュレータ向けにVLAモデルをファインチューニングする際、総MSEが低いチェックポイントが実機で最良とは限らないことを示し、グループ別誤差がより信頼できる選択指標であると主張する論文。
原題: Per-Group Error, Not Total MSE: Fine-Tuning Vision-Language-Action Models for 11-DoF Mobile Manipulation / Pau Montagut Bofi, Mario García Blasco, Tessa Pulli 他
日本語で読む → - 論文マニピュレーションロボティクス
ハイブリッド零空間制御による極限動作生成:直線経路追従への応用
マニピュレータが直線経路に沿って移動できる距離を最大化する「極限動作生成」を提案。RLとモデルベース制御を切り替えるハイブリッド制御と拡散モデルによる初期姿勢サンプリングで、従来比27%の経路長延長を達成した。
原題: Extreme Motion Generation via Hybrid Null-Space Control for Straight-Line Path Following / Xinyi Yuan, Weiwei Wan, Kensuke Harada
日本語で読む → - 論文マニピュレーションロボティクス
目的を持った流れ:潜在アクション誘導フローマッチングによるロボット操作ポリシー
ロボット操作の行動クローニングにおいて、フローマッチングの初期分布を潜在アクションモデルで適応的に選択するLAFMを提案し、実世界とベンチマークで性能を大幅に向上させた。
原題: Flowing With Purpose: Latent Action Guided Flow Matching Policies For Robotic Manipulation / Bruno Machado, Alexandre Chapin, Emmanuel Dellandrea 他
日本語で読む → - 論文マニピュレーションロボティクス
KRVF: エッジモバイルマニピュレーションのためのソース認識型セマンティックボクセル世界表現
エッジ計算環境でのモバイルマニピュレーション向けに、占有・色・意味情報・時間的新鮮度・情報源を符号化したタスク指向ボクセル表現KRVFを提案し、ROS 2実装でオンラインRGB-D観測をロボットのタスク用メモリに変換する。
原題: KRVF: A Source-Aware Semantic Voxel World Representation for Edge Mobile Manipulation / Runfeng Ling
日本語で読む → - 論文水中マニピュレーション/センシングロボティクス
水中ソフトグリッパの接触前センシングに向けたグリッパ一体型能動電気感覚の検討
濁りや遮蔽で視覚が使えない水中環境でのソフトグリッパ操作を支援するため、電場の乱れを測る能動電気感覚をグリッパに組み込み、接触前に物体を検知できるかをシミュレーションと水槽実験で検証した。
原題: Toward Gripper-Integrated Active Electrosense for Pre-Contact Sensing in Underwater Soft Grippers / Ahsan Tanveer, Muhammad Hamza, Waqar Hussain Afridi 他
日本語で読む → - 論文マニピュレーションロボティクス
自分が何をしたか覚えていますか?:部分観測可能な物体操作のための行動記憶学習
ロボットの過去の行動履歴を圧縮して記憶するモジュールを導入し、部分観測下での接触を伴う長期的な操作タスクを成功させる新しいポリシーCAMPを提案した。
原題: Remember what you did?: Learning Behavioral Memories for Partially Observable Object Manipulation / Kuancheng Wang, Seungho Yeom, Jinglin Cao 他
日本語で読む → - 論文マニピュレーションロボティクス
VQActFlow: ベクトル量子化による行動モード制御を用いたマルチタスクロボット操作
連続的な行動を離散コードブックに量子化し、変分フローマッチングでコード系列を生成することで、マルチタスク操作ポリシーの行動モード選択を明示的に扱う手法を提案した。
原題: VQActFlow: Vector-Quantized Action Mode Steering for Multi-Task Robot Manipulation / Zhigen Zhao, Mark Leggiero, Yipu Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
TopoRetarget: 巧みな操作のための相互作用を保持するリターゲティング
人間の手と物体のデモンストレーションをロボットハンドに適応させる際、接触構造を保つリターゲティング手法を提案。接触精度とポリシー学習成功率を向上させ、実機へのゼロショット転送も実現。
原題: TopoRetarget: Interaction-Preserving Retargeting for Dexterous Manipulation / Jielin Wu, Shenzhe Yao, Guanqi He 他
日本語で読む → - 論文マニピュレーションロボティクス
縫い目からグラフへの再構築による衣服の配置合わせ
ロボットによる衣服操作で縫い目情報を活用するため、グラフニューラルネットワークと注意機構を用いて縫い目観測を構造骨格グラフに変換し、変形を考慮した視覚サーボ制御で衣服の配置合わせを実現した。
原題: Seam-to-Graph Reconstruction for Garment Configuration Alignment / Xuzhao Huang, Kai Tang, Fuyuki Tokuda 他
日本語で読む → - 論文マニピュレーションロボティクス
RMTL: VLM報酬を用いた長時間操作のための強化マイクロタスク学習
長時間の操作タスクを複数のマイクロタスクに分解し、VLM報酬と逆カリキュラムで学習する階層的強化学習手法を提案。
原題: RMTL: Reinforced Micro-task Learning for Long-Horizon Manipulation with VLM Rewards / Anıl Can Ateş, Orhan Kahraman, Cihan Topal
日本語で読む → - 論文マニピュレーションロボティクス
FlipItRight: 多様な物体に対する安定した姿勢目標の投げフリップ
高自由度マニピュレータを用いて、物体を投げて空中で回転させ、目標の姿勢で着地させるフレームワークを提案。物体レベルとロボットレベルのプランナーを組み合わせ、実機で90%の成功率を達成。
原題: FlipItRight: Stable Pose-Targeted Throw-Flip Across Diverse Objects / Axel Dawne, Shinkyu Park
日本語で読む → - 論文マニピュレーションロボティクス
協調ダイナミクスの潜在空間への蒸留による分散型マルチエージェント操作の暗黙的協調
分散型マルチエージェント操作において、中央集権的な情報や通信なしに暗黙的協調を実現するため、協調ダイナミクスを潜在空間に蒸留するCLS-DPを提案した。
原題: Distilling Collaborative Dynamics into Latent Space for Implicit Coordination in Decentralized Multi-Agent Manipulation / Chanyoung Park, Minsung Yoon, Andrew Jeong 他
日本語で読む → - 論文マニピュレーションロボティクス
スペクトル分解による階層的ポリシー学習
ロボットの行動系列をスペクトル分解し、低周波成分で大まかな動き、高周波成分で精密な調整を捉える階層的ポリシーを提案。シミュレーションと実機で精密操作タスクの性能を向上させた。
原題: Hierarchical Policy Learning via Spectral Decomposition / Shuxin Cao, Liquan Wang, Walker Byrnes 他
日本語で読む → - 論文マニピュレーションロボティクス
CoStream: 単純な行動の合成による汎用的な複雑操作の実現
複雑な操作タスクを、基盤モデルと多様なセンシングを組み合わせた複数の単純な行動(意味的・予測的・反応的)に分解し、それらをSE(3)インターフェース上で合成することで、高精度と汎用性を両立するフレームワークを提案した。
原題: CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation / Haonan Chen, Yuxiang Ma, Stephen Tian 他
日本語で読む → - 論文マニピュレーションロボティクス
把持→計画と失敗帰属:正確で汎用的なロボット操作のための閉ループ二段階フレームワーク
把持と動作計画の連携における失敗原因の曖昧さを解消するため、失敗帰属モデルを導入し、診断結果に基づいて把持候補生成と計画の両方を最適化する二段階フレームワークGTP-FAを提案した。シミュレーションと実機実験で、RL、IL、拡散ポリシー、VLAなど様々なベース学習器の成功率を向上させた。
原題: Grasp-Then-Plan with Failure Attribution: A Closed Two-Stage Framework for Precise and Generalizable Robotic Manipulation / Jiahao Xu, Peiyuan Wang, Hanzhuo Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
巧みな操作のための相互作用ダイナミクス
本論文は、器用なマニピュレーションを相互作用ダイナミクスの問題として捉え、接触力や安全制約を考慮したオフセットフリーの制御アーキテクチャを提案し、QPベースのリアルタイム制御を実現した。
原題: Interaction Dynamics for Dexterous Manipulation / Yongyan Cao
日本語で読む → - 論文マニピュレーションロボティクス
意味と運動学を橋渡しする:ゼロショットロボット操作のためのモジュール型フレームワーク
視覚言語モデルと運動計画をモジュール化して組み合わせ、訓練なしで言語指示によるロボット操作を実現するフレームワークを提案した。
原題: Bridging Semantics and Kinematics: A Modular Framework for Zero-Shot Robotic Manipulation / Ali Alabbas, Dipshikha Das, Camillo Murgia 他
日本語で読む → - 論文マニピュレーションロボティクス
CoDex: デモなしで学ぶ構成的手先機能操作
視覚言語モデルと強化学習を組み合わせ、デモなしでスプレーボトルやグルーガンなどの内部機構を持つ物体を操作する戦略を自律的に発見するフレームワークを提案。
原題: CoDex: Learning Compositional Dexterous Functional Manipulation without Demonstrations / Bowen Jiang, William Painter Reger, Roberto Martin-Martin
日本語で読む → - 論文マニピュレーションロボティクス
MoDex: 連続多物体器用把持のための拡散ポリシー
単一の器用な手で複数の物体を順次把持する問題に対し、把持に参加する指を指定する対向空間条件を用いた拡散ポリシーを提案し、模倣学習と強化学習の2段階訓練でシミュレーションと実機の成功率を向上させた。
原題: MoDex: A Diffusion Policy for Sequential Multi-Object Dexterous Grasping / Haofei Lu, Hongjia Liu, Yifei Dong 他
日本語で読む → - 論文マニピュレーションロボティクス
嗜好較正型ヒューマン・イン・ザ・ループ強化学習によるロボット操作
人間介入を利用した強化学習で、介入が誘発する嗜好信号から劣った軌道区間を特定し、Q値の過大評価を防ぎつつ方策を人間の修正行動に合わせて較正するPACTフレームワークを提案した。
原題: Preference-Calibrated Human-in-the-Loop Reinforcement Learning for Robotic Manipulation / Zeyi Liu, Guangyao Liu, Yinuo Qu 他
日本語で読む → - 論文マニピュレーションロボティクス
FAWAM: 力覚を考慮した世界行動モデルによる閉ループ接触リッチ操作
接触を伴う操作タスクにおいて、力覚情報を認識・予測・実行時補正の3段階で活用するモデルを提案し、成功率を大幅に向上させた。
原題: FAWAM: Force-Aware World Action Models for Closed-Loop Contact-Rich Manipulation / Haotian He, Zeyu Yan, Qipeng Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
Trans2Occ: 透明物体のボクセル占有推定と把持 - シミュレーションから実世界へ
単一RGB画像から透明物体のボクセル占有を直接予測し、シミュレーションで大規模学習したモデルを実ロボットに微調整なしで適用して把持を実現する枠組みを提案した。
原題: Trans2Occ: Voxel Occupancy Estimation and Grasp for Transparent Objects from Simulation to Reality / Yixuan Yang, Sha Zhang, Rui Li 他
日本語で読む → - 論文マニピュレーションロボティクス
PhyRoGen: 手続き型コンテンツ生成による物理ロボット操作パズルの合成生成
ロボット操作パズルの学習データを自動生成するフレームワークPhyRoGenを提案し、6つの生成器で24種類のパズルを生成して実機シミュレーションで操作可能であることを示した。
原題: PhyRoGen: Synthetic Generation of Physical Robot Manipulation Puzzles Using Procedural Content Generation / Lennart Julian Droß, Andreas Orthey, Marc Toussaint
日本語で読む → - 論文マニピュレーションロボティクス
RelAfford6D: 制約駆動ロボット操作のための関係的6Dアフォーダンスグラフ
自由形式の指示から関係的6Dアフォーダンスグラフを構築し、運動学的制約として操作を実行する学習不要のフレームワークを提案。
原題: RelAfford6D: Relational 6D Affordance Graphs for Constraint-Driven Robotic Manipulation / Guodong Zhang, Qichen He, Wenyuan Xie 他
日本語で読む → - 論文マニピュレーションロボティクス
GCNGrasp-VP: アフォーダンス誘導による視点計画を用いた効率的なタスク指向把持
オクルージョンによるタスク指向把持の性能低下を解決するため、アフォーダンス場の予測と能動的な視点計画を統合したフレームワークを提案。シーン再構成を不要とし、1回の視点調整で高精度な把持を実現する。
原題: GCNGrasp-VP: Affordance-Guided View Planning for Efficient Task-Oriented Grasping / Zanjia Tong, Wenlong Dong, Chengjie Zhang 他
日本語で読む →