論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA/マニピュレーション画像認識
概念ゲート型視覚蒸留による視覚言語行動モデルの雑然環境耐性の向上
視覚言語行動モデルが雑然環境で失敗する原因を、背景による特徴希釈と特定し、それを抑える訓練不要の推論時フレームワークCGVDを提案した。
原題: Overcoming Visual Clutter in Vision Language Action Models via Concept-Gated Visual Distillation / Sangmim Song, Sarath Kodagoda, Marc Carmichael 他
日本語で読む → - 論文マニピュレーションロボティクス
TGM-VLA: タスク誘導ミックスアップによるサンプリング効率とロバスト性を高めたロボット操作
ロボットの模倣学習において、キーフレームサンプリングの冗長性と時間分布の不均衡を解消し、暗い物体の視認性を高める色反転投影と、タスク指示に応じて点群とアクションヒートマップを融合するタスク誘導ミックスアップを導入し、RLBenchとCOLOSSEUMで高い成功率を達成した。
原題: TGM-VLA: Task-Guided Mixup for Sampling-Efficient and Robust Robotic Manipulation / Fanqi Pu, Lei Jiang, Wenming Yang
日本語で読む → - 論文マニピュレーションロボティクス
部分観測下での言語誘導把持:現場点検・保守における移動操作のための手法
脚式移動マニピュレータが部分観測下で言語指示に基づき物体を把持するパイプラインを提案し、現場の点検・保守シナリオで成功率を向上させた。
原題: Language-Guided Grasping under Partial Observation for Mobile Manipulation in Field Inspection and Maintenance / Dilermando Almeida, Juliano Negri, Guilherme Lazzarini 他
日本語で読む → - 論文マニピュレーションロボティクス
探索支援型ボトルネック遷移によるロバストでデータ効率的な変形物体操作
変形物体操作における分布外状態への対処として、ボトルネック状態を導入し、探索を活用して認識不能な状態も操作可能にするフレームワークExBotを提案した。
原題: Exploration-assisted Bottleneck Transition Toward Robust and Data-efficient Deformable Object Manipulation / Yujiro Onishi, Ryo Takizawa, Yoshiyuki Ohmura 他
日本語で読む → - 論文マニピュレーションロボティクス
GraspADMM: ADMM最適化による巧みな把持合成の改善
物体上の目標接触点と手の実際の接触位置をADMMで分離し、把持の多様性を保ちながら動的安定性と運動学的実現可能性を両立させる把持合成フレームワークを提案した。
原題: GraspADMM: Improving Dexterous Grasp Synthesis via ADMM Optimization / Liangwang Ruan, Jiayi Chen, He Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
PhysGraph: 物理に基づくグラフ変換器ポリシーによる両手巧緻な手-道具-物体操作
両手による道具操作を、システムを運動学的グラフとして表現し、注意機構に物理的構造事前知識を注入するグラフ変換器ポリシーPhysGraphを提案。パラメータ数を減らしつつ操作精度と成功率を向上させ、未見の形状へのゼロショット転移も示した。
原題: PhysGraph: Physically-Grounded Graph-Transformer Policies for Bimanual Dexterous Hand-Tool-Object Manipulation / Runfa Blark Li, David Kim, Xinshuang Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
ToMPC: ADMMによるタスク指向モデル予測制御による安全なロボット操作
安全で効率的なロボット操作のためのタスク指向モデル予測制御フレームワークを提案し、衝突回避と環境との相互作用を統合し、ADMMで最適化問題を解く。
原題: ToMPC: Task-oriented Model Predictive Control via ADMM for Safe Robotic Manipulation / Xinyu Jia, Wenxin Wang, Jun Yang 他
日本語で読む → - 論文マニピュレーションロボティクス
単一視点点群からのエンドツーエンド器用把持学習:多物体シーンデータセットによるアプローチ
多物体シーンでの器用な把持を実現するため、単一視点の点群から把持構成を直接予測するエンドツーエンドネットワークDGS-Netと、それを訓練するための多物体シーンデータセットを提案した。
原題: End-to-End Dexterous Grasp Learning from Single-View Point Clouds via a Multi-Object Scene Dataset / Tao Geng, Dapeng Yang, Ziwei Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
反実仮想失敗合成による実行可能な操作リカバリの学習
実世界の成功デモから生成モデルで反実仮想的な失敗ロールアウトを合成し、失敗診断と回復軌道を予測するフレームワークを提案。実機実験で補正精度を大幅に向上させた。
原題: Learning Actionable Manipulation Recovery via Counterfactual Failure Synthesis / Dayou Li, Jiuzhou Lei, Hao Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
MemoAct: アトキンソン=シフリン記憶モデルに着想を得たロボットマニピュレーション向け階層的記憶拡張ポリシー
人間の記憶モデルに倣い、感覚・短期・長期の階層的記憶を組み合わせてロボットのマニピュレーションを記憶依存タスクで高精度化するポリシーを提案し、新ベンチマークで有効性を示した。
原題: MemoAct: Atkinson-Shiffrin-Inspired Hierarchical Memory-Augmented Policy for Robotic Manipulation / Liufan Tan, Jiale Li, Gangshan Jing
日本語で読む → - 論文マニピュレーションロボティクス
拘束環境下での変形・剛体ハイブリッド物体の協調操作
変形リンクと剛体要素からなるハイブリッド物体を、拘束環境下で双腕ロボットにより操作するための準静的プランナを提案。Cosseratロッドモデルと解析的勾配を用いて高速化し、シミュレーションと実機で精度を検証した。
原題: Coordinated Manipulation of Hybrid Deformable-Rigid Objects in Constrained Environments / Anees Peringal, Anup Teejo Mathew, Panagiotis liatsis 他
日本語で読む → - 論文VLA/ナビゲーション/マニピュレーションロボティクス
DiffusionAnything: 統一ナビゲーションと把持前動作のためのエンドツーエンド・インコンテキスト拡散学習
RGB画像のみから、メートル規模のナビゲーションとセンチメートル規模のマニピュレーションを単一モデルで計画する拡散ポリシーを提案。タスクごとに5分の自己教師ありデータで学習し、未知シーンへのゼロショット汎化を実現する。
原題: DiffusionAnything: End-to-End In-context Diffusion Learning for Unified Navigation and Pre-Grasp Motion / Iana Zhura, Yara Mahmoud, Jeffrin Sam 他
日本語で読む → - 論文マニピュレーションロボティクス
未知の柔軟環境における拘束の特性評価
未知環境で柔軟に拘束された物体を安全に操作するためのオンライン経路計画アルゴリズムを提案し、拘束の剛性をリアルタイムで識別・特性評価する手法を開発した。
原題: Characterization of Constraints in Flexible Unknown Environments / Samrat Bhattacharyya, Nabil Simaan
日本語で読む → - 論文マニピュレーションロボティクス
言語基盤の分離型行動表現によるロボット操作
自然言語を意味的ブリッジとして用い、翻訳・回転・グリッパー制御という3つの解釈可能な行動プリミティブを導入し、対照学習と模倣学習を組み合わせて汎化性能を高めるロボット操作フレームワークを提案した。
原題: Language-Grounded Decoupled Action Representation for Robotic Manipulation / Wuding Weng, Tongshu Wu, Liucheng Chen 他
日本語で読む → - 論文空中マニピュレーションロボティクス
AeroPlace-Flow: 視覚的先読みと物体フローによる空中マニピュレータの言語接地物体配置
空中マニピュレータが自然言語指示に従って物体を配置するための訓練不要フレームワークを提案し、画像編集による目標画像生成と3D幾何推論を統合して衝突回避軌道を生成、実機で平均75%の成功率を達成した。
原題: AeroPlace-Flow: Language-Grounded Object Placement for Aerial Manipulators via Visual Foresight and Object Flow / Sarthak Mishra, Rishabh Dev Yadav, Naveen Nair 他
日本語で読む → - 論文マニピュレーションロボティクス
ManiDreams: 不確実性を考慮したタスク特化型直観物理による堅牢な物体操作のためのオープンソースライブラリ
物体操作の堅牢性を高めるため、知覚・パラメータ・構造の不確実性を計画ループ内で表現・伝播・制約するモジュール式フレームワークManiDreamsを提案・公開した。
原題: ManiDreams: An Open-Source Library for Robust Object Manipulation via Uncertainty-aware Task-specific Intuitive Physics / Gaotian Wang, Kejia Ren, Andrew S. Morgan 他
日本語で読む → - 論文マニピュレーションロボティクス
ReTac-ACT: 精密組立のための状態ゲート型視覚-触覚融合トランスフォーマー
視覚が遮蔽される精密組立の最終段階で、触覚情報を動的に重視するゲート機構と双方向クロスアテンションを備えた視覚-触覚模倣学習ポリシーを提案し、NISTベンチマークで高い成功率を達成した。
原題: ReTac-ACT: A State-Gated Vision-Tactile Fusion Transformer for Precision Assembly / Minchi Ruan, LiangQing Zhou, Hongtong Li 他
日本語で読む → - 論文マニピュレーションロボティクス
TiPToP: 計画を行うモジュラーなオープン語彙ロボットマニピュレーションシステム
事前学習済み基盤モデルとGPU加速タスク・モーションプランナを組み合わせ、RGB画像と言語から直接ロボット操作を計画・実行するモジュラーシステムを提案。訓練データ不要でVLAを上回る成功率と速度を達成。
原題: TiPToP: A Modular Open-Vocabulary Robot Manipulation System That Plans / William Shen, Nishanth Kumar, Sahit Chintalapudi 他
日本語で読む → - 論文マニピュレーションロボティクス
把持と非把持の同時操作:多段階器用タスクへの実用的アプローチ
物体把持と別物体への操作を同時に行う多段階タスクを、物体中心スキルに分解し、少数の実演から実機で学習・実行する手法DexMultiを提案。
原題: Concurrent Prehensile and Nonprehensile Manipulation: A Practical Approach to Multi-Stage Dexterous Tasks / Hao Jiang, Yue Wu, Yue Wang 他
日本語で読む → - 論文空中マニピュレーションロボティクス
空中連続体マニピュレータのためのひずみパラメータ化連成動力学とデュアルカメラ視覚サーボ
空中連続体マニピュレータの動的モデリングと視覚サーボ制御を提案。ひずみパラメータ化CosseratロッドモデルとUAV剛体モデルを統合し、デュアルカメラIBVSで視野制限を克服する。
原題: Strain-Parameterized Coupled Dynamics and Dual-Camera Visual Servoing for Aerial Continuum Manipulators / Niloufar Amiri, Farrokh Janabi-Sharifi
日本語で読む → - 論文マイクロマニピュレーションロボティクス
時間変動流下でのマイクロロボット細胞押し操作のための残差RL-MPC
マイクロ流体中の細胞押し操作を、MPCに強化学習で学習した残差ポリシーを組み合わせたハイブリッド制御で行い、時間変動流下でのロバスト性と追従精度を向上させた。
原題: Residual RL-MPC for Robust Microrobotic Cell Pushing Under Time-Varying Flow / Yanda Yang, Sambeeta Das
日本語で読む → - 論文マニピュレーションロボティクス
キーフレーム連鎖による非マルコフ的長期間ロボット操作
長期的な依存関係を持つ操作タスク向けに、過去の重要なフレームを自動選択・連鎖させてVLAモデルに組み込むフレームワークを提案し、シミュレーションで有効性を示した。
原題: Non-Markovian Long-Horizon Robot Manipulation via Keyframe Chaining / Yipeng Chen, Wentao Tan, Lei Zhu 他
日本語で読む → - 論文マニピュレーションロボティクス
DexGrasp-Zero: 形態整合型ポリシーによるゼロショット異種エンボディ器用把持
異なる多指ハンド間でゼロショット転移可能な器用把持ポリシーを提案。解剖学的ノードと直交運動プリミティブを用いた形態整合グラフ表現と、物理特性注入機構を備えたグラフ畳み込みネットワークにより、未見のハンドへの汎化を実現。
原題: DexGrasp-Zero: A Morphology-Aligned Policy for Zero-Shot Cross-Embodiment Dexterous Grasping / Yuliang Wu, Yanhan Lin, WengKit Lao 他
日本語で読む → - 論文マニピュレーションロボティクス
球面調和関数による効率的なハイブリッドSE(3)等変ビジュモータフローポリシー:ロボット操作への応用
球面調和表現を用いてSO(3)等変性を保証しつつ、点群と画像のハイブリッド視覚モダリティを動的に融合する特徴強調モジュールを導入し、高速サンプリングと安定した等変学習を両立するE3Flowを提案した。シミュレーションと実機で有効性を検証し、成功率と推論速度の向上を実証した。
原題: Efficient Hybrid SE(3)-Equivariant Visuomotor Flow Policy via Spherical Harmonics for Robot Manipulation / Qinglun Zhang, Shen Cheng, Tian Dan 他
日本語で読む → - 論文マニピュレーションロボティクス
LLMによるオントロジーと類似性に基づく計画を用いた汎用的なタスク指向物体把持
視覚認識の意味的特徴に頼らず、LLMで構築したオブジェクト・部品・タスクのオントロジーと点群の幾何解析、既知物体の類似性マッチングにより、多様な物体・タスクに汎化するタスク指向把持を実現した。
原題: Generalizable task-oriented object grasping through LLM-guided ontology and similarity-based planning / Hao Chen, Takuya Kiyokawa, Weiwei Wan 他
日本語で読む → - 論文マニピュレーションロボティクス
適応触覚融合と力混合制御によるマスターマイクロ残差補正を用いた接触リッチ操作
視覚模倣学習に触覚と力覚を組み合わせ、マスター・マイクロ残差制御アーキテクチャで高周波のリアルタイム補正を行い、接触を伴う精密操作の成功率を向上させた。
原題: Master Micro Residual Correction with Adaptive Tactile Fusion and Force-Mixed Control for Contact-Rich Manipulation / Xingting Li, Yifan Xie, Han Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
カメレオン:視覚運動操作のための制御インデックス型予測記憶
観察と行動の間に時間差があるタスクで、過去の観察を記憶し将来の行動に活用するための視覚運動ポリシー「Chameleon」を提案し、実ロボットベンチマークで高い成功率を達成した。
原題: Chameleon: Control-Indexed Prospective Memory for Visuomotor Manipulation / Xinying Guo, Chenxi Jiang, Hyun Bin Kim 他
日本語で読む → - 論文マニピュレーションロボティクス
見て、計画して、巻き戻す:進捗認識型視覚言語行動モデルによる堅牢なロボット操作
ロボット操作のタスク進捗を明示的なマイルストーンで測定し、失敗時に回復可能な状態へ巻き戻すことで堅牢性を高める、進捗認識型の視覚言語行動フレームワークSPRを提案した。
原題: See, Plan, Rewind: Progress-Aware Vision-Language-Action Models for Robust Robotic Manipulation / Tingjun Dai, Mingfei Han, Tingwen Du 他
日本語で読む → - 論文マニピュレーションロボティクス
逆動力学のスペクトル分解によるモデルベース操作の高速探索
逆動力学方程式のスペクトル分解を用いて、長期間のロボット操作計画を効率的に探索する手法を提案。直交成分で到達可能集合を近似し、RRT等と組み合わせて長時間計画を実現。
原題: Spectral Decomposition of Inverse Dynamics for Fast Exploration in Model-Based Manipulation / Solvin Sigurdson, Benjamin Riviere, Joel Burdick
日本語で読む → - 論文マニピュレーションロボティクス
R3DP: 実時間3D認識ポリシーによる身体的操作
大規模3D視覚モデルの強力な事前知識を、非同期の高速・低速協調モジュールと軽量な時間特徴予測ネットワークで統合し、実時間性能を保ちながら操作ポリシーの成功率を向上させる手法を提案した。
原題: R3DP: Real-Time 3D-Aware Policy for Embodied Manipulation / Yuhao Zhang, Wanxi Dong, Yue Shi 他
日本語で読む →