論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2025/12/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
基盤モデル時代の身体性ロボットマニピュレーション:計画と学習の視点
ロボットマニピュレーションの学習ベース手法を、高レベル計画と低レベル制御の統一的な枠組みで整理したサーベイ。言語・コード・動作・アフォーダンス・3D表現の推論や、入力モデリング・潜在表現学習・方策学習の分類を提示し、課題と展望を論じる。
原題: Embodied Robot Manipulation in the Era of Foundation Models: Planning and Learning Perspectives / Shuanghao Bai, Wenxuan Song, Jiayi Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
制約環境下における変形可能線状物体の階層的変形計画とニューラル追従制御
障害物のある環境でケーブルなどの変形可能線状物体を操作するため、階層的な変形計画とデータ駆動型モデル予測制御を組み合わせた枠組みを提案し、その有効性を検証した。
原題: Hierarchical Deformation Planning and Neural Tracking for DLOs in Constrained Environments / Yunxi Tang, Tianqi Yang, Jing Huang 他
日本語で読む → - 論文マニピュレーションロボティクス
非把持マニピュレーションのための分類法とモジュラーツールシステム
把持以外の操作(押す・こする・削るなど)に必要なエンドエフェクタの特性を分類し、2本指グリッパに装着できるモジュラーツールシステムを提案した論文。
原題: Taxonomy and Modular Tool System for Versatile and Effective Non-Prehensile Manipulations / Cedric-Pascal Sommer, Robert J. Wood, Justin Werfel
日本語で読む → - 論文マニピュレーションロボティクス
ロボットマニピュレーションのための1秒未満3Dメッシュ生成
単一のRGB-D画像から、物体セグメンテーション・拡散モデルによるメッシュ生成・点群位置合わせを統合し、1秒未満でロボット操作に使える3Dメッシュを生成するシステムを提案。
原題: Subsecond 3D Mesh Generation for Robot Manipulation / Qian Wang, Omar Abdellall, Tony Gao 他
日本語で読む → - 論文マニピュレーションロボティクス
制約環境下におけるマルチマニピュレータシステムの軌道追従
障害物の多い狭い環境で複数の移動マニピュレータが協調して物体を運ぶため、時相論理仕様を満たす軌道計画とオンライン制御を組み合わせた枠組みを提案し、シミュレーションで検証した。
原題: Trajectory Tracking for Multi-Manipulator Systems in Constrained Environments / Mayank Sewlia, Christos K. Verginis, Dimos V. Dimarogonas
日本語で読む → - 論文マニピュレーションロボティクス
深層学習による微小誤差補正を用いた自己駆動型実験室のための透明基板の閉ループロボットマニピュレーション
壊れやすく透明な基板をロボットでハンドリングする際の誤差を深層学習で検出・補正する閉ループシステムを開発し、130回の試験で98.5%の初回配置精度を達成した。
原題: Closed-Loop Robotic Manipulation of Transparent Substrates for Self-Driving Laboratories using Deep Learning Micro-Error Correction / Kelsey Fontenot, Anjali Gorti, Iva Goel 他
日本語で読む → - 論文マニピュレーションロボティクス
マルチタスクロボットマニピュレーションのための意味的原子スキル学習
実演から意味的に整合した原子スキル空間を学習し、キーポーズ想像により長期的なタスク実行を可能にするフレームワークAtomSkillを提案。
原題: Learning Semantic Atomic Skills for Multi-Task Robotic Manipulation / Yihang Zhu, Weiqing Wang, Shijie Wu 他
日本語で読む → - 論文マニピュレーションロボティクス
空中・産業ロボティクスにおける剛体物体操作のためのクロスエンボディメント・グリッパベンチマーク
異なるロボットプラットフォーム間でグリッパを再利用する際の転送時間・エネルギー効率・把持性能を評価する新しいベンチマークCEGBを提案し、軽量自己ロック式グリッパで実証した。
原題: A Cross-Embodiment Gripper Benchmark for Rigid-Object Manipulation in Aerial and Industrial Robotics / Marek Vagas, Martin Varga, Jaroslav Romancik 他
日本語で読む → - 論文マニピュレーションロボティクス
閉アーキテクチャロボットのための外乱対応安全運動制御の統合
内部トルク制御が変更できない産業用マニピュレータに対し、外乱抑制とロバスト制御バリア関数を組み合わせた外付け制御を開発し、高精度追従と安全性を実現した。
原題: Unified Disturbance Aware Safe Kinematic Control for Closed-Architecture Robots / Fan Zhang, Jinfeng Chen, Joseph J. B. Mvogo Ahanda 他
日本語で読む → - 論文マニピュレーションロボティクス
RoboMIND 2.0:汎用身体知能のためのマルチモーダル両腕移動マニピュレーションデータセット
6種類のロボットで集めた31万件超の両腕操作・移動マニピュレーション軌道(触覚・シミュレーション含む)を公開し、階層型VLM+VLAシステムMIND-2を提案した論文。
原題: RoboMIND 2.0: A Multimodal, Bimanual Mobile Manipulation Dataset for Generalizable Embodied Intelligence / Chengkai Hou, Kun Wu, Jiaming Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
その手の中の世界:実環境での人間中心マニピュレーション学習のための大規模オープンソースエコシステム
実環境で収集した1000時間超の人間のマニピュレーションデータとウェアラブル収集キット、ベンチマークをオープンソースで提供し、ロボットのマニピュレーション成功率を8%から60%に向上させた。
原題: World In Your Hands: A Large-Scale and Open-Source Ecosystem for Learning Human-Centric Manipulation in the Wild / Yupeng Zheng, Jichao Peng, Weize Li 他
日本語で読む → - 論文マニピュレーションロボティクス
人間の動画から巧みな手と物体の相互作用を学習する世界モデル
一人称視点の人間動画から指のキーポイントを抽出し、巧みな手の動作を予測する世界モデルDexWMを提案。補助的な手の一貫性損失により、Franka PandaとAllegroグリッパーでのゼロショット転移でDiffusion Policyを50%以上上回る。
原題: World Models for Learning Dexterous Hand-Object Interactions from Human Videos / Raktim Gautam Goswami, Amir Bar, David Fan 他
日本語で読む → - 論文マニピュレーションロボティクス
OMP: 方向性アライメントによる一段階Meanflowポリシー
拡散モデルの推論遅延とフローモデルの複雑さを解決するため、方向性アライメントと微分導出方程式を導入し、単一ステップで高精度なロボットマニピュレーションを実現するOMPを提案。
原題: OMP: One-step Meanflow Policy with Directional Alignment / Han Fang, Yize Huang, Yuheng Zhao 他
日本語で読む → - 論文マニピュレーションロボティクス
身体性を持つ思考の木:身体性世界モデルによる意図的なマニピュレーション計画
物理ベースのデジタルツインを世界モデルとして用い、木探索とVLMによる失敗診断でロボットのマニピュレーション計画を立案するReal2Sim2Realフレームワークを提案。
原題: Embodied Tree of Thoughts: Deliberate Manipulation Planning with Embodied World Model / Wenjiang Xu, Cindy Wang, Rui Fang 他
日本語で読む → - 論文マニピュレーションロボティクス
SIMPACT: 視覚言語モデルによるシミュレーション活用型行動計画
視覚言語モデルにテスト時に物理シミュレーションを組み合わせ、追加学習なしで接触を伴う細かいマニピュレーションの行動計画を可能にした手法。
原題: SIMPACT: Simulation-Enabled Action Planning using Vision-Language Models / Haowen Liu, Shaoxiong Yao, Haonan Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
操作行動を組み込んだ定数時間動作計画
把持や挿入などの操作行動を考慮しつつ、ミリ秒単位の一定時間で衝突のない動作計画を返すB-CTMPを提案し、棚取りやプラグ挿入で実機検証した。
原題: Constant-Time Motion Planning with Manipulation Behaviors / Nayesha Gandotra, Itamar Mishani, Maxim Likhachev
日本語で読む → - 論文マニピュレーションロボティクス
セマンティックセグメンテーションとキーポイント検出を用いたハイブリッドグリッパによるトマト収穫の新手法
柔らかい補助指と剛体外骨格を組み合わせたハイブリッドグリッパと、RGB-Dカメラによるセグメンテーション・キーポイント検出、力制御とPSO軌道計画を統合し、トマトの自動収穫を約80%の成功率で実現した。
原題: A Novel Approach to Tomato Harvesting Using a Hybrid Gripper with Semantic Segmentation and Keypoint Detection / Shahid Ansari, Mahendra Kumar Gohil, Yusuke Maeda 他
日本語で読む → - 論文マニピュレーションロボティクス
OmniDexVLG:視覚言語モデルが導く把持意味論・分類・機能的アフォーダンスからの器用な把持生成学習
言語と視覚の指示に基づき、把持分類・接触意味論・機能的アフォーダンスを統合的に扱う器用な把持生成フレームワークを提案。大規模データ生成パイプラインとマルチモーダル推論モジュールを組み合わせ、意味的に制御可能な把持を実現する。
原題: OmniDexVLG: Learning Dexterous Grasp Generation from Vision Language Model-Guided Grasp Semantics, Taxonomy and Functional Affordance / Lei Zhang, Diwen Zheng, Kaixin Bai 他
日本語で読む → - 論文マニピュレーションロボティクス
言語ベースの行動表現でロボット制御のスケール不一致を橋渡し
ロボットの行動コマンドを方向性に基づく言語表現に変換することで、異なる機体やタスク間の数値スケールの違いを吸収し、事前学習済み知識の転移性能を高める手法を提案した。
原題: Bridging Scale Discrepancies in Robotic Control via Language-Based Action Representations / Yuchi Zhang, Churui Sun, Shiqi Liang 他
日本語で読む → - 論文マニピュレーションロボティクス
実演編集強化学習による汎用巧みな機能把持
把持スタイルとアフォーダンスを条件として分解し、単一の実演を編集する強化学習で多様な物体の機能把持を学習、シミュレーションから実世界への転移とVLMによる指示追従を実現した。
原題: Universal Dexterous Functional Grasping via Demonstration-Editing Reinforcement Learning / Chuan Mao, Haoqi Yuan, Ziye Huang 他
日本語で読む → - 論文マニピュレーションロボティクス
M³Aポリシー:フォトメトリック再レンダリングによる可変材料操作拡張ポリシー
単一の実演から光輸送に基づくフォトメトリック再レンダリングで多様な材料の実演を生成し、材料に依存しない操作ポリシーを学習する枠組みを提案。
原題: $\mathbf{M^3A}$ Policy: Mutable Material Manipulation Augmentation Policy through Photometric Re-rendering / Jiayi Li, Yuxuan Hu, Haoran Geng 他
日本語で読む → - 論文マニピュレーションロボティクス
VacuumVLA: 吸引と把持を統合したエンドエフェクタでVLAの能力を強化する複雑ロボットマニピュレーション
2本指グリッパと真空吸引ユニットを組み合わせた低コストなハイブリッドエンドエフェクタを開発し、DexVLAやPi0といったVLAフレームワークに組み込むことで、従来困難だった複雑な操作タスクを実現した。
原題: VacuumVLA: Boosting VLA Capabilities via a Unified Suction and Gripping Tool for Complex Robotic Manipulation / Hui Zhou, Siyuan Huang, Minxing Li 他
日本語で読む → - 論文マニピュレーションロボティクス
一般物体に対するロバストな微分可能衝突検出
凸凹物体に対応した微分可能な衝突検出フレームワークを提案し、距離ベースの平滑化と適応サンプリングで勾配計算を安定化、把持合成に応用した。
原題: Robust Differentiable Collision Detection for General Objects / Jiayi Chen, Wei Zhao, Liangwang Ruan 他
日本語で読む → - 論文マニピュレーションロボティクス
RGMP: 汎化可能なヒューマノイドロボット操作のための再帰的幾何事前マルチモーダルポリシー
視覚言語モデルに幾何学的な事前知識を組み込み、ガウス過程でロボットと対象物の関係を再帰的に符号化することで、少ないデータで未知環境にも汎化するヒューマノイド操作を実現した。
原題: RGMP: Recurrent Geometric-prior Multimodal Policy for Generalizable Humanoid Robot Manipulation / Xuetao Li, Wenke Huang, Nengyuan Pan 他
日本語で読む → - 論文マニピュレーションロボティクス
ロボットボルト締め作業の信頼性向上
産業組立や科学施設の保守に不可欠なボルト締め作業をロボット化し、トルク制御とコンプライアンス、マルチモーダルHRI、高レベル監視機構を統合した制御フレームワークを提案・検証した。
原題: Improving dependability in robotized bolting operations / Lorenzo Pagliara, Violeta Redondo, Enrico Ferrentino 他
日本語で読む → - 論文空中マニピュレーションロボティクス
AERMANI-VLM: 視覚言語モデルによる空中マニピュレーションのための構造化プロンプトと推論
事前学習済みVLMを微調整なしで空中マニピュレータに適用し、高レベル推論と低レベル制御を分離して安全な飛行スキル選択を行うフレームワークを提案した。
原題: AERMANI-VLM: Structured Prompting and Reasoning for Aerial Manipulation with Vision Language Models / Sarthak Mishra, Rishabh Dev Yadav, Avirup Das 他
日本語で読む → - 論文マニピュレーションロボティクス
GPU物理シミュレータを用いたサンプリングベース最適化による双腕マニピュレーション
GPU加速物理シミュレータを世界モデルとして用い、タスク特化型コスト関数で誘導されるMPPIにより、障害物環境での複雑な双腕操作をリアルタイムで解き、sim-to-real転移も実現した。
原題: Sampling-Based Optimization with Parallelized Physics Simulator for Bimanual Manipulation / Iryna Hurova, Alinjar Dan, Karl Kruusamäe 他
日本語で読む → - 論文マニピュレーションロボティクス
CBMC-V3:SNNによる俊敏なマニピュレーションのためのCNSに着想を得た制御フレームワーク
スパイキングニューラルネットワーク(SNN)を用いて人間の中枢神経系を模倣した5モジュール・3階層の制御フレームワークを構築し、ロボットアームの俊敏なマニピュレーションを実現した。
原題: CBMC-V3: A CNS-inspired Control Framework Towards Agile Manipulation with SNN / Yanbo Pang, Qingkai Li, Mingguo Zhao
日本語で読む → - 論文マニピュレーションロボティクス
GenDexHand:多指ハンドのための生成的シミュレーション
VLMのフィードバックで物体配置を調整する閉ループ生成により、多指ハンド操作用の多様なタスクと環境を自動生成し、サブタスク分解で強化学習の効率と成功率を高める手法を提案。
原題: GenDexHand: Generative Simulation for Dexterous Hands / Feng Chen, Zhuxiu Xu, Tianzhe Chu 他
日本語で読む → - 論文マニピュレーションロボティクス
大規模な器用なロボットピアノ演奏
人間の実演なしに強化学習と模倣学習を組み合わせ、約1000曲を演奏できるロボットハンドを実現した。
原題: Dexterous Robotic Piano Playing at Scale / Le Chen, Yi Zhao, Jan Schneider 他
日本語で読む →