論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2025/11/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
EgoMI:一人称視点の人間デモから能動視覚と全身マニピュレーションを学習
人間の一人称視点の操作データから頭部と手の動きを同時に取得し、半人型ロボットで能動視覚を伴う模倣学習を実現するフレームワークを提案した。
原題: EgoMI: Learning Active Vision and Whole-Body Manipulation from Egocentric Human Demonstrations / Justin Yu, Yide Shentu, Di Wu 他
日本語で読む → - 論文マニピュレーションロボティクス
H-GAR: 目標駆動型の観測・行動洗練による階層的インタラクションフレームワーク
目標観測と粗い行動スケッチを起点に、観測と行動を相互に洗練させる階層的フレームワークを提案し、ロボットマニピュレーションの精度を向上させた。
原題: H-GAR: A Hierarchical Interaction Framework via Goal-Driven Observation-Action Refinement for Robotic Manipulation / Yijie Zhu, Rui Shao, Ziyang Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
VLMが計画した原子スキルのデモンストレーションによる優しいマニピュレーション方策学習
VLMで長期的な接触を伴うタスクを原子スキルに分解し、力制約付きRLで各スキルをシミュレーション学習、そのデモを視触覚拡散方策に蒸留して実機展開する枠組みを提案。
原題: Gentle Manipulation Policy Learning via Demonstrations from VLM Planned Atomic Skills / Jiayu Zhou, Qiwei Wu, Jian Li 他
日本語で読む → - 論文マニピュレーションロボティクス
勾配を勾配で積み上げる:双腕ロボット組立のための分散型エネルギー関数
適応的ポテンシャル関数を自動合成して区分連続なエネルギー関数を作り、近視的最適化だけで双腕ロボットの組立を分散的に計画・再計画するフレームワークを提案。
原題: Building Gradient by Gradient: Decentralised Energy Functions for Bimanual Robot Assembly / Alexander L. Mitchell, Joe Watson, Ingmar Posner
日本語で読む → - 論文マニピュレーションロボティクス
相似変換に基づくマルチアーム操作制御のための協調タスク空間
複数のロボットアームを単一アームのように扱える協調タスク空間を、共形幾何代数の幾何プリミティブと相似変換を用いて定式化し、操作空間制御に統合する手法を提案した論文。
原題: Cooperative Task Spaces for Multi-Arm Manipulation Control based on Similarity Transformations / Tobias Löw, Cem Bilaloglu, Sylvain Calinon
日本語で読む → - 論文マニピュレーションロボティクス
果樹剪定のための冗長ロボットマニピュレータによる自動行動計画
果樹剪定ロボットの行動計画問題を定式化し、知覚・モデリング・計画を統合したワークフローを提案して実機で検証した。
原題: Automated Behavior Planning for Fruit Tree Pruning via Redundant Robot Manipulators: Addressing the Behavior Planning Challenge / Gaoyuan Liu, Bas Boom, Naftali Slob 他
日本語で読む → - 論文マニピュレーションロボティクス
CroSTAta: ロボットマニピュレーションのためのクロス状態遷移注意トランスフォーマー
状態遷移パターンに基づいて注意重みを調整する新しい注意機構を提案し、実演からのロボットマニピュレーション学習において、失敗と回復のパターンなど時間的構造を明示的にモデル化することで、精度が重要なタスクで標準的な注意機構やTCN、LSTMを上回る性能を達成した。
原題: CroSTAta: Cross-State Transition Attention Transformer for Robotic Manipulation / Giovanni Minelli, Giulio Turrisi, Victor Barasuol 他
日本語で読む → - 論文マニピュレーションロボティクス
U-LAG: 不確実性を考慮した遅延適応型目標再設定によるロボットマニピュレーション
知覚遅延やノイズがある環境で、物体の位置変化に応じて実行中に目標を再設定するモジュールU-LAGを提案し、ピック・プッシュ・積み重ね・ペグ挿入タスクで有効性を示した。
原題: U-LAG: Uncertainty-Aware, Lag-Adaptive Goal Retargeting for Robotic Manipulation / Anamika J H, Anujith Muraleedharan
日本語で読む → - 論文マニピュレーションロボティクス
RaycastGrasp: ウェアラブルデバイスによる視線操作でロボットマニピュレーション
MRヘッドセットを用いて、ユーザーの一人称視点の視線固定で実世界の物体を操作する支援ロボットインタフェースを提案し、88%以上の意図・物体認識精度を達成した。
原題: RaycastGrasp: Eye-Gaze Interaction with Wearable Devices for Robotic Manipulation / Zitiantao Lin, Yongpeng Sang, Yang Ye
日本語で読む → - 論文マニピュレーションロボティクス
VCoT-Grasp: 視覚的思考連鎖推論による言語駆動型把持生成のための把持基盤モデル
視覚的思考連鎖推論を組み込んだエンドツーエンドの把持基盤モデルを提案し、大規模データセットを構築して、実環境での把持成功率と未知物体への汎化性能を向上させた。
原題: VCoT-Grasp: Grasp Foundation Models with Visual Chain-of-Thought Reasoning for Language-driven Grasp Generation / Haoran Zhang, Shuanghao Bai, Wanqi Zhou 他
日本語で読む → - 論文マニピュレーションロボティクス
サンプリングベースMPCのための生成モデル:適応的な接触リッチマニピュレーションのためのブートストラップ手法
サンプリングベースMPCの制御列を条件付きフローマッチングで学習し、オンライン計画を効率化する生成予測制御フレームワークを提案。四足ロボットの実世界接触リッチ移動マニピュレーションに初めて適用し、サンプル効率と汎化性能を向上させた。
原題: Generative Models From and For Sampling-Based MPC: A Bootstrapped Approach For Adaptive Contact-Rich Manipulation / Lara Brudermüller, Brandon Hung, Xinghao Zhu 他
日本語で読む → - 論文マニピュレーションロボティクス
点群条件付きフローマッチングによるロボットマニピュレータの最適化ベース動作計画のウォームスタート
単視点の点群を条件としたフローマッチングで最適化初期解を生成し、マニピュレータの動作計画を高速化・高成功率化する手法を提案。
原題: Warm-Starting Optimization-Based Motion Planning for Robotic Manipulators via Point Cloud-Conditioned Flow Matching / Sibo Tian, Minghui Zheng, Xiao Liang
日本語で読む → - 論文マニピュレーションロボティクス
ポイント・アンド・ゴー:支援ロボティクスにおけるモード切替の直感的参照座標系再配置
車椅子搭載マニピュレータの操作を直感的にするため、グリッパを向けた方向に移動軸を再定義する「ポイント・アンド・ゴー」モード切替を提案し、従来のカルテシアンモード切替や学習手法より作業時間・停止・切替回数を削減した。
原題: Point and Go: Intuitive Reference Frame Reallocation in Mode Switching for Assistive Robotics / A. Wang, C. Jiang, M. Przystupa 他
日本語で読む → - 論文マニピュレーションロボティクス
FastUMI-100K:大規模UMI形式データセットによるデータ駆動型ロボットマニピュレーションの進展
モジュール型ハードウェアと軽量トラッキングを備えたFastUMIシステムで収集した10万件超の家庭内タスク実演データセットを構築し、多様な模倣学習アルゴリズムで高い成功率を示した。
原題: FastUMI-100K: Advancing Data-driven Robotic Manipulation with a Large-scale UMI-style Dataset / Kehui Liu, Zhongjie Jia, Yang Li 他
日本語で読む → - 論文マニピュレーションロボティクス
逐次タスクを逐次教示する(ST)²:ロボットに長期的マニピュレーションスキルを教える
長期的なマニピュレーションタスクを教えるための逐次的な学習手法(ST)²を提案し、実店舗環境でのユーザー研究により、逐次教示が一括教示よりも多くのユーザーで優れた性能を示すことを明らかにした。
原題: Sequentially Teaching Sequential Tasks $(ST)^2$: Teaching Robots Long-horizon Manipulation Skills / Zlatan Ajanović, Ravi Prakash, Leandro de Souza Rosa 他
日本語で読む → - 論文マニピュレーションロボティクス
強化学習で獲得した両腕ロボットスキルの計画とスケジューリング
強化学習で訓練した単腕・両腕のプリミティブスキルをライブラリ化し、Transformerベースのプランナがスキルの離散的なスケジュールと連続パラメータを同時予測することで、長期的な接触を伴う両腕マニピュレーションを効率的に計画する階層的フレームワークを提案した。
原題: Learning to Plan & Schedule with Reinforcement-Learned Bimanual Robot Skills / Weikang Wan, Fabio Ramos, Xuning Yang 他
日本語で読む → - 論文マニピュレーションロボティクス
NovaFlow: 生成動画からの実行可能フローによるゼロショットマニピュレーション
タスク記述から動画を生成し、それを3Dの物体フローに変換してロボットの動作計画を立てることで、実演なしで新しい操作タスクをゼロショット実行するフレームワーク。
原題: NovaFlow: Zero-Shot Manipulation via Actionable Flow from Generated Videos / Hongyu Li, Lingfeng Sun, Yafei Hu 他
日本語で読む → - 論文マニピュレーションロボティクス
ARRC: 検索拡張生成を用いた知識駆動型自律マニピュレーションのための高度推論ロボット制御
RAGとRGB-D知覚を組み合わせ、自然言語指示から安全なロボットアームの動作計画を生成・実行するシステムを提案。卓上タスクで有効性を検証した。
原題: ARRC: Advanced Reasoning Robot Control - Knowledge-Driven Autonomous Manipulation Using Retrieval-Augmented Generation / Eugene Vorobiov, Ammar Jaleel Mahmood, Salim Rezvani 他
日本語で読む → - 論文マニピュレーションロボティクス
Placeit!:ロボットの物体配置スキルを学習するフレームワーク
進化的計算と品質多様性最適化を用いて、剛体物体の多様で有効な配置姿勢を自動生成するフレームワークを提案し、実世界のピック&プレースで90%の成功率を達成した。
原題: Placeit! A Framework for Learning Robot Object Placement Skills / Amina Ferrad, Johann Huber, François Hélénon 他
日本語で読む → - 論文マニピュレーションロボティクス
ヒューマノイドロボットによる効率的な多地点検査のための経路・動作最適化
階層的計画とMPCを組み合わせ、ヒューマノイドが多地点をミリメートル精度で高速に検査する枠組みを提案し、Kuavo 4Proで検証した。
原題: Path and Motion Optimization for Efficient Multi-Location Inspection with Humanoid Robots / Jiayang Wu, Jiongye Li, Shibowen Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
GRITS: こぼれを考慮した誘導拡散ポリシーによるロボットの食品すくいタスク
食品すくい時のこぼれを予測するモデルを拡散ポリシーの誘導信号として使い、こぼれを抑えつつ成功率を高める手法を提案し、実機で有効性を示した。
原題: GRITS: A Spillage-Aware Guided Diffusion Policy for Robot Food Scooping Tasks / Yen-Ling Tai, Yi-Ru Yang, Kuan-Ting Yu 他
日本語で読む → - 論文マニピュレーションロボティクス
自動運転実験室で働く移動マニピュレータの運動学解析と視覚アルゴリズム統合
自動運転実験室での人間支援を目的に、移動マニピュレータの運動学モデルと逆運動学を構築し、特徴ベース検出とホモグラフィによる姿勢推定を組み合わせた視覚アルゴリズムを統合して、テクスチャ物体の把持を実現した。
原題: Kinematic Analysis and Integration of Vision Algorithms for a Mobile Manipulator Employed Inside a Self-Driving Laboratory / Shifa Sulaiman, Tobias Busk Jensen, Stefan Hein Bengtson 他
日本語で読む → - 論文マニピュレーションロボティクス
ActiveUMI: ロボット不要の人間デモンストレーションによる能動的知覚を伴うロボットマニピュレーション
VRテレオペレーションキットとセンサ付きコントローラで人間の両手作業デモを収集し、頭部運動による能動的知覚も学習してロボットに転移するデータ収集フレームワークを提案。6つの両手タスクで平均70%の成功率を達成。
原題: ActiveUMI: Robotic Manipulation with Active Perception from Robot-Free Human Demonstrations / Qiyuan Zeng, Chengmeng Li, Jude St. John 他
日本語で読む → - 論文マニピュレーションロボティクス
Hoecken-Dハンド:直線平行ピンチングと自己適応把持を実現する新型ロボットハンド
Hoeckenリンク機構と差動バネ機構を組み合わせ、単一アクチュエータで直線平行ピンチングと物体形状に応じた適応把持を切り替えられる低コストなロボットハンドを開発した。
原題: Hoecken-D Hand: A Novel Robotic Hand for Linear Parallel Pinching and Self-Adaptive Grasping / Wentao Guo, Wenzeng Zhang
日本語で読む → - 論文マニピュレーションロボティクス
DeGrip: デスクトップ解体作業向けのコンパクトなケーブル駆動型ロボットグリッパ
廃棄デスクトップPCの解体作業に特化した3自由度ケーブル駆動グリッパを開発し、Isaac Sim上の解体環境で狭所作業と任意姿勢での部品取り外し性能を検証した。
原題: DeGrip: A Compact Cable-driven Robotic Gripper for Desktop Disassembly / Bihao Zhang, Davood Soleymanzadeh, Xiao Liang 他
日本語で読む → - 論文マニピュレーションロボティクス
遺伝的ノイズ除去によるロボット操作のための2ステップ拡散ポリシー
拡散ポリシーのノイズ除去過程を身体性AIタスク向けに適応させ、遺伝的ノイズ除去という集団ベースサンプリングで2回の推論で高精度なロボット操作を実現した。
原題: Two-Steps Diffusion Policy for Robotic Manipulation via Genetic Denoising / Mateo Clemente, Leo Brunswic, Rui Heng Yang 他
日本語で読む → - 論文マニピュレーションロボティクス
Botany-Bot: ガウススプラットを用いた遮蔽・葉裏の植物構造のデジタルツイン監視
ロボットアームとステレオカメラ、ターンテーブル、3Dガウススプラットモデルを組み合わせ、葉に隠れた茎の芽や葉の裏表を高解像度で撮影し、植物の詳細な注釈付きデジタルツインを構築するシステムを提案。
原題: Botany-Bot: Digital Twin Monitoring of Occluded and Underleaf Plant Structures with Gaussian Splats / Simeon Adebola, Chung Min Kim, Justin Kerr 他
日本語で読む → - 論文マニピュレーションロボティクス
視覚に頼らず接触と構造事前知識で操作するフレームワーク
視覚が使えない環境で、関節トルクによる接触検出と構造事前知識を組み合わせ、未知環境でも衝突を避けて操作タスクを遂行する枠組みを提案した。
原題: A Contact-Driven Framework for Manipulating in the Blind / Muhammad Suhail Saleem, Lai Yuan, Maxim Likhachev
日本語で読む → - 論文マニピュレーションロボティクス
VT-Refine: 視触覚フィードバックによる両手組立のシミュレーション微調整学習
少数の実演と高忠実度の触覚シミュレーションを組み合わせ、強化学習で両手組立ポリシーを微調整することで、接触の多い精密作業の実世界性能を向上させた研究。
原題: VT-Refine: Learning Bimanual Assembly with Visuo-Tactile Feedback via Simulation Fine-Tuning / Binghao Huang, Jie Xu, Iretiayo Akinola 他
日本語で読む → - 論文マニピュレーションロボティクス
RoboHiMan: 長期的マニピュレーションにおける構成的一般化のための階層的評価パラダイム
長期的なマニピュレーションタスクにおけるスキル構成の一般化を評価するため、多様な摂動下での原子タスクと構成タスクのベンチマークHiMan-Benchと3つの評価パラダイムを提案し、代表的なモデル・アーキテクチャの能力ギャップを明らかにした。
原題: RoboHiMan: A Hierarchical Evaluation Paradigm for Compositional Generalization in Long-Horizon Manipulation / Yangtao Chen, Zixuan Chen, Nga Teng Chan 他
日本語で読む →