論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2024/10/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
視覚言語モデルによるタスク指向ロボットマニピュレーション
視覚言語モデルと空間推論パイプラインを組み合わせ、高レベルなタスク指示に基づいて物体を操作するフレームワークを提案。
原題: Task-oriented Robotic Manipulation with Vision Language Models / Nurhan Bulus Guran, Hanchi Ren, Jingjing Deng 他
日本語で読む → - 論文マニピュレーションロボティクス
アフォーダンス領域と人間のデモンストレーションに基づく両手動作モデルの学習
物体のアフォーダンス領域間の空間制約を人間のデモから抽出し、両手操作の動作モデルを学習する手法を提案。注ぐ・こねるタスクのシミュレーションで評価した。
原題: Learning Spatial Bimanual Action Models Based on Affordance Regions and Human Demonstrations / Björn S. Plonka, Christian Dreher, Andre Meixner 他
日本語で読む → - 論文マニピュレーションロボティクス
AugInsert: 物体組立タスクのためのデータ拡張によるロバストな視覚-力政策の学習
ペグ挿入組立タスクにおいて、知覚IOアーキテクチャを用いたマルチセンサー政策を開発し、因子ベースの評価フレームワークでロバスト性を評価した。マルチセンサーデータ拡張により分布外性能を向上させ、力-トルクセンシングが最も情報量が多いことを示した。
原題: AugInsert: Learning Robust Visual-Force Policies via Data Augmentation for Object Assembly Tasks / Ryan Diaz, Adam Imdieke, Vivek Veeriah 他
日本語で読む → - 論文マニピュレーションロボティクス
強化学習と動的運動プリミティブによるマルチマニピュレータの協調動作計画
実演ライブラリを活用し、強化学習と動的運動プリミティブを組み合わせて、動的環境で衝突を避けながら複数のマニピュレータが協調して適応的な軌道をリアルタイム生成する手法を提案し、PyBullet上のUR5eで検証した。
原題: Collaborative motion planning for multi-manipulator systems through Reinforcement Learning and Dynamic Movement Primitives / Siddharth Singh, Tian Xu, Qing Chang
日本語で読む → - 論文マニピュレーションロボティクス
3D-ViTac:視触覚センシングによる繊細なマニピュレーションの学習
低コストで柔軟な高密度触覚センサと視覚情報を統合した3D表現を用い、拡散ポリシーによる模倣学習で両手巧みな操作を実現するシステムを提案。
原題: 3D-ViTac: Learning Fine-Grained Manipulation with Visuo-Tactile Sensing / Binghao Huang, Yixuan Wang, Xinyi Yang 他
日本語で読む → - 論文マニピュレーションロボティクス
移動マニピュレータの経路制約下におけるトポロジカルに異なる初期解の生成と最適化
移動マニピュレータの経路計画で局所解に陥る問題を回避するため、トポロジカルに異なる複数の経路を生成し最適化する手法を提案した。
原題: Generating and Optimizing Topologically Distinct Guesses for Mobile Manipulator Path Planning with Path Constraints / Rufus Cheuk Yin Wong, Mayank Sewlia, Adrian Wiltz 他
日本語で読む → - 論文ロコマニピュレーションロボティクス
嗜好オラクル誘導マルチモード方策による動的二足歩行ロコマニピュレーション
ハイブリッドオートマトンをオラクルとして用い、嗜好報酬でモード遷移列を誘導することで、サッカーや箱移動などの動的全身ロコマニピュレーションを単一方策で学習する手法を提案。
原題: Preferenced Oracle Guided Multi-mode Policies for Dynamic Bipedal Loco-Manipulation / Prashanth Ravichandar, Lokesh Krishna, Nikhil Sobanbabu 他
日本語で読む → - 論文マニピュレーションロボティクス
適応コンプライアンスポリシー:拡散誘導制御のための近似コンプライアンス学習
人間のデモから操作タスクに応じて空間的・時間的にシステムのコンプライアンスを動的に調整する枠組みを提案し、接触の多い複雑な操作タスクで従来の視覚運動ポリシーを50%以上上回る性能を達成した。
原題: Adaptive Compliance Policy: Learning Approximate Compliance for Diffusion Guided Control / Yifan Hou, Zeyi Liu, Cheng Chi 他
日本語で読む → - 論文マニピュレーションロボティクス
分割統治:ロボットのペグ挿入組立におけるインピーダンス戦略の解読
ペグ挿入組立において、成功する複数のインピーダンスパラメータの分布と構造をクラスタリングとPCAで分析し、ニューラルネットワークで実現可能なパラメータを予測する手法を提案した。
原題: Divide et Impera: Decoding Impedance Strategies for Robotic Peg-in-Hole Assembly / Johannes Lachner, Federico Tessari, A. Michael West 他
日本語で読む → - 論文マニピュレーションロボティクス
冗長マニピュレータのタスク指向計画・制御による多層安全機構
冗長ロボットマニピュレータに対し、MPCベースの軌道計画と固有受容感覚のみを用いたトルク制御を組み合わせ、不確実な障害物や予期せぬ接触に対応する多層安全フレームワークを提案した。
原題: Multi-layered Safety of Redundant Robot Manipulators via Task-oriented Planning and Control / Xinyu Jia, Wenxin Wang, Jun Yang 他
日本語で読む → - 論文マニピュレーションロボティクス
脚式マニピュレータによる全身ダイナミック投擲
脚式ロボットが全身のモータを活用して物体を投擲するタスクを深層強化学習で学習し、シミュレーションで精度・安定性・飛距離の向上を示し、実機ヒューマノイドへ転移した。
原題: Whole-Body Dynamic Throwing with Legged Manipulators / Humphrey Munn, Brendan Tidd, Peter Böhm 他
日本語で読む → - 論文モバイルマニピュレーションロボティクス
M2Diffuser: 3Dシーンにおけるモバイルマニピュレーションのための拡散ベース軌道最適化
ロボット中心の3Dスキャンから移動と操作を統合した全身軌道を拡散モデルで生成し、推論時に物理制約とタスク目的を最適化する手法を提案。20以上のシーンで既存手法を上回り、実機転移も成功。
原題: M2Diffuser: Diffusion-based Trajectory Optimization for Mobile Manipulation in 3D Scenes / Sixu Yan, Zeyu Zhang, Muzhi Han 他
日本語で読む → - 論文マニピュレーションロボティクス
GRAPPA: オンラインエージェント誘導によるロボット政策の汎化と適応
複数の役割特化型対話エージェントが協調し、基礎ロボット政策をオンラインで環境に接地させて行動分布を望ましい状態へ誘導することで、未知環境への汎化と適応を実現するフレームワークを提案。
原題: GRAPPA: Generalizing and Adapting Robot Policies via Online Agentic Guidance / Arthur Bucker, Pablo Ortega-Kral, Jonathan Francis 他
日本語で読む → - 論文マニピュレーションロボティクス
意味論的に安全なロボットマニピュレーション:意味論的シーン理解から動作安全保証まで
3D環境の意味論的マップと大規模言語モデルの推論を用いて「水の入ったコップをノートPCの上で動かすのは危険」といった常識的な危険条件を検出し、制御バリア関数による安全フィルタでロボット動作を安全に制約する手法を提案した。
原題: Semantically Safe Robot Manipulation: From Semantic Scene Understanding to Motion Safeguards / Lukas Brunke, Yanni Zhang, Ralf Römer 他
日本語で読む → - 論文空中マニピュレーションロボティクス
重心を動的に移動可能なUAVのマニピュレーション能力向上
重心位置を動的に変化させられる飛行ロボットにおいて、接触時の力発生を最大化する重心位置の最適化手法を提案し、2自由度マニピュレータ搭載時のツール作業への拡張をシミュレーションで検証した。
原題: Advancing Manipulation Capabilities of a UAV Featuring Dynamic Center-of-Mass Displacement / Tong Hui, Matteo Fumagalli
日本語で読む → - 論文マニピュレーションロボティクス
多様体交差上の制約付き非線形Kaczmarz射影による協調マルチロボット移動マニピュレーション
移動マニピュレータの多数の制約を多様体として同時に扱い、制約付き非線形Kaczmarz射影で解く手法を提案し、3〜6台の協調動作生成と実機検証を行った。
原題: Constrained Nonlinear Kaczmarz Projection on Intersections of Manifolds for Coordinated Multi-Robot Mobile Manipulation / Akshaya Agrawal, Parker Mayer, Zachary Kingston 他
日本語で読む → - 論文マニピュレーションロボティクス
非把持物体再配置のための物体中心キノダイナミック計画
物体中心の計画パラダイムを採用し、大規模で物理的に複雑な非把持再配置問題を、モデル誤差や実世界の不確実性に対処しながら解く統合フレームワークを提案した。
原題: Object-Centric Kinodynamic Planning for Nonprehensile Robot Rearrangement Manipulation / Kejia Ren, Gaotian Wang, Andrew S. Morgan 他
日本語で読む → - 論文マニピュレーションロボティクス
物理的コンプライアンスとコントローラ切替による言語条件付き多指巧み操作
人間の運動制御の二チャネル仮説に着想を得て、VLAによる高レベル計画と軽量な巧み操作ポリシーをイベント駆動で切替え、柔軟な13自由度ロボットハンドで言語指示に基づく多指操作を実現した。
原題: Language Conditioned Multi-Finger Dexterous Manipulation Enabled by Physical Compliance and Switching of Controllers / Cheng Pan, Kai Junge, Benhui Dai 他
日本語で読む → - 論文マニピュレーションロボティクス
RDT-1B:双腕マニピュレーションのための拡散基盤モデル
双腕ロボット操作のための12億パラメータの拡散ベース基盤モデルRDTを提案し、統一行動空間と大規模マルチロボットデータで事前学習することで、未知物体へのゼロショット汎化や言語指示追従、少数デモからの新スキル学習を実現した。
原題: RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation / Songming Liu, Lingxuan Wu, Bangguo Li 他
日本語で読む → - 論文マニピュレーションロボティクス
DeformPAM:選好ベースの行動整合による変形物体の長期的操作のためのデータ効率学習
人間の選好データから報酬モデルを学習し、拡散モデルで生成した複数候補行動を報酬で選別することで、変形物体の長期的操作を少ないデータで高精度に実現する枠組みを提案。
原題: DeformPAM: Data-Efficient Learning for Long-horizon Deformable Object Manipulation via Preference-based Action Alignment / Wendi Chen, Han Xue, Fangyuan Zhou 他
日本語で読む → - 論文モバイルマニピュレーションロボティクス
動的オープンボキャブラリ3Dシーングラフによる長期言語誘導型モバイルマニピュレーション
RGB-D入力と視覚言語モデルを用いて動的に更新可能な3Dシーングラフを構築し、言語指示に基づく長期モバイルマニピュレーションを実現するフレームワークDovSGを提案した。
原題: Dynamic Open-Vocabulary 3D Scene Graphs for Long-term Language-Guided Mobile Manipulation / Zhijie Yan, Shufei Li, Zuoxu Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
Diff-DAgger: 拡散ポリシーを用いた不確実性推定によるロボットマニピュレーション
拡散ポリシーの学習目的を利用して不確実性を推定し、ロボットが専門家に質問する対話型模倣学習を効率化した手法を提案。積み重ね・押し・挿入タスクで失敗予測と成功率を改善し、時間も短縮した。
原題: Diff-DAgger: Uncertainty Estimation with Diffusion Policy for Robotic Manipulation / Sung-Wook Lee, Xuhui Kang, Yen-Ling Kuo
日本語で読む → - 論文マニピュレーションロボティクス
RecoveryChaining: ロバストなマニピュレーションのための局所回復ポリシー学習
階層強化学習を用いて、モデルベース制御器が失敗した際に発動する回復ポリシーを学習し、疎な報酬下でもロバストなマニピュレーションを実現する手法を提案。シミュレーションから実機への転移も成功。
原題: RecoveryChaining: Learning Local Recovery Policies for Robust Manipulation / Shivam Vats, Devesh K. Jha, Maxim Likhachev 他
日本語で読む → - 論文マニピュレーションロボティクス
HMT-Grasp: 混雑環境におけるロボット把持のためのハイブリッドMamba-Transformer手法
Vision Mambaと並列畳み込み-Transformerブロックを統合し、局所・大域特徴を同時に捉えることで、混雑環境でのロボット把持精度を向上させる手法を提案した。
原題: HMT-Grasp: A Hybrid Mamba-Transformer Approach for Robot Grasping in Cluttered Environments / Songsong Xiong, Hamidreza Kasaei
日本語で読む → - 論文空中マニピュレーションロボティクス
GPS非依存の空中把持・収穫のための自律飛行システム設計
GPSが使えない屋内環境で、オンボード計算のみを用いて空中で果実を把持・収穫するUAVシステムを設計・実装した。
原題: Design, Localization, Perception, and Control for GPS-Denied Autonomous Aerial Grasping and Harvesting / Ashish Kumar, Laxmidhar Behera
日本語で読む → - 論文マニピュレーションロボティクス
SegGrasp: セマンティック・幾何学誘導セグメンテーションによるゼロショットタスク指向把持
視覚言語モデルと凸分解による幾何情報を組み合わせ、学習なしで対象物の機能部位を狙うゼロショット把持を実現したフレームワーク。
原題: SegGrasp: Zero-Shot Task-Oriented Grasping via Semantic and Geometric Guided Segmentation / Haosheng Li, Weixin Mao, Weipeng Deng 他
日本語で読む → - 論文マニピュレーションロボティクス
拡散モデルに基づく確率的接触探索による多指マニピュレーション
拡散モデルで接触モード列を生成しA*探索と粒子フィルタで不確実性を考慮して多指操作の接触計画を行う手法を提案し、実機ネジ回しタスクなどで有効性を示した。
原題: Diffusion-Informed Probabilistic Contact Search for Multi-Finger Manipulation / Abhinav Kumar, Thomas Power, Fan Yang 他
日本語で読む → - 論文マニピュレーションロボティクス
LucidGrasp: 6D姿勢推定による透明度の異なる実験器具の自律操作ロボットフレームワーク
透明度が異なる液体入り実験器具を6D姿勢推定で認識し、注液などの繊細な操作を自律的に行うロボットフレームワークを開発した。
原題: LucidGrasp: Robotic Framework for Autonomous Manipulation of Laboratory Equipment with Different Degrees of Transparency via 6D Pose Estimation / Maria Makarova, Daria Trinitatova, Qian Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
REPeat: ロボット支援食事における軟食の事前把持のためのReal2Sim2Realアプローチ
軟らかい食品をロボットが掬いやすいよう、押す・切る・ひっくり返すなどの事前動作をシミュレーションで探索し、成功率が上がれば実機で実行するReal2Sim2Real手法を提案。15皿・10種の食品で把持成功率が平均27%向上した。
原題: REPeat: A Real2Sim2Real Approach for Pre-acquisition of Soft Food Items in Robot-assisted Feeding / Nayoung Ha, Ruolin Ye, Ziang Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
マルチレベル整列表現に基づくオープンボキャブラリマニピュレーションのタスク成功予測
指示文と操作前後の視点画像から、卓上マニピュレーションの成否を予測する手法を提案。局所画像情報・言語整列特徴・言語構造化特徴を統合したマルチレベル表現で、MLLMを上回る精度を達成した。
原題: Task Success Prediction for Open-Vocabulary Manipulation Based on Multi-Level Aligned Representations / Miyu Goko, Motonari Kambara, Daichi Saito 他
日本語で読む →