論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2025/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
VTLA:視覚・触覚・言語・行動モデルと選好学習による挿入操作
視覚と言語に触覚を統合したVTLAモデルを提案し、選好最適化(DPO)で連続的なロボット操作を学習。ピン挿入タスクで90%以上の成功率と実機転移を実現した。
原題: VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation / Chaofan Zhang, Peng Hao, Xiaoge Cao 他
日本語で読む → - 論文マニピュレーションロボティクス
Grasp the Graph 2.0:グラフニューラルネットワークのアンサンブルによる高精度な把持姿勢検出
雑然とした環境での把持姿勢検出を高精度化するため、グラフニューラルネットワークのアンサンブルを用いた軽量な仮説検証型フレームワークを提案し、GraspNet-1Billionで最大35%の精度向上と実機で91%の成功率を達成した。
原題: Grasp the Graph (GtG) 2.0: Ensemble of Graph Neural Networks for High-Precision Grasp Pose Detection in Clutter / Ali Rashidi Moghadam, Sayedmohammadreza Rastegari, Mehdi Tale Masouleh 他
日本語で読む → - 論文マニピュレーション制御
仮想センサを用いたモデル予測制御のためのシステム同定:2自由度ダイレクトドライブロボットアームへの応用
高コストセンサをモデリング時のみ使い、運用時はIMUから先端位置を推定する仮想センサを同定してNMPCを実現する枠組みを提案し、2自由度アームで高精度な軌道追従を実証した。
原題: System Identification for Virtual Sensor-Based Model Predictive Control: Application to a 2-DoF Direct-Drive Robotic Arm / Kosei Tsuji, Ichiro Maruta, Kenji Fujimoto 他
日本語で読む → - 論文マニピュレーションロボティクス
箱折りの自動化:折り畳み手順の抽出とランキング手法
箱を初期状態から目標形状へ折り畳む手順を抽出し、ハードウェアとの適合性に基づいてランキングする手法を提案し、ロボットによる実例を示した。
原題: Automating Box Folding: Sequence Extraction and Ranking Methodologies / Giuseppe Fabio Preziosa, Davide Ferloni, Andrea Maria Zanchettin 他
日本語で読む → - 論文マニピュレーションロボティクス
動的環境におけるロボットアームのための安全認識型ロバストモデル予測制御
動的環境でロボットアームが安全に動作するため、位相ベースのノミナル制御とロバスト安全モードを統合したロバストMPCフレームワークを提案し、障害物予測に基づく制約調整で衝突回避とタスク効率を両立させた。
原題: Safety-Aware Robust Model Predictive Control for Robotic Arms in Dynamic Environments / Sanghyeon Nam, Dongmin Kim, Seung-Hwan Choi 他
日本語で読む → - 論文マニピュレーションロボティクス
EmbodiedMAE: ロボットマニピュレーションのための統合3Dマルチモーダル表現
RGB・深度・点群を統合的に学習するマルチモーダルMAEを提案し、DROID-3Dデータセットで訓練することで、シミュレーションと実機の操作タスクにおいて既存の視覚基盤モデルを上回る性能を達成した。
原題: EmbodiedMAE: A Unified 3D Multi-Modal Representation for Robot Manipulation / Zibin Dong, Fei Ni, Yifu Yuan 他
日本語で読む → - 論文マニピュレーションcs.GR
CoDA: 関節物体の全身操作のための協調拡散ノイズ最適化
身体・左右の手の3つの拡散モデルをノイズ空間で協調最適化し、関節物体を高精度に全身操作する動作を生成する手法を提案。
原題: CoDA: Coordinated Diffusion Noise Optimization for Whole-Body Manipulation of Articulated Objects / Huaijin Pi, Zhi Cen, Zhiyang Dou 他
日本語で読む → - 論文マニピュレーションロボティクス
協働ロボットによる航空機テスト自動化のための力駆動型検証
協働ロボットとAIを用いた航空機テスト自動化において、力・トルク・姿勢データをCNNで分類し、XAIで解釈性を高める手法を提案した。
原題: Force-Driven Validation for Collaborative Robotics in Automated Avionics Testing / Pietro Dardano, Paolo Rocco, David Frisini
日本語で読む → - 論文マニピュレーションロボティクス
動画デモに導かれる多段階マニピュレーションのタスク・動作計画
指示動画から把持・解放状態と物体姿勢を抽出し、RRTプランナを拡張して多段階のタスク・動作計画を生成する手法を提案。複数ロボットで実証した。
原題: Multi-step manipulation task and motion planning guided by video demonstration / Kateryna Zorina, David Kovar, Mederic Fourmy 他
日本語で読む → - 論文マニピュレーションロボティクス
シーン文脈に基づく個人適応型ロボット物体再配置
ユーザーの整理好みをシーン文脈から学習し、部分的に配置された環境で物体を再配置するベンチマークPARSECとLLMベースのモデルContextSortLMを提案。
原題: Personalized Robotic Object Rearrangement from Scene Context / Kartik Ramachandruni, Sonia Chernova
日本語で読む → - 論文マニピュレーションロボティクス
DORA: 物体アフォーダンス誘導による器用なロボットマニピュレーションのための強化学習
物体のアフォーダンスマップを活用し、把持姿勢の候補生成と投票型分類で意味的に妥当な制約を与えることで、多指ハンドの強化学習を効率化しタスク成功率を平均15.4%向上させた。
原題: DORA: Object Affordance-Guided Reinforcement Learning for Dexterous Robotic Manipulation / Lei Zhang, Soumya Mondal, Zhenshan Bing 他
日本語で読む → - 論文マニピュレーションロボティクス
言語と実演から構成可能な行動を学習するフレームワークBLADE
言語注釈付き実演とLLMを活用し、長期ロボットマニピュレーションのための構造化された高レベル行動表現を自動構築する手法を提案。新規状況への一般化性能をシミュレーションと実機で検証した。
原題: Learning Compositional Behaviors from Demonstration and Language / Weiyu Liu, Neil Nie, Ruohan Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
ロボットマニピュレーションのための適応的拡散方策最適化
拡散モデルベースの方策を強化学習で高速かつ安定にファインチューニングするAdamベースの手法ADPOを提案し、ロボット制御タスクで有効性を示した。
原題: Adaptive Diffusion Policy Optimization for Robotic Manipulation / Huiyun Jiang, Zhuang Yang
日本語で読む → - 論文マニピュレーションロボティクス
実演からの多関節物体の逐次運動学モデル学習
人間の実演から多自由度関節物体の運動学制約と操作順序を同時に学習するOKSM表現と、点群からそれを推定するPokenetを提案し、実世界で関節軸・状態推定精度を20%以上改善した。
原題: Learning Sequential Kinematic Models from Demonstrations for Multi-Jointed Articulated Objects / Anmol Gupta, Weiwei Gu, Omkar Patil 他
日本語で読む → - 論文マニピュレーションロボティクス
適応型ワイピング:力覚フィードバックと事前学習済み物体表現を用いた少数ショット模倣学習による接触リッチ操作
力覚フィードバックと事前学習済み物体表現を組み合わせ、スポンジの物性や拭き面の高さ変化に適応する接触リッチなワイピングを少数ショット模倣学習で実現した。
原題: Adaptive Wiping: Adaptive contact-rich manipulation through few-shot imitation learning with Force-Torque feedback and pre-trained object representations / Chikaha Tsuji, Enrique Coronado, Pablo Osorio 他
日本語で読む → - 論文マニピュレーションロボティクス
逆カリキュラム学習による四足歩行ロボットのスケートボード搭乗
逆カリキュラム強化学習を用いて、四足歩行ロボットがスケートボードに乗り込む動作を獲得できるようにした研究。
原題: Quadrupedal Robot Skateboard Mounting via Reverse Curriculum Learning / Danil Belov, Artem Erkhov, Elizaveta Pestova 他
日本語で読む → - 論文協調マニピュレーションロボティクス
H2-COMPACT:適応的接触軌道ポリシーによる人間-ヒューマノイド協調マニピュレーション
触覚のみから人間の意図を推定し、脚式ヒューマノイドが人間と協調して長尺荷物を運搬する階層型ポリシー学習フレームワークを提案。実機Unitree G1で目隠しした人間の追随者と同等の性能を達成した。
原題: H2-COMPACT: Human-Humanoid Co-Manipulation via Adaptive Contact Trajectory Policies / Geeta Chandra Raju Bethala, Hao Huang, Niraj Pudasaini 他
日本語で読む → - 論文マニピュレーションロボティクス
狭所における把持と動作の統合計画フレームワーク
狭い空間にある物体を把持するため、把持と動作計画を同時に解く手法のベンチマークを20シナリオと共に提案し、2つのベースライン手法で評価した。
原題: A Framework for Joint Grasp and Motion Planning in Confined Spaces / Martin Rudorfer, Jiří Hartvich, Vojtěch Vonásek
日本語で読む → - 論文マニピュレーションロボティクス
水中環境における自律移動マニピュレータの協調組立
水中で2台の自律マニピュレータが協調してペグを保持し穴に挿入するペグインホール作業を、タスク優先度逆運動学と力覚センサを用いて実現する手法を提案した。
原題: Cooperative Assembly with Autonomous Mobile Manipulators in an Underwater Scenario / Davide Torielli
日本語で読む → - 論文マニピュレーションロボティクス
変形ツールと剛体物体の接触相互作用推定:学習とモデルベース最適化の融合
変形するツールが剛体を巧みに操作する際の運動と接触力を、学習と物理モデルを組み合わせて推定する手法を提案し、シミュレーションと実機で有効性を示した。
原題: Estimating Deformable-Rigid Contact Interactions for a Deformable Tool via Learning and Model-Based Optimization / Mark Van der Merwe, Miquel Oller, Dmitry Berenson 他
日本語で読む → - 論文マニピュレーションロボティクス
オープンワールドロボット操作のための効率的な感覚運動学習
限られたデモデータから規則性を活用し、新しい物体やタスクに適応できる汎用的な操作スキルを効率的に学習する手法を提案する論文。
原題: Efficient Sensorimotor Learning for Open-world Robot Manipulation / Yifeng Zhu
日本語で読む → - 論文移動マニピュレーションロボティクス
MORE: 接地された言語推論による移動マニピュレーション再配置
シーングラフと能動的フィルタリングでタスク関連サブグラフを抽出し、言語モデルによるゼロショットの長期的移動マニピュレーション計画を高信頼化する手法を提案。BEHAVIOR-1Kで大幅に性能向上。
原題: MORE: Mobile Manipulation Rearrangement Through Grounded Language Reasoning / Mohammad Mohammadi, Daniel Honerkamp, Martin Büchner 他
日本語で読む → - 論文マニピュレーションロボティクス
UniDiffGrasp:VLM推論とパーツ拡散を統合した双腕オープンボキャブラリ制約把持フレームワーク
VLMで対象物の機能パーツを特定し、その幾何制約を拡散モデルに与えて6自由度把持を生成、双腕協調把持も行う統合フレームワークを提案。実機で単腕0.876、双腕0.767の成功率を達成。
原題: UniDiffGrasp: A Unified Framework Integrating VLM Reasoning and VLM-Guided Part Diffusion for Open-Vocabulary Constrained Grasping with Dual Arms / Xueyang Guo, Hongwei Hu, Chengye Song 他
日本語で読む → - 論文マニピュレーションロボティクス
ManipLVM-R1: 大規模視覚言語モデルによる具現化マニピュレーションの推論のための強化学習
高価な人手アノテーションに頼らず、検証可能な報酬を用いた強化学習で大規模視覚言語モデルを訓練し、ロボットマニピュレーションの汎化と物理的推論を向上させるフレームワークを提案。
原題: ManipLVM-R1: Reinforcement Learning for Reasoning in Embodied Manipulation with Large Vision-Language Models / Zirui Song, Guangxian Ouyang, Mingzhe Li 他
日本語で読む → - 論文マニピュレーションロボティクス
J-PARSE: 直列マニピュレータの逆運動学制御における特異点を効果的に解消するヤコビアン投影アルゴリズム
直列マニピュレータの逆運動学制御において、特異点近傍でも滑らかに動作させるため、操作性楕円体のアスペクト比を保つ安全ヤコビアンを構築し、特異方向の指令を縮小して投影する手法を提案。テレオペレーションやサーボ、学習への応用が期待される。
原題: J-PARSE: Jacobian-based Projection Algorithm for Resolving Singularities Effectively in Inverse Kinematic Control of Serial Manipulators / Shivani Guptasarma, Matthew Strong, Honghao Zhen 他
日本語で読む → - 論文マニピュレーションロボティクス
複数直交アームを持つ果実収穫ロボットのための高速ヒューリスティックスケジューリングと軌道計画
複数の直交ロボットアームで果実を収穫する際のスケジューリングと軌道計画を高速に解くヒューリスティック手法を提案し、最大12本のアームで性能を評価した。
原題: Fast Heuristic Scheduling and Trajectory Planning for Robotic Fruit Harvesters with Multiple Cartesian Arms / Yuankai Zhu, Stavros Vougioukas
日本語で読む → - 論文マニピュレーションロボティクス
アクションフィールドに基づくロボットによる衣類のしわ伸ばしと位置合わせのための自動動作生成
ニューラルネットワークでシーン画像から直接エンドエフェクタの動作ベクトルを生成し、衣類のしわ伸ばしと位置合わせを高精度かつ高速に行う手法を提案した。
原題: Automated Action Generation based on Action Field for Robotic Garment Smoothing and Alignment / Hu Cheng, Fuyuki Tokuda, Kazuhiro Kosuge
日本語で読む → - 論文マニピュレーションロボティクス
運動プリミティブによるモジュール型ロボット制御
生物の運動制御に着想を得て、運動プリミティブを組み合わせたモジュール型ロボット制御フレームワークを提案し、複雑な動作生成や接触タスクへの有効性を示した。
原題: Modular Robot Control with Motor Primitives / Moses C. Nah, Johannes Lachner, Neville Hogan
日本語で読む → - 論文マニピュレーションロボティクス
身体認識を視覚表現に接地させた効率的な方策学習
ViTのトークン表現にエージェントと環境を分離する対照学習を導入し、身体的な帰納バイアスを組み込んだ視覚表現で操作タスクの方策学習とロボット間転移を改善した。
原題: Grounding Bodily Awareness in Visual Representations for Efficient Policy Learning / Junlin Wang, Zhiyun Lin
日本語で読む → - 論文マニピュレーションロボティクス
静的知覚を超えて:布折り畳みのためのVLMへの時間的文脈の統合
布折り畳みタスクにおいて、時間的文脈を活用して言語条件付きのピック・アンド・プレース動作を予測するモデルBiFoldを分析し、その内部表現がテキストと画像領域の効果的な整合と時間的一貫性を可能にすることを示した。
原題: Beyond Static Perception: Integrating Temporal Context into VLMs for Cloth Folding / Oriol Barbany, Adrià Colomé, Carme Torras
日本語で読む →