論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
R3DP: 実時間3D認識ポリシーによる身体的操作
大規模3D視覚モデルの強力な事前知識を、非同期の高速・低速協調モジュールと軽量な時間特徴予測ネットワークで統合し、実時間性能を保ちながら操作ポリシーの成功率を向上させる手法を提案した。
原題: R3DP: Real-Time 3D-Aware Policy for Embodied Manipulation / Yuhao Zhang, Wanxi Dong, Yue Shi 他
日本語で読む → - 論文マニピュレーションロボティクス
部分観測下での言語誘導把持:現場点検・保守における移動操作のための手法
脚式移動マニピュレータが部分観測下で言語指示に基づき物体を把持するパイプラインを提案し、現場の点検・保守シナリオで成功率を向上させた。
原題: Language-Guided Grasping under Partial Observation for Mobile Manipulation in Field Inspection and Maintenance / Dilermando Almeida, Juliano Negri, Guilherme Lazzarini 他
日本語で読む → - 論文マニピュレーションロボティクス
逆動力学のスペクトル分解によるモデルベース操作の高速探索
逆動力学方程式のスペクトル分解を用いて、長期間のロボット操作計画を効率的に探索する手法を提案。直交成分で到達可能集合を近似し、RRT等と組み合わせて長時間計画を実現。
原題: Spectral Decomposition of Inverse Dynamics for Fast Exploration in Model-Based Manipulation / Solvin Sigurdson, Benjamin Riviere, Joel Burdick
日本語で読む → - 論文マニピュレーションロボティクス
月面構造物の組立・設備設置のための長距離ロボットマニピュレーション
月面での建設作業向けに、展開式ブームを用いた長距離マニピュレータを開発し、たわみや振動を抑える制御戦略を提案。最大1.8mのブーム長で平均誤差15mm未満を達成し、ケーブル配線作業で実証した。
原題: Long-Reach Robotic Manipulation for Assembly and Outfitting of Lunar Structures / Stanley Wang, Venny Kojouharov, Long Yin Chung 他
日本語で読む → - 論文マニピュレーションロボティクス
イベント駆動型プロアクティブ支援操作:接地された視覚言語プランニングによる実現
ユーザーの指示を待たず、作業空間の状態変化(イベント)を検知して能動的に支援行動を生成するロボット操作フレームワークを提案した。実機のテーブルトップタスクで有効性を検証した。
原題: Event-Driven Proactive Assistive Manipulation with Grounded Vision-Language Planning / Fengkai Liu, Hao Su, Haozhuang Chi 他
日本語で読む → - 論文マニピュレーションロボティクス
Exp-Force: 視覚言語モデルによる経験条件付き把持前力選択
単一のRGB画像から最小限の把持力を予測するフレームワークを提案。過去の把持経験を参照して視覚言語モデルを条件付けし、接触モデルや手動設計なしで把持前の力を選択する。
原題: Exp-Force: Experience-Conditioned Pre-Grasp Force Selection with Vision-Language Models / Siqi Shang, Minchao Huang, Bill Fan 他
日本語で読む → - 論文ヒューマノイド/マニピュレーションロボティクス
FAME: 全身ヒューマノイドの操作範囲を拡大する力適応型強化学習
上半身の姿勢と両手にかかる力を潜在表現として取り込み、外力下でもバランスを保つ立ち姿勢ポリシーを強化学習で獲得。力覚センサなしで実機ヒューマノイドに適用可能。
原題: FAME: Force-Adaptive RL for Expanding the Manipulation Envelope of a Full-Scale Humanoid / Niraj Pudasaini, Yutong Zhang, Jensen Lavering 他
日本語で読む → - 論文マニピュレーションロボティクス
動作・環境不確かさ下でのマニピュレータの安全保証付き軌道生成
深層確率KoopmanモデルとSOS計画を組み合わせ、不確かな環境でも衝突リスクを形式的に保証するMPPIベースの軌道生成フレームワークを提案し、実機で検証した。
原題: Provably Safe Trajectory Generation for Manipulators Under Motion and Environmental Uncertainties / Fei Meng, Zijiang Yang, Xinyu Mao 他
日本語で読む → - 論文マニピュレーションロボティクス
GarmentPile++: 視覚言語推論によるアフォーダンス駆動の乱雑な衣類取り出し
衣類の山から言語指示に従って安全かつ正確に1枚だけを取り出すパイプラインを提案。視覚言語モデルと視覚アフォーダンスを統合し、SAM2によるセグメンテーションとマスク微調整、さらに大型衣類向けの双腕協調を導入した。
原題: GarmentPile++: Affordance-Driven Cluttered Garments Retrieval with Vision-Language Reasoning / Mingleyang Li, Yuran Wang, Yue Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
DexKnot: 器用な袋結び操作のための汎化可能な視覚運動ポリシー学習
袋結びの汎化可能なポリシーを、キーポイントのアフォーダンスと拡散ポリシーを組み合わせて学習するフレームワークを提案した。
原題: DexKnot: Generalizable Visuomotor Policy Learning for Dexterous Bag-Knotting Manipulation / Jiayuan Zhang, Ruihai Wu, Haojun Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
強化学習と大規模言語モデルを統合したロボット操作のためのハイブリッドフレームワーク
強化学習による低レベル制御と大規模言語モデルによる高レベル計画を組み合わせ、複雑な指示を理解して実行できるロボット操作フレームワークを提案した。シミュレーションでタスク完了時間の短縮と精度・適応性の向上を確認した。
原題: Hybrid Framework for Robotic Manipulation: Integrating Reinforcement Learning and Large Language Models / Md Saad, Sajjad Hussain, Mohd Suhaib
日本語で読む → - 論文マニピュレーションロボティクス
構造化プランナーとしてのワールドモデル:ロボット操作のための疎な未来予測
密な未来予測の冗長性と誤差蓄積を避けるため、キネマティクスに基づく疎な構造化フレームを予測するワールドモデルを提案し、視覚プランニングと運動制御を橋渡しする。
原題: Beyond Dense Futures: World Models as Structured Planners for Robotic Manipulation / Minghao Jin, Mozheng Liao, Mingfei Han 他
日本語で読む → - 論文マニピュレーションロボティクス
指先ワークスペースクラウドと接触認識サンプリングに基づく巧みな把握データ拡張
遠隔操作で収集した少数の把握デモを基に、指先のワークスペースクラウドと接触認識サンプリングを用いた把握生成器でデータを拡張し、任意構造のロボットハンドに対して高速かつ高品質な把握生成を実現する手法を提案した。
原題: Dexterous grasp data augmentation based on grasp synthesis with fingertip workspace cloud and contact-aware sampling / Liqi Wu, Haoyu Jia, Kento Kawaharazuka 他
日本語で読む → - 論文VLA/マニピュレーションロボティクス
DAM-VLA: 動的行動モデルに基づくロボット操作のための視覚言語行動フレームワーク
VLMの推論と拡散ベースの行動モデルを統合し、タスクに応じて腕の移動とグリッパー操作を動的に切り替えるVLAフレームワークを提案。シミュレーションと実環境で高い成功率を達成した。
原題: DAM-VLA: A Dynamic Action Model-Based Vision-Language-Action Framework for Robot Manipulation / Xiongfeng Peng, Jiaqian Yu, Dingzhe Li 他
日本語で読む → - 論文マニピュレーションロボティクス
自己巻き付きを考慮したケーブル牽引平面物体操作の軌道最適化
ケーブルが物体に自己巻き付きする状況を考慮し、張力の有無を暗黙的に扱う軌道最適化手法を提案。緩和階層を構築し、自己巻き付きを状態発展として誘導する手法が有効であることを示した。
原題: Trajectory Optimization for Self-Wrap-Aware Cable-Towed Planar Object Manipulation under Implicit Tension Constraints / Yu Li, Amin Fakhari, Hamid Sadeghian
日本語で読む → - 論文マニピュレーションロボティクス
OpenHEART: 脚付きマニピュレータによる異種関節物体の開扉
脚付きマニピュレータでドアや引き出しなど多様な関節物体を開くための、サンプル効率の良い強化学習フレームワークを提案。ハンドルとパネルの形状を低次元特徴に圧縮し、関節の開く方向と可動域を推定することで、シミュレーションと実機で汎用的に動作する。
原題: OpenHEART: Opening Heterogeneous Articulated Objects with a Legged Manipulator / Seonghyeon Lim, Hyeonwoo Lee, Seunghyun Lee 他
日本語で読む → - 論文マニピュレーションロボティクス
RoboSolver: ロボットアーム問題を解くためのマルチエージェントLLMフレームワーク
LLMとVLMを組み合わせたマルチエージェントフレームワークで、テキストや画像からロボットアームの順運動学・逆運動学・速度・加速度計算、3Dシミュレーション、動作制御を自動実行する。
原題: RoboSolver: A Multi-Agent Large Language Model Framework for Solving Robotic Arm Problems / Hamid Khabazi, Ali F. Meghdari, Alireza Taheri
日本語で読む → - 論文マニピュレーションロボティクス
KANでフローする?KANとRWKVによる3Dフローマッチングでロボットマニピュレーションを進化させる
軽量なRWKV-KANバックボーンと行動一貫性正則化を組み合わせたフローマッチング方策を提案し、パラメータを86.8%削減しつつ複数の操作ベンチマークで最高精度を達成した。
原題: KAN We Flow? Advancing Robotic Manipulation with 3D Flow Matching via KAN & RWKV / Zhihao Chen, Yiyuan Ge, Ziyang Wang
日本語で読む → - 論文マニピュレーションロボティクス
HybridFlow:ロボットマニピュレーションのための2ステップ生成ポリシー
MeanFlowの1ステップ生成とReFlowの精密化を組み合わせた3段階・2NFEの生成ポリシーを提案し、拡散ポリシーより8倍高速で成功率も15〜25%向上させた。
原題: HybridFlow: A Two-Step Generative Policy for Robotic Manipulation / Zhenchen Dong, Jinna Fu, Jiaming Wu 他
日本語で読む → - 論文マニピュレーションロボティクス
GSR: 身体性マニピュレーションのための構造化推論学習
世界状態の変化を意味的に接地したシーングラフ上の遷移として明示的にモデル化し、長期的なマニピュレーションタスクの推論とゼロショット汎化を改善する手法を提案。
原題: GSR: Learning Structured Reasoning for Embodied Manipulation / Kewei Hu, Michael Zhang, Wei Ying 他
日本語で読む → - 論文空中マニピュレーションロボティクス
斜面上への着陸のための固有感覚的接触位置推定を備えた全方向デュアルアーム空中マニピュレータ
双腕の全方向空中マニピュレータを開発し、トルクオブザーバによる固有感覚的な接触検出と位置推定で、視覚に頼らず斜面上への着陸を実現した。
原題: Omnidirectional Dual-Arm Aerial Manipulator with Proprioceptive Contact Localization for Landing on Slanted Roofs / Martijn B. J. Brummelhuis, Nathan F. Lepora, Salua Hamaza
日本語で読む → - 論文マニピュレーションロボティクス
IRIS: 学習駆動型タスク特化型シネマロボットアームによる視覚運動制御
3Dプリント製の低コスト6自由度ロボットアームとTransformerベースの模倣学習を組み合わせ、人間の実演から映画撮影向けの滑らかなカメラ軌道を自律的に学習・実行するシステムを構築した。
原題: IRIS: Learning-Driven Task-Specific Cinema Robot Arm for Visuomotor Motion Control / Qilong Cheng, Matthew Mackay, Ali Bereyhi
日本語で読む → - 論文マイクロマニピュレーションロボティクス
MicroPush: 磁気ローリングマイクロロボットによる接触の多い細胞押し出しと組立のためのシミュレータとベンチマーク
磁気ローリングマイクロロボットが混雑した2D環境で細胞を押したり組み立てたりするためのオープンソースシミュレータとベンチマークを開発し、接触を考慮したモデルと計画・制御スタックを提供した。
原題: MicroPush: A Simulator and Benchmark for Contact-Rich Cell Pushing and Assembly with a Magnetic Rolling Microrobot / Yanda Yang, Sambeeta Das
日本語で読む → - 論文空中マニピュレーションロボティクス
Tilt-X: 傾斜・伸縮可能な連続マニピュレータによる柔軟な空中マニピュレーション
傾斜機構・伸縮ステージ・ケーブル駆動連続アームを統合した空中マニピュレータを開発し、プロペラ後流の影響を避けつつ広い作業空間を実現した。
原題: Tilt-X: Enabling Compliant Aerial Manipulation through a Tiltable-Extensible Continuum Manipulator / Anuraj Uthayasooriyan, Krishna Manaswi Digumarti, Jack Breward 他
日本語で読む → - 論文マニピュレーションロボティクス
自己駆動型実験室におけるロボットマニピュレータのための視覚誘導初期化を伴うアドミタンスベース動作計画
自己駆動型実験室での安全で適応的なロボット操作を実現するため、アドミタンス制御を軌道実行に組み込み、視覚による初期位置推定で参照軌道を生成する動作計画フレームワークを提案した。
原題: Admittance-Based Motion Planning with Vision-Guided Initialization for Robotic Manipulators in Self-Driving Laboratories / Shifa Sulaiman, Tobias Jensen, Francesco Schetter 他
日本語で読む → - 論文マニピュレーションロボティクス
低コスト触覚力制御グリッパによる力調整マニピュレーションの学習
低コストの触覚フィードバック付き力制御グリッパと、把持力を高頻度で調整するフレームワークを提案し、力加減が重要な実世界タスクで有効性を示した。
原題: Learning Force-Regulated Manipulation with a Low-Cost Tactile-Force-Controlled Gripper / Xuhui Kang, Tongxuan Tian, Sung-Wook Lee 他
日本語で読む → - 論文マニピュレーションロボティクス
MultiGraspNet: マルチグリッパーロボット把持のためのマルチタスク3Dビジョンモデル
並列グリッパーと真空グリッパーの把持姿勢を単一の3D深層学習モデルで同時に予測し、1台のロボットで複数のエンドエフェクタを使い分けられるようにした。
原題: MultiGraspNet: A Multitask 3D Vision Model for Multi-gripper Robotic Grasping / Stephany Ortuno-Chanelo, Paolo Rabino, Enrico Civitelli 他
日本語で読む → - 論文マニピュレーションロボティクス
Robo3R: 高精度フィードフォワード3D再構成によるロボットマニピュレーションの強化
RGB画像とロボット状態から実時間でメートルスケールの3Dシーンを再構成するフィードフォワードモデルを提案し、模倣学習や把持生成などの操作タスクで性能を向上させた。
原題: Robo3R: Enhancing Robotic Manipulation with Accurate Feed-Forward 3D Reconstruction / Sizhe Yang, Linning Xu, Hao Li 他
日本語で読む → - 論文マニピュレーションロボティクス
視覚・触覚・グラフ融合による適応的動的モダリティ拡散方策:マルチエージェントマニピュレーション
視覚・触覚・エージェント間位置グラフを適応的に統合する拡散方策を提案し、マルチエージェント協調マニピュレーションの把持安定性と衝突回避を改善した。
原題: ADM-DP: Adaptive Dynamic Modality Diffusion Policy through Vision-Tactile-Graph Fusion for Multi-Agent Manipulation / Enyi Wang, Wen Fan, Dandan Zhang
日本語で読む → - 論文マニピュレーションロボティクス
CRAFT: 力覚対応カリキュラム微調整による接触の多いマニピュレーションへのVLAモデル適応
VLAモデルに力覚情報を優先的に学習させるカリキュラム微調整フレームワークCRAFTを提案し、接触の多い操作タスクでの成功率と汎化性能を向上させた。
原題: CRAFT: Adapting VLA Models to Contact-rich Manipulation via Force-aware Curriculum Fine-tuning / Yike Zhang, Yaonan Wang, Xinxin Sun 他
日本語で読む →