論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
ロボットマニピュレータの全身動的安全確保:CBFベース安全フィルタのための3Dポアソン安全関数
マニピュレータの全身衝突回避を、環境占有データからポアソン方程式を解いて単一の安全関数を合成し、実時間の安全フィルタで制約を課すことで実現する枠組みを提案した。
原題: Full-Body Dynamic Safety for Robot Manipulators: 3D Poisson Safety Functions for CBF-Based Safety Filters / Meg Wilkinson, Gilbert Bahati, Ryan M. Bena 他
日本語で読む → - 論文マニピュレーションロボティクス
いつ見て、いつ感じるかを学ぶ:接触を考慮した操作のための適応的視覚・トルク融合
接触を伴う操作タスクで、非接触時は視覚のみを使い、接触時のみ力覚情報を適応的に活用する融合戦略を提案し、拡散ベースの操作ポリシーで既存手法より成功率を14%向上させた。
原題: Learning When to See and When to Feel: Adaptive Vision-Torque Fusion for Contact-Aware Manipulation / Jiuzhou Lei, Chang Liu, Yu She 他
日本語で読む → - 論文VLA/マニピュレーションロボティクス
AnySlot: ゼロショットのスロット配置のための目標条件付き視覚言語行動ポリシー
言語指示による精密な物体配置を実現するため、言語を視覚的な目標マーカーに変換し、目標条件付きVLAポリシーで実行する階層的フレームワークを提案。また、スロット配置の評価用ベンチマークSlotBenchも導入。
原題: AnySlot: Goal-Conditioned Vision-Language-Action Policies for Zero-Shot Slot-Level Placement / Zhaofeng Hu, Sifan Zhou, Qinbo Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
AffordSim: アフォーダンス認識ロボット操作のためのスケーラブルなデータ生成器とベンチマーク
自然言語のタスク記述から3Dアフォーダンス予測を統合し、タスク関連シーンと軌道を自動生成するデータ生成器とベンチマークを提案。手動注釈なしで高成功率を達成し、実ロボットへのゼロショット転送も実証。
原題: AffordSim: A Scalable Data Generator and Benchmark for Affordance-Aware Robotic Manipulation / Mingyang Li, Haofan Xu, Haowen Sun 他
日本語で読む → - 論文マニピュレーションロボティクス
安全な協調操作における行動シフト検出のための信念ダイナミクス
共有作業空間でのロボット操作中に、協調エージェントの行動戦略が切り替わることを検出する軽量モジュールUA-TOMを提案し、衝突を52%削減することを示した。
原題: Belief Dynamics for Detecting Behavioral Shifts in Safe Collaborative Manipulation / Devashri Naik, Divake Kumar, Nastaran Darabi 他
日本語で読む → - 論文マニピュレーションロボティクス
液体を扱うロボットの緊急停止
液体入り開放容器を運ぶロボットの緊急停止を、最適制御とモデル予測制御で実現し、こぼさずに素早く停止させる手法を提案した。
原題: Emergency Stopping for Liquid-manipulating Robots / Samuli Hynninen, Ville Kyrki
日本語で読む → - 論文空中マニピュレーションロボティクス
腱駆動型空中連続体マニピュレータのAI対応画像ベースハイブリッド視覚/力制御
腱駆動型空中連続体マニピュレータに対し、画像特徴誤差を安定化しつつ環境との物理的相互作用を自律的に行う、カスケード型ハイブリッド視覚/力制御フレームワークを提案した。
原題: AI-Enabled Image-Based Hybrid Vision/Force Control of Tendon-Driven Aerial Continuum Manipulators / Shayan Sepahvand, Farrokh Janabi-Sharifi, Farhad Aghili
日本語で読む → - 論文マニピュレーションロボティクス
平行反平行四辺形腱駆動手首によるハンカチ回しタスクの周期定常制御
柔軟物体であるハンカチを高速で回転させる周期運動を実現するため、専用設計の腱駆動手首と階層制御、粒子バネモデルを組み合わせ、約99%の展開率と低い追従誤差を達成した。
原題: Periodic Steady-State Control of a Handkerchief-Spinning Task Using a Parallel Anti-Parallelogram Tendon-driven Wrist / Lei Liu, Haonan Zhang, Huahang Xu 他
日本語で読む → - 論文マニピュレーションロボティクス
VistaBot: 時空間認識ビュー合成による視点ロバストなロボット操作
カメラ視点の変化にロバストなロボット操作を実現するため、幾何モデルとビデオ拡散モデルを統合したフレームワークVistaBotを提案。テスト時のカメラ校正不要で、シミュレーションと実世界で性能を検証した。
原題: VistaBot: View-Robust Robot Manipulation via Spatiotemporal-Aware View Synthesis / Songen Gu, Yuhang Zheng, Weize Li 他
日本語で読む → - 論文マニピュレーションロボティクス
機能ベースのパラメトリック協調設計最適化による器用なロボットハンドの設計
ロボットハンドの設計をタスク駆動の評価や制御と統合し、掌構造・指の運動学・指先形状・表面曲率を統一したパラメトリックフレームワークを提案し、把持安定性の最適化で検証した。
原題: Function-based Parametric Co-Design Optimization of Dexterous Hands / Mohammad Amin Mirzaee, Harsh Gupta, Wenzhen Yuan
日本語で読む → - 論文マニピュレーションロボティクス
全身移動マニピュレーションのためのスケーラブルな軌道生成
GPU加速フレームワークAutoMoMaを提案し、移動ベースとアームの運動学を統合したAKRモデリングと並列軌道最適化により、多様な環境・ロボットでの大規模な物理的に有効な軌道データを高速生成する。
原題: Scalable Trajectory Generation for Whole-Body Mobile Manipulation / Yida Niu, Xinhai Chang, Xin Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
GraspSense: 言語誘導知覚と力マップによる器用なロボットハンドの物理的根拠に基づく把持・握力計画
物体表面の機械的特性の不均一性を考慮し、局所的な許容接触力マップを用いて把持候補を再ランク付けし、指の剛性を調整することで安全な把持を実現するパイプラインを提案した。
原題: GraspSense: Physically Grounded Grasp and Grip Planning for a Dexterous Robotic Hand via Language-Guided Perception and Force Maps / Elizaveta Semenyakina, Ivan Snegirev, Mariya Lezina 他
日本語で読む → - 論文移動マニピュレーションロボティクス
連続移動マニピュレーションの効率性と信頼性の調和
人間のように連続した移動マニピュレーションタスクを効率的かつ信頼性高く実行するための統合フレームワークを提案した。信頼性を考慮した軌道プランナーと位相依存の切替制御を組み合わせ、不確実性下での実世界評価で有効性を示した。
原題: Synergizing Efficiency and Reliability for Continuous Mobile Manipulation / Chengkai Wu, Ruilin Wang, Yixin Zeng 他
日本語で読む → - 論文マニピュレーションロボティクス
ボタンを押す: 優しい押下動作の計測学習
ボタン押し操作を対象に、訓練時のみ物体にセンサを取り付け、接触音を検出するエンコーダを学習し、推論時は視覚と音声のみで接触力の低い操作を実現する手法を提案した。
原題: You're Pushing My Buttons: Instrumented Learning of Gentle Button Presses / Raman Talwar, Remko Proesmans, Thomas Lips 他
日本語で読む → - 論文マイクロマニピュレーションロボティクス
生物学的マイクロマニピュレーションにおけるマイクロ器用性:身体性、知覚、制御
マイクロスケールでの生物学的対象物の操作を、身体性・知覚・制御の観点から「マイクロ器用性」として体系化し、既存のプラットフォームと制御戦略をレビューした論文。
原題: Micro-Dexterity in Biological Micromanipulation: Embodiment, Perception, and Control / Kangyi Lu, Lan Wei, Zongcai Tan 他
日本語で読む → - 論文マニピュレーションロボティクス
精密な物体配置のための分離点拡散
物体配置タスクを階層的かつ分離された点拡散フレームワークでモデル化し、配置精度と汎化性能を向上させた。
原題: Disentangled Point Diffusion for Precise Object Placement / Lyuxing He, Eric Cai, Shobhit Aggarwal 他
日本語で読む → - 論文マニピュレーションロボティクス
CLASP: オープンボキャブラリの机上物体把持のための閉ループ非同期空間知覚
机上物体の把持を対象に、視覚言語モデルの空間的幻覚と開ループ実行の脆弱性を克服するため、非同期閉ループフレームワークCLASPを提案した。
原題: CLASP: Closed-loop Asynchronous Spatial Perception for Open-vocabulary Desktop Object Grasping / Yiran Ling, Wenxuan Li, Siying Dong 他
日本語で読む → - 論文マニピュレーションロボティクス
デバイス条件付きニューラルアーキテクチャ探索による効率的なロボット操作
ロボット操作のための視覚運動ポリシーを、異なるハードウェア制約に効率的に適応させる統一フレームワークDC-QFAを提案。デバイス条件付きの量子化対応学習とハードウェア制約付きアーキテクチャ探索を組み合わせ、各デバイスへの再最適化なしで最適なサブネットを選択可能にする。
原題: Device-Conditioned Neural Architecture Search for Efficient Robotic Manipulation / Yiming Wu, Huan Wang, Zhenghao Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
MoRI: 長期的操作タスクのためのRLとILエキスパートの混合
強化学習と模倣学習のエキスパートを動的に切り替えるシステムMoRIを提案し、複雑な実世界操作タスクで高成功率と少ない介入を実現した。
原題: MoRI: Mixture of RL and IL Experts for Long-Horizon Manipulation Tasks / Yaohang Xu, Lianjie Ma, Gewei Zuo 他
日本語で読む → - 論文マニピュレーションロボティクス
KernelSOSによる接触を伴う操作のためのグローバルサンプリングベース軌道最適化
接触を伴う操作の軌道最適化において、グローバル探索と局所最適化を統合したフレームワークGlobal-MPPIを提案し、高次元・長時間のタスクで既存手法より高速な収束と低コストを達成した。
原題: Global Sampling-Based Trajectory Optimization for Contact-Rich Manipulation via KernelSOS / Zhongqi Wei, Frederike Dümbgen
日本語で読む → - 論文マニピュレーション画像認識
SynAgent: ソロから協調へのエージェント相乗効果による汎用的な協調ヒューマノイド操作
単一エージェントの人間と物体のインタラクションデータを活用し、複数ヒューマノイドによる協調操作を実現するフレームワークを提案。相互作用を保ったリターゲティングと分散訓練により、物体形状を超えた汎用的な協調動作を学習する。
原題: SynAgent: Generalizable Cooperative Humanoid Manipulation via Solo-to-Cooperative Agent Synergy / Wei Yao, Haohan Ma, Hongwen Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
F2F-AP: フローから未来への非同期ポリシーによるリアルタイム動的マニピュレーション
非同期推論の遅延問題を解決するため、物体のフロー予測を用いて未来の観測を合成し、視覚特徴を整合させることで、動的環境での操作を先読みして実行するフレームワークを提案した。
原題: F2F-AP: Flow-to-Future Asynchronous Policy for Real-time Dynamic Manipulation / Haoyu Wei, Xiuwei Xu, Ziyang Cheng 他
日本語で読む → - 論文マニピュレーションロボティクス
OmniUMI:人間に合わせたマルチモーダルインタラクションによる物理的基盤を持つロボット学習
UMI型インターフェースに触覚・把持力・外力などの物理的接触信号を統合し、拡散ポリシーで学習するシステムを提案。力に敏感な操作タスクで有効性を示した。
原題: OmniUMI: Towards Physically Grounded Robot Learning via Human-Aligned Multimodal Interaction / Shaqi Luo, Yuanyuan Li, Youhao Hu 他
日本語で読む → - 論文マニピュレーションロボティクス
VADF: 視覚適応型拡散ポリシーフレームワークによる効率的なロボット操作
拡散ポリシーの学習収束の遅さと推論タイムアウト問題を解決するため、訓練時のサンプル難易度に応じた重み付けと、推論時の視覚に基づくタスク分割により、収束ステップ数を削減し早期成功率を向上させるフレームワークを提案した。
原題: VADF: Vision-Adaptive Diffusion Policy Framework for Efficient Robotic Manipulation / Xinglei Yu, Zhenyang Liu, Shufeng Nan 他
日本語で読む → - 論文マニピュレーションロボティクス
トレース条件付きVLA計画による長期的操作
長期的な操作タスクを、タスク管理VLMが現在の観察から残りの計画を予測し、視覚的トレースを実行VLAに提供することで、短期的なVLA実行を長期的な指示追従に拡張するフレームワークを提案。
原題: Long-Horizon Manipulation via Trace-Conditioned VLA Planning / Isabella Liu, An-Chieh Cheng, Rui Yan 他
日本語で読む → - 論文マニピュレーションロボティクス
BiDexGrasp: 物体の形状とサイズを考慮した協調的な両手巧みな把持
両手ロボットハンドによる巧みな把持のための大規模データセットと生成モデルを提案し、効率的なデータ合成パイプラインと協調・適応的な把持生成フレームワークを構築した。
原題: BiDexGrasp: Coordinated Bimanual Dexterous Grasps across Object Geometries and Sizes / Mu Lin, Yi-Lin Wei, Jiaxuan Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
非対称グリッパーGETのための2Dおよび3D把持プランナー
非対称グリッパーGET向けに、単視点RGB-D画像から高速に把持計画を行うGET-2D-1.0と、メッシュベースのGET-3D-1.0を提案し、物理実験でベースラインを上回る性能を示した。
原題: 2D and 3D Grasp Planners for the GET Asymmetrical Gripper / Andrew Goldberg, Ethan Ransing, Anton Kourakin 他
日本語で読む → - 論文モバイルマニピュレーション/HRIロボティクス
ExpressMM: 人間とロボットのインタラクションにおける表現豊かなモバイル操作行動
本論文では、モバイルマニピュレータが人間と協調作業中に意図を表現するためのフレームワークExpressMMを提案し、視覚言語モデルと視覚言語行動ポリシーを統合して、中断可能な対話を実現した。
原題: ExpressMM: Expressive Mobile Manipulation Behaviors in Human-Robot Interactions / Souren Pashangpour, Haitong Wang, Matthew Lisondra 他
日本語で読む → - 論文VLA/触覚/マニピュレーションロボティクス
視覚言語行動モデルへの物理フィードバック統合のためのモジュール型感覚ストリーム
視覚言語行動モデル(VLA)に触覚やトルクなどの複数の物理センサ信号を統合するモジュール型フレームワークを提案し、実世界実験で性能向上を実証した。
原題: Modular Sensory Stream for Integrating Physical Feedback in Vision-Language-Action Models / Jimin Lee, Huiwon Jang, Myungkyu Koo 他
日本語で読む → - 論文ロコマニピュレーションロボティクス
DreamControl-v2: 訓練可能な誘導拡散事前分布による、より簡潔でスケーラブルな自律人型スキル
人型ロボットの操作スキル学習を改善するため、ロボットの動作空間で直接訓練する誘導拡散モデルを導入し、多様なデータを統合して自動化とスケーラビリティを向上させた。
原題: DreamControl-v2: Simpler and Scalable Autonomous Humanoid Skills via Trainable Guided Diffusion Priors / Sudarshan Harithas, Sangkyung Kwak, Pushkal Katara 他
日本語で読む →