Roberto Martín-Martín
収録論文 71本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- エピソード評価を超えて:連続的身体化質問応答における記憶アーキテクチャのボトルネック身体化AI/記憶アーキテクチャ2026/7/1
身体化質問応答(EQA)を連続的に評価した際、既存の記憶保持だけでは不十分で、視覚的意味情報を保持する構造化された空間的記憶(3D幾何学に基づく)が必要であることを示した論文。
- 視覚運動ポリシーの短期記憶を拡張し長期的タスクを実現模倣学習2026/6/1
本論文は、模倣学習による視覚運動ポリシーに短期記憶を効果的に組み込むためのアーキテクチャPRISMを提案し、新しいベンチマークReMemBenchで評価した。
- OopsieVerse: 損傷認識シミュレーションによるロボット操作の安全性ベンチマーク安全性/シミュレーション2026/6/1
家庭用ロボットの物理的安全性を評価するため、接触力や温度変化などの損傷を検出・定量化する統一シミュレーションフレームワークとベンチマークを提案した。
- 長期的ロボット制御のための視覚運動ポリシーにおける記憶検索VLA2026/6/1
部分観測環境での長期タスクを可能にするため、注意機構を用いた記憶検索を備えた視覚運動ポリシーHALOを提案。VLMの事前知識を活用して誤相関を抑え、記憶誤差の蓄積を軽減する。
- VOFA: ヒューマノイドのための力適応制御を用いた視覚目標物体押し操作ロコマニピュレーション2026/5/1
ヒューマノイドロボットが未知の物理特性を持つ物体を目標位置まで押し動かすための、視覚目標条件付きの階層的制御システムを提案した。高レベルの視覚運動ポリシーと低レベルの力適応全身制御を組み合わせ、シミュレーションと実機で高い成功率を達成した。
- 大規模言語モデルによる部分観測タスク・動作計画の状態推定ガイドタスク・動作計画2026/3/1
ロボットが部分観測環境で計画を実行中に予期しない物体を観測した際、LLMの常識知識を用いてタスク関連物体の信念を形成し、計画・実行時間を大幅に短縮するフレームワークCoCo-TAMPを提案した。
- 変形物体の移動操作のための粒子動力学の迅速適応変形物体操作2026/3/1
変形物体の未知の動力学を扱うため、シミュレーションで物体の粒子位置などの特権情報から動力学埋め込みを学習し、実ロボットで推論する二段階手法RAPiDを提案した。
- 因子分解型潜在行動ワールドモデルワールドモデル2026/2/18
動画から潜在行動を学習する際、シーンを複数の独立因子に分解し、各因子が独自の潜在行動を推論・予測するフレームワークFLAMを提案。複数エンティティが同時に動く複雑な環境での予測精度と表現品質を向上させ、下流の政策学習を容易にする。
- 時空間を探索する:オープンワールド物体検索のための統合メモリ・行動ループ物体検索2025/11/1
ロボットが過去の状態や空間的文脈を手がかりに物体を探すため、長期記憶と行動を単一のループで統合するフレームワークSTARを提案し、新ベンチマークで有効性を示した。
- CAVER: 好奇心駆動型音響視覚探索ロボットマニピュレーション2025/11/1
物体を叩いて音を鳴らす専用エンドエフェクタと音響視覚表現、好奇心に基づく探索アルゴリズムを組み合わせ、効率的に物体の音と見た目の関係を学習するロボットを提案。
- MoMaGen: ソフト・ハード制約下で多段階両腕移動マニピュレーションのデモを生成sim2real2025/10/1
移動ベースと両腕の多段階タスク向けに、到達可能性などのハード制約と視認性などのソフト制約を満たすデータ生成を制約付き最適化として定式化し、多様なデモを自動生成する手法を提案。
- GeT-USE: シミュレーション上の身体拡張を介した双腕移動マニピュレーションのための汎用ツール使用学習sim2real2025/10/1
シミュレーション上でロボットの身体拡張(新しいエンドエフェクタの構築)を探索し、タスクに有効なツール形状の知識を獲得した後、実機の視覚運動ポリシーへ転移することで、利用可能な物体から最適なツールを選んで使う汎用ツール使用を実現した研究。
- RoboSSM: 状態空間モデルによるスケーラブルな文脈内模倣学習模倣学習2025/9/1
Transformerの代わりに状態空間モデル(Longhorn)を用いた文脈内模倣学習手法を提案し、長い文脈のプロンプトでも効率的に推論できることを示した。
- マッシュ、スプレッド、スライス!視覚的空間進捗による物体状態操作の学習マニピュレーション2025/9/1
物体の位置を変えずに物理的・視覚的状態が進行する操作(マッシュ、スプレッド、スライスなど)を統一フレームワークSPARTAで学習し、実機で高精度・高速訓練を実現した。
- MimicDroid: 人間の遊び動画からの文脈内学習によるヒューマノイドロボット操作VLA2025/9/1
人間の遊び動画のみを訓練データとして、ヒューマノイドが新しい操作タスクを数例の動画から効率的に学習できる文脈内学習手法を提案し、実世界で成功率を約2倍に向上させた。
- 人間とロボットの協調マニピュレーションのための混合主導対話マニピュレーション2025/8/1
自然言語による混合主導の対話を通じて、人間とロボットが協力してタスクを遂行するシステムMICoBotを提案し、実機実験で有効性を示した。
- COLLAGE: 適応的融合に基づく検索による拡張方策学習模倣学習2025/8/1
少数の模倣学習デモから大規模データセットを検索する際、複数の特徴量に基づく適応的な後期融合で関連デモを選択し、重要度サンプリングで方策学習を改善する手法を提案。
- SLAC: 教師なしシミュレーション事前学習による安全で効率的な実機ロボット強化学習sim2real2025/6/1
低忠実度シミュレータでタスク非依存の潜在行動空間を事前学習し、実機でのオフポリシー強化学習を安全かつ高効率化する手法を提案。双腕移動マニピュレーションで1時間以内に全身接触タスクを学習。
- SafeMimic: 移動マニピュレーションのための安全で自律的な人間からロボットへの模倣学習模倣学習2025/6/1
一人称視点の人間動画から移動マニピュレーションを安全かつ自律的に学習するフレームワークを提案。安全性Q関数を用いて行動を検証し、必要に応じてバックトラックしながらロボットの形態に適応させる。
- Casper: 視覚言語モデルによる多様な意図推論を実現する支援型遠隔操作遠隔操作2025/6/1
視覚言語モデルの常識知識を活用し、ユーザーの操作入力から多様な意図をリアルタイムに推論して、長期的な移動マニピュレーション作業を支援する遠隔操作システムを提案した。
- DataMIL: データモデルによるロボット模倣学習のためのデータ選択模倣学習2025/5/1
ロボット模倣学習において、ポリシー自体を活用してタスク成功率を直接最適化するデータ選択フレームワークを提案し、シミュレーションと実世界の60以上のタスクで有効性を示した。
- BiFlex: 非構造環境での操作のための受動的二モード剛性柔軟手首マニピュレーション2025/4/1
柔らかい座屈ハニカム構造を用いて、高い剛性と低い剛性の二つのモードを自然に切り替える受動的な柔軟手首を開発し、精密操作と安全性を両立させた。
- なぜ自動化するのか?ロボット自動化への欲求、費やす時間、幸福度の相関の探求HRI2025/1/1
BEHAVIOR-1Kと米国時間使用調査のデータを用い、家事タスクの自動化への欲求が所要時間よりも幸福感や痛みといった感情と強く関連することを明らかにし、性別や所得による違いも示した研究。
- 効率的な階層強化学習のための分離された教師なしスキル発見階層強化学習2024/10/1
教師なしで分離されたスキルを学習し、階層強化学習で効率的に再利用する手法DUSDiを提案。
- BUMBLE: 視覚言語モデルによる建物全体の移動マニピュレーションのための推論と行動の統合移動マニピュレーション2024/10/1
建物規模の長期的な移動マニピュレーションタスクに取り組むため、視覚言語モデルを基盤に開放世界RGBD知覚、粗から細への運動スキル、二層メモリを統合したフレームワークBUMBLEを提案し、70試行で平均47.1%の成功率を達成した。
- 見ることを学ぶ:方策分解による意思決定のための情報探索マニピュレーション2024/10/1
ロボットが操作に必要な情報を能動的に探し出す「情報探索方策」と、得た情報を使って操作を行う「情報受容方策」に分解して別々に学習する手法DISaMを提案し、実機を含む5つの操作タスクで有効性を示した。
- SkiLD: 因子間相互作用に導かれた教師なしスキル発見教師なし強化学習2024/10/1
状態を因子に分解し、因子間の多様な相互作用を引き起こすスキルを教師なしで学習する手法を提案。家庭環境ロボットなど長期的な疎報酬タスクで既存手法を上回る。
- KinScene: 関節物体を含むシーンのモデルベース移動マニピュレーションマニピュレーション2024/9/1
移動マニピュレータが屋内シーンを自律探索し、関節物体の運動モデルを構築して、長期的な操作タスクを計画・実行するフルスタック手法を提案。
- 先見性のあるナビゲーションに向けて:最適視点軌道計画とロボットナビゲーションの融合視点計画/巡回ナビゲーション2024/8/1
四足歩行ロボットが巡回・監視タスクにおいて、アームカメラの視点計画と移動計画を統合し、長期的な環境カバレッジを最適化する枠組みを提案した論文。
- ロボティクスにおける深層強化学習:実世界での成功に関するサーベイ強化学習2024/8/1
深層強化学習をロボットに応用した実世界での成功事例を調査し、成功要因や未開拓領域、今後の研究方向を整理したサーベイ論文。
- ScrewMimic: 人間動画からのスクリュー空間射影による両手模倣学習模倣学習2024/5/1
両手の協調動作をスクリュー運動としてモデル化した新たな行動空間を提案し、人間の動画1本から複雑な両手操作を学習して自己教師あり微調整で改善するフレームワーク。
- 自然言語でSim2Realギャップを埋めるsim2real2024/5/1
画像の自然言語記述をドメイン間の共通信号として用い、シミュレータと実機の視覚的差異を埋めることで、画像条件付きロボット方策のSim2Real転移を改善する手法を提案した。
- BEHAVIOR-1K:1000の日常活動とリアルなシミュレーションによる人間中心の身体性AIベンチマークsim2real2024/3/1
人間がロボットにやってほしいと望む1000の日常活動を、50のシーンと9000以上の物体を含む物理シミュレーション環境OMNIGIBSONで再現し、実世界への転移も検証したベンチマークを提案した。
- DROID: 大規模実環境ロボットマニピュレーションデータセットマニピュレーション2024/3/1
北米・アジア・欧州の50名が12ヶ月かけて564シーン・84タスクで収集した76k軌道・350時間のロボット操作データセットを構築し、学習ポリシーの性能と汎化性能が向上することを示した。
- TeleMoMa: モバイルマニピュレーションのためのモジュール式で汎用的な遠隔操作システム遠隔操作2024/3/1
RGB-DカメラやVRコントローラなど複数の入力インターフェースを統合し、移動マニピュレータの全身遠隔操作を可能にするモジュール式システムを開発。模倣学習用の実演データ収集を容易にし、その有効性を実機とシミュレーションで示した。
- BaRiFlex: A Robotic Gripper with Versatility and Collision Robustness for Robot Learning2023/12/1
- Model-Based Runtime Monitoring with Interactive Imitation Learning2023/10/1
- Mini-BEHAVIOR: A Procedurally Generated Benchmark for Long-horizon Decision-Making in Embodied AI2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- MUTEX: Learning Unified Policies from Multimodal Task Specifications2023/9/1
- Principles and Guidelines for Evaluating Social Robot Navigation Algorithms2023/6/1
- Causal Policy Gradient for Whole-Body Mobile Manipulation2023/5/1
- MaskViT: Masked Visual Pre-Training for Video Prediction2022/6/1
- BEHAVIOR in Habitat 2.0: Simulator-Independent Logical Task Description for Benchmarking Embodied AI Agents2022/6/1
- Error-Aware Imitation Learning from Teleoperation Data for Mobile Manipulation2021/12/1
- BEHAVIOR: Benchmark for Everyday Household Activities in Virtual, Interactive, and Ecological Environments2021/8/1
- What Matters in Learning from Offline Human Demonstrations for Robot Manipulation2021/8/1
- iGibson 2.0: Object-Centric Simulation for Robot Learning of Everyday Household Tasks2021/8/1
- Differentiable Factor Graph Optimization for Learning Smoothers2021/5/1
- LASER: Learning a Latent Action Space for Efficient Reinforcement Learning2021/3/1
- iGibson 1.0: a Simulation Environment for Interactive Tasks in Large Realistic Scenes2020/12/1
- Semantic and Geometric Modeling with Neural Message Passing in 3D Scene Graphs for Hierarchical Mechanical Search2020/12/1
- Human-in-the-Loop Imitation Learning using Remote Teleoperation2020/12/1
- Learning Multi-Arm Manipulation Through Collaborative Teleoperation2020/12/1
- Deep Affordance Foresight: Planning Through What Can Be Done in the Future2020/11/1
- Robot Navigation in Constrained Pedestrian Environments using Reinforcement Learning2020/10/1
- Multimodal Sensor Fusion with Differentiable Filters2020/10/1
- robosuite: A Modular Simulation Framework and Benchmark for Robot Learning2020/9/1
- ReLMoGen: Leveraging Motion Generation in Reinforcement Learning for Mobile Manipulation2020/8/1
- Visuomotor Mechanical Search: Learning to Retrieve Target Objects in Clutter2020/8/1
- Learning to Generalize Across Long-Horizon Tasks from Human Demonstrations2020/3/1
- JRMOT: A Real-Time 3D Multi-Object Tracker and a New Large-Scale Dataset2020/2/1
- 6-PACK: Category-level 6D Pose Tracker with Anchor-Based Keypoints2019/10/1
- JRDB: A Dataset and Benchmark of Egocentric Robot Visual Perception of Humans in Built Environments2019/10/1
- Interactive Gibson Benchmark (iGibson 0.5): A Benchmark for Interactive Navigation in Cluttered Environments2019/10/1
- Regression Planning Networks2019/9/1
- Variable Impedance Control in End-Effector Space: An Action Space for Reinforcement Learning in Contact-Rich Tasks2019/6/1
- Deep Local Trajectory Replanning and Control for Robot Navigation2019/5/1
- Mechanical Search: Multi-Step Retrieval of a Target Object Occluded by Clutter2019/3/1
- DenseFusion: 6D Object Pose Estimation by Iterative Dense Fusion2019/1/1
- The RBO Dataset of Articulated Objects and Interactions2018/6/1