Matthew Gombolay
収録論文 42本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 家庭環境における介護者との縦断的ロボット学習:デモンストレーションからの学習模倣学習2026/8/25
家庭環境で非専門家の介護者がロボットにタスクを教える際の障壁を特定し、事前訓練と適応的フィードバックによる支援の効果を複数回の訪問を通じて評価した。
- ビデオからシミュレーション、そして実世界へ:単一の人間ビデオからの全自動器用スキル獲得器用操作/sim2real2026/6/1
単一の人間操作ビデオから、シミュレーション環境でのデジタルツイン構築と物体中心のキーフレーム最適化によりロボット動作を獲得し、さらに実世界のノイズや不完全な知覚への頑健性を分離するsim-to-real戦略で器用な操作スキルを自律的に獲得するフレームワークを提案した。
- 複合ロボットチームの通信と協調のための異種ポリシーネットワーク群制御2026/6/1
異なる状態・行動・観測空間を持つエージェントからなる異種ロボットチームの協調と通信を学習するため、異種グラフアテンションネットワークに基づくHetNetを拡張し、スケーラビリティとバイナリメッセージの効率的な学習を実現した。
- 適応的な個人化説明による選好と性能のバランス説明可能AI2025/4/1
自動運転車のシミュレーションで、ユーザーの説明選好とタスク性能を両立する適応的な個人化説明戦略を提案し、性能向上を実証した。
- 大規模言語モデルを用いた人間とロボットの双方向メンタルモデル調整人間ロボットインタラクション2025/3/1
人間とロボットが互いのメンタルモデルのずれを自然言語対話で検出・共有し、双方向に調整して共通理解に至る枠組みを提案した論文。
- ロボサッカーチームのためのスケーラブルで俊敏な動的運動計画の学習に向けた方策最適化マルチエージェント運動計画2025/2/1
ロボサッカーのような動的環境で、異種エージェントが障害物を避けつつ目標に到達するための学習ベースの動的ナビゲーションモデルを提案し、簡単な環境で有効性を示した。
- 部分観測環境における混合役割人間チームの非同期訓練人間ロボット協調2024/12/1
人間の代わりに自律エージェントと協調訓練を行う非同期訓練パラダイムを提案し、部分観測協力ゲームで人間被験者実験により有効性を検証した。
- ELEMENTAL: デモンストレーションと視覚言語モデルを活用したロボット報酬設計のための対話型学習模倣学習2024/11/1
自然言語指示と視覚的なユーザーデモンストレーションを組み合わせ、逆強化学習と自己反省による反復フィードバックでロボットの報酬関数を設計するフレームワークを提案。
- 放送映像からの車いすテニスナビゲーション学習:ドメイン知識転移と拡散運動計画ナビゲーション2024/9/1
ウェブ上のテニス放送映像から専門家のナビゲーション戦略を抽出し、拡散モデルによる模倣学習で車いすロボットのボール打撃領域への移動を実現するゼロショット知識転移フレームワークを提案。
- 微分可能なファクターグラフと回転並進不変表現によるボールダイナミクスの学習ダイナミクス学習2024/9/1
微分可能なファクターグラフ推定器とダイナミクスモデルをエンドツーエンドで学習し、回転並進不変表現と自己乗算バイパスを導入して卓球ボールの軌道予測精度を向上させた。
- 拡散モデルと運動学的制約勾配誘導による多様なロボット打撃動作の学習マニピュレーション2024/9/1
拡散モデルと運動学的制約勾配誘導(KCGG)を組み合わせ、オフラインで制約を守りつつ多様な打撃動作を生成する手法を提案し、エアホッケーと卓球で模倣学習を上回る性能を示した。
- 自己教師あり初期化学習による高速モデル予測制御モデル予測制御2024/8/1
MPCの初期解を生成するポリシーを強化学習で学習し、最適化時間を短縮しつつ制御性能を向上させるフレームワークを提案。
- 人間と機械の協調を可能にする対話的・説明可能システムの設計人間機械協調2024/6/1
料理ゲーム環境で人間とAIの協調を検証し、対話的に再プログラム可能な説明可能AIがチーム性能を向上させる一方、学習ベース手法は単純な協調ヒューリスティックに劣ることを示した。
- オンラインベイズ適応による準最適下での混合イニシアチブ人間-ロボットチーム形成人間-ロボット協調2024/3/1
人間とロボットが互いに準最適な状況でも、オンラインベイズ推定で人間の協力意思を推論し、チーム性能と信頼を向上させる手法を提案。
- 条件付きフローマッチングによる効率的な軌道予測と生成軌道生成2024/3/1
フローマッチングを用いて軌道予測と生成を統合し、拡散モデルより最大100倍高速で高精度な軌道生成を実現した手法T-CFMを提案。
- Multi-Camera Asynchronous Ball Localization and Trajectory Prediction with Factor Graphs and Human Poses2024/1/1
- Interpretable Reinforcement Learning for Robotics and Continuous Control2023/11/1
- CrossLoco: Human Motion Driven Control of Legged Robots via Guided Unsupervised Reinforcement Learning2023/9/1
- Diffusion Models for Multi-target Adversarial Tracking2023/7/1
- The Effect of Robot Skill Level and Communication in Rapid, Proximate Human-Robot Collaboration2023/4/1
- Learning Coordination Policies over Heterogeneous Graphs for Human-Robot Teams via Recurrent Neural Schedule Propagation2023/1/1
- Utilizing Human Feedback for Primitive Optimization in Wheelchair Tennis2022/12/1
- Safe Inverse Reinforcement Learning via Control Barrier Function2022/12/1
- Athletic Mobile Manipulator System for Robotic Wheelchair Tennis2022/10/1
- Fast Lifelong Adaptive Inverse Reinforcement Learning from Demonstrations2022/9/1
- Robots Enact Malignant Stereotypes2022/7/1
- Multi-UAV Planning for Cooperative Wildfire Coverage and Tracking with Quality-of-Service Guarantees2022/6/1
- Towards Cognitive Robots That People Accept in Their Home2022/4/1
- Efficient Exploration via First-Person Behavior Cloning Assisted Rapidly-Exploring Random Trees2022/3/1
- Learning Interpretable, High-Performing Policies for Autonomous Driving2022/2/1
- Iterated Reasoning with Mutual Information in Cooperative and Byzantine Decentralized Teaming2022/1/1
- Towards Sample-efficient Apprenticeship Learning from Suboptimal Demonstration2021/10/1
- Natural Language Specification of Reinforcement Learning Policies through Differentiable Decision Trees2021/1/1
- A Generalized Robotic Handwriting Learning System based on Dynamic Movement Primitives (DMPs)2020/12/1
- FireCommander: An Interactive, Probabilistic Multi-agent Environment for Heterogeneous Robot Teams2020/11/1
- Learning from Suboptimal Demonstration via Self-Supervised Reward Regression2020/10/1
- Human-Robot Team Coordination with Dynamic and Latent Human Task Proficiencies: Scheduling with Learning Curves2020/7/1
- Coordinated Control of UAVs for Human-Centered Active Sensing of Wildfires2020/6/1
- Joint Goal and Strategy Inference across Heterogeneous Demonstrators via Reward Network Distillation2020/1/1
- When Your Robot Breaks: Active Learning During Plant Failure2019/12/1
- Learning to Dynamically Coordinate Multi-Robot Teams in Graph Attention Networks2019/12/1
- Safe Coordination of Human-Robot Firefighting Teams2019/3/1