Kevin Murphy
収録論文 12本 ・ フィジカルAI/ロボット学習
世界モデル/強化学習世界モデル強化学習オフライン強化学習/表現学習/視覚的妨害物協調マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- エージェント探索と構造化モデリングの相乗効果によるタスク十分な世界モデルの学習世界モデル/強化学習2026/7/5
エージェントが環境を能動的に探索してタスク関連情報を収集し、そのデータからタスクに必要な最小限の表現を世界モデルで学習することで、サンプル効率と汎化性能を向上させる手法を提案した。
- 世界行動検証器:順方向・逆方向の非対称性による自己改善型世界モデル世界モデル2026/4/1
世界モデルが自身の予測誤差を検出し自己改善するフレームワークWAVを提案。状態の妥当性と行動の到達可能性を分離検証し、順方向・逆方向の非対称性を活用してサンプル効率とポリシー性能を向上させる。
- 階層的ニューラルオプションと抽象世界モデルの同時学習強化学習2026/2/2
抽象世界モデルと階層的ニューラルオプションを同時に学習するAgentOWLを提案し、少ないデータでより多くのスキルを獲得できることを示した。
- DMC-VB:視覚的妨害物を含む制御のための表現学習ベンチマークオフライン強化学習/表現学習/視覚的妨害物2024/9/26
視覚的妨害物がある環境でのオフライン強化学習エージェントの頑健性を評価するための大規模データセットとベンチマークを提案し、事前学習済み表現が政策学習に寄与しないことや状態と画素観測の間の表現ギャップを明らかにした。
- 多数のケーブル駆動ロボットによる協調モジュール式マニピュレーション:支援建設とギャップ横断に向けて協調マニピュレーション2024/3/1
軍事用のギャップ横断を支援するため、複数のケーブル駆動パラレルロボットが協調してペイロードを操作する分散型システムを提案し、遠隔操作や軌道追従、力増幅を実証した。
- Hands-free Telelocomotion of a Wheeled Humanoid toward Dynamic Mobile Manipulation via Teleoperation2022/3/1
- HOPPY: An Open-source Kit for Education with Dynamic Legged Robots2021/3/1
- A Comparison Between Joint Space and Task Space Mappings for Dynamic Teleoperation of an Anthropomorphic Robotic Arm in Reaction Tests2020/11/1
- HOPPY: An open-source and low-cost kit for dynamic robotics education2020/10/1
- Towards Differentiable Resampling2020/4/1
- Tracking Emerges by Colorizing Videos2018/6/1
- Generation and Comprehension of Unambiguous Object Descriptions2015/11/1