Michael Groom
収録論文 3本 ・ フィジカルAI/ロボット学習
強化学習移動操作/強化学習/リスク認識マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 分位点結合フローマッチングによる分布強化学習強化学習2026/5/1
分布強化学習における条件付きフローマッチング批判器の損失がワッサーシュタイン距離と整合しない問題を解決するため、ソースとベルマン目標サンプルを分位点で整列させるFlowIQNを提案した。
- 移動操作のためのリスク認識強化学習移動操作/強化学習/リスク認識2026/3/1
移動マニピュレータのリスク認識行動を学習する手法を提案。分布強化学習でリスク中立な教師ポリシーを訓練し、歪みリスク指標でリスク調整した後、模倣学習で深度観測に基づく学生ポリシーに蒸留する。
- COBRA-PPM: 確率的プログラミングを用いた不確実環境下のロボットマニピュレーションのための因果ベイズ推論アーキテクチャマニピュレーション2024/3/1
因果ベイズネットワークと確率的プログラミングを組み合わせ、不確実性下でのロボット操作のための介入推論を行うフレームワークを提案。ブロック積み上げタスクで高い予測精度と成功率を示し、sim2real転移も実証した。