Renming Huang
収録論文 3本 ・ フィジカルAI/ロボット学習
計画/不確実性模倣学習オフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PO-PDDL: 視覚デモから記号的POMDPを学習し不確実性下でのロボット計画を実現計画/不確実性2026/6/1
実ロボットの視覚デモから、部分観測と確率的行動を扱える記号的POMDPモデルを自動学習し、不確実性下でのタスク計画を可能にする手法を提案した。
- 軌道ではなく意図を模倣せよ模倣学習2026/2/1
模倣学習において、行動の意図と実行の詳細を周波数空間でのマルチスケールトークン化により分離し、意図トークンを用いた転移と適応を可能にする手法MINTを提案。
- 拡散モデルを最適化器として活用するオフライン強化学習の効率的計画法オフライン強化学習2024/7/1
拡散モデルのサンプリングを軌道生成と最適化に分離し、自己回帰モデルで高速に実行可能な軌道を生成しつつ拡散モデルで最適化することで、オフライン強化学習の計画を3〜10倍高速化した。