Minyoung Hwang
収録論文 5本 ・ フィジカルAI/ロボット学習
報酬モデリング逆強化学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Robometer:軌道比較による汎用ロボット報酬モデルのスケーリング報酬モデリング2026/3/1
軌道内の進捗監督と軌道間の選好監督を組み合わせた報酬モデルを提案し、100万軌道のデータセットで学習することで、汎用性の高い報酬関数を実現した。
- Masked IRL: LLMによるデモンストレーションと言語からの報酬曖昧性解消逆強化学習2025/11/1
言語指示から状態の重要度マスクを推定し、LLMで曖昧な指示を明確化することで、少ないデータで報酬関数を学習する手法を提案。
- MotIF: 動作指示ファインチューニングVLA2024/9/1
ロボットの動作の成否を判定するために、キーポイント軌跡を最終画像に重ねた抽象表現で視覚言語モデルをファインチューニングする手法を提案し、MotIF-1Kデータセットを構築した。
- Promptable Behaviors: Personalizing Multi-Objective Rewards from Human Preferences2023/12/1
- Meta-Explore: Exploratory Hierarchical Vision-and-Language Navigation Using Scene Object Spectrum Grounding2023/3/1