Bumjun Kim
収録論文 1本 ・ フィジカルAI/ロボット学習
VLM報酬モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 同じ軌道、矛盾する報酬(ROBORMBENCH):視覚言語報酬モデルにおける言い換えの脆弱性VLM報酬モデル2026/9/4
視覚言語モデルをロボット学習の報酬関数として使う際、意味的に等価な指示の言い換えで報酬が大きく変わり、成功と失敗が反転することもあることを示し、その脆弱性を測るベンチマークROBORMBENCHを構築した。