Rada Mihalcea
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA/安全性評価
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SafetyALFRED:マルチモーダル大規模言語モデルの安全意識計画の評価VLA/安全性評価2026/4/1
SafetyALFREDは、ALFREDベンチマークに6種類のキッチン危険を追加し、マルチモーダル大規模言語モデルの危険認識と能動的なリスク軽減計画を評価する。実験では、QA設定での認識は高いが、身体化計画での緩和成功率が低いというギャップを示し、身体化文脈での是正行動を重視するベンチマークへの転換を提唱する。