Jiahao Lu
収録論文 1本 ・ フィジカルAI/ロボット学習
安全性評価
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GuardianBench:身体化AIにおける潜在的な文脈リスクのための同一シーン指示対比ベンチマーク安全性評価2026/8/22
同一シーンで指示だけを変えた安全/不安全の対比ペアからなるベンチマークを構築し、VLMが指示に鈍感で安全判断を誤ることを示し、軽量な事後学習手法で改善を実証した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
同一シーンで指示だけを変えた安全/不安全の対比ペアからなるベンチマークを構築し、VLMが指示に鈍感で安全判断を誤ることを示し、軽量な事後学習手法で改善を実証した。