Ankit Garg
収録論文 1本 ・ フィジカルAI/ロボット学習
VLMセキュリティ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ピクセルの隙間を読む:テキスト-画像埋め込みの整合性と視覚言語モデルにおけるタイポグラフィ攻撃成功率の関連性VLMセキュリティ2026/4/14
視覚言語モデルに対するタイポグラフィ・プロンプトインジェクション攻撃の成功率が、フォントサイズや視覚的変換、テキスト-画像埋め込み距離とどう相関するかを体系的に評価した研究。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
視覚言語モデルに対するタイポグラフィ・プロンプトインジェクション攻撃の成功率が、フォントサイズや視覚的変換、テキスト-画像埋め込み距離とどう相関するかを体系的に評価した研究。