Shouling Ji
収録論文 1本 ・ フィジカルAI/ロボット学習
セキュリティ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 意思決定レベルでの乗っ取り:ビット反転攻撃による大規模言語モデルへの認知バイアス注入セキュリティ2026/7/28
大規模言語モデルの重みの一部ビットを反転させるだけで、モデルの認知傾向を操作し、下流の意思決定に影響を与える攻撃手法を提案した論文。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
大規模言語モデルの重みの一部ビットを反転させるだけで、モデルの認知傾向を操作し、下流の意思決定に影響を与える攻撃手法を提案した論文。