跳到正文
原文
TrendAI Research·本站收录 · 原文发表

TrendAI 推出 Scarecrow:让攻击者的 AI 智能体拒绝读取被盗文档

Scarecrow: Making the Attacker’s AI Say No

AI 导读

TrendAI Research 发布 Scarecrow,通过在文档中植入只触发拒答的隐藏指令,使读取该文档的攻击者 AI 智能体停止处理内容。该技术利用间接提示注入的同一机制反向防护:模型无法区分文档内容与关于文档的指令,隐藏指令与操作者请求同等竞争。Scarecrow 已在 GitHub 开源,可用于用户自有文档。

阅读原文trendaisecurity.com