跳到正文
原文
Adversa AI·· 2026-03-30

红队测试智能体 AI 时模拟错了攻击者:六类威胁行为者与五大专业领域

You're simulating the wrong attacker (and your red team can't find the right one)

AI 导读

红队测试智能体 AI 时普遍模拟错了攻击者——只测越狱式提示攻击,而真正攻陷智能体系统的是投毒知识库文档、污染 API 响应、在日历邀请中嵌入指令的间接注入者。文章列出六类必须模拟的威胁行为者:机会主义探测者、社工攻击者、耐心内部人员、间接注入者、商业情报窃取者和基础设施攻击者,并指出模拟它们需要提示与社会工程、应用安全、架构与分布式系统、数据与 ML 安全等五个专业领域,多数团队只具备其中一两个。

阅读原文adversa.ai