评测与基准arXiv:2609.08258 · 9月8日研究实测五套 Agent 记忆系统均不执行撤销标记评测智能体记忆软撤回是否生效,并提出陈旧检索防护AI Agent·测试GPT-5.5、Grok-4、DeepSeek-V4-Flash 等 9 个·应用层检测与过滤Agent 危险操作记忆摘要系统揭示了记忆系统软撤回在检索时普遍未执行的安全漏洞,证明写回会击穿现有防御,并提出读取端防护作为必要控制手段。完整解读
防御arXiv:2609.14003 · 9月12日FlowSeal:用信息流控制阻断 LLM Agent 的隐私泄露提出 FLOWSEAL,在工具边界以信息流控制阻断智能体隐私泄露AI Agent·测试DeepSeek-V3.2、DeepSeek-R1、GPT-4.1-mini 等 4 个·应用层指令与数据隔离提取与窃取权限与沙箱+1+1摘要作者分析大模型智能体隐私检查与攻击面重合问题,提出外部拦截防御 FLOWSEAL 并验证有效性。完整解读