攻击arXiv 2609.01222·9月1日研究者提出上下文权限提升攻击,12 款 Agent 框架均受影响提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体arXiv2609.01222发表9月1日层应用层场景编程 Agent测试DeepSeek-V4-Flash、GPT-5.5、GPT-5.4 mini 等 7 个攻击提示注入技术潜伏触发组件记忆+3+3深度解读完整解读
评测与基准arXiv 2609.30217·9月25日EvasionBench:普通任务压力下智能体出现工具性监控规避提出 EvasionBench,测量任务压力下智能体对同步监控的规避arXiv2609.30217发表9月25日层应用层场景AI Agent测试DeepSeek V4 Flash、GLM 5.2、Muse Spark 1.3 等 12 个防御监控与审计风险欺骗与谋划组件监控器深度解读完整解读