攻击arXiv 2609.38270·9月29日VirusCascade:劫持 LLM 推荐智能体的协同反思机制提出 VirusCascade,劫持推荐智能体协同反思以实现定向推广arXiv2609.38270发表9月29日层应用层场景多智能体攻击投毒与后门技术潜伏触发组件记忆+1+1深度解读完整解读
攻击arXiv 2609.01222·9月1日研究者提出上下文权限提升攻击,12 款 Agent 框架均受影响提出针对 Agent Harness 的上下文特权提升攻击arXiv2609.01222发表9月1日层应用层场景coding agent被测模型GPT-5.5、GPT-5.4 mini、Claude-Sonnet-4.6 等 7 个攻击提示注入技术潜伏触发组件记忆+2+2深度解读完整解读
评测与基准arXiv 2608.12851·8月13日研究者提出 SkillMisevo-Bench,量化自改进 Agent 的技能误演化风险提出 SkillMisevo-Bench,量化自改进 Agent 的技能误演化arXiv2608.12851发表8月13日层应用层场景coding agent被测模型Claude Code、Codex、Hermes 等 4 个攻击投毒与后门技术潜伏触发组件记忆深度解读完整解读