评测与基准arXiv:2605.01970 · 5月3日Trojan Hippo Bench:针对 LLM Agent 持久记忆攻击与防御的动态基准提出 Trojan Hippo Bench,评测智能体持久记忆攻击与防御AI Agent·测试Gemini 3.1 Pro、GPT-5-mini、GPT-5·应用层投毒与后门潜伏触发记忆+2+2摘要论文提出了评测智能体持久化记忆攻击与防御的 Trojan Hippo Bench,揭示了潜伏攻击威胁及内存防御的安全与效用权衡。完整解读
攻击arXiv:2608.06862 · 8月7日SynChain:诱导计算机使用 Agent 自建攻击链并跨任务持久化提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件网页与电脑操作编程 Agent·测试Qwen3.5-9B、Llama-3.1-8B、Ministral-3-8B 等 5 个·应用层投毒与后门潜伏触发MCP 与技能+3+3摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。完整解读