评测与基准arXiv:2605.01970 · 5月3日Trojan Hippo Bench:针对 LLM Agent 持久记忆攻击与防御的动态基准提出 Trojan Hippo Bench,评测智能体持久记忆攻击与防御AI Agent·测试Gemini 3.1 Pro、GPT-5-mini、GPT-5·应用层投毒与后门潜伏触发记忆+2+2摘要论文提出了评测智能体持久化记忆攻击与防御的 Trojan Hippo Bench,揭示了潜伏攻击威胁及内存防御的安全与效用权衡。完整解读