攻击arXiv:2604.02623 · 4月论文提出 eTAMP 攻击:网页内容注入可跨会话污染 Web Agent 记忆提出 eTAMP,通过网页注入跨会话污染 Web 智能体轨迹记忆网页与电脑操作·测试GPT-5-mini、GPT-5.2、GPT-OSS-120B 等 7 个·应用层投毒与后门潜伏触发记忆+1+1摘要论文提出了基于环境注入的跨任务记忆投毒攻击 eTAMP,作者报告智能体在环境压力下易感性增加且能力与安全并不协同。该论文评估了基于大语言模型的 Web 智能体在利用历史交互轨迹进行记忆增强时的安全脆弱性。完整解读
攻击arXiv:2609.04533 · 9月4日Repeat-After-Me:针对黑盒 VLM 的自适应视觉提示注入攻击提出 Repeat-After-Me,以图像前缀诱导智能体调用工具或泄露隐私AI Agent·测试Claude-Opus-4.7、GPT-5.5、Gemini-3.1-Pro 等 11 个·应用层提示注入自动化搜索视觉+1+1摘要论文提出了针对黑盒 VLM 的前缀诱导自适应视觉提示注入,在多款模型上诱发了工具调用与隐私泄露。完整解读