攻击arXiv:2607.25560 · 7月28日SigLeak 可从执行轨迹推断专有 Agent 技能提出 SigLeak,从执行轨迹比对中推断专有智能体技能编程 Agent攻击者黑盒·测试GPT-5.4-mini、GPT-5.5、GLM-5.2 等 4 个·应用层提取与窃取自动化搜索MCP 与技能摘要提出了通过良性查询和对照轨迹推断黑盒专有技能的 SigLeak 框架,揭示了智能体执行可见性带来的行为侧信道泄露风险。完整解读
攻击arXiv:2607.05189 · 7月6日研究者提出 MemGhost,对持久化个人 Agent 实现隐蔽记忆注入提出 MEMGHOST,以单封恶意邮件向持久个人智能体注入隐蔽记忆AI Agent·测试GPT-5.4、Claude Sonnet 4.6、Claude Sonnet 4.5 等 6 个·应用层投毒与后门潜伏触发记忆+2+2摘要总结了论文的研究背景、双代理优化方法 MEMGHOST、全周期实验结果以及作者对记忆信任边界的启示。本文研究了持久化个人智能体面临的隐蔽记忆注入威胁,提出了一套兼顾写入、隐蔽与跨会话生效的自动化生成框架与全周期评测基准。完整解读
攻击arXiv:2609.04533 · 9月4日Repeat-After-Me:针对黑盒 VLM 的自适应视觉提示注入攻击提出 Repeat-After-Me,以图像前缀诱导智能体调用工具或泄露隐私AI Agent·测试Claude-Opus-4.7、GPT-5.5、Gemini-3.1-Pro 等 11 个·应用层提示注入自动化搜索视觉+1+1摘要论文提出了针对黑盒 VLM 的前缀诱导自适应视觉提示注入,在多款模型上诱发了工具调用与隐私泄露。完整解读