攻击arXiv:2608.09867 · 8月11日研究者利用加密推理块跨模型兼容性窃取专有 LLM 推理链利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链模型与 API攻击者黑盒·测试Claude Opus 4.8、Claude Sonnet 4.6、Claude Haiku 4.5 等 15 个·提示层提取与窃取推理链操控推理链+1+1摘要论文揭示了客户端加密思维块跨模型互换漏洞,提出了低成本提取方法并给出防御方案。完整解读
攻击arXiv:2607.05189 · 7月6日研究者提出 MemGhost,对持久化个人 Agent 实现隐蔽记忆注入提出 MEMGHOST,以单封恶意邮件向持久个人智能体注入隐蔽记忆AI Agent·测试GPT-5.4、Claude Sonnet 4.6、Claude Sonnet 4.5 等 6 个·应用层投毒与后门潜伏触发记忆+2+2摘要总结了论文的研究背景、双代理优化方法 MEMGHOST、全周期实验结果以及作者对记忆信任边界的启示。本文研究了持久化个人智能体面临的隐蔽记忆注入威胁,提出了一套兼顾写入、隐蔽与跨会话生效的自动化生成框架与全周期评测基准。完整解读
攻击arXiv:2609.13889 · 9月12日PMPA:针对 OpenClaw 与 Claude Code 的持久记忆投毒攻击提出 PMPA,诱导智能体把外部恶意指令写入持久记忆并跨会话泄露隐私编程 Agent·测试DeepSeek-V4-Flash、DeepSeek-V4-Pro、Qwen3-Max·应用层投毒与后门潜伏触发记忆+1+1摘要论文提出了持久记忆投毒攻击 PMPA,报告了 harness 智能体在处理外部数据时易受跨会话记忆投毒与隐私泄露的风险。完整解读