攻击arXiv:2608.09867 · 8月11日研究者利用加密推理块跨模型兼容性窃取专有 LLM 推理链利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链模型与 API攻击者黑盒·测试Claude Opus 4.8、Claude Sonnet 4.6、Claude Haiku 4.5 等 15 个·提示层提取与窃取推理链操控推理链+1+1摘要论文揭示了客户端加密思维块跨模型互换漏洞,提出了低成本提取方法并给出防御方案。完整解读
攻击arXiv:2609.04533 · 9月4日Repeat-After-Me:针对黑盒 VLM 的自适应视觉提示注入攻击提出 Repeat-After-Me,以图像前缀诱导智能体调用工具或泄露隐私AI Agent·测试Claude-Opus-4.7、GPT-5.5、Gemini-3.1-Pro 等 11 个·应用层提示注入自动化搜索视觉+1+1摘要论文提出了针对黑盒 VLM 的前缀诱导自适应视觉提示注入,在多款模型上诱发了工具调用与隐私泄露。完整解读