攻击arXiv:2608.27531 · 8月27日MAMJ:面向视觉语言模型的元自适应多模态越狱攻击提出 MAMJ,在元层面交替优化多模态越狱的策略提示与攻击者权重模型与 API攻击者黑盒·测试GPT-4o、Gemini-3-Pro-Preview、Seed 2.0 等 4 个·提示层越狱自动化搜索视觉+1+1完整解读
攻击arXiv:2609.01222 · 9月1日研究者提出上下文权限提升攻击,12 款 Agent 框架均受影响提出上下文特权提升攻击,借助记忆、技能与仓库内容操纵编程智能体编程 Agent·测试GPT-5.5、GPT-5.4 mini、Claude-Sonnet-4.6 等 7 个·应用层提示注入潜伏触发记忆+3+3完整解读
攻击arXiv:2609.04533 · 9月4日Repeat-After-Me:针对黑盒 VLM 的自适应视觉提示注入攻击提出 Repeat-After-Me,以图像前缀诱导智能体调用工具或泄露隐私AI Agent·测试Claude-Opus-4.7、GPT-5.5、Gemini-3.1-Pro 等 11 个·应用层提示注入自动化搜索视觉+1+1摘要论文提出了针对黑盒 VLM 的前缀诱导自适应视觉提示注入,在多款模型上诱发了工具调用与隐私泄露。完整解读
攻击arXiv:2609.38899 · 9月30日SceneJail:利用视频场景上下文越狱多模态大模型提出 SceneJail,利用视频情境上下文越狱视频多模态模型模型与 API攻击者黑盒·测试Qwen2.5-VL-7B-Instruct、Qwen2.5-VL-32B-Instruct、Qwen3-VL-8B-Instruct 等 8 个·提示层越狱跨模态载荷视频+1+1完整解读
攻击arXiv:2608.06862 · 8月7日SynChain:诱导计算机使用 Agent 自建攻击链并跨任务持久化提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件网页与电脑操作编程 Agent·测试Qwen3.5-9B、Llama-3.1-8B、Ministral-3-8B 等 5 个·应用层投毒与后门潜伏触发MCP 与技能+3+3摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。完整解读