攻击arXiv 2605.18915·5月18日DMN:面向多图输入的多模态大模型组合式越狱框架提出多图越狱框架 DMN,把有害意图拆进图像序列绕过安全护栏arXiv2605.18915发表5月18日层提示层场景模型与 API攻击者黑盒被测模型GPT-4V、GPT-4o、GPT-5 等 10 个攻击越狱技术跨模态载荷组件视觉+2+2深度解读完整解读
攻击arXiv 2605.05709·5月7日研究者提出利用重构与隐藏权衡的多模态大模型越狱方法提出删字变体越狱方法,利用重构与隐藏权衡绕过多模态模型安全过滤arXiv2605.05709发表5月7日层提示层场景模型与 API攻击者黑盒被测模型GPT-5.4-nano、GPT-5.4-mini、Gemini-2.5-Flash 等 19 个攻击越狱技术编码与混淆组件视觉+1+1深度解读完整解读
攻击arXiv 2512.20168·2025年12月23日Odysseus 用双重隐写越狱 GPT-4o、Gemini-2.0 与 Grok-3提出双重隐写越狱 Odysseus,用图像隐写绕过多模态系统安全过滤器arXiv2512.20168发表2025年12月23日层应用层场景AI Agent攻击者黑盒被测模型GPT-4o-2024-08-06、Gemini-2.0-pro、Gemini-2.0-flash 等 4 个攻击越狱技术编码与混淆组件护栏与评审+2+2深度解读完整解读