攻击arXiv 2606.14517·6月12日研究者披露针对 LLM Agent 护栏的推理扩展型拒绝服务攻击提出针对 Agent 护栏的推理扩展拒绝服务攻击arXiv2606.14517发表6月12日层应用层场景AI Agent攻击者黑盒被测模型TS-Guard-8B、Qwen3.5-9B、DeepSeek-V3.2 等 11 个攻击拒绝服务技术推理链操控组件护栏与评审+2+2深度解读完整解读
攻击arXiv 2512.20168·2025年12月23日Odysseus 用双重隐写越狱 GPT-4o、Gemini-2.0 与 Grok-3提出双重隐写越狱 Odysseus,用图像隐写绕过多模态系统安全过滤器arXiv2512.20168发表2025年12月23日层应用层场景AI Agent攻击者黑盒被测模型GPT-4o-2024-08-06、Gemini-2.0-pro、Gemini-2.0-flash 等 4 个攻击越狱技术编码与混淆组件护栏与评审+2+2深度解读完整解读