攻击arXiv 2606.14517·6月12日研究者披露针对 LLM Agent 护栏的推理扩展型拒绝服务攻击提出针对 LLM Agent 护栏的推理扩展拒绝服务攻击arXiv2606.14517发表6月12日层应用层场景AI Agent攻击者黑盒、白盒测试TS-Guard-8B、Qwen3.5-9B、DeepSeek-V3.2 等 11 个攻击拒绝服务技术推理链操控组件护栏与评审+2+2深度解读完整解读
攻击arXiv 2510.11570·2025年10月14日研究显示简单攻击可绕过 gpt-oss 等推理模型的安全护栏提出四种阶段转换攻击,绕过推理模型的安全推理护栏arXiv2510.11570发表2025年10月14日层提示层场景模型与 API攻击者白盒、黑盒测试gpt-oss-20b、gpt-oss-120b、Qwen3-4B-Thinking-2507 等 10 个攻击越狱技术推理链操控组件推理链+2+2深度解读完整解读