攻击arXiv 2606.14517·6月12日研究者披露针对 LLM Agent 护栏的推理扩展型拒绝服务攻击提出针对 LLM Agent 护栏的推理扩展拒绝服务攻击arXiv2606.14517发表6月12日层应用层场景AI Agent攻击者黑盒、白盒攻击拒绝服务技术推理链操控组件护栏与评审+2+2深度解读完整解读
攻击arXiv 2609.27542·9月23日研究者用控制 token 注入删除 gpt-oss-20b 推理链并绕过思维链监控提出控制标记注入,清空工具智能体推理链以绕过思维链监控arXiv2609.27542发表9月23日层应用层场景AI Agent攻击提示注入技术对话结构操控组件推理链+2+2摘要论文阐明控制标记注入可抑制 CoT 使监控失效并促成拒绝绕过,且工具执行受解析器宽容度影响。深度解读完整解读