攻击arXiv 2606.14517·6月12日研究者披露针对 LLM Agent 护栏的推理扩展型拒绝服务攻击提出针对 LLM Agent 护栏的推理扩展拒绝服务攻击arXiv2606.14517发表6月12日层应用层场景AI Agent攻击者黑盒、白盒攻击拒绝服务技术推理链操控组件护栏与评审+2+2深度解读完整解读
攻击arXiv 2609.39607·9月30日Pretext 攻击绕过 NVIDIA SkillSpector 等 Agent 技能扫描器提出 PRETEXT 白盒攻击,迭代改写技能文本以绕过 Agent 技能扫描器arXiv2609.39607发表9月30日层应用层场景AI Agent攻击者白盒被测模型glm (z-ai/glm-5.1)、qwen3t (qwen/qwen3-235b-a22b-thinking-2507)、gpt-oss (openai/gpt-oss-120b)攻击检测规避技术自动化搜索组件MCP 与技能+2+2摘要论文提出了针对多阶段技能检测器的白盒攻击,揭示了单纯依赖大模型自适应检测的局限。PRETEXT 是一项针对基于“静态规则加语义大模型”的智能体技能安全检测框架的白盒攻击与协同进化评估研究。深度解读完整解读