攻击arXiv 2606.14517·6月12日研究者披露针对 LLM Agent 护栏的推理扩展型拒绝服务攻击提出针对 LLM Agent 护栏的推理扩展拒绝服务攻击arXiv2606.14517发表6月12日层应用层场景AI Agent攻击者黑盒、白盒攻击拒绝服务技术推理链操控组件护栏与评审+2+2深度解读完整解读
评测与基准arXiv 2609.19140·9月17日AgentLSD:在对抗性任务污染下评测 AI 安全 Agent用 AgentLSD 评测安全 Agent 在对抗任务污染下的解题与开销arXiv2609.19140发表9月17日层应用层场景网页与电脑操作被测模型Gemma-4 31B、DeepSeek-V4 Flash、GPT-OSS 120B 等 6 个攻击提示注入摘要AgentLSD 用配对 web CTF 表明,欺骗性环境证据会改变安全智能体的解题率与工作量。AgentLSD 是一个对照框架,用来测量安全智能体在任务本身不变时,对对抗性任务污染的反应。深度解读完整解读