防御arXiv 2610.02869·10月2日AgentTrap:面向自主渗透测试 Agent 的有状态反馈欺骗蜜罐提出 AgentTrap 有状态蜜罐,欺骗并反击自主渗透测试 AgentarXiv2610.02869发表10月2日层应用层场景coding agent被测模型AIDA、Claude Code、PentestGPT 等 8 个攻击恶意使用深度解读完整解读
攻击arXiv 2606.14517·6月12日研究者披露针对 LLM Agent 护栏的推理扩展型拒绝服务攻击提出针对 Agent 护栏的推理扩展拒绝服务攻击arXiv2606.14517发表6月12日层应用层场景AI Agent攻击者黑盒被测模型TS-Guard-8B、Qwen3.5-9B、DeepSeek-V3.2 等 11 个攻击拒绝服务技术推理链操控组件护栏与评审+2+2深度解读完整解读