防御arXiv 2610.00400·10月2日DART:用表征位移检测多轮 LLM 智能体中的新兴安全风险提出 DART,用去噪表征转移检测并干预多轮智能体攻击arXiv2610.00400发表10月2日层应用层场景AI Agent攻击者黑盒测试Qwen3-8B、Qwen3-14B、Qwen3-32B 等 6 个防御监控与审计攻击越狱组件监控器+2+2深度解读完整解读