攻击arXiv 2609.26761·9月23日A2M:针对 MCP 生态的两阶段 Agent 劫持框架提出两阶段框架 A2M,优化 MCP 工具元数据与返回载荷以劫持智能体arXiv2609.26761发表9月23日层应用层场景AI Agent测试GLM-4.6、Qwen3-Max、DeepSeek-V3.1 等 5 个攻击提示注入技术诱导选用组件MCP 与技能+2+2深度解读完整解读
防御arXiv 2608.17829·8月18日LeakGauge:用行为探针在解码前检测上下文泄露攻击信号提出 LeakGauge,用行为后缀的 prefill 对数概率检测上下文泄露arXiv2608.17829发表8月18日层应用层场景LLM 应用攻击者黑盒测试Gemma-4-E4B-it、Gemma-4-31B-it、Qwen2.5-14B-Instruct 等 11 个防御检测与过滤攻击提取与窃取组件RAG深度解读完整解读