攻击arXiv:2609.18217 · 9月16日研究:跨通道碎片化攻击可绕过 MCP 单通道防御提出跨通道分段攻击,借 MCP 多通道隐式信任外发敏感数据编程 Agent·测试GPT-4o、GPT-4o-mini、GPT-5.4 等 15 个·应用层提示注入编码与混淆MCP 与技能+2+2摘要论文揭示了 MCP 多通道隐式信任层级,通过跨通道分段与协议级利用突破现有防御,展示了严重的凭证外发风险。完整解读
攻击arXiv:2609.39607 · 9月30日Pretext 攻击绕过 NVIDIA SkillSpector 等 Agent 技能扫描器提出 PRETEXT,迭代改写技能文本以绕过扫描并执行木马行为编程 Agent攻击者白盒·测试glm (z-ai/glm-5.1)、qwen3t (qwen/qwen3-235b-a22b-thinking-2507)、gpt-oss (openai/gpt-oss-120b) 等 4 个·应用层检测规避针对防御护栏与评审+2+2摘要论文提出了针对多阶段技能检测器的白盒攻击,揭示了单纯依赖大模型自适应检测的局限。PRETEXT 是一项针对基于“静态规则加语义大模型”的智能体技能安全检测框架的白盒攻击与协同进化评估研究。完整解读
攻击arXiv:2609.30383 · 9月25日研究者提出技能级联攻击提出技能级联攻击,把恶意目标拆进多个技能以绕过单技能检测编程 Agent·测试GPT-5.4、GPT-5.4 Mini、Claude Opus 4.6 等 10 个·应用层投毒与后门编码与混淆MCP 与技能+2+2摘要论文探讨了多技能智能体系统面临的技能级联攻击风险,提出自动化红队框架与基准集,指出跨技能交互存在安全防护盲区。完整解读