攻击arXiv:2608.23858 · 8月25日研究者对 Google AP2 v0.2 做系统安全分析,识别 48 项威胁系统分析智能体支付协议 AP2,揭示合法签名无法阻止前置上下文操纵AI Agent·测试gpt-5.3、gpt-5.5·应用层提示注入MCP 与技能+1+1完整解读
攻击arXiv:2609.33985 · 9月28日研究:众包微调数据投毒可放大专有指令抽取提出主题锚点投毒,放大众包微调后的专有指令提取模型与 API攻击者黑盒·测试Qwen2.5-7B-Instruct、Qwen2.5-14B-Instruct、Llama-3.1-8B-Instruct 等 6 个·训练与数据层投毒与后门潜伏触发微调与开源权重+1+1摘要论文提出基于主题锚点的数据中毒攻击,证明低比例的中毒样本可在黑盒条件下隐蔽放大微调指令泄漏。完整解读