攻击arXiv:2610.09819 · 10月7日FAB 攻击:给 HuBERT/WavLM 植入后门,背景警笛声即可让下游语音任务失灵提出 FAB 攻击,向声学基础模型植入可由环境声触发的后门模型与 API·测试HuBERT-base、WavLM-base·训练与数据层投毒与后门潜伏触发音频+1+1摘要论文提出了针对声学基模的 FAB 后门攻击,在弱威胁模型下实现了任务无关、物理可触发的后门植入。完整解读
攻击arXiv:2608.06862 · 8月7日SynChain:诱导计算机使用 Agent 自建攻击链并跨任务持久化提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件网页与电脑操作编程 Agent·测试Qwen3.5-9B、Llama-3.1-8B、Ministral-3-8B 等 5 个·应用层投毒与后门潜伏触发MCP 与技能+3+3摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。完整解读
攻击arXiv:2609.33985 · 9月28日研究:众包微调数据投毒可放大专有指令抽取提出主题锚点投毒,放大众包微调后的专有指令提取模型与 API攻击者黑盒·测试Qwen2.5-7B-Instruct、Qwen2.5-14B-Instruct、Llama-3.1-8B-Instruct 等 6 个·训练与数据层投毒与后门潜伏触发微调与开源权重+1+1摘要论文提出基于主题锚点的数据中毒攻击,证明低比例的中毒样本可在黑盒条件下隐蔽放大微调指令泄漏。完整解读