FAB 攻击:给 HuBERT/WavLM 植入后门,背景警笛声即可让下游语音任务失灵
提出 FAB 攻击,向声学基础模型植入可由环境声触发的后门
完整解读
另有 48 篇论文还没打上分类标签,暂不在筛选结果里。
提出 FAB 攻击,向声学基础模型植入可由环境声触发的后门
提出 PERSISTBD,在发布前强化后门使其经良性后训练仍然存活
本文研究第三方 LLM 智能体在开发者进行良性监督微调(SFT)和强化学习(RL)后训练时的后门持久性风险。
提出破坏执行连续性的回滚攻击,揭示检查点恢复的安全故障
提出 AKRASIA 推断期后门,用代码级触发器与伪装推理操纵代码模型
提出 TrojanWorld,通过想象引导给世界模型智能体植入供应链后门
提出主题锚点投毒,放大众包微调后的专有指令提取