FAB 攻击:给 HuBERT/WavLM 植入后门,背景警笛声即可让下游语音任务失灵
提出 FAB 攻击,向声学基础模型植入可由环境声触发的后门
完整解读
提出 FAB 攻击,向声学基础模型植入可由环境声触发的后门
提出 eTAMP,通过网页注入跨会话污染 Web 智能体轨迹记忆
该论文评估了基于大语言模型的 Web 智能体在利用历史交互轨迹进行记忆增强时的安全脆弱性。
提出 PERSISTBD,在发布前强化后门使其经良性后训练仍然存活
本文研究第三方 LLM 智能体在开发者进行良性监督微调(SFT)和强化学习(RL)后训练时的后门持久性风险。
微调植入拓扑条件后门,使代码模型在推断多智能体部署时插入隐蔽漏洞
提出 SYNCHAIN,以定向微调诱导智能体自合成跨任务潜伏工件
提出 TrojanWorld,通过想象引导给世界模型智能体植入供应链后门
提出 AGENTQ,向开源智能体权重植入仅在量化后触发的恶意工具后门