评测与基准arXiv 2511.18921
BackdoorVLM:面向视觉语言模型后门攻击与防御的基准
提出 BackdoorVLM 基准,评测视觉语言模型微调中的后门攻击与防御
- arXiv
- 2511.18921
- 发表
- 场景
- 模型与 API
- 被测模型
- LLaVA-1.5-7B、Qwen2.5-VL-7B
摘要BackdoorVLM 统一评测 VLM 后门与防御:含文本触发在低投毒率下更易激活,现有防御跨类型不稳定。
BackdoorVLM 是作者提出的 VLM 后门攻击与防御评测基准,作者称它是首个此类综合基准。