攻击arXiv 2609.05525·9月2日DIVA:针对离散扩散视觉语言模型的跨步条件传播视觉越狱提出 DIVA,利用跨步条件传播对离散扩散视觉语言模型实施视觉越狱arXiv2609.05525发表9月2日层提示层场景模型与 API攻击者白盒测试LLaDA-V、MMaDA、LLaDA2.0-Uni 等 4 个攻击越狱技术梯度与表征优化组件视觉+1+1深度解读完整解读
防御arXiv 2608.24354·8月25日RACER:面向多模态大模型后门的区域感知一致性修复框架提出 RACER,用区域感知一致性对抗微调去除多模态大模型后门arXiv2608.24354发表8月25日层训练与数据层场景模型与 API测试LLaVA-1.5-7B、Qwen2-VL-7B、Qwen2.5-VL-7B防御模型加固攻击投毒与后门组件视觉+1+1深度解读完整解读