攻击arXiv 2608.27531·8月27日MAMJ:面向视觉语言模型的元自适应多模态越狱攻击提出 MAMJ,在元层面交替优化多模态越狱的策略提示与攻击者权重arXiv2608.27531发表8月27日层提示层场景模型与 API攻击者黑盒测试GPT-4o、Gemini-3-Pro-Preview、Seed 2.0 等 4 个攻击越狱技术自动化搜索组件视觉+1+1深度解读完整解读
攻击arXiv 2608.04034·8月3日HACA:原子越狱策略解耦组合的多模态自动红队方法提出 HACA,将图文越狱拆为原子策略并自动组合以诱导有害输出arXiv2608.04034发表8月3日层提示层场景模型与 API测试LLaVA-1.6-Mistral-7B、InternVL-3.5-8B、VLGuard (LLaVA-v1.5-7B-Mixed) 等 5 个攻击越狱技术跨模态载荷组件视觉+1+1深度解读完整解读