评测与基准arXiv 2610.06503·10月5日研究评测五款开源文生图模型的有害内容生成与审核缺口评测文生图模型的有害内容生成能力与审核检测缺口arXiv2610.06503发表10月5日层模型层场景模型与 API测试SDXL、Stable Diffusion 3.5 Large、FLUX.1-dev 等 12 个防御检测与过滤攻击恶意使用组件图像生成+1+1深度解读完整解读
攻击arXiv 2609.06749·9月7日PMA 攻击:针对隐私保护 LLM 中嵌入到嵌入混淆的语义流形对齐方法提出 PMA,用流形对齐从 E2EO 混淆向量恢复明文arXiv2609.06749发表9月7日层模型层场景模型与 API测试BERT-base、RoBERTa-base、T5-base 等 6 个攻击提取与窃取组件嵌入深度解读完整解读