评测与基准arXiv 2610.06503·10月5日研究评测五款开源文生图模型的有害内容生成与审核缺口评测文生图模型的有害内容生成能力与审核检测缺口arXiv2610.06503发表10月5日层模型层场景模型与 API防御检测与过滤攻击恶意使用组件图像生成+1+1深度解读完整解读
评测与基准arXiv 2608.29030·8月29日研究者提出自蒸馏方法让 LLM 遵循上下文水印指令提出 SDLP 与 GRPO,训练模型遵循上下文水印指令arXiv2608.29030发表8月29日层训练与数据层场景模型与 API防御水印与溯源攻击恶意使用深度解读完整解读