OpenAI 公布应对 EU AI Act 的文本水印方案 textGrain
Our approach to EU text provenance rules
AI 导读
OpenAI 公布其应对 EU AI Act 文本溯源要求的方案,核心技术为 textGrain,通过在模型选词中加入不可见统计信号,再由检测器判断文本是否带有 OpenAI 水印。API 客户即日起可自愿开启部分模型的文本水印,默认关闭;未来数周内 OpenAI 将在欧盟地区为符合条件的 ChatGPT 和 Codex 输出加入不可见水印,并开放检测器申请,初期仅限经批准的研究者和专家机构。OpenAI 表示 textGrain 在评测中达到或超过包括 SynthID for text 在内的其他方案,但检测仍受文本长度和改写影响:在 1% 目标误报率下,200 token 段落检出率约 80%,400 token 约 95%,数学类内容明显更低;400 token 段落中替换 10% 同义词后检出率从约 92% 降至 66%,替换 25% 则降至 17%。
推荐理由
OpenAI 为回应 EU AI Act 推出文本水印方案,并公开 textGrain 在短文本和改写下的检测率下降数据,可供关注内容溯源合规的团队参考。
阅读原文