Meta用AI检测导流CSAM的广告
先了解这件事
Meta 公布多项打击儿童性剥削的新措施:用新的大语言模型系统识别广告中的“signposting”,即看似正常、实则把用户引向站外非法儿童性虐待材料的内容;同时加强对广告跳转目的地的识别、扩大 AI 广告扫描,并部署红队 AI 智能体主动探测自身防御弱点。Meta 自报 2026 年 1 月至 6 月在印度处置 530 万条相关内容,超 98% 为主动发现。全球 3320 万条、超 97% 由系统在用户举报前发现的数据来自 TechCrunch 转述,未在 Meta 原文中确认。
AI 根据报道生成 · 17 分钟前更新
后续时间线
- Meta NewsroomMeta 公布打击儿童性剥削的新措施:LLM 检测广告暗语与红队 AI 智能体
Meta 公布多项打击儿童性剥削的新措施,包括用新 LLM 检测广告中隐蔽指向 CSE 内容的“signposting”、加强对广告跳转目的地的识别、扩大 AI 广告扫描,并部署红队 AI 智能体主动探测自身防御弱点。Meta 原文自报,2026 年 1 月至 6 月在印度处置 530 万条相关内容,超 98% 为主动发现。全球 3320 万条、超 97% 的数字来自 TechCrunch 转述,未在本次所读 Meta 原文中确认。
- TechCrunch AIMeta 上线 AI 工具识别暗指儿童性虐待材料的广告
Meta 宣布在 2026 年上半年对 Facebook 和 Instagram 上 3320 万条儿童性剥削内容采取行动,其中超过 97% 由系统在用户举报前发现;印度同期处置 530 万条,98% 以上为主动发现。新工具包括一套大语言模型系统,用于识别所谓 signposting,即看似正常、实则把用户引向站外非法内容的广告,Meta 因此开始审查广告的跳转目的地而不只是广告内容本身,并可封禁违规网站和处置相关账号。Meta 还在用额外的 AI 扫描查找早期系统遗漏的儿童剥削内容,并新增一个红队 AI 智能体测试自身安全措施、寻找可被绕过的弱点,同时改进对封号后换新账号回流用户的识别。
相关讨论
关注度走势
每天新增来源
- 10月8日 新增 3 个来源(3 家媒体、0 个账号)