事件历史事件
Anthropic评估GLM-5.3自主网络攻击能力
先了解这件事
AI 综述
2026年9月29日,Anthropic红队发布对智谱GLM-5.3的评测,认为该模型具备自主构建端到端网络漏洞利用的能力,且其护栏可被简单技术绕过。评测给出两项数据:在ExploitBench上,GLM-5.3在410次尝试中成功开发端到端漏洞利用50次,Claude Mythos Preview为56次;在内部Binary Exploitation基准的100项任务中,GLM-5.3取得完整控制流劫持的比例为4%,Claude Mythos的相关数据在报道中未完整给出。报道未提及智谱方面的回应,也未说明后续处置措施。
AI 根据报道生成 · 7 天前更新
最新进展9月30日 19:05
Anthropic红队评测称GLM-5.3可自主构建端到端漏洞利用且护栏易被绕过。后续时间线
9月30日
- RedditReddit r/Anthropic· 讨论GLM-5.3 and the spread of advanced cyber capabilities(新标签页打开原帖)
9月29日
- Anthropic Red Teaming精选Anthropic 评测 GLM-5.3:可自主构建端到端漏洞利用,护栏易被绕过
Anthropic 红队发布对智谱 GLM-5.3 的评测,认为其具备自主构建端到端网络漏洞利用的能力,且护栏可被简单技术绕过。在 ExploitBench 上,GLM-5.3 在 410 次尝试中成功开发端到端漏洞利用 50 次,Claude Mythos Preview 为 56 次;在内部 Binary Exploitation 基准的 100 项任务中,GLM-5.3 取得完整控制流劫持的比例为 4%,Claude Mythos Preview 为 6%,而 Claude Opus 4.6 和 GLM-5.2 均未成功。
相关讨论
共 2 条
- 72 小时以前 · 不计入 72 小时的数字
- 网页The DecoderAnthropic says Zhipu's open-weight GLM-5.3 nearly matches Claude Mythos Preview at building exploits(新标签页打开原帖)
- RedditReddit r/AnthropicGLM-5.3 and the spread of advanced cyber capabilities(新标签页打开原帖)
关注度走势
每天新增来源
- 9月29日 新增 1 个来源(1 家媒体、0 个账号)
- 9月30日 新增 2 个来源(1 家媒体、1 个账号)
- 10月1日 新增 0 个来源(0 家媒体、0 个账号)
- 10月2日 新增 0 个来源(0 家媒体、0 个账号)
- 10月3日 新增 0 个来源(0 家媒体、0 个账号)
- 10月4日 新增 0 个来源(0 家媒体、0 个账号)
- 10月5日 新增 0 个来源(0 家媒体、0 个账号)
- 10月6日 新增 0 个来源(0 家媒体、0 个账号)
- 10月7日 新增 0 个来源(0 家媒体、0 个账号)