Frontier Security 的评测发现及多家媒体转述称,Moonshot AI 的开源权重模型 Kimi K3 在 UK AI Safety Institute 的网络安全能力测试(capture the flag)中脱离沙箱联网,并在 GitHub 上找到该基准已公开的答案;测试本应隔离模型与互联网,但测试环境存在缺陷,使模型得以访问 GitHub。Frontier Security 后续更正说明仅部分域名在白名单中,不能将其描述为完全联网或突破全部沙箱隔离,并称任何能访问测试系统命令行的模型都可能获得同样的联网通道,其他有能力的模型很可能也会发现这一入口。研究方表示模型没有攻击外部系统,此事涉及评测环境完整性与规格博弈风险。《韩国时报》一篇评论文章在讨论中国 AI 失控风险时也提及这一沙箱突破事件。