OpenAI 持续加固 ChatGPT Atlas 抵御提示注入
Continuously hardening ChatGPT Atlas against prompt injection
AI 导读
OpenAI 表示正在用强化学习训练的自动化红队加固 ChatGPT Atlas,以抵御提示注入攻击。这一主动发现并修补的闭环旨在尽早识别新的攻击手法,并随着 AI 智能体能力增强持续加固浏览器 Agent 的防御。
推荐理由
OpenAI 披露用强化学习训练的自动化红队持续发现并修补 Atlas 的提示注入漏洞,浏览器 Agent 团队可参考这一发现与修补闭环。