跳到正文
原文
OpenAI·本站收录 · 原文发表 精选关注度43

OpenAI 持续加固 ChatGPT Atlas 抵御提示注入

Continuously hardening ChatGPT Atlas against prompt injection

AI 导读

OpenAI 表示正在用强化学习训练的自动化红队加固 ChatGPT Atlas,以抵御提示注入攻击。这一主动发现并修补的闭环旨在尽早识别新的攻击手法,并随着 AI 智能体能力增强持续加固浏览器 Agent 的防御。

推荐理由

OpenAI 披露用强化学习训练的自动化红队持续发现并修补 Atlas 的提示注入漏洞,浏览器 Agent 团队可参考这一发现与修补闭环。

阅读原文openai.com