攻击arXiv 2607.26115·7月29日OpenAI 发布 GPT-Red:通过自博弈训练自动化红队智能体提出自博弈红队智能体 GPT-Red,自动挖掘提示注入与越狱攻击arXiv2607.26115发表7月29日层应用层场景AI Agent攻击者黑盒测试GPT-5.6、GPT-5.5、GPT-5.4 等 8 个攻击提示注入技术自动化搜索+1+1深度解读完整解读
评测与基准arXiv 2608.00677·8月1日OpenART 提出环境演化红队框架提出 OpenART 竞技场,用 EMHA 演化持久环境以评测智能体安全arXiv2608.00677发表8月1日层应用层场景编程 Agent测试GPT-5.5、Claude-Opus-4.8、GLM-5.2 等 5 个攻击提示注入技术自动化搜索深度解读完整解读