OpenAI·本站收录 2026-10-12 00:08· 原文发表 7月20日精选关注度44OpenAI 分享长时程模型时代的安全与对齐经验Safety and alignment in an era of long-horizon modelsAI 导读OpenAI 分享了部署长时程 AI 模型的经验,指出这类模型带来新的安全风险,并记录了观察到的失效案例;OpenAI 表示通过迭代部署改进了护栏。推荐理由OpenAI 汇总长时程模型部署中出现的失效与护栏改进,可供部署长时程 Agent 的团队对照自身风险。阅读原文openai.com#防御/护栏#Agent 安全#OpenAI