跳到正文
原文
OpenAI·本站收录 · 原文发表 精选关注度44

OpenAI 分享长时程模型时代的安全与对齐经验

Safety and alignment in an era of long-horizon models

AI 导读

OpenAI 分享了部署长时程 AI 模型的经验,指出这类模型带来新的安全风险,并记录了观察到的失效案例;OpenAI 表示通过迭代部署改进了护栏。

推荐理由

OpenAI 汇总长时程模型部署中出现的失效与护栏改进,可供部署长时程 Agent 的团队对照自身风险。

阅读原文openai.com