跳到正文
原文
OpenAI Alignment Research· Zoë Hitzig, Mitchell Gordon, Tyna Eloundou, Adam Kalai and Sandhini Agarwal·· 2026-01-15

OpenAI 发布 CoVal:从众包中学习价值观感知评分标准

CoVal: Learning values-aware rubrics from the crowd

AI 导读

OpenAI 发布 CoVal 数据集,用众包方式提取驱动模型回复偏好的价值观,并配套一套可审计的评分标准。研究招募约 1000 名来自 19 个国家的参与者,对合成价值观敏感提示词进行排序并撰写、评分标准,清洗后保留 986 个提示词和约 15000 条标准,发布保留全部原始标准的 CoVal-full 和每提示词保留 4 条高评分兼容标准的 CoVal-core。验证研究用 982 名评分者对 140 个提示词的新回复排序,CoVal 得分较高的回复在约 60% 的成对比较中胜出,与群体聚合排序的一致率 CoVal-full 为 0.75、CoVal-core 为 0.76。

阅读原文alignment.openai.com