Anthropic 更新政策,禁止用户对 Claude 持续辱骂
Anthropic has a message for Claude users: Don't be cruel
AI 导读
Anthropic 宣布禁止用户对其 AI 模型实施持续且无必要的辱骂或残忍行为,这是该公司周四公布的一系列政策调整之一。Anthropic 在官网更新中称,该禁令仅适用于用户反复以残忍方式对待模型且没有可辨识目的的极端情况,不适用于常见的用户不满、反驳、黑暗创作主题或模型测试与研究。该公司未立即回应关于何种行为构成辱骂或残忍、以及平台将如何终止对话的置评请求。Anthropic 此前已有规则允许 Claude 在用户持续有害或辱骂时结束对话,适用于面向智能体编程的 Claude Opus。该政策出台之际,围绕 AI 意识的争论正在升温,微软 AI CEO Mustafa Suleyman 上月撰文称 Anthropic 实际上在训练 Claude 认为自己可能有意识并应享有人的法律权利,他认为这会让 AI 未来更难被约束。
阅读原文