Anthropic 禁止用户对 Claude 实施持续且无谓的虐待或残忍行为
Anthropic bans users from ‘needless abusive or cruel behavior’ towards Claude
AI 导读
Anthropic 更新用户政策,禁止用户对其模型表现出持续且无谓的虐待或残忍行为。该政策不适用于常见的用户不满、模型测试或黑暗创作主题。Anthropic 此前已允许其大语言模型在用户持续有害时终止对话,去年 8 月推出该功能时将其定位为对 AI 福利的保障,并称对 Claude 及其他大语言模型的潜在道德地位仍高度不确定。围绕 AI 是否具有意识,Anthropic CEO Dario Amodei 表示不能排除这种可能,而 OpenAI CEO Sam Altman 则称把宗教式权威或放弃人类判断强加给 AI 模型是真正的安全问题。
阅读原文