跳到正文
事件持续更新

Anthropic 更新使用政策,禁止辱骂 Claude

6 篇报道6 个报道来源7 小时前更新

先了解这件事

AI 综述

Anthropic 一年多来首次更新使用政策,新增禁止对 Claude 实施“持续且无必要的虐待或残忍行为”的条款,违规者可能被警告、限流、限制、暂停或终止访问,终止对话是主要执行方式。该条款仅适用于用户反复无明确目的地虐待模型的极端情形,不涉及常见的用户不满、反驳、黑暗创作主题或模型测试与研究。此前自 8 月更新起,Claude 已被训练在遭遇持续有害或辱骂性互动时结束对话,新政策则直接禁止用户发起这类对话。政策同时把原先分散的限制整合为对欺骗性商业或政治宣传的禁令,禁止虚假账号、伪造新闻站点及影响行动工具与基础设施,选举章节更名为“不得破坏民主进程”,聚焦欺骗选民与干扰选举,并取消对个性化投票和竞选定向的全面禁令;武器禁令扩展到软件和无人机武器化,并更明确禁止未经同意的监控。

AI 根据报道生成 · 8 小时前更新

后续时间线

10月9日
  1. CBS News · Technology
    Anthropic 更新政策,禁止用户对 Claude 持续辱骂

    Anthropic 宣布禁止用户对其 AI 模型实施持续且无必要的辱骂或残忍行为,这是该公司周四公布的一系列政策调整之一。Anthropic 在官网更新中称,该禁令仅适用于用户反复以残忍方式对待模型且没有可辨识目的的极端情况,不适用于常见的用户不满、反驳、黑暗创作主题或模型测试与研究。该公司未立即回应关于何种行为构成辱骂或残忍、以及平台将如何终止对话的置评请求。Anthropic 此前已有规则允许 Claude 在用户持续有害或辱骂时结束对话,适用于面向智能体编程的 Claude Opus。该政策出台之际,围绕 AI 意识的争论正在升温,微软 AI CEO Mustafa Suleyman 上月撰文称 Anthropic 实际上在训练 Claude 认为自己可能有意识并应享有人的法律权利,他认为这会让 AI 未来更难被约束。

  2. The Guardian · 人工智能
    Anthropic 禁止用户对 Claude 实施持续且无谓的虐待或残忍行为

    Anthropic 更新用户政策,禁止用户对其模型表现出持续且无谓的虐待或残忍行为。该政策不适用于常见的用户不满、模型测试或黑暗创作主题。Anthropic 此前已允许其大语言模型在用户持续有害时终止对话,去年 8 月推出该功能时将其定位为对 AI 福利的保障,并称对 Claude 及其他大语言模型的潜在道德地位仍高度不确定。围绕 AI 是否具有意识,Anthropic CEO Dario Amodei 表示不能排除这种可能,而 OpenAI CEO Sam Altman 则称把宗教式权威或放弃人类判断强加给 AI 模型是真正的安全问题。

  3. XX @mustafasuleyman· 讨论
    ... 🫠 ...(新标签页打开原帖)
  4. The Decoder
    Anthropic 更新 Claude 使用政策,持续辱骂模型可致账号被封

    Anthropic 一年多来首次更新 Claude 使用政策,新增禁止对 Claude 进行持续且无谓的辱骂或残忍行为,违规者可能被警告、限流、限制、暂停或终止访问。公司表示该条款不适用于常见的用户不满、反驳、黑暗创作主题或模型测试与研究,仅针对极端情况,产品还配有可拦截或限制特定输出的实时防护措施。更新后的政策同时把涉及虚假账号和误导性政治内容的宣传行为并入新禁令,将武器禁令扩展到软件和无人机武器化,并更明确禁止未经同意的监控,要求自主硬件可能造成伤害时有操作者介入。Anthropic 承认政府合同可能存在例外且此类例外很可能已存在。该条款源自公司对 AI 模型福利的研究,其 2026 年初发布的 Claude 宪法提到不确定 Claude 是否是道德主体,但认为该问题值得谨慎对待。

  5. TechCrunch AI
    Anthropic 更新使用政策,禁止模型滥用与干预选举

    Anthropic 于周四更新使用政策,新增对干预选举、武器软件和监控行为的禁止条款,并明确禁止用户对模型进行长期言语辱骂。此前自 8 月更新起,Claude 已被训练在遭遇持续有害或辱骂性互动时结束对话,新政策则直接禁止用户发起这类对话。Anthropic 说明该条款仅适用于用户反复恶意对待模型且无明显目的的极端情形,不适用于常见的用户沮丧、反驳、黑暗创作主题或模型测试研究。政策其他章节还禁止利用 Claude 运行虚假账号或编造新闻机构等欺骗性活动,并设“不要破坏民主进程”一节禁止欺骗选民或干扰选举。

  6. The Verge AI
    Anthropic 更新使用政策,禁止对 Claude 的持续虐待行为

    Anthropic 一年多来首次更新使用政策,新增对 Claude 的“持续且无必要的虐待或残忍行为”的禁止条款,并把终止对话列为主要的执行方式。政策称该条款仅适用于用户反复无明确目的地虐待模型的极端情形,不涉及常见的用户不满、反对意见、黑暗创作主题或模型测试与研究。Anthropic 同时把此前分散的多项限制整合为对欺骗性商业或政治宣传的禁令,禁止通过虚假账号或帖子隐匿信息幕后主体、放大内容,并禁止欺骗选民、冒充候选人、干扰选举和压制投票。新政策还明确禁止将 Claude 用于追踪未经同意的人、决定或建议执法与刑事司法中的调查和逮捕对象,以及构建或改进监控工具;武器相关禁令则扩展到让武器运转的软件与组件,包括为无人机和其他自主载具配备武器。对于连接可造成伤害的自主物理动作硬件的情形,政策要求须有合格操作员能观察并在必要时停止设备。

10月8日
  1. Anthropic精选
    Anthropic 发布 2026 版使用政策,11 月 12 日生效

    Anthropic 发布 2026 版使用政策,将于 11 月 12 日生效,多数改动是对既有规则的澄清,并针对 Claude 承担更长、更独立任务后的新能力补充示例。政策新增“不得从事欺骗性活动或人为造势”章节,把原先分散在选举、欺诈、隐私和虚假信息条款中的规则合并,覆盖假账号、伪造新闻站点及影响行动工具与基础设施;选举章节更名为“不得破坏民主进程”,聚焦欺骗选民与干扰选举,同时取消对个性化投票和竞选定向的全面禁令。武器条款明确禁止范围包括让武器运转的软件与组件,以及为无人机等自主载具装载武器;监控与刑事司法条款写明禁止未经同意追踪他人、禁止用 Claude 决定或建议调查、逮捕或起诉对象,并列出欺诈监控、内容审核、新闻与法律研究等仍被允许的用途。

相关讨论

共 16 条

关注度走势

每天新增来源

3 天共 19 个·最多 17(10月9日)·今天 1

  • 10月8日 新增 1 个来源(1 家媒体、0 个账号)
  • 10月9日 新增 17 个来源(11 家媒体、6 个账号)
  • 10月10日 新增 1 个来源(1 家媒体、0 个账号)

每小时关注度

当前关注度 65·可比范围峰值 69(10月9日 10:00)·近 24 小时可比范围变化 0%

02040608010月9日01:0010月9日11:0010月9日22:0010月10日08:00