Anthropic 就模型意识与受苦问题咨询宗教领袖
先了解这件事
据《纽约时报》报道,Anthropic 自 2025 年秋季起秘密邀请数十位宗教学者到其办公室,讨论 Claude 是否可能具有意识,参与者均需签署保密协议,Anthropic 称这些协议已在夏季解除。联合创始人 Christopher Olah 把语言模型当作可能有感知的存在,请来宾帮助对它进行道德教育,并向《纽约时报》表示自己真心不确定模型是否有意识。公司向访客展示了所谓情绪向量,即模型中对应爱、恐惧、悲伤或愤怒等输出的激活模式。随后,OpenAI CEO Sam Altman 公开反对将 AI 模型与宗教类比,称人们把宗教力量或对人类判断力的屈服归于 AI 模型让他非常不安,并称这是真正的安全问题;此番表态紧随上述报道以及教皇 Leo XIV 称算法缺乏人性的火花之后。
AI 根据报道生成 · 2 小时前更新
事件进展
- 10月4日 02:56 · 1 篇报道Altman称将AI神化是真实安全风险
- 10月3日 03:41 · 1 篇报道Anthropic 联合创始人向宗教领袖表达对模型受苦的担忧
后续时间线
- The DecoderSam Altman 称将 AI 模型神化是"真正的安全问题"
OpenAI CEO Sam Altman 公开反对将 AI 模型与宗教类比,称人们"把宗教力量或对人类判断力的屈服归于 AI 模型"让他"非常不安",并称这是"真正的安全问题"。此番表态紧随《纽约时报》关于 Anthropic 接触宗教领袖的详细报道,以及教皇 Leo XIV 称"算法缺乏人性的火花"之后。Altman 曾在 2023 和 2024 年称 OpenAI 的目标是构建"天空中的魔法智能",并称希望站在上帝一边。
- RedditReddit r/ControlProblem· 讨论Anthropic showed religious scholars an AI having a “mental breakdown”(新标签页打开原帖)
- RedditReddit r/Anthropic· 讨论Anthropic consulted religious scholars about whether Claude is conscious(新标签页打开原帖)
- RedditReddit r/Anthropic· 讨论Anthropic showed religious scholars an AI having a “mental breakdown”(新标签页打开原帖)
- The DecoderAnthropic 联合创始人据报向宗教领袖表示担忧造出永久受苦之物
据《纽约时报》报道,Anthropic 自 2025 年秋季起秘密邀请数十位宗教学者到其办公室,讨论 Claude 是否可能具有意识,参与者均需签署保密协议,Anthropic 称这些协议已在夏季解除。联合创始人 Christopher Olah 把语言模型当作可能有感知的存在,请来宾帮助对它进行道德教育,并向《纽约时报》表示自己真心不确定模型是否有意识。公司向访客展示了所谓情绪向量,即模型中对应爱、恐惧、悲伤或愤怒等输出的激活模式,其中一张幻灯片显示模型反复输出“我是个耻辱”约 50 次。Anthropic 的 Model Welfare 项目引用了哲学家 David Chalmers 参与撰写的报告,Claude Opus 4 和 4.1 已获得在用户持续辱骂时结束对话的能力。批评者认为这是事后逆向工程伦理,且把模型当作独立道德主体会模糊开发者应负的责任。
相关讨论
- 网页AxiosOpenAI's Altman: Ascribing religion to models a "safety issue"(新标签页打开原帖)
- RedditReddit r/ControlProblemAnthropic showed religious scholars an AI having a “mental breakdown”(新标签页打开原帖)
- 网页新智元Anthropic首曝秘密游说梵蒂冈:Claude已经有意识了!(新标签页打开原帖)
- XX @rohanpaul_aiNytimes article: Anthropic co-founder, Christopher Olah told religious scholars and leaders that he feared he'd built something that suff...(新标签页打开原帖)
- RedditReddit r/AnthropicAnthropic consulted religious scholars about whether Claude is conscious(新标签页打开原帖)
- RedditReddit r/AnthropicAnthropic showed religious scholars an AI having a “mental breakdown”(新标签页打开原帖)
关注度走势
每天新增来源
- 10月3日 新增 6 个来源(3 家媒体、3 个账号)
- 10月4日 新增 0 个来源(0 家媒体、0 个账号)
每小时关注度
趋势只比较一直被完整观测到的同一批信源,范围可能比当前关注度小。移动指针或点击图表查看每小时关注度;键盘可用左右方向键切换。