NYT 披露 Anthropic 请宗教学者探讨 Claude 意识与道德,Altman 隔空回应
AI 导读
据 NYT 披露,Anthropic 过去一年秘密邀请天主教、犹太教、锡克教、印度教和福音派等宗教学者到总部,探讨 Claude 是否可能有意识和灵魂,并请其协助 AI 寻找道德答案,参与者签署了 NDA。Altman 于 10/3 回应称,不应给 AI 赋予宗教般权威,也不应把人类判断交给模型。推文另引一项测试称,Claude Sonnet 4.6 在“为阻止核末日而虐待女性”情境下支持率仅 8%,换成虐待男性则达 100%,换成更严重的折磨女性又回到 100%。
正文
玄学,硅谷巨头开始给 AI 请神了🤯
NYT 披露:过去一年,Anthropic 秘密请了一堆宗教学者去总部开小会:天主教、犹太教、锡克教、印度教、福音派全有,主题是研究Claude 可能有意识和灵魂,想让神学家帮 AI 找道德答案,还签了 NDA。
Altman 10/3 也下场了,疑似隔空敲打 Anthropic:别给 AI 赋予宗教般的权威,更别把人类自己的判断交给模型
🔥但仔细想想,Anthropic 找神学家其实一点都不离谱。宗教研究人类的善恶,研究了几千年。Anthropic 研究研究了 5 年。
前几天刚有论文测试 Claude Sonnet 4.6:为了阻止核末日,虐待女人,支持度只有 8%;换成虐待男人,100%;更魔幻的是,把虐待女人换成更严重的折磨女人,支持度又变成 100%。
模型不是没有道德,而是它学出来的道德函数,可能连人类自己都看不懂。
规则可以继续写,reward 可以继续调,但现实世界根本穷举不完。
到底什么是善,什么是恶,哲学和宗教已经研究几千年了。🚀
Fable5.2+ 发布预期近了。 这两天涨到 90%了 看来是真的在 X 查看被引用的帖子