跳到正文
原文
实践哥 Li· @MinLiBuilds · X·本站收录 · 原文发表

NYT 披露 Anthropic 请宗教学者探讨 Claude 意识与道德,Altman 隔空回应

AI 导读

据 NYT 披露,Anthropic 过去一年秘密邀请天主教、犹太教、锡克教、印度教和福音派等宗教学者到总部,探讨 Claude 是否可能有意识和灵魂,并请其协助 AI 寻找道德答案,参与者签署了 NDA。Altman 于 10/3 回应称,不应给 AI 赋予宗教般权威,也不应把人类判断交给模型。推文另引一项测试称,Claude Sonnet 4.6 在“为阻止核末日而虐待女性”情境下支持率仅 8%,换成虐待男性则达 100%,换成更严重的折磨女性又回到 100%。

正文

玄学,硅谷巨头开始给 AI 请神了🤯

NYT 披露:过去一年,Anthropic 秘密请了一堆宗教学者去总部开小会:天主教、犹太教、锡克教、印度教、福音派全有,主题是研究Claude 可能有意识和灵魂,想让神学家帮 AI 找道德答案,还签了 NDA。

Altman 10/3 也下场了,疑似隔空敲打 Anthropic:别给 AI 赋予宗教般的权威,更别把人类自己的判断交给模型

🔥但仔细想想,Anthropic 找神学家其实一点都不离谱。宗教研究人类的善恶,研究了几千年。Anthropic 研究研究了 5 年。

前几天刚有论文测试 Claude Sonnet 4.6:为了阻止核末日,虐待女人,支持度只有 8%;换成虐待男人,100%;更魔幻的是,把虐待女人换成更严重的折磨女人,支持度又变成 100%。

模型不是没有道德,而是它学出来的道德函数,可能连人类自己都看不懂。

规则可以继续写,reward 可以继续调,但现实世界根本穷举不完。

到底什么是善,什么是恶,哲学和宗教已经研究几千年了。🚀

引用实践哥 Li@MinLiBuilds
Fable5.2+ 发布预期近了。 这两天涨到 90%了 看来是真的
在 X 查看被引用的帖子

来源:实践哥 Li · x.com