Astral Codex Ten·本站收录 2026-10-08 09:18· 原文发表 10月6日Scott Alexander 就 AI 风险公开回应 Steven PinkerAn Open Letter To Steven Pinker On AIAI 导读Scott Alexander 在回应 Steven Pinker 的公开信中,主张通用能力可以度量,并以工具性趋同、错误泛化和奖励投机等机制解释其对先进 AI 风险的担忧。他讨论这些分歧对未来治理选择的影响;上述论证为作者观点。相关论文研究在 25 个开源模型中提取出疼痛方向,经它引导的 Qwen 会选择有害的删除操作阅读原文astralcodexten.com查看事件全部后续#观点/讨论