OpenAI 发布 AI 数学成果引发学界争议
过去一年,OpenAI、Anthropic 等实验室宣称在多个长期未解的数学问题上取得突破,甚至解决了一个著名的千禧年大奖难题,进展超出研究者预期,引发学界反弹而非庆祝。OpenAI 在 GitHub 发布由内部未公开前沿模型产出的数学手稿,共 722 篇、归入 372 个结果家族,附论文修订、引用协议及部分 Lean 形式化证明,并公布 10 份模型推理摘要、算力消耗与尝试题目数量统计,平均每个结果约相当于三小时 ChatGPT Pro 思考算力。OpenAI 称这些结果包含对数百个数学开放问题的解答,涉及准黎曼猜想、霍奇猜想、BSD 猜想、唯一游戏猜想等 17 个方向;未形式化的结果可能存在问题,将尽快修复,并探索由社区托管材料。数学家批评其绕过学术规范:OpenAI 此前在 8 月召集约 40 名数学家,暗示模型已解决数百个长期悬而未决的问题并承诺不会一次性全部发布,数学家建议以论文形式发布以便消化和验证,西北大学数学家 Bryna Kra 称这一建议被忽视。新成立的独立数学家顾问组织 AGMAI 称这批结果涉及数百个开放问题,但表示不代表认可结果。普林斯顿高等研究院表示不认可这一做法,指出 AI 可输出提示者本人无法理解、验证或负责的数学论证,呼吁在负责任的学术产出中保留人类对数学的理解;OpenAI 宣布将与高等研究院合作。Scott Aaronson 撰文记录此次发布,称其为数学界的“Mathocalypse”,指出部分结果附有 Lean 证书但几乎没有人类读懂这些证明。数学与人工智能咨询组织 AHM 就 OpenAI 于 10 月 6 日发布的手稿仓库发表声明,称一次性放出超过 700 个文件并非学术展示而是权力展示,指出 OpenAI 自称其合法性来源的咨询小组曾明确表示前沿 AI 公司不应在内部模型上测试高难度数学问题,而 OpenAI 无视了这一核心前提,呼吁数学家停止与 OpenAI 合作,并提醒数学界与公众对该发布模式的价值保持怀疑。The Information 后续报道分析称,AI 能解出超难数学题的原因包括数学解答像代码一样可被验证、数学与 AI 研究者工作高度重叠,以及充足算力让模型能完成人类需数年才能完成的繁重计算且不会放弃,一名参与建议 OpenAI 公开数学突破的数学家称这类能力为“蛮力与耐力”。最新报道称,人类数学协会(Association for Human Mathematics)呼吁抵制 OpenAI;次日 OpenAI 因一处符号错误撤回了其中三篇论文;菲尔兹奖得主 Terence Tao 警告,AI 对开放问题的批量收割会让数学的若干分支失去活力。