跳到正文
原文
TechCrunch AI· Tim Fernholz·本站收录 · 原文发表

OpenAI 发布的数学解答未达到学界标准

OpenAI’s math solutions aren’t meeting the field’s standards yet

AI 导读

OpenAI 本周发布数百份高难度数学问题解答,但未完全符合普林斯顿高等研究院 AGMAI 九月底提出的规范。AGMAI 的首要建议是停止在专有模型上测试高等数学问题,而 OpenAI 明确表示正用开放研究问题评估其专有模型。719 份手稿中仅 10 份公开了模型的思维链,42% 的证明未经过形式化。剑桥大学与伦敦国王学院数学家的新论文记录了 OpenAI 针对 Navier-Stokes 方程衍生问题的解答中,自然语言证明与 Lean 代码之间至少两处不一致,认为这类自动形式化证明在未经同行评审前不应被直接信任。数学家 Terence Tao 与哈佛大学教授 Melanie Wood 均指出,模型给出解答时人类尚未理解结果,后续工作才刚开始。

相关论文
阅读原文techcrunch.com