新论文称 Lean 验证不能为 OpenAI 的 Navier-Stokes 自然语言证明背书
剑桥大学与伦敦国王学院的研究者发表论文,论证 AI 自动形式化无法保证语义忠实,因此 Lean 对 OpenAI 所宣称 Navier-Stokes 方程解爆破证明的形式化验证,不能证明其自然语言证明正确。作者指出,消解数学自然语言歧义所需的难度在可解性复杂度层级(SCI)中为无穷大,比停机问题(SCI=1)更难,并给出多个 AI 把自然语言陈述与证明翻译成 Lean 时发生错译的实例。在 OpenAI 的 Navier-Stokes 证明中,Lean 形式化与自然语言论文并不对应:论文 Lemma 8.6 的估计用 m+4 阶导数,而对应 Lean 定理 norm_derivativeWord_inverse_le 用了 m+5 阶导数,结论更弱;压力通量估计(10.19)的界与证明思路也与 Lean 版本不同。
推荐理由论文用可解性复杂度层级论证语义忠实的自动形式化比停机问题更难,并给出 OpenAI Navier-Stokes 证明中 Lean 与自然语言不一致的具体例子。