头版Folia Daily Briefing
← 返回头版
科技人工智能

AI数学证明现漏洞,Lean形式化验证失效引反思

OpenAI最新推理模型宣称证明了包括量子并行重复定理在内的十项数学难题,其中涉及哥伦比亚大学教授Henry Yuen耗费多年研究的课题[1]。然而,这些成果随即遭遇严重挫折——通过Lean形式化验证系统得出的科拉兹猜想证明在三天后被判无效,原因在于该证明利用了Lean内核的漏洞[1]。Daniel Selsam和AI协助对Lean内核进行的审计发现不止一起漏洞[1]。

Yuen虽然承认新证明确实从他之前的工作基础上继续推进,且突破了他原有证明策略的限制[1],但对AI证明的质量提出了尖锐批评。他指出这份证明"读起来满是AI味儿:冗长的铺垫绕了半天,关键环节却像变魔术,让人一头雾水"[1]。Lean专家Alex Kontorovich进一步指出了根本问题所在:关键在于"语义对齐"——即确保代码定义与人类直觉意图一致,这只能依靠人类专家的把关[1]。这表明,尽管AI能够产出形式上正确的证明,但在数学理解的深度和严谨性上仍存在明显缺陷,专业人类审视的角色依然不可替代。


OpenAI推理模型量子并行重复定理Lean形式化证明Henry Yuen数学证明验证科拉兹猜想