OpenAI 722 篇数学论文:AI 证明还是营销?
OpenAI 在 GitHub 上发布了 722 篇 AI 生成的数学论文,声称在朗道-西格尔零点猜想等难题上取得进展。但数学界对此保持审慎态度,并非所有人买账。
这不仅仅关于论文的一纸发布
10月6日,OpenAI将722篇数学论文上传至GitHub,其中大部分附带了用Lean编写的形式化证明——Lean是一种定理证明语言,已成为机器可验证数学的黄金标准。 headlines所宣称的——公司前沿模型在朗道-西格尔零点猜想相关问题上取得进展——如果真的站得住脚,将是足以重塑解析数论格局的结果。
然而与OpenAI以往的数学声明一样,关键全在那个"如果"上。
朗道-西格尔为何重要
朗道-西格尔零点猜想地处数论中最深刻的两个问题之交:素数分布与L-函数的行为。粗略而言,它在追问:某些L-函数是否在s = 1附近存在一个异常接近的实零点——所谓的异常零点。若此类零点存在,将对类数公式、素性判定以及支撑现代密码学的解析数论更广阔架构产生连锁反应。
无人证明该猜想。亦无人彻底排除异常零点的可能性。OpenAI声称其模型产出了与该问题"相关"的结果,这一事实之所以引人注目,正是因为它表明模型触及了一个容不得半点差错的数学领域——一步走错便可能使整个论证功亏一篑,而门槛本就极高。
论文背后的流程
据OpenAI称,这722篇论文来自对约4,000道未解决问题在一款未公开模型上进行评估后的结果,经过筛选后保留了被认为足够重要的成果。每篇论文平均消耗的计算资源,相当于ChatGPT Pro思考模式三小时的工作量。其中两道结果——一道关于ζ函数零点,另一道关于复乘阿贝尔簇上的霍奇猜想——被明确列为标准流程之外的例外。
这种透明度其实相当罕见。大多数AI生成的研究成果并不附带如此详尽的流程披露。OpenAI还发布了其中10篇论文的推理过程,主题涵盖从π的有理性度到特征2下Tokaplansky直接有限性猜想,再到量子海森堡铁磁体中的自磁化现象。
但推理过程的关键在于:它展示的是模型走过的路径,而非这条路是否正确。在纯数学中,一个看似合理的推导完全可以隐藏一个只有人类专家才能察觉的微妙错误。
Lean之问
OpenAI表示,722篇论文中"许多但并非全部"包含Lean形式化证明。公司承认未经形式化的结果可能存在错误,并承诺一旦发现问题将予以修正。这种做法既诚实又具战略意义:Lean证明是机器可校验的;没有它们,一个结果的可信度取决于它能吸引到的同行评审——而目前,针对AI生成数学成果的同行评审机制几乎处于空白状态。
这一区别至关重要,因为数学界在过去十年里正是为了消除歧义而将Lean打造为验证工具。一份尚未形式化的AI生成证明,与其说是定理,不如说是一个信心十足的猜想。
AGMAI: advisory,而非背书
数学与人工智能 Advisory Group(AGMAI)成立于今年9月,为OpenAI的披露流程提供了指导。其在9月29日发布的建议相当详尽:在外部托管仓库中注册、披露模型名称与提示词、公布推理摘要与计算成本、使用Lean进行形式化、说明筛选方法与失败的尝试。
随后,AGMAI几乎立刻收回了大部分建议。在其针对OpenAI最新发布的回应中,该小组强调其建议并非对结果的背书,不代表数学界,且评估工作属于数学家——而非AI公司或其顾问委员会。
这一保留条款意义重大。这意味着OpenAI为此次发布建立可信度的框架,同时也在内容与自身之间划清了界限。这相当于数学界的"我们促成了这场对话,但我们没写过那些台词。"
模式即是故事
这并不是OpenAI第一次就大胆的数学声明大张旗鼓。今年9月,公司宣布其内部模型已解决了纳维-斯托克斯存在性与光滑性问题——七道千禧年大奖难题之一。跟进该声明的数学工作者认为其中存在问题,争议迫使公司作出回应。同期,OpenAI还称其内部模型已解决了100余道未解决问题。8月,公司报告利用一款代号为Astra的内部版旗舰模型,在10道问题上取得了新成果。
而在2025年10月,一名公司高管发帖声称GPT-5已解决一道埃尔德什问题,在引发强烈反弹后被删除。
模式已然清晰:OpenAI反复宣布突破,而数学界对此深表怀疑。每一次,公司都会增添更多透明度机制——顾问委员会、Lean形式化、GitHub仓库——但核心张力仍未得到解决。AI可以大规模生成数学成果,而人类数学家只能以有限的速度进行验证。这两者目前完全不在一个节奏上。
谁受益,谁受损
即便这722篇论文中只有一小部分经受住同行评审,受益者将是那些 suddenly 获得新工具来探索猜想领域的解析数论学者。朗道-西格尔猜想、复乘阿贝尔簇上的霍奇猜想,以及列表上的其他若干问题,都是正当的开放性问题,任何进展都极具价值。
受损者则是那些不得不从AI生成成果的洪流中辨别信号与噪声的数学家。学界并未寻求这场倾盆大雨,而现有的同行评审基础设施也根本无力应对如此规模的冲击。
无论论文最终能否站住脚,OpenAI都是赢家。公司已经确立了一种新的模板,定义了AI公司如何宣布科学成果——一套外表光鲜的透明度表演,恰好催生此次发布已获得的那种头条新闻。
接下来会发生什么
OpenAI表示将资助研讨会和专项项目,帮助数学家理解AI生成的成果,并称正致力于对该模型负责任地向公众发布。这两步都是合理的举措。但真正的考验更为简单:独立的数学家是否验证了那些Lean证明?未经形式化的结果是否经得起推敲?
朗道-西格尔猜想不会被一次GitHub上传所解决。它将由一条其他数学家能够检查、质疑并在此基础上推进的推理链条来解开。AI可以助力这一过程。但眼下,OpenAI的722篇论文更像是一批规模庞大的研究提案,而非一批已验证的成果。
至于究竟是哪一种,将由数学界来裁决。而这正是AGMAI免责声明的全部意义所在。