OpenAI声称解决纳维-斯托克斯问题突破,但数学界尚未信服
OpenAI宣布其1万个AI智能体在88小时内解决了一个90年难题。克雷数学研究所尚未表态,而即便证明成立,它也可能无法满足真正需要通用解法的工程师们。
所谓成果
9月8日,OpenAI宣布,一款处于开发阶段的AI模型解决了一道困扰人类90余年的数学难题。该公司表示,从9月1日起,他们部署了约1万个自主AI代理,以协同编队形式持续运行88小时,才得出这一结果。在公开声明中,OpenAI将这项成果称为“数学家与AI研究人员长期努力的结晶”。
但OpenAI并未透露具体细节——而这恰恰决定了这是一项历史性突破还是自我标榜的虚荣:他们到底解决了哪道题?解法呈现为何种形态?由AI集群生成的证明能否经受住同行评议?
《日经新闻》的报道将该问题锁定为纳维-斯托克斯方程(Navier-Stokes),即七条“千禧年大奖难题”之一,也被公认为现代分析领域最难啃的硬骨头。该问题追问的是:对于任意一组初始条件,三维空间中是否始终存在光滑且符合物理现实的解?若答案为“是”,则证实湍流永远不会自发产生奇点;若答案为“否”,同样会颠覆认知,证明流体在特定条件下能够自行崩解。
克莱数学研究所目前尚未置评。这份沉默,究竟是审慎,还是难以置信。
为何重要
“千禧年大奖难题”诞生于2000年,初衷正是出于一类现实:有些问题太宏大,单个研究者无力承接;又太基础,绝不能无视。在应用数学家眼中,纳维-斯托克斯问题高居榜单之首。它的解答贯穿一切,从喷气发动机设计到气候建模,再到血液在动脉中的流动。一个完整的答案不仅会重写教科书,还将解锁如今仍停留在理论层面的工程能力。
倘若OpenAI的成果属实,这将是AI具备职业数学家级推理能力的最具分量的证明。不是模式匹配,不是沿着既有文献做定理串联,而是更接近原创性洞察——若真是原创洞察,AI能力的边界将在一夜之间被重新定义。
但“原创性”恰恰是所有人最先要拷问的环节。
真正的问题:主意是谁的?
围绕此次发布的评论普遍聚焦于一个关键分野:AI代理究竟是在借用人类数学家提供的思路,把一条已知路径推演到极致?还是系统自主生成了此前人类从未构想过的全新数学概念?
这绝非字面游戏。它决定了这一事件只是一个令人印象深刻的工程里程碑,还是机器推理能力的真正跃升。两种可能带来的后续影响天差地别。
建立在人类直觉之上的证明,验证的是一项工具;建立在机器生成直觉之上的证明,验证的是一种全新的心智。两者都意义重大,但只有后者才会迫使我们重新审视:数学发现本身,是否已经发生了质变。
截至目前,OpenAI拒绝完整公开该证明。他们称该模型仍处于开发阶段、尚未发表。这种透明度缺失难免引人猜疑。数学界从不靠信任来接受成果。
工程师的隐忧
即便假设该证明经得起检验——这本身就是一个巨大的前提——还有一个更安静却不可忽视的局限。纳维-斯托克斯千禧年问题存在多种表述形式。一般的存在性与光滑性定理针对的是最抽象的版本,它本身并不能直接给工程师一套可嵌入仿真的构造性解法。
流体力学专家需要的是能在各类物理条件下实用、算法化的湍流计算方法。无论多么优雅,纯存在性证明给不了他们这个。如果OpenAI的方法产出的是这类结果而非完整的构造性框架,数学界或许会欢呼,而工程界则会转身去用下一件工具。
这并非纳维-斯托克斯独有的困境。纯数学与应用效用之间的鸿沟一直存在,AI生成的证明也同样继承这一局限。
接下来会发生什么
关键在于通过三道门槛。
第一,验证。任何独立团队——无论是高校、研究机构还是克莱研究所内部——都必须能够复现或审计该证明。OpenAI动用1万个协同代理,意味着整个证明生成过程是分布式且可能不透明的。可复现性将取决于公司是否愿意公开代码、模型权重以及从第一性原理推演至最终结果的中间推理轨迹。截至发稿,这些均未对外提供。
第二,同行评议。数学界按正式出版运作,而非新闻稿。arXiv上的预印本只是最低门槛,期刊发表必须经过匿名评审。OpenAI的声明提及与数学家合作,这或许意味着证明已通过某种内部关卡,亦或许是向外界发出的审查邀请函。
第三,克莱研究所的评定。千禧年奖金每项虽为100万美元,但更重要的是其机构权威性。克莱研究所的评委会目前因多数奖项未拨付而处于空缺状态;但若它能召集开会并审阅此项工作,无论是否正式授奖,其裁决都将主导舆论走向。在这些问题上,数学界历来尊重克莱的结论。
谁赢谁输
若证明获验证,OpenAI将摘得AI推理史上最耀眼的成就。它将超越该系统乃至所有AI历史上创下的所有基准纪录。公司的估值、招聘号召力以及对政府的谈判筹码都将随之重塑。
数学界则陷入一种悖论:得失并存。得,在于获得一个能自动化繁琐证明工作、甚至催生人类遗漏猜想的新工具;失,在于“发现专属人类直觉”的浪漫叙事将破灭,定理证明相关岗位的劳动力市场也会收缩——无论人们是否愿意接受这一结果。
应用科学领域——航空航天、气象、能源——则处于观望状态。纯证明不等于实用求解器。这些行业会等看完后续再说。
核心结论
OpenAI的这次发布,是一则注定成为传奇或注脚的头版新闻。其技术路径本身并不离奇——大规模代理集群本就是当前领域的前进方向。真正的障碍在于认证。一套由AI舰队生成、单个人类无法逐行跟踪的证明,在字面意义上就是“不可信”,直到有人把它一行一行重建出来。
若这88小时的推演受人类主导,那它只是工程学的胜利;若代理们真构思出全新之物,那就是另一回事了——而数学界天生多疑、文化上高度设防,绝不会在每一个符号都被核验之前轻易让步。
克莱研究所的沉默,已经说明了一切。他们清楚一个成立的纳维-斯托克斯证明会怎样改变世界,也同样清楚这条路上曾有过多少次误判与过度承诺。