business 9 分钟阅读

OpenAI 称破解千禧年大奖难题,但数学界仍持保留态度

OpenAI 宣布攻克纳维-斯托克斯千禧年难题,这是数学领域最艰巨的挑战之一。数学家们对此表示振奋,但要求严格验证。为什么这场赌注远不止 100 万美元。

  • KakaoAI
  • Noam Shazeer
  • M23
  • 数学
  • Ven Chandrasekaran

无法消散的声明

OpenAI 宣布已解决七大千禧年难题之一——这是一类极其顽固的数学挑战,克莱数学研究所于21世纪初设立这些难题,每道配有一百万美元奖金。其中涉及的难题是纳维-斯托克斯(Navier-Stokes)存在性与光滑性,探讨的是描述流体运动的方程是否会在有限时间内崩溃,从而从完全普通的初始条件中产生无限速度。

9月8日发布的这一公告本身就非同寻常。若一台计算机解决了千禧年难题,那将是人工智能领域的里程碑时刻,其意义将超越科技新闻,进入大众文化范畴。这同时也会让 OpenAI 握有极具价值的声明所有权——至少在数学界最终评估之前,是独享还是共享,取决于学界如何看待这项成果。

但数学界尚未信服。而这一区分的分量,比你想象的更重。

OpenAI 实际说了什么

据该公司所述,其研究人员在9月1日将资源集中到纳维-斯托克斯问题之前,先在其最新 AI 原型上测试了全部六道尚未解决的千禧年难题。据报道,他们部署了1000个 AI 智能体去攻克一个简化版本,并在50小时内完成了求解。随后,他们升级至10000个智能体,以更强大的算力应对完整问题。

OpenAI 计算机科学家 Ven Chandrasekaran 在一次媒体简报会上表示,该证明显示"存在这样的流体,初始状态完全正常,但在纳维-斯托克斯方程下,实际上在有限时间内达到了无限速度。" OpenAI 数学家 Sebastian Bubeck 称这是"我们在过去12个月中见证的问题复杂度不断提升所走向的辉煌顶点。"

这里的关键措辞很重要:OpenAI 声称已生成了解法。但他们尚未称该解法已通过同行评审或独立验证。在数学领域,这一差距就是一切。

时机为何不寻常

此次公告出现在一个异常拥挤的时间窗口中。9月7日,哈佛大学的 Levent Alpöge 和纽约大学的 Tristan Buckmaster 发布了一篇论文,声称使用 Anthropic 的 Claude 以及 OpenAI 自家的 Codex 和 Astra 模型,解决了一个流体运动谜题的版本。他们的结果覆盖了零粘度情形,并表示更一般性的解法即将到来。

同日,加州理工学院的 Anima Anandkumar 及其合作者也发布了另一份零粘度解法,不过是通过物理信息神经网络而非通用语言模型获得。

当代最受尊敬的数学家之一陶哲轩在 Mastodon 上将 Alpöge-Buckmaster 的工作称为"杰出的成就"。但他并未直接评论 OpenAI 的声明。

克莱数学研究所主席 Martin Bridson 发表了一份措辞谨慎的声明:“当我们思考关于数学理解重大进展的公告时,这当然是一个令人兴奋的日子。“注意那个动词——“思考”。不是确认,也不是认可。

验证的鸿沟

千禧年难题的解不止需要一场令人信服的媒体简报或一篇 arXiv 预印本。它需要数学界独立验证论证并认定其正确。这一过程可能耗时数月甚至数年。安德鲁·怀尔斯对费马大定理的证明经历了两年 scrutiny 后才被广泛接受。庞加莱猜想由格里戈里·佩雷尔曼解决,但他的论文在2002年和2003年上线后,又经过了数年的共同体审查。

千禧年难题没有正式的同行评审流程。克莱研究所将评估工作委托给相关领域的专家。这些专家现在将以他们能拿出的最高严谨程度来阅读 OpenAI 的工作——或其产出的成果。

如果该证明成立,OpenAI 及其合作者将共享一项将重新定义 AI 在纯数学领域能力的成果。如果它不成立——或在审查中浮现关键漏洞——这一事件将被铭记为一家 AI 公司过度延伸的时刻。

真正的赌注

一百万美元奖金只是象征。真正流通的货币是可信度。

十余年来,AI 系统一直在游戏、编程竞赛以及日益复杂的推理基准测试中占据主导地位。但数学始终是一个领域——在那里,人类的直觉、创造力以及构建真正新概念的能力,具有模式匹配系统难以复制的分量。一个经核证的千禧年难题解法将粉碎这一假设。它将告诉每一个严肃机构、每一个严肃领域:AI 已跨越了此前无法企及的门槛。

它也将重塑这笔奖金本身的经济逻辑。克莱研究所从未支付过千禧年难题的奖金,因为尚无一道被核证。OpenAI 的声明若获确认,将改变这一历史。

但在可信度之下,还有一个更微妙的问题。如果 AI 能解决千禧年难题,数学家与其工具之间的关系将何去何从?Alpöge 和 Buckmaster 使用了 Claude 和 Codex。Anandkumar 的团队使用了物理信息神经网络。OpenAI 部署了数千个智能体。数学工作的方式正在改变——而从事这项工作的人们,或许并不完全认同这还算不算在做数学。

谁赢谁输

如果声明被核证:OpenAI 将获得一家公司从未拥有过的奖杯。更广泛的 AI 研究领域将获得任何基准测试分数都无法匹配的合法性提升。拥抱 AI 辅助方法的数学家将获得机构层面的认可。克莱研究所面临首次奖金发放。

如果未被核证:OpenAI 在一个它正稳步积累真正好感的领域中声誉受损。数学界可能会在对 AI 生成证明的怀疑上更加坚定。其他希望做出类似声明的公司将面临更高的验证门槛。而"AI 即将解决数学"这一叙事将遭受挫折,可能放缓投资与热情。

最稳妥的预测是,我们数月内无法得知答案。数学界的步伐缓慢且审慎。OpenAI 面临的压力将是尽快发表一份完整、可核查的论证——并主动邀请审查而非回避它。

下一步会发生什么

关注三件事。第一,OpenAI 是否会发布一份以专家可审查形式呈现的完整书面证明。第二,克莱研究所是否会正式将该声明承认为奖项候选人——这是一个将释放高度关注信号的程序性步骤。第三,任何独立验证团队——尤其是那些已在处理相关问题的人——是否会找到漏洞或确认结果。

在此之前,这项声明是一座建立在尚未接受检验之基础上的非凡规模的主张。这不是判决——它是序章。真正的故事仍在书写之中。