science 9 分钟阅读

OpenAI宣称已破解纳维-斯托克斯方程——但这为何让你不安

OpenAI声称其AI模型用10,000个智能体和130万亿token破解了数学界最难的难题之一。但证明背后的思想归谁所有——以及数学本身是否真的成立?

  • Noam Shazeer
  • Anthropic
  • GitHub下架
  • Lean
  • 数学
  • 流体力学

声明内容

OpenAI 于 9 月 8 日宣布,其未公开的 AI 模型已解决了纳维-斯托克斯存在性与光滑性难题——这是克莱数学研究所七大千禧年大奖问题之一。公司称,他们部署了约 10,000 个 AI 智能体,历时 88 小时,消耗了 130 万亿个 token,最终生成并验证了一份 165 页的证明。如果这一结果能通过同行评审,它将成为继格里戈里·佩雷尔曼 2003 年解决庞加莱猜想之后,第二道被解答的千禧年大奖难题。

这一影响令人震撼。纳维-斯托克斯方程控制着液体和气体的运动规律,是天气预报、飞机设计、海洋学和气候建模的数学根基。一个得到确认的解法将不仅仅是解答一道数学题——它将重新校准人类预测和 engineered 一切流动现象的方式。

但在庆祝之前,有几件事值得审视。

证明究竟说了什么

据 OpenAI 引用的一份报道,该 AI 模型识别出了纳维-斯托克斯方程会出现崩溃的具体条件——在某些时刻,静止水中微小的涡流在理论上会在有限时间内加速到无限速度。在数学中,得出无穷大的结论意味着奇点的存在,即方程变得无定义、光滑性证明失效的点。

因此,AI 的发现并不是说这些方程是错的,而是说它们存在一个漏洞——一个无法保证平滑、可预测行为的数学空白。事实上,这正是千禧年大奖问题所追问的含义之一:解是否永远保持光滑,还是可能形成奇点?OpenAI 的模型似乎给出了后者的答案。

这本身已经是一个引人注目的结果,但背后的机制引发的疑问多于解答。

速度过于可疑

公告时间线上的几个细节值得注意。

据报道,Anthropic 的研究人员也在从事相关的流体力学问题。当 OpenAI 的突破消息传出后,据称 OpenAI 在周末联系了纽约大学的数学家特里斯坦·巴克马斯特(Tristan Buckmaster)和 Anthropic 的研究员莱文特·阿尔波格(Levent Alpoge),讨论协调联合发表。然而,巴克马斯特抢先在网上发表了自有初步结果。几小时后,OpenAI 才发布了论文。

这一顺序并不寻常。千禧年级别的成果通常在发布前会有数年与少数专家之间私下交流的过程。这种周末 simultané 竞赛要么意味着非凡的准备,要么意味着巨大的压力。它同时也引出了一个显而易见的问题:究竟谁先得到了这个结果,依据又是什么?

知识产权问题真实存在

巴克马斯特在自己的研究过程中使用了 OpenAI 的 AI 模型。他提出了这样一种可能性:他输入到系统中的某些想法或提示词被吸收进了模型的优化过程,随后作为证明的一部分回馈给他。OpenAI 称,它是通过自己的 10,000 智能体管道独立生成了这份证明,否认使用了任何用户贡献的洞见。然而,该公司的措辞并未做到绝对否认——它承认用户数据会融入通用改进循环,且无法以 100% 的确定性排除间接使用的可能。

这不是一个无关紧要的文字游戏,它触及了 AI 驱动发现应如何归属的核心问题。如果一名研究人员将一项新颖的猜想输入一个专有系统,而该系统随后基于该猜想生成了证明,那么这项成果归谁所有?研究人员?公司?还是两者都不?数学界目前还没有明确的框架来回答这个问题。

与此同时,Anthropic 表示,他们研究的是一个相关但不同的流体力学问题,而非千禧年大奖问题本身的表述。这一区别在法律上或许重要,但很难缓解更广泛的问题:当两家 AI 实验室在重叠的问题和工具上竞速时,独立发现与借鉴洞见的边界究竟在哪里?

数学能在同行评审中存活吗?

最重要的问题仍然是未解的。一份由 AI 生成的 165 页证明并不自动有效。克莱数学研究所从未接受过 AI 生成的证明作为验证依据,数学界坚持每一个步骤都必须有人类可验证的逻辑。截至本文撰写之时,尚无独立的同行评审完成。

历史提供了值得警惕的先例。2022 年,一个团队声称使用 SAT 求解器解决了完美哈希问题,但这一结果经历了数年精心的人类验证才被认可。2024 年,AI 系统在若干组合学问题上产出了有前景但 ultimately flawed 的方法。模式是一致的:AI 可以发现人类遗漏的模式,但同样可以构建出看似优雅却暗藏错误的论证。验证不是可有可无的选项。

如果这份证明经得起 scrutiny,其对应用科学的后果将是巨大的。气候模型依赖纳维-斯托克斯模拟,目前的模型之所以近似湍流,正是因为精确解尚未可知。一份关于奇点形成的验证证明将迫使工程师从根本上重写关于阻力、热传递和大气动力学的建模方式,同时也会使某些模拟技术在定义上变得不可靠。

接下来会发生什么

接下来的几个月将决定这个故事是一个里程碑还是一次失误。

数学家们将逐字逐句审阅那份 165 页的文件。克莱研究所将决定是否启动正式验证程序。巴克马斯特和阿尔波格很可能发布各自的分析。Anthropic 可能会就发表竞赛作出回应。而 OpenAI 的模型——目前仍未公开——要么揭示其方法论,要么继续作为一个黑箱,其输出仅凭信任而被接受。

此外还有一个更大的制度性问题。如果一家 AI 公司能够在不披露模型架构或训练方法的情况下解决一道千禧年大奖难题,这对开放科学意味着什么?数学界始终遵循的原则是,证明必须透明且可复现。一份没有任何数学家能够完整追溯的 AI 生成证明,有可能破坏这一契约。

底线

OpenAI 的公告要么是十年来最重要的数学突破,要么是一个过早庆祝的案例研究。其主张大胆,时间线存有争议,知识产权影响未经检验,数学有效性尚待验证。

唯一明确的是,AI 辅助研究与 AI 驱动发现之间的界限已经超越了大多数机构的预期。纳维-斯托克斯问题已让数学家们束手束脚两个世纪之久,而一个 AI 系统声称仅用 88 小时便将其解决。无论这一主张能否站住脚,它所引发的关于所有权、验证和透明度的辩论,将在未来数年内塑造数学研究的模样。