science 10 分钟阅读

OpenAI 新聘数学顾问团队是其迄今为止最巧妙的公关举措

OpenAI 招募了九位顶尖数学家对其声称已解决超过100个未解问题的成果进行审核。这个顾问小组无权放慢公司的步伐——但它确实为这些主张披上了一层数学界迫切渴望的认可外衣。

  • KakaoAI
  • Noam Shazeer
  • Motif
  • 伽罗瓦逆问题
  • Lean

看似让步的审计

9月21日,OpenAI宣布成立一个由九位数学家组成的独立顾问小组,总部设在普林斯顿高等研究院。成员中包括剑桥大学的菲尔兹奖得主蒂莫西·高尔斯(Timothy Gowers),以及IAS的菲尔兹奖得主爱德华·威滕(Edward Witten)和马丁·海雷尔(Martin Hairer)。该小组的正式名称——“数学与人工智能顾问组”(Advisory Group on Mathematics and Artificial Intelligence)——听起来像一个学术机构。但它并非如此。

OpenAI还透露,一款内部模型(其训练始于8月28日)已在数学的几乎各个分支中解决了超过100个悬而未决的问题。其中包括纳维-斯托克斯存在性与光滑性问题——七大千禧年大奖难题之一,附有100万美元奖金。该公司此前在8月曾披露,一款代号为"Astra"的模型已解决了其中的十个问题。新数字是旧数字的十倍。

妙处就在这里。OpenAI将数学界一直要求的——外部审查——递交到了他们手中,但同时完全掌控着何时、如何,以及这些成果是否经过同行评审。

迫使就范的反噬

这个顾问组并非凭空出现。在一份题为《AI在数学领域的严重错位》(A Severe Misalignment of AI in Mathematics)的公开信中,二十五位菲尔兹奖得主警告称,该领域正被拉入陷阱。他们担心的并非AI会解决难题。而是解题这种行为——没有证明、没有背景、不与现有文献互动——正在成为衡量AI进展的指标。

数学不是竞技体育。对开放问题的正确答案,若没有可验证的论证,毫无价值。当AI系统开始产出无法检验的解时,整个学科的知识传递机制便会崩溃。这正是数学家们所抗议的。

OpenAI听到了反对意见。它只是将回应重新包装为"合作"而非"顺从"。这一区分至关重要,因为它将叙事从防御转向开放——而OpenAI已花了数年将这一叙事铸入品牌。

这个小组能做什么与不能做什么

关键在于细则。顾问组将就如何评估和发布OpenAI的数学成果提供建议。他们会就研究规范发表意见,并就工具应服务于学习还是研究提出看法。但OpenAI明确表示,该小组不对公司数学研究的节奏提供建议。

成员不从OpenAI领取报酬。他们可以主动提供建议。他们可以在公开场合批评公司对数学的影响。这些都是真正的自由。但它们都无法回答核心问题:谁来决定一个声称的解是否真的是解?

答案依然是OpenAI。顾问组可以说公司是否应该公布其发现,以及如何公布。但他们不能说这些发现是否为真。正是这一区分将问责制转化为了合法性的机器。

想想这种结构性不对称。OpenAI控制数据、模型和时间线。顾问组处于距离之外——他们可以观察和评论,但无法通过传统渠道独立验证输出成果,因为OpenAI尚未同意共享原始模型产物或训练流程。这不是疏漏;这是公司自己划定的明确边界。

谁赢谁输

OpenAI赢得最多。他们在不丧失控制权的前提下获得了背书架构。一旦这个小组——尤其是其高曝光度成员——开始验证具体成果,每项声明都将附带此前不存在的机构分量。即便小组措辞谨慎,也将发挥事实上的信号放大效应。蒂莫西·高尔斯说出"我们认为这些成果值得进一步调查"这样一句话,在他一言即可左右资助与招聘格局的领域里,具有不成比例的分量。

小组中的数学家获得了平台,但也承担了风险。他们的名字如今已与其广泛社群已标注为可能空洞的声明相邻。如果小组背书的结果日后在 scrutiny 下瓦解,声誉损失不会仅限于OpenAI。它将波及那些信任其判断力的人。一些潜在参与者已日益意识到这一动态——据报道,数位资深人物曾被接触但均予拒绝,理由是学术独立与企业 proximity 之间的冲突。

更广泛的数学界获得了一个他们所要求的渠道,但这是一个单向通道。OpenAI尚未同意将其成果提交传统同行评审。顾问组是一条替代路径——更快、更可控、且根本上是不对称的。公司生产,小组包装建议,社群接收。

还有二阶效应需要考虑。那些苦苦挣扎于吸引纯数学研究生的大学系所,现在可能面临将AI生成成果纳入课程的压力——不是因为成果已经过验证,而是因为市场要求如此。资助机构可能会悄悄调整其优先事项。那些花数月啃噬单个定理的博士后,其职业轨迹可能在与一个两个月产出一百个解的系统比较中被低估。顾问组并未制造这些压力,但它将被视为使这些压力正常化的生态系统中的一部分。

接下来会发生什么

立即可见的测试是发表。该小组已搭建一个表单,收集数学家关于如何处理OpenAI所称的大量重要成果的意见。 operative word 是"重要"。OpenAI自行对其成果进行分类。顾问组就时机和框架提供建议。该领域的其余人则被邀请通过网页表单发表评论。

如果OpenAI的主张即便经过一轮温和的独立验证仍然成立,其先例将是巨大的。解决一道千禧年大奖难题,将成为自DeepMind在蛋白质折叠方面工作以来数学领域最为显眼的AI里程碑。它将重塑什么才算智力成就的等级秩序,并迫使人们直面人类专业性与机器生成之间的关系。克拉数学研究所颁发的100万美元奖金——至今仍只授予人类——如果一台机器率先声称给出了解,将成为一个象征性的遗物。

如果这些主张经不起检验,顾问组将成为一个案例,展示机构信誉如何在未 earned 的情况下被借用来使用。我们在此前的其他领域见过这种模式。被行业俘获的科学顾问委员会曾为争议性发现披上虚假精确的外衣,从烟草到制药莫不如此。这里的不同在于, stakes 是认识论层面的,而非商业性的——数学的真理性不可协商,而该领域终将把信号与噪声区分开来,无论包装多么光鲜。

支撑这些成果模型的训练自8月下旬开始。大约两个月。在如此短的时间窗口内宣称解决了超过100个开放问题,不仅大胆——它们超出了该领域从任何来源、人类或机器,所见识过的一切。现在的责任完全转移到顾问组身上,要求他们公布一份关于哪些内容真正经过验证、哪些仍未验证、以及公司选择不共享什么的公开说明。

突破与新闻稿之间的界限在AI领域向来模糊。OpenAI刚刚组建了一个数学家委员会,让它变得更加模糊。