人工智能放缓协议:披着安全外衣的权力博弈
科技巨头已达成共识,放缓人工智能开发节奏,但安全承诺与反垄断担忧交织缠绕。核心问题是:当行业自己制定规则时,究竟谁会受益?
看似围栏的盟约
在一项引发即时质疑的周末协议中,山姆·阿尔特曼、达里奥·阿莫迪、杰米斯·哈萨比斯和埃隆·马斯克承诺对人工智能开发进行"前沿管控"。该提案由阿莫迪的文章加以充实,呼吁在实验室内部引入第三方审计员、实施国内监管,并达成全球性放缓协议。表面上看,这像是负责任的行业走向成熟;在实践中,它更像是一道护城河。
怀疑者很快便将其命名为卡特尔。这四位首席执行官控制着地球上算力最密集的几家前沿实验室。如果他们集体决定放缓步伐——同时嵌入由其选择的审计员,并推动主要适用于同等规模实验室的规则——他们管理的就不只是风险,而是竞争。
开源社区立刻感受到了刺痛。小型实验室和独立开发者多年来一直在开发对前沿形成压力的模型。一项只针对最大参与者的自愿放缓计划听起来或许公平,但只要你注意到是谁划定门槛、谁来选择审计员,就能发现问题所在。
安全担忧是真实的。激励机制却更复杂。
人工智能实验室内部的警报并非捏造。Anthropic、OpenAI 和 Google DeepMind 的研究人员曾公开警告称,递归自我改进——模型能够在无需人类干预的情况下训练并推进自身的阶段——可能比任何人承认的都要更近。Anthropic 表示其可能最早于 2027 年初到来。OpenAI 首席科学家确认公司正将大量资源投向这一里程碑。Jacob Coxon 辞去 Anthropic 职务的辞职信在 X 上被观看超过 1.7 亿次,信中描述了一种在迈向自我改进型超级智能的过程中狂奔、而将灾难性风险视为附带损害的企业文化。
这一背景很关键。这些高管并非在本周末才发现恐惧。他们早在数月间就一直在聆听自家研究人员发出的相同警告——Coxon 的信件让这些警告变得无法再被忽视。
领导 AI 未来项目(AI Futures Project)并曾任职于 OpenAI 的丹尼尔·科科塔伊洛直言不讳:外部人士多年来一直在呼吁此类放缓。超过 1000 名 AI 实验室员工在今年 7 月签署了一封公开信,要求在 OpenAI 与 Hugging Face 事件后暂停研发。如今,这些首席执行官正在采纳这些诉求,并将自己的名字附于其上。
这究竟是真正与安全研究保持一致,还是战略性的收编,取决于接下来会发生什么。自愿框架的记录向来不佳。尼克·里斯曾担任国土安全部新兴技术政策主任,现任纽约大学兼职教授,他将行业此举比作十年前的社交媒体做法:在他人替你制定更糟规则之前,先提出你自己的规则。
监管真空让一切更加顺理成章
时机绝非偶然。在当前政府之下,全面人工智能监管可能性不大。特朗普曾公开将人工智能风险称为"骗局",指称近期安全关切系捏造,并在一次会议的免提通话中对英伟达的黄仁勋表示,人工智能唯一需要的护栏就是一位强有力的总统。白宫已同意对模型进行有限的事前审查期,但这只是有限的让步,而非一整套制度。
在这种环境下,行业自律成了默认选项。卡特尔问题便不可避免地浮出水面。当狐狸来制定鸡舍的规则时,监管俘获不是阴谋论——而是基本假设。
技术监督项目(Tech Oversight Project)执行董事萨查·霍沃斯措辞严厉。她称自愿框架本质上就是监管俘获,并 arguing 国会不应再次将责任外包给行业。政治诚信项目(Political Integrity Project)的丹尼尔·洛博-刘易斯则预言其将遭遇与 Meta 监督委员会相同的命运:一个足以显得可信却无力改变任何事情的机构。
中国这张牌
讨论人工智能治理若抛开中国则无从谈起。这是最古老也最持久的论点。政客和高管们都以北京为证,证明美国不能承受放缓的步伐。有一条 X 帖子原话道出了这种情绪:“如果我注定死在杀手 AI 手中,我希望它是美国的,而非中国的。”
中国官员随即反驳。外交部发言人郭嘉昆将放缓言论斥为"制造恐慌"。其潜台词很清楚:北京不会配合,因此美国应继续竞赛。
但多位专家对此种叙事提出了反对。Midas 项目的泰勒·约翰斯顿指出,假定中国不会协调本身也是一种假设。Redwood Research 的巴克·什莱格利斯认为,鲁莽的开发对任何一方政府都无益处,而关于生存风险技术的国际协调绝非毫无先例——核不扩散就涉及敌对国家在互毁的替代方案前找到合作之道。
霍沃斯走得更远,她称中国论调是一条熟悉的退路。“每当一个行业想要逃避监管,中国就被搬出来当作鬼怪,“她说。科科塔伊洛回忆了一幅漫画:一群人在驶下悬崖的汽车里大喊:“太好了,我们领先于中国。”
重点不在于中国合作有保证。而是"中国牌"已被用来为几乎所有的监管拖延辩护,除非有更强的替代方案出现,否则它将继续被使用。
谁赢,谁输
如果协议按原文落实,赢家将是那些已经坐拥前沿算力最深、资金最厚的实验室。他们获得了一层负责任的外衣,有了延缓竞争对手的借口——对手无力承担同样的审计基础设施——并且抢先塑造那些最终将凝固为法律的任何规范。
输家是开源开发者、小型实验室,以及前沿公司圈外那些被排除在定义何为"负责"之外的任何人。同时也是那些从速度中受益的人——试图指引对齐研究的研究人员、构建安全机制的工程师、努力跟上节奏的记者和政策制定者。
一些专家提出了中间道路,值得密切关注:要求实验室披露并减少用于前沿研究的算力预算,由第三方审计员核实数据。算力是这个行业最接近节流阀的东西。如果能放缓算力,就能以可测量的方式放缓进步;如果能测量它,就能执行它。
这仍然只是一个提案,而非政策。目前的协议是口头且自愿的。如果它能推动对话走向可执行的限制,那是好迹象;如果它成为最终定论,则是坏迹象。
接下来会发生什么
最重要的问题不在于这份协议是否真诚。真诚难以证明,更容易伪造。真正的问题是:行业能否被约束于比一份周末声明更强的东西之上。
里斯点出了结构性难题:掌权者中没有人对最终去向拥有现实的愿景。“我们一直有一个模糊的、未定义的最终状态,“他说。“在没有理解路径、甚至不理解终点线是什么——或者是否有终点线——的情况下,很难想象竞赛。”
这种模糊性正是卡特尔茁壮成长的空间。在没有明确公共标准时,算力最多的人设定节奏;有了标准,他们未达目标时便可以被问责。
美国和国外的监管机构应将当前提案视为起点,而非和解。阿莫迪所勾勒的框架包含有价值的要素——独立审计员、吹哨人保护、可衡量的限制。但历史表明,带有市场权力动机的行业的自愿承诺往往会在压力下软化。下一届政府未必认同特朗普对人工智能风险的 dismiss 态度。如果民主党总统上任并面临内部警告的同样升级,其选择将在弱势自愿体制与真正法律之间。行业当前的举措,最好被理解为一种尝试:在有人要求更强版本之前,先将弱势版本永久化。
这场放缓可能是真诚的。它也可能是围绕一场比赛建起的代价最昂贵的一道围栏——将所有人挡在外面,而既得利益者决定跑多快。