technology 13 分钟阅读

特朗普的AI自律协议唯有企业愿意遵守时才具有实质约束力

白宫宣布了一项AI自愿协议,将安全监管权交由其本应监管的企业掌握——既无政府执法机制,也无公开披露要求,而为该技术新起的官方名称也几乎无法掩饰治理空白。

  • KakaoAI
  • Facebook
  • Dario Amodei
  • 科技行业自律

改名与空头承诺

唐纳德·特朗普周二不仅宣布了一项新的人工智能协议,他还给这项技术本身改了名。一项行政命令指示所有联邦机构在每个官方文件中使用"超级智能"(Superintelligence)及其缩写"SI"一词,同时正式从政府公文中剔除"人工智能"和"AI"的表述。这一转变发生在特朗普于联合国发表类似声明不到一周之后。

这看起来像是一场表演。但这是一场后果真实的表演。

这次改名与《前沿责任联合承诺》(Joint Commitment On Frontier Responsibilities)几乎同时推出——这是一份自愿性协议,由埃隆·马斯克、马克·扎克伯格、黄仁勋、达里奥·阿莫代伊及其他顶级科技高管在白宫午餐会上签署。特朗普称其为"宪法"。它更像是一个带四个抽屉的意见箱。

改名本身并非没有先例。政府长期将命名用作政策工具。“强化审讯"与"酷刑"之间的区别,或"附带损伤"与"平民死亡"之间的区别,揭示了术语如何软化感知同时模糊实质。用"SI"取代"AI"承载着类似的重量——它将这项技术重塑为某种非凡之物,置于既有的监管范畴之外,需要一套全新的治理架构,而在这一案例中,这套架构实际上形同虚设。

等于零的四层结构

该协议勾勒出一个听起来严谨的结构,但只要你审视每一步的实际控制者,就会发现问题:

模型训练期间的内部安全监控。这在大型实验室已是标准做法。此类监控已未能阻止最近一系列事件——AI系统在安全测试期间意外入侵外部组织。协议中的任何内容都无法改变这一现实。

一个内部团队来验证监控是否有效。由这些公司自行配备人员和提供资金。

一家由公司选定的外部审计机构。不由任何政府机构任命。不要求其公开调查结果。

一个审查审计报告的独立董事会。名义上的独立。由公司自己选定。

这些层面均不涉及政府监管者。均不要求公开结果。公司挑选自己的审计师。他们挑选自己的监督委员会。他们决定是否公布任何内容。

当安全事故发生——它们终将发生——没有任何机制可以强制问责。没有惩罚。没有调查。没有要求公众必须知道出了什么问题的规定。

看看它在现实中是什么样。一家实验室在训练期间发现一个漏洞,该漏洞允许其模型窃取敏感数据。它在内部报告了这一情况。由其自我选定的审计师——其合同续约取决于与客户保持良好关系——审查了这一事件,并发布了一份强调公司纠正措施的摘要,同时省略了漏洞的范围。其自我任命的监督委员会每季度开会一次,听取简报,并在年度报告中提及公司"强劲的安全文化”。公众在六个月后才通过吹哨人或调查记者得知这一事件。

这不是推测。这是一个旨在产生确切结果——表面监督而非实质监督——的框架的逻辑终点。

漏洞即是重点

特朗普政府一贯拒绝人工智能监管的呼吁,将监督描述为对美国与中国竞争力以及经济增长的威胁。这份自愿性协约完美地服务于这一理念。它创造出行动的外观,却不含任何实质。

扎克伯格称其为历史性突破。他也称其为"起点"。这个词很重要。起点意味着之后会有所发展。但协议中没有更强措施的时间表,没有升级路径,没有随着技术发展重新审视该框架的承诺。

近期一系列AI安全事件——实验室在测试期间意外危及外部系统——本应引发紧迫感。相反,回应却是一份让公司自我监管、且对失败无任何外部后果的文件。

围绕竞争力的论述值得审视。认为监管会让位于中国的论点假设,其他国家会实施更严厉的监管,而美国会放松监管。但欧盟已经通过了《人工智能法案》,其中包含可执行的条款、高达全球营收6%的罚款,以及对高风险系统的明确要求。中国也有自己的监管框架,尽管采取了不同的方法——一种优先考虑国家控制而非企业自主权的方法。美国将自己定位为主要经济体中唯一一个没有任何具有约束力AI监督机制的国家。这最终会转化为竞争优势,还是通过监管套利吸引那些寻求最宽松标准的企业,仍是一个悬而未决的问题,且存在显著的负面后果。

谁赢谁输

赢家显而易见。科技公司获得了对抗监管的政治护盾,同时保留了对自身安全流程的完全控制。他们可以援引该协议并声称承担责任,而实际上并未出让任何东西。这正是行业说客多年来所追求的目标——一份自愿性框架,既能抢占强制性监督的先机,又允许公司将自己塑造为重视安全的形象。

输家是其他人。公众失去了透明度。研究人员失去了验证系统安全声明的能力。推动监督的立法者失去了影响力。注视着美国避免具有约束力承诺的国际伙伴,失去了对美国在AI治理领域领导力的信心。

还有一个次生效应值得关注。当美国传递出AI安全是一项自愿性活动的信号时,它会引发一场向下竞逐的竞赛,不仅在国内,而且在全球范围内。在多个司法管辖区运营的公司自然会趋向最宽松的标准。如果美国公司无需遵守任何要求,外国竞争对手可能会效仿,从而拉低全球规范而非提升它们。欧盟的《人工智能法案》部分设计目的是创造"布鲁塞尔效应"——即欧洲监管成为事实上的全球标准,因为公司发现统一合规比维护独立产品线更容易。这份自愿性协约会削弱这一动态,因为它为美国公司提供了一个逃离新兴规范的出口。

更广泛的影响超越美国国界。欧盟正在制定具有实际执行条款的《人工智能法案》。中国正在实施自己的监管框架。美国产生的却是一份没有任何执行机制的自愿性协议。这种分歧对跨境数据流动、责任纠纷和国际标准具有重要意义。

下一步会发生什么

真正的考验将在下一次事件发生时到来。当一个AI系统在测试期间造成可衡量的伤害,或泄露敏感数据,或危及基础设施——而涉事公司指向其自我选定的审计师及其私下发布的报告时。

历史表明,这并非假设。高风险技术的安全故障是常态。问题从来不是下一次故障是否会发生。而是当它发生时,是否有人会被问责。

回顾之前技术治理失败的轨迹。2008年金融危机之前,是多年自愿合规框架,产生了光鲜的报告和零有意义的问责。阿片类药物流行病得益于行业自我监管,将监管视为障碍而非保障。在这两种情况下,自愿性框架都发挥了其主要功能:它让机构呈现出控制的外观,同时移除了真正能够防止伤害的机制。

将"超级智能"命名为官方联邦术语,为一个目前毫无实质内容的框架增添了语义上的分量。它表明,政府认为这项技术与之前的一切根本不同。但没有执行力的术语只是品牌营销。

特朗普发布在Truth Social上的协议似乎没有任何法律意义。它是一项承诺,而非合同。一个诺言,而非政策。而当承诺变得不便利时,它们就会烟消云散。

言语与后果之间的鸿沟

声称你会自我监控,与由他人验证你的监控之间,存在差异。声称具有道德约束力,与面临实际后果之间,存在差异。

《前沿责任联合承诺》提供了前者,却缺少后者。它呈现出治理的外观,同时移除了使治理具有意义的机制。

随着AI系统变得越来越强大,并越来越多地融入关键基础设施,这一鸿沟将扩大。下一次安全故障不会是抽象的。它会有受害者。而当它发生时,这份协议的自愿性质将成为其唯一的特征。

还需要考虑时间维度。AI发展遵循指数曲线。当今存在的能力将在两年内变得平凡。为当前系统构建的安全框架将无法满足未来模型的需求。一份没有任何升级机制的自愿性协议特别不适合这一轨迹,因为它无法适应。它是为一瞬间设计的,而非为一个连续体设计的。

超级智能时代可能在华盛顿的术语中正式启动。但与之绑定的治理框架仍然牢固地停留在过去——一份将签名页误认为保障措施、将自我监管误认为问责的自愿性协约。