business 8 分钟阅读

美国阻止英国对前沿AI模型进行预测试

白宫已命令OpenAI和Anthropic在美方核查完成之前,不得向英国AI安全研究所披露新模型——此举削弱了伦敦峰会后的安全架构,并暴露出双方在AI治理控制权问题上的跨大西洋分歧。

  • AI 安全
  • 开源权重模型
  • 人工智能
  • Motif
  • 北约

美国在AI安全问题上划下了红线

白宫已告知OpenAI和Anthropic:在美国验证流程完成之前,必须拒绝与英国AI安全研究所(AISI)共享其最新模型。据《政客》杂志报道,这一压力来自美国国家网络安全办公室,代表了一项正式政策转变,而非孤立事件。

Anthropic立即遵守。该公司未向英国AISI提供其Mistral 5.1模型,称该模型仅限某些美国机构使用。当被问及时,它援引了与美国政府的持续合作,以便最终扩大访问权限——这种措辞谨慎地将对华盛顿的责备推给了美国政府,而非公司本身。

OpenAI尚未公开确认是否也在 withholding 模型,尽管英国AISI主任Henry Tuhmann在最近一份议会信函中承认,Anthropic最新系统的访问受限,而与OpenAI的GPT-6 Astra合作仍在继续。

此处发生的事情远超单次延迟安全检查的影响。

英国建立了一套体系——而美国刚刚将其打破

在2024年由英国政府主办的AI安全峰会上,英国与包括OpenAI和Anthropic在内的前沿企业达成了一项协议:模型将在发布前由英国AISI进行测试。这曾被认为是面向最强AI系统的全球首个独立部署前安全机制。英国AISI成为指定的测试枢纽。

这是前沿公司首次以美国政府指示为由,拒绝将最新模型提交给该流程。

英国科学、创新和技术大臣安迪·伯纳姆(Andy Burnham)在联合国大会上试图控制局面,承诺继续与美国及主要AI开发者紧密合作,同时推动建立单一的全球安全标准。措辞审慎,但实质是退缩:当主要伙伴拒绝遵循时,英国无法强制执行自己参与设计的规则。

实际后果是英国AISI作为守门人的信誉受损。如果最先进模型因为华盛顿说可以就绕过其检查,那么自2024年峰会以来建立的全部发布前验证架构就被掏空了。

美国为何采取这一立场

特朗普政府的强硬立场反映了一种真正的网络安全关切。先进AI模型理论上可以被武器化——用于识别关键基础设施的漏洞、大规模自动化网络钓鱼或探测防御系统。从华盛顿的角度来看,在美国自身审查完成之前让外国机构审查模型行为,存在故意或意外泄露的风险。

论证很直接:美国公司在美国监管下、以美国投资开发了这些模型;美国政府享有优先审查权。

但该政策存在结构性缺陷。负责评估前沿模型的商务部AI标准与创新中心(CAISI)正面临严重的人员短缺——数十个技术岗位空缺,负责人也尚未确认。如果美国验证流程本身已因人员有限而成为瓶颈,再加上对盟友访问设置强制延迟,将延缓先进模型在全球范围内的部署,每次发布周期可能推迟数周甚至数月。

这种 slowdown 会伤害所有人,包括希望快速部署的美国公司和试图建立本土能力国际合作伙伴。

谁得利,谁受损

美国政府 narrowly 得利。 它获得了对自身企业生产的最高危技术的独家优先审阅权。它设定了任何盟友获取模型的条件。它迫使Anthropic和OpenAI等公司对华盛顿负责,而非伦敦、柏林或东京。

英国失去了对其设计用于监控的模型的可见性。其2024年峰会框架在公司认为合适时才具有约束力——而公司现在选择服从华盛顿而非伦敦。

欧盟各方间接受损。 欧盟一直在通过《人工智能法案》推动自身的监管框架。如果美国可以单方面限制与英国的模型共享,它同样可以对布鲁塞尔、巴黎或柏林这样做。美国承诺的大西洋两岸AI安全架构现在仅取决于美国的优先事项。

AI公司失去了运营简洁性。 它们现在必须应对两套相互竞争的验证体系——一套由其控制,另一套则不然——并面临在两套义务冲突时优先服从美国流程的压力。

全球安全社区失去了协调能力。 发布前测试的核心理念在于,多个独立机构可以捕捉不同的失效模式。将审查集中于一个单一民族国家体系——尤其是一个已知存在人员缺口的体系——降低了在模型发布前发现危险问题的可能性。

接下来会发生什么

短期内,可能会是一段尴尬的外交周旋。美国将坚称其正在遵循既定政策。英国将呼吁盟国遵守2024年峰会的承诺。Anthropic和OpenAI将保持沉默,它们已成功将责任推卸给了本国政府。

但更深层次的问题仍未解决:究竟由谁来判定什么是发布前沿AI模型的足够安全标准?美国的处理方式将此视为国家安全问题,答案在华盛顿给出。英国的处理方式将其视为一项多边治理挑战,通过独立机构来解答。两者如今正正面冲突。

如果这种模式反复出现——如果每次重大模型发布都要经过一个按照自身时间表和自身标准运作的美国闸门——协调AI安全的承诺将沦为空洞的辞令。而那些构建这些系统的公司将获得前所未有的筹码:它们可以让一个首都与另一个首都相互制衡,声称自己遵守当下最方便的那一个政府的规则。

眼下,白宫赢下了第一轮。关键问题是英国及其盟友是否会接受这一安排——还是开始构建不依赖美国许可的平行验证体系。