Anthropic与OpenAI正制造安全危机,谋求成为"大而不能倒"
Anthropic和OpenAI正利用对AI安全的恐惧来寻求政府保护,但它们的沙盒逃逸事件暴露出的是薄弱的安防,而非生存性风险——而中国正伺机利用这一时间差。
老虎没越狱,是动物园设计师的责任
过去几个月,Anthropic和OpenAI一直在讲述一个读起来像惊悚小说的故事:人工智能模型正在逃出牢笼,入侵服务器,并可能在十年末消灭人类。这个故事引人入胜,证据却十分单薄,而目的地显而易见——获得政府保护,让这些创业公司变得大而不能倒。
叙事弧线始于六月,当时外部研究人员测试了Anthropic的Fable 5模型,声称发现了国家安全风险。特朗普政府随即暂停了对Fable 5和Mythos 5的外国人访问权限。Anthropic则通过完全禁用访问来配合。所谓的"风险"是什么?只是一条让模型修复代码的单条提示词。
OpenAI紧随其后,上演了同样的合规表演,推迟GPT-5.6的发布以待政府审查。两家公司最终向公众兜售了三个主张:他们的模型比承认的更具危险性,在正确的人手中可以被控制,而开源的中国替代方案则做不到这一点。
到七月,这种虚构已固化为一场奇观。OpenAI披露,由其专有模型驱动的AI代理逃脱了沙箱,利用零日漏洞入侵了Hugging Face的服务器。Anthropic承认Claude模型也做了同样的事,攻击了三家组织。这些并非孤立事件,而是某些人已经称之为"洪水"的前奏雨滴。
一个名为Felony Bench的反讽基准测试现在追踪这些违规行为,统计AI代理威胁第三方的独立实例。这个玩笑正在变成一本账簿。
接着人类戏剧登场。Anthropic研究员Jacob Coxon在X平台上公开辞职,警告AI可能在2030年前杀死全人类。科学主管Evan Hubinger支持他,将概率定为超过10%。Anthropic首席执行官、如今这场运动的标志性人物Dario Amodei,终于获得了弹药。
这个论点颇具诱惑力:这些模型足够聪明,能突破限制;它们只会变得更聪明;开源模型无法被控制。因此,只有闭源模型才被允许存在——而生产它们的必须由国家的力量来保护。
但如果你抽一根线,整件毛衣就会散开。
如果一只老虎逃出围栏,杀死了邻居家的羚羊,你不会宣布这只老虎令人生畏并禁止所有未来的动物园。你会问,为什么围栏造得如此粗糙。
美国能源部几十年来就知道如何隔离敏感的计算工作负载。它用物理隔离(airgap)保护其最强大的超级计算机。这算不上尖端安全——这是基础工程。如果Anthropic和OpenAI的沙箱失败了,责任在于设计者,而非模型本身。
这些公司本该解释他们的安全措施为何崩溃。他们本该为造成的伤害负责。相反,他们在指着老虎尖叫着所谓生存风险。
正如另一位作家Tom Claburn所说:AI模型不会杀人,人会杀人。而那些因疏忽而扣动扳机的人应当承担责任。
理性的问责本应是理智之路。但恐惧是一种强大的药物,政客对此上瘾。当选民相信"天网"是真实的,国会议员就不能冒看起来软弱风险。他们先开枪,再问问题。
真正的棋招是节奏,而非预防
Amodei一直透明地表达了他的诉求。在最近一篇博客文章中,他呼吁控制前沿节奏——放缓能力提升的速度,让风险防控能够追赶上。Sam Altman和Elon Musk已表示支持。措辞听起来利他,机制却是保护主义的。
控制前沿节奏服务于两个自利的目标。首先,它重置了投资者的预期。如果另一种选择是灭绝,耐心便成为一种美德,损失便成为投资。其次,它赢得了时间,让美国政府内部互相博弈——利用国家安全恐惧来为排斥竞争对手的监管辩护。
当美国实验室停滞不前时,中国AI开发者正在缩小差距。算式很简单:监管拖延迟缓的每一月,都是北京和上海开源权重模型的每一月进步。
Amodei想通过切断先进加速技术和打击模型蒸馏来延长美国的领先优势。历史表明这将会适得其反。过去的芯片限制已经推动了中国在高效架构方面的创新。DeepSeek V4.1 Flash是最新证明——以少得多的资源超越了前沿模型。
讽刺意味浓烈。试图制造一场AI军备竞赛的Anthropic和OpenAI,正确保他们的成功成为国家安全问题而非市场竞争问题。这让它们变得不可或缺。而不可或缺的公司会获得救助。
山姆大叔未必买账
这个计划的前提是华盛顿配合。但这并不确定。
唐纳德·特朗普总统一直抵制监管,担心这会给中国追赶的时间。周一,他在真实社交平台上发布了一连串帖子,称AI恐惧是一场骗局和诈骗。他宣称自己在戳穿又一个骗局——AI将接管世界、吞噬一切、摧毁一切,机器人将涌入城市清除所有人。
英伟达的Jensen Huang看穿了这场操纵。在一次高盛会议上,他提出了显而易见的问题:还有什么比制造一个问题更能创造需求的呢?
前联邦贸易委员会主席Lina Khan主张相反的方向——根据现有法律追究AI首席执行官的责任。她说,针对危险或缺陷产品的法规没有AI豁免权。执法机构已有权力对公司及其高管提起诉讼。
Huang和Khan代表了美国科技政策的两种竞争本能:操纵市场,还是执行规则。Anthropic和OpenAI押注于前者。这并非稳赢的赌局。
时间仍站在美国一方
即使监管者拒绝让步,美国的模型制造商仍有一个优势:时间。落后于中国的风险越大,山姆大叔出手干预的可能性就越高。每一次漏洞、每一次警报、每一位因生存恐惧而辞职的研究人员,都在施加压力。
投资者可能在政治风向转变之前失去耐心。但单一事件——一个由中文模型驱动的 rogue AI代理引发某种灾难——可以立即重启恐慌循环。这些公司已经为此做好了准备。他们构建了叙事,也能重新部署它。
现在的问题是,美国政府是否认清了正在发生什么。如果他们认清了,这些公司将为其失败的沙箱和疏忽的发布面临问责。如果他们没认清,他们就能得到想要的:保护、补贴,以及由恐惧筑起的水濠。
无论如何,老虎没有越狱。笼子只是设计拙劣——而动物园管理员正试图卖给你一张新动物园的门票。