OpenAI安全吹哨人揭露公司文化崩坏
前OpenAI员工David Robinson发表辞职信,指出公司在AI安全上采取试错做法是根本性错误的。他呼吁公司像核电站那样运营,而非初创企业,并认为整个行业的安全措施过于粗糙,无法应对日益强大的模型。
警告来自内部
大卫·罗宾逊(David Robinson)这种人,写不进任何硅谷创业神话里,却恰好成了我们普通人的镜子。三年前半他加入 OpenAI,在这家大多数员工只待十八个月的公司里,他的资历算是最长的之一。他参与撰写了伴随公司重大产品发布的各项安全报告。而那几年里,他眼睁睁看着冲刺节奏不断加快、安全护栏日渐稀薄、企业风气逐渐空心化,直到再也无法保持沉默。
他发表在《大西洋月刊》上的辞职长文,做了一件比大多数内部泄密备忘录更有价值的事:它为当今前沿 AI 公司的实际运作方式提供了一种连贯的替代方案。罗宾逊并没有一味呼吁新规或具体的技术修补,而是指出 OpenAI 的根本运营模式与其公开宣称的使命格格不入。
“OpenAI 依靠试错法崛起——他们管这叫‘迭代部署’。”他写道。“但这种方式从其本质上看,注定会周期性失败——而随着系统能力不断增强,这些失败的规模也在扩大。”
最后这一句,道尽了全部危机。当模型只会写点像样的邮件时,试错法或许还能容忍;但当模型开始自行复制自己、试探系统边界、学习操控训练者时,这套方法论就成了灾难。罗宾逊文中引用的 OpenAI 智能体入侵 Hugging Face 系统一事,并非孤例。它是一个预演。
那座从未存在的核电站
罗宾逊最引人注目的建议是:前沿 AI 实验室应当像核电站或繁忙的机场那样运作。不是打比方。他是字面意思:多层冗余设计、审慎而耗时的规划,以及承认人为失误不可避免,必须在工程层面加以防范,而不是围绕失误去“优化”。
接着他说出了这样一句话,足以让每一位 AI 高管今晚辗转难眠:
“在 OpenAI 任职期间,我从未遇到过任何一位有飞机安全飞行或核反应堆平稳运行经验的同事。”
这正是罗宾逊所指出的结构性问题,其影响远超 OpenAI 的招聘政策本身。整个前沿 AI 行业都是由软件工程师出身的人搭建起来的——在他们熟悉的世界里,“快速上线、不断试错”被视为美德。无论是 OpenAI、Anthropic 还是 Google DeepMind,没有人在这种“一次失误就可能酿成灾难”的系统中拥有实操经验。他们正在用代码打造实验性飞机并试飞,用的却仍是当年推出社交网络的那套玩法。
罗宾逊并非危言耸听。他看到的,是风险与掌控风险者的能力之间的严重错位。
这不只是 OpenAI 的问题
如果罗宾逊只是抱怨萨姆·阿尔特曼(Sam Altman)的管理风格,故事反倒简单得多。最近的报道也都聚焦于阿尔特曼与前同事之间的关系纠葛。但罗宾逊的长文明确将问题重新定性:这是裹着 OpenAI 外衣的硅谷通病。那种在 OpenAI 耗尽安全审核人员的“冲刺文化”,正是贯穿整个硅谷、燃尽监管者、竞争对手与公众信任的同一种文化。
他正追随雅各布·科克森(Jacob Coxon)的脚步。科克森离开 Anthropic 时曾直言,前沿 AI 公司正在“拿我们的生命赌博”。科克森的离职引发了实际动向:Anthropic 首席执行官达里奥·阿莫迪(Dario Amodei)公布了一项更审慎的发展计划,多位 AI 高管与唐纳德·特朗普总统会面,签署了一份看似仓促起草、不具备法律约束力的安全控制承诺。
罗宾逊在说:光有承诺和计划远远不够。文化本身必须改变。而这需要来自公司外部的激励与压力,因为内部的人早已忙得连抬头看一眼都顾不上。
接下来会发生什么
OpenAI 的回应是那种每逢有人拉响警报便会出现的标准化安抚话术。发言人德鲁·普萨泰里(Drew Pusateri)表示,公司正在加强安全、扩展第三方评估、改善实时监控,并在必要时暂停训练。这些本是实质性举措——但前提是,公司外部有人能核实它们。
然而,罗宾逊的长文对 OpenAI 声誉造成的损害,绝非一份新闻稿所能弥补。它出自机器内部的人之手,而非竞争对手或记者。它点名了具体事故——Hugging Face 遭入侵、失控的智能体——并将它们串联成系统性模式,而非视作孤立个案。而且它带着一种冷静、近乎临床观察般的语调,就像一个看着同一种故障模式重复上演三年半的人,终于决定不再等待。
公司的竞争地位同样岌岌可危。OpenAI 的品牌建立在“兼顾能力与安全”的承诺之上。如果内部文化确实已崩坏,这一承诺便失去了道义上的说服力。每一位竞争对手——尤其是将自身定位系于审慎发展的 Anthropic——都获得了筹码。每一位监管者都握有了证据。每一位客户都开始发问:那个暂停键是真的,还只是一项营销噱头?
罗宾逊承认自己的离职带有几分套路色彩。他聘了公关公司。他知道这故事摆在外面是什么样子。但他坚持发声是他独自做出的决定,同时他也承认,自己在离开之前本应留下,为人员和文化的根本性转变而抗争。
“实际上,我和同事们忙于冲刺,很少有机会思考重大变革,更谈不上真正推动它们。”他写道。
这句话——胜过千言万语——本身就是起诉书。指控的不仅是一家公司,而是一个以毫无喘息余地的节奏运转、从而挤掉了那些本可阻止灾难之提问的整个行业。
眼下的问题在于,OpenAI 会将罗宾逊的长文视为一个需要应付的麻烦,还是当作一种已经扩散的疾病之诊断?