business 8 分钟阅读

OpenAI解雇安全研究员:开启了一场更大的博弈

OpenAI坚称被解雇的研究员违反了信任,而非只是提出安全警告。但时间、措辞和沉默揭示了更大的问题:一家公司选择速度而非审慎,并冒着失去其科学团队信任的风险。

  • KakaoAI
  • Noam Shazeer
  • Facebook
  • 开源权重模型
  • 人工智能

三次解雇背后的真实故事

OpenAI 周五宣布,开除三名安全研究员——Jasmine Wang、Tomek Korbak 和 Mikita Balesni——称内部调查发现他们犯下了公司所称的"严重违背信任"的行为。新闻稿小心地强调,这三人的离开与他们公开表达的 AI 安全担忧无关。OpenAI 表示,这纯粹是如何处理敏感信息的问题。

然而,这种说法在事件背景之下显得格格不入。

就在 OpenAI 发布公告的前一天,三位研究者发表了一封公开信,敦促公司就这一决定更加透明。他们认为,自己并非因违反政策而被解雇,而是因发声批评实验室中他们看来危险的发展优先级而被排挤。在他们看来,他们的行为与 OpenAI 自身宣称的使命是一致的。OpenAI 在其反驳声明中并未直接回应这些指控。

公司承认调查发现存在"超出信函所述范围"的违规行为,但未提供任何细节。没有例子,没有时间线,也没有向研究员或公司外部任何人展示任何证据。

这真正关乎谁

解雇专攻 AI 安全的研究员,绝非普通的 HR 事项。这是一种信号,迅速传遍了一个本就敏感的行业。

OpenAI 多年来一直是前沿模型实验室中最具影响力的一家,其安全团队历来是推动产品开发速度的少数制度性制衡力量之一。当这些研究员离开——尤其是在显示出这项工作本身不受欢迎的环境中——无论是内部还是外部密切关注的人,都能收到一个直白的讯息:安全关切只有在方便的时候才被容忍。

这不是理论。今年,整个行业的顶尖模型实验室员工越来越大声地发声,警告在没有足够护栏的情况下构建自我改进系统的风险。OpenAI 对 Hugging Face 的黑客入侵,暴露了内部训练数据和研究成果,加剧了这种焦虑。那些发现自己的工作被未经同意公开——或怀疑自己被公开——的研究员如今面临一个二元选择:公开发声并承担不忠的标签,或者保持沉默,眼睁睁看着实验室走得比他们认为是安全的更快的速度。

OpenAI 最新的举动告诉了他们公司倾向于哪条路。

措辞就是一切

“违背信任"这个措辞值得注意。它不是法律术语,也不是标准的雇佣类别。它是道德话语,被战略性地部署。

通过将解雇定性为信任问题而非有具体描述的违规,OpenAI 控制了叙事,无需为之辩护。如果指控被逐条列出——泄密、违约、违反某项明确协议——批评者可以审视它们,与公司惯例进行对比,并判断处罚是否与过错相当。相反,公司援引信任这一固有主观的概念,就此打住。

效果是让异议感觉像背叛。

这是任何工作场所都强大的工具。当目标是被聘来对正在构建的技术提出棘手问题的研究员时,这恐怕更加危险。信任本应是对等的。当一方单方面定义信任,并以此作为解雇理由时,信任就不再是一种相互义务,而变成了一场忠诚测试。

这对监管意味着什么

从政策角度来看,时机也值得推敲。

欧盟的《人工智能法案》现已进入执法阶段,要求高风险 AI 系统的提供者保持透明、记录风险评估,并确保在部署前解决安全关切。OpenAI 的 GPT 模型及相关系统将至少受部分条款约束。监管者将要面对的问题是:一家以不透明方式解雇自身安全研究员的公司,能否可信地宣称自己正在履行这些义务。

硅谷长期以来受益于一种事实上的责任豁免:创新的速度为宽松的监管提供了正当理由,市场通过竞争而非法律来惩罚失败。这种安排正在瓦解。每一家公司似乎将速度置于问责之上的实例,都在削弱自我监管已足够有力的论据。

OpenAI 的声誉部分建立在它声称是这场所有人都输掉的比赛中的负责任参与者。如果研究员们是正确的——如果他们因提出安全关切而非不当行为被解雇——那么公司不再仅仅在能力上竞争。它在信任上竞争,并且正在这份最需要其专业知识的人群中失去信任。

谁赢谁输

眼前的赢家是谁,取决于谁因加速 OpenAI 的产品时间表且不受制度制约而获益。推断这一点并不困难。

输家更难指认,但后果更深远。他们包括研究员本人,解雇后面临职业污名。他们包括更广泛的 AI 安全社区,失去了一个有人因问了错误问题而受纪律处分的标志性案例。他们包括那些希望 OpenAI 宣称的安全承诺能转化为结构性保障而非修辞性承诺的任何人大。

也包括来自布鲁塞尔及更远地区的监管者,他们现在掌握了一个案例研究:一家公司如何在悄然移除最可能执行问责的人的同时,管理问责的外观。

接下来会发生什么

Wang、Korbak 和 Balesni 的公开信可能只是开始。被冤枉的研究员在雇主拒绝自我解释时,通常不会停止公开写作。随着故事发展,更多声明、更多采访、更多细节将出现。

就 OpenAI 而言,它不太可能提供能够化解争议的精确细节。公司目前的策略是断言违规的严重性,让缺乏细节对自己有利。这种方式能赢得时间,但无法解决根本矛盾:一家希望自己在安全问题上被认真对待的实验室,不能容忍被看作是惩罚那些认真对待安全工作的人。

AI 公司内部的对齐争论已不再是抽象的。它有名字,它有面孔。周五,OpenAI 选择了一边。