OpenAI开除安全研究员,速度与安全的分歧公开化
OpenAI解雇三名安全研究员——他们表示因强调可监控性而被解雇——暴露了公司部署速度与安全风险承诺之间的裂痕。日本监管动向同样是一个值得全球监管者密切关注的安静信号。
不会被人遗忘的那封信
OpenAI 三名研究人员于 10 月 8 日宣布,他们已于前一周被解雇。他们的主张直截了当:他们被辞退是因为坚持安全第一。该公司当天发布的回应同样毫不客气。OpenAI 表示,一项调查认定这三人违反了保密政策,安全担忧并非原因。
双方讲述的是同一个故事,只是角度不同。而两者之间的差距——此刻比以往任何时候都更为悬殊——正是人工智能治理的未来将被决定的战场。
这三位研究人员——科扎克(Tomek Korbak)、王茉莉(Jasmine Wang)和巴莱伊斯尼(Mikita Baleisnyi)——并非简单辞职。他们发表了一封信,致信 OpenAI 的安全与安保委员会、安全咨询小组以及使命咨询委员会。这封信读起来不像投诉,倒更像是一封写给公司自身的警告:解雇的执行方式,以及在建筑内外解释这些解雇的方式,正在让剩余员工噤若寒蝉。
这个词——“噤若寒蝉”——承载着沉重分量。它是那些目睹企业文化发生转变、并试图在其变得不可逆转之前加以记录的人的语言。
他们实际在做什么
要了解此事为何超越一家公司本身,你需要知道这些研究人员研究的是什么。三人都致力于可观测性——即随着系统变得越来越不透明,让人类能够观察 AI 推理过程。这不是一个光鲜的领域,但它或许是房间里最重要的工作。
科扎克还有另一个角色。他担任 OpenAI 与美国外部安全研究机构 METR 之间的技术联络人,该机构对 7 月 Hugging Face 数据泄露事件进行了独立调查。那次泄露——私有模型权重被暴露——让 OpenAI 内部的每一次安全讨论都变得更加尖锐。科扎克身处这两场对话的核心。
王的申诉范围更窄,却发人深省。她说她被解雇的唯一理由是她有权访问一位高管的邮箱。她是在履行招聘职责时获得这一权限的,在相关工作结束后请求 IT 部门将其移除,并在任何意外暴露后数分钟内上报。移除从未完成。她已要求 OpenAI 书面说明对她解雇的其他依据。
巴莱伊斯尼表示,他的离职面谈暗示他泄露了知识产权,他对此予以否认。他更直接地被告知,他频繁与外部安全研究机构交流,导致公司对他失去信任。
无论是邮箱事件还是知识产权问题,都不是小事。保密协议的存在自有其道理。但更广泛的模式——那些本职工作是保持 AI 可追溯的研究人员,在公司正全力冲刺更强、更不透明系统的时刻被清除——不可能被解读为巧合。
奥特曼的矛盾
对 OpenAI 最不舒服的细节在于公开记录。9 月 12 日,首席执行官山姆·奥特曼(Sam Altman)在 X 平台发帖称,应授予独立评估机构与内部团队同样的员工访问权限。他呼应了 Anthropic 首席执行官达里奥·阿莫迪(Dario Amodei)的立场。两人都在论证:外部监督不能流于理论——它需要切身利益。
不到一个月后,负责构建此类面向外部安全基础设施的三名研究人员被解雇。科扎克的信件明确警告,解雇可能被用作切断与 METR 关系的借口。王走得更远,她写信给加利福尼亚州和特拉华州检察长,要求他们让 OpenAI 遵守奥特曼的承诺。
这并非次要的时间问题。这是整个行业的结构性张力浓缩进单个新闻周期的产物:公众场合高调作出的问责承诺,紧随其后的是看起来毫无问责可言的运营决策。
日本的静默视角
为什么一家日本科技出版物会以如此关注报道这件事?不仅仅是因为 OpenAI 是家喻户晓的名字。日本的科技媒体——本例中是 ITmedia——多年来一直在追踪 AI 发展的治理维度,往往比西方同行拥有更多制度性的耐心。这里的报道不聚焦戏剧性,而聚焦结构:谁向谁汇报,哪些委员会存在,哪些承诺已公开作出,以及现场实际情况是否与修辞相符。
这对国际受众来说是一个有用的视角。英语媒体倾向于将这些纠纷框定为内部派系争斗。而日本式的 framing 则将其视为更大模式中的一部分——这一模式之所以重要,正是因为它正重复出现在每一家主要 AI 实验室。
接下来会发生什么
OpenAI 的声明未透露哪些具体保密条款被违反,也未提供支持该主张的证据。公司表示发现了超出研究人员所述范围的"严重信任背叛",但未提供任何细节。它也确认,与外部安全评估机构的合同正处于最后阶段,相关细节将在数周内公布。
这些研究人员不太可能销声匿迹。他们的信件已经创造了永久性记录。如果 OpenAI 正在签约的外部评估机构被发现缺乏奥特曼所承诺的访问权限,科扎克、王和巴莱伊斯尼的被解雇将成为证明该承诺从未真实的证据。
加利福尼亚州和特拉华州正在密切关注。研究人员已正式要求这两个州执行奥特曼的承诺。州检察长是将此事视为治理问题还是人事问题,将决定这轮解雇会成为监管信号还是沦为附录中的一条注脚。
争相交付最强大模型的公司在构建的系统已无法由单一组织安全 containment。那些理解这一点——并试图构建相匹配的监测基础设施——的研究人员已被清除。这才是故事背后的故事。这是全球监管者需要关注的核心。