technology 9 分钟阅读

27岁:他因AI失控而选择离开

一位27岁的Anthropic研究员彻底离开AI行业,警告自我改进系统可能在明年年底超出人类控制。他的离职是迄今为止最强烈的信号——那些正在打造AGI的人,正逐渐对自身安全护栏失去信心。

  • Noam Shazeer
  • Anthropic
  • 开源权重模型
  • AI安全
  • 人工智能
  • AGI

这份辞职声明如同警报

Jacob Coxson 今年二十七岁。2026年上半年,他在 OpenAI 度过了一段时光——这家公司将前沿 AI 开发变成了一场旁人围观的竞技表演;随后他跳槽到 Anthropic,看起来像是一次"道德升级"——从踩油门换成了踩刹车。然而到了九月,他彻底离开了这个行业。

他的理由并非职场 toxic,也不是项目停滞。而是他认为,具备自我改进能力的 AI 将在明年年底前达到一个人类再也无法掌控的临界点。用他自己的话说,最激进的那种情景早已不是科幻小说,而是他面前正在展开的现实轨迹。

这篇最早由《华尔街日报》报道的消息,不应被简单当作一个孤僻异议者的恐慌。Coxson 是大约一千名 AI 研究者之一——其中包括 OpenAI 首席科学家 Yakub Chapowski 和 Anthropic CEO Dario Amodei——他们最近签署了一份声明,敦促各国政府建立一个协作式的"制动"系统,以便在必要时能够遏制自我改进型 AI 的发展。一位仍身处"发动机舱"内部的研究员选择转身离去,这种信号比任何政策论文都跑得快。

谁赢,谁输

Coxson 的离职,最直接受益的是那些多年来一直在发声的人:他们说,各实验室之间以及美国与中国之间的竞争态势,使得自愿安全协议在结构上注定不稳定。刹车需要所有司机在同一时刻抬起油门,而眼下根本没有这样的共识。

输家更难命名,因为他们迄今还不存在于任何法律或公司架构之中。他们正是人类机构引导一项可能超越自身的技术之集体能力。这恰恰是那条警告刺耳的原因——它关乎的并非就业或营收,而是能动性(agency)。

Coxson 最锋利的一句观察穿透了常规的安全辩论。他将当前局势比作曼哈顿计划,随即指出了其中荒谬的倒置:核弹是在沙漠掩体中由数千名科学家在军方守卫下造出来的;而今天,能够改变文明轨迹的人是旧金山一群靠 MacBook 工作的工程师。权力不再集中于制度,而是个人化的、非正式的、且不受问责的。

改变一切的中国因素

西方对 AI 安全辩论的报道几乎总是将其当作美国行业问题来讨论。但这只看到了半幅图景。Coxson 在阐述理由时明确提到了中国——来自中国 AI 实验室的竞争压力,使得任何单一公司——即便像 Anthropic 这样高度重视安全的公司——都几乎不可能单方面放慢脚步。

这正是该故事令东亚受众感到紧迫的原因,因为他们已经身处竞争之中,而非站在外部旁观。韩国政府一直在强势推动本土 AI 能力建设;日本经产省(METI)正在重塑监管框架;台湾和新加坡正定位自己为 AI 枢纽。在所有这些案例中,当地的本能反应都是加速,而非减速。

韩国媒体在数天内即跟进报道,Daum 上以"明年我们或许已无法控制 AI"大致标题刊出——这表明这条警告已被最受美中科技竞争影响的地区开始吸收。对韩国读者而言,潜台词很清晰:如果中美在赛跑,韩国没有退赛的选择权。关键问题是,它能否在进入讨论刹车机制的餐桌旁坐到一席之地。

勇敢的公司,但还不够勇敢

Coxson 离职时并未贬损 Anthropic。他认为该公司的安全努力是认真且真诚的。这一点很重要。Anthropic 是唯一一家以对齐研究作为公众身份核心的主要前沿实验室,并且它用真实的招聘和真实的产品约束为这一身份背书。

但认真不等于足够。Coxson 的结论——没有任何单一公司能够在没有政府干预或全行业限速机制的情况下负责任地推进 AGI 开发——正是在机器内部待得足够久、看清其齿轮转动之后,所得出的合乎逻辑的终点。

OpenAI 最近宣称其最新模型已达到 AGI 水平,而 Sam Altman 则向 G20 官员发出有关 AI 赋能网络攻击风险的警告——这表明 Coxson 离开的那家公司并非在安全方面放缓,而是在重新定义目标。当 AGI 的定义跑得比安全的定义更快时,刹车系统根本没有地方可以介入。

真正的"制动"看起来是什么样

那千名研究者签署的声明在技术细节上刻意保持模糊。“制动"可以是任何东西——从要求报告自我改进实验的规范,到包含检查机制的国际条约,再到由新的全球机构执行的紧急停机协议。这类东西今天都不存在。

但有一点很清楚:自愿性的行业协议已跟不上能力发展的速度。OpenAI、Anthropic、Google DeepMind,以及阿里巴巴通义、百度文心等中国实验室,都在发布连其创建者自己都感到意外的模型。令人惊讶的频率才是真正重要的指标,而这一频率正在加速。

Coxson 的时间线——明年年底为拐点——是个人的判断,而非共识性预测。但越来越多拥有最高工作许可权限的人在这一方向上取得一致,这才是值得关注的信号。

为什么一次辞职胜过千篇论文

关于 AI 安全的学术论文每月都在堆积。像 Coxson 这样的辞职却极为罕见,它们携带另一种分量——证明这条警告对那些发出它的人来说不是抽象的理论。他没有在卖书,也没有在国会作证。他只是从过山车上下车了。

全球 AI 竞赛不会由那些警告的人来决定,而将由建造它的人和监管他们的政府来决定。Coxson 的离去是关于建造者们的一份数据点。首尔、东京、华盛顿和北京的政策制定者们是否在倾听,才是问题所在。

如果接下来的十二个月里出现了一个令其创建者感到意外的自我改进型 AI 系统——而轨迹表明这很可能发生而非纯属推测——那么二〇二六年九月将被后世视为:实验室内部的人们终于停止假装那道刹车是可选的时刻。