他们明知网络正处于 doom loop(毁灭循环),却依然将其建成
解封的法院文件显示,OpenAI 和微软内部曾警告,其 AI 数据抓取行为将引发网络内容的「毁灭循环」——而他们仍继续加速了这一进程。他们自己的话语揭示了 AI 增长的代价。
那些本应拉响警报的文件
《纽约时报》起诉OpenAI和微软的未密封法庭文件,产生了AI商业史上最坦率的一次自白。这些公司自己的内部文件警告称,他们对数据抓取的做法会开启一个损害整个网络的"死亡螺旋"。其研究员将内容采集的规模形容为"人类历史上最大规模的劳动窃取"。他们的法律立场让"合理使用原则变得完全像个笑话"。
这些警告来自公司内部。它们并非泄密举报人或敌对专家提供。它们是由那些受雇建造正在重塑互联网系统的人员写就的。
最突出的声音属于布伦特·赫希特(Brent Hecht),微软应用科学总监。他的定性在任何标准下都堪称直白,但绝非天真。赫希特理解正在发生什么,因为他正是帮助设计这一切的人。而现在,他的公司正试图将他从记录中抹去。
微软的危机公关
针对已发表的言论,微软的回应迅速而措辞审慎。发言人亚历克斯·霍尔克(Alex Haurek)告诉The Verge,这些评论反映了"一位员工的个人观点,并非法律分析,也不代表公司立场。"
在另一份文件中,微软数据战略与运营总经理乔丹·乌斯丹(Jordan Usdan)走得更远——他将赫希特的角色描述为对抗性的。他称赫希特为"对AI数据生态系统应如何运作持有分歧性、学术性和前瞻性观点的人",并指出微软雇佣他正是为了引入"不对称的、未来主义的和学术性的观点"。
这种框架发人深省。微软并未否认赫希特分析的内容。它试图限制他的权威——将一个结构性警告降级为单个研究员的性格特征,而此人观点本就因其工作性质而在公司内部显得另类。
但这种区分的损害是有限的。死亡螺旋并非边缘理论。它是一个有据可查的内部结论。而且无论微软是否愿认领赫希特的具体措辞,他所预测的结果现在已清晰可见地正在上演。
Google Zero不是预测。它是现实。
赫希特所描述的死亡螺旋已不再是假设。Google Zero——即Google搜索结果越来越多地返回基于抓取内容生成的AI摘要,而非指向原始来源的链接——这一现象已上线并可测量。当AI模型大规模消费网络内容时,它们会激励出版商将材料置于付费墙后或完全撤除。随着原创内容从开放网络中消失,AI模型可用的原始素材减少。模型退化。平台则回应以从剩余开放来源中更激进地抓取。出版商进一步退守。螺旋收紧。
这就是死亡螺旋。它具有自我强化性。而且它正在此刻发生。
《纽约时报》并非唯一注意到这一点的出版商。整个行业的媒体都已报告搜索引荐流量下降、缓存行为改变,以及积极阻止AI爬虫的努力。有些已成功。大多数未能成功。开放网络的经济基础本就脆弱。AI模型训练加剧了这种压力。
谁为螺旋买单
死亡螺旋的成本分配并不均等。出版商和创作者承担直接负担——广告收入损失、有机流量减少、对自身作品变现能力下降。依靠数字订阅和展示广告资助调查报道的新闻编辑部,正目睹这些收入流萎缩,而AI中间商捕获注意力却未对内容生态做出任何贡献。
更大的问题是谁从螺旋中获利。OpenAI和微软构建的模型,若无法获得数十年来人类创作的网络内容,便不可能达到当前的能力水平。从构建模型的公司角度来看,这些内容的利润空间几乎为零。它们达成的授权协议——包括广泛报道的《纽约时报》协议——代表了部分修正,但它们只与最显赫的出版商打交道。小型媒体、独立记者和垂直领域创作者既未获得补偿,也缺乏谈判筹码。
这种不对称是结构性的。一家报纸可以拒绝授权其内容。一家AI公司仍可抓取它,然后调整。法律不确定性有利于平台方。
纳德拉与奥特曼说了什么,不如他们做了什么重要
法庭文件还提及了萨提亚·纳德拉(Satya Nadella)和山姆·奥特曼(Sam Altman)的言论。两人都无法摆脱这一局势核心的矛盾:负责任的AI公共言论与内部文档并存,而后者警告当前的数据获取策略不可持续且具有潜在剥削性。
这种矛盾并非OpenAI或微软独有。它是定义了整个行业的特征——该行业在估值叙事上建立在充裕承诺之上,却悄悄为稀缺做好准备。模型需要越来越多的数据。数据来源——开放网络——正因消耗它的同一过程而退化。公司对此动态心知肚明。它们的文件证明了这一点。
真正的 stakes
这些未密封文件之所以重要,是因为它们剥去了抽象的外衣。这并非关于合理使用原则的辩论,也非关于文本与数据挖掘是否天生有益的哲学问题。这是一份记录:一家公司理解自身行为,记录后果,然后继续前行。
法院、监管机构和公众面临的问题,不在于死亡螺旋是否真实。而在于那些曾预测到它却加速它的公司,是否应为此负责。
对该问题的回答将决定未来十年互联网的架构。如果当前轨迹持续,开放网络将成为资源开采区——一个内容被开采至无法再生产,然后被遗弃的地方。如果选择相反的道路,激励机制将转变。出版商将获得杠杆。创作者将获得报酬。螺旋将断裂。
微软和OpenAI知道它们正驶向哪个方向。文件使这一点显而易见。目前正在进行的法律案件将决定这种知识是否重要。
接下来会发生什么
几种结果都有可能。最可能的是 settlement framework,从出版商那里提取授权费,但不为未来案例确立明确先例。这将为主流新闻机构提供临时缓解,同时让小型创作者继续暴露于风险之中。死亡螺旋会继续,尽管速度略减。
可能性较小但影响更深远的结果是司法裁决,确立对AI数据抓取的具有约束力的限制。此类判决将重塑整个行业的经济格局。依赖 unrestricted web access 的模型将面临更高训练成本或能力下降。市场将相应调整——一些公司存活,一些退出。
第三种可能性是立法层面的监管干预,可能依据欧盟《数字服务法》框架,或在美国通过新的版权立法。这条路更慢,但可能比单纯诉讼更持久。
无论哪种情景展开,内部文件现已成为公共记录的一部分。它们提供了证据,证明涉事公司理解其数据策略的后果。这种知识将在法庭上发挥作用。它也可能在舆论法庭上产生分量,而围绕AI开发的叙事仍在书写之中。