business 8 分钟阅读

微软承认AI正在挖自己的坟墓——连同我们一起

解密法庭文件显示,微软高管私下承认,AI正在吞噬它所依赖的内容生态。该公司的一位主任将其称为

  • KakaoAI
  • Noam Shazeer
  • AI训练数据
  • Rockstar
  • 重整
  • AI训练

改变一切的泄露

数月来,AI公司与媒体出版商之间的冲突一直表现为言语上的战争。记者指控大型科技公司窃取内容,科技高管则称赞其模型与开放网络之间的共生关系。双方都没有拿出决定性证据——直到如今。

《纽约时报》对OpenAI提起的版权诉讼中解密的法庭文件,揭示了罕见的内容:一家全球最大科技公司内部的第一方承认,AI热潮正在侵蚀其模型所依赖的生态系统本身。微软应用科学总监布伦特·赫希(Brent Hecht)在一封内部文件中写道,公司的AI内容战略已经启动了一个"末日循环",将损害其自身模型以及整个互联网。

“终产品在很大程度上威胁了其关键供应商的经济基础,这是极为罕见的,“赫希写道。“但这就是我们为LLM业务及其内容供应链所创造的局面。”

这场诉讼已使微软作为OpenAI最大股东的身份卷入其中。但这些文件揭示的不仅是一起诉讼案。它们表明,至少有一家主要AI公司的领导层在私下理解出版商公开宣扬的事实:在没有补偿的情况下利用爬取内容训练AI的当前模式是自相矛盾的。

末日循环的实际含义

赫希的措辞是刻意选择的经济学术语。供应链本应是可持续的。当下游产品摧毁上游来源时,链条就会断裂。这就是末日循环。

机制很简单。AI模型使用从互联网上获取的大量文本进行训练——新闻文章、书籍、评论和 commentary。用户随后与这些模型互动,而不是访问原始来源。出版商网站的流量下降。订阅和广告收入被侵蚀。用于生产新内容的资源越来越少。下一代模型的训练数据变得日益稀少、质量下降,或者授权成本更高。模型随之退化。循环再次开始。

萨提亚·纳德拉(Satya Nadella)在回应AI聊天机器人时部分承认了这种动态,正如《纽约时报》律师所引用:与它们对话"替代了……直接在AI平台上提供信息,而非需要前往底层来源”。

这句话是一种安静的替换宣言。AI平台不是在放大来源,而是在取代它。而取代对任何一方来说都不是一种可持续的关系。

付费墙难题

文件还揭示了一个令人不适的细节:AI公司如何获取训练内容。据报道,OpenAI员工使用了绕过付费墙的方法。当一名员工告诉联合创始人格雷格·布罗克曼(Greg Brockman)一种绕过《纽约时报》付费墙的方法时,布罗克曼的回应据报是:“啊,不错。”

这并非轻微的道德失足。这是系统性获取内容的方式的证据,而出版商明确将这些内容限制给付费订阅者。如果AI公司正在积极绕过其消费内容出版商的经济模式,那么权力失衡显而易见,信任赤字更为明显。

更广泛的含义是,“抓取一切"的战略不仅法律上脆弱——它在关系上也是灾难性的。每次绕过付费墙都加强了出版商的看法,即AI公司将他们的内容视为免费资源而非产品。这种看法使许可谈判更加困难,诉讼可能性更大。

谁赢谁输

直接输家是出版商,尤其是那些缺乏《纽约时报》品牌忠诚度的中层和本地新闻机构。《纽约时报》可以承受一场诉讼。区域性报纸无法承受其网络流量哪怕一小部分的损失。

长期输家是读者。一个缺乏实质性新闻的网络将变成AI生成内容的反馈循环——用AI生成内容训练AI生成内容——正是赫希描述的末日循环。当聊天机器人回复变得越来越浅薄时,新奇感很快就会消退。

赢家是可以授权高质量训练数据的任何人。达成协议(如《纽约时报》与OpenAI和其他公司)的出版商获得了新的收入来源。但这些交易进一步集中权力。没有影响力的小型出版商被完全挤出。

微软和OpenAI面临真正的战略困境。他们的模型随着更多更好内容而改进。但当前的提取模式正在摧毁内容管道。公司自己的总监承认了这一点。问题是承认它是否会改变行为。

接下来会发生什么

最可能的结果是缓慢的调整。AI公司将从无约束的抓取转向许可内容合作。一些出版商将获得有利的条款。许多则不会。权力的结构性失衡依然存在。

《纽约时报》案件的先例可能重塑行业。如果裁定爬取内容构成侵权,将迫使每家主要AI公司重新评估其训练数据。如果裁定OpenAI胜诉,将鼓励继续提取并加速末日循环。

欧盟等地的监管机构已经审查当前AI实践是否符合现有版权框架。美国案件可能影响全球辩论。

对媒体行业而言,这些文件是 vindication 而非解脱。将末日循环论点发表在法庭文件中,确保该叙事不能被 dismiss 为行业自我利益。但 vindication 不支付账单。出版商需要的不是被承认的真理,而是可执行的权利。

更大的悖论

这些文件中最引人注目的元素不是指控——出版商已发表多年。是来源。AI公司自己的总监描述一个自我毁灭的反馈循环,比任何外部批评更接近来自行业内部的警告。

微软无意中为媒体行业提供了迄今为止最有力的论点:不是AI有害,而是当前方法在内部不连贯。这项技术承诺增强人类知识。相反,它正在吞噬使这种知识成为可能的基础设施。

这种见解是否能转化为政策、定价或合作伙伴关系还有待观察。但末日循环不再是一个隐喻。它已被记录在案。