15亿美元版权和解案:日本作者一无所获
Anthropic 同意支付 15 亿美元,就用于训练 Claude 的盗版书籍版权问题达成和解。然而,该和解案在很大程度上排除了非英语创作者——包括日本作家村上春树——揭示了 AI 授权机制如何系统性地让英语世界以外的创作者处于劣势。
这场跳过半个世界的和解
Anthropic 同意支付 15 亿美元,解决一起版权诉讼。这笔钱用于补偿那些书籍被从盗版网站下载、并用于训练 Anthropic 旗下大型语言模型 Claude 的作家。纸面上看,这似乎是人工智能时代创作者权利的一场里程碑式胜利。
但如果你透过 headline number 往深看,这场和解讲的故事截然不同——包括村上春树在内的日本作家几乎分文未得,尽管他们的作品正是 Anthropic 抓取的数据的一部分。
这不是偶然。这是 AI 授权体系的结构性产物:以英文权利为默认,其他一切为次。
诉讼是如何开始的
案件始于 2024 年 8 月,三位作家——Andrea Bartz、Charles Graeber 和 Kirk Wallace Johnson——在美国加利福尼亚北区联邦地区法院提起集体诉讼。他们的指控直截了当:Anthropic 未经许可,系统性地从盗版数据库 LibGen 和 PiLiMi 下载了约七百万本书,然后用它们来训练 Claude。
案号 4:24-cv-05417,成为所有人观察美国法院将如何处理 AI 与版权问题的参照点。到 2025 年 6 月 23 日,法官 William Alsup 发布了被他称为"公平使用裁决"的文件——第 231 号文件,一份 40 页的判决,划出了一条谨慎的分界线。
Alsup 得出结论:用书籍训练大型语言模型属于"高度转换性"使用。AI 不会复制小说,也不会取代小说;它学习模式、结构和技法,以生成完全不同的新事物。这一推理与美国版权法中公平使用的核心 doctrine 相契合,后者优先考虑一项使用是否增添了新的表达或含义,而非仅仅复制原作。
但 Alsup 在第二个问题上划出了鲜明界限:将盗版副本作为永久档案保留,不属于公平使用。“创建通用型永久图书馆,不能成为豁免盗版理由,“他写道。这一认定创造了压力,最终导向和解谈判。
15 亿美元这个数字
2025 年 8 月,Anthropic 与原告达成基本和解协议。总额:15 亿美元。Alsup 于 2025 年 9 月给予初步批准。2026 年 7 月 20 日,法官 Araceli Martinez-Olguin 作出最终批准。
这笔钱补偿两件事:从盗版网站未经授权下载书籍,以及 Anthropic 决定保留这些副本而非销毁它们。它并不补偿"训练"本身——Alsup 此前已裁定该部分合法。
那么 15 亿美元买到了什么?本质上,它买到了 Anthropic 继续持有其已有数据的自由。这笔和解是对"持续性"定价,而非对"使用"定价。
日本缺席
故事在这里扩展到美国版权法之外。
Anthropic 抓取的盗版数据库——LibGen 和 PiLiMi——包含数十种语言的书籍。日文标题大量存在。村上春树的作品,包括《挪威的森林》,出现在这些档案中。Anthropic 的抓取工具会将它们与英文标题一并纳入。
然而,和解方案几乎未向日本创作者支付任何费用。
原因来自结构,而非偶然。
首先,集体诉讼依据美国法律、由美国原告提起。被列为代表的作家——Bartz、Graeber 和 Johnson——均为美国人。补偿的法律机制通过美国版权法规和美国法院程序运行。在日本持有权利的日本作家,在此案中不享有自动诉讼资格。
其次,Anthropic 的和解基金是根据所列原告及类似美国作家的作品来校准的。公司同集体律师谈判,而非同外国权利持有人谈判。没有联络日本出版社协会,没有同 Society of Authors 这类权利集体建立合作,也没有机制让日本遗产管理方主张份额。
第三,也是最为关键的一点:和解的经济学反映的是英文书目之商业价值。七百万本书被抓取。绝大多数是英文。和解金额追踪的是该英文语料的授权价值,而非全球多语种语料的价值。
一位作品出现在盗版数据库中的日本作家,没有任何途径进入这笔赔付。体系根本不将其视为当事人。
这揭示了 AI 授权的什么
Anthropic 和解正被赞誉为创作者补偿的里程碑。它同时也是另一个里程碑:将非英语创作者排除在 AI 授权交易之外。
这一模式将反复上演。每家主要 AI 公司都在抓取多语种数据。每场和解都将遵循同样的法律架构——美国集体诉讼、美国法规、美国原告池。资金将流向这些案件中列名的作家。其他人旁观。
缺口不是 bug。它是知识产权法与 AI 开发交叉点上的 feature。版权具有地域性。AI 是全球性的。错配沿语言线产生赢家和输家。
英语创作者身处法律机制之内。日语、韩语、法语、德语创作者身处机制之外——即便他们的作品同样大量出现在训练数据中。
为何在全球范围内重要
日本是世界第三大图书市场。村上春树是最常被翻译的在世作家之一。他的遗产管理方不应在这场关于 AI 公司学习何种书籍的和解中隐形。
同样的排除适用于韩国网络小说、德国非虚构作品、中国文学。所有这些都进入了盗版数据库。所有这些都训练了模型。没有一样进入补偿池。
这不是关于 AI 是否应从书籍中学习的争议。法院已经就此作出了裁决。这是关于学习发生时谁获得报酬、谁因权利存在于和解不承认的管辖区而被排除在外的争议。
15 亿美元这个数字将被引用多年。它没有显示的是:数十亿美元的价值从非英文书目流入 AI 公司,而创作这些内容的作家分文未得。
那个数字更难计算。但它也是衡量这场和解真正代表性的更诚实指标。
前路何在
几件事可以改变这一动态。
日本、韩国和欧洲的權利集体可以直接与 AI 公司谈判,完全绕过美国法院机制。多边授权框架可以将训练数据视为需要跨境补偿的类别。AI 公司可以在抓取实践中构建透明度,并将非英文书目自愿纳入和解基金池。
这些都不是必然。当前架构偏向阻力最小的路径:在美国法院和解,向英语原告付款,翻篇。
对日本作家及其遗产管理方而言,这条路以一篇关于 15 亿美元和解的新闻稿和一封沉默的空信封告终。
数据被使用了。模型被训练了。创作者未被征询。支票从未抵达。
这是 headline number 没有讲述的故事。