7 月 20 日,加州奥克兰联邦法官 Araceli Martínez-Olguín 签署了 Anthropic 与作者群体达成的 15 亿美元版权和解协议的最终批准令。这是美国版权法历史上金额最高的和解案,但它的真正意义不在于天文数字的赔偿金额——而在于法院在裁决中划出的一条明确界限:用合法获取的书籍训练 AI 属于合理使用,但从盗版网站下载 700 万本书并储存为「中央图书馆」的行为构成独立侵权。
两年前,畅销悬疑小说作家 Andrea Bartz 联合另外两位作者起诉 Anthropic,指控其在训练 Claude 聊天机器人的过程中未经授权使用了数十万本盗版书籍。如今,这场官司以 91% 的版权持有人主动申领赔偿、仅 350 名作者选择退出的结果宣告终结。
一个法律分水岭:合法获取 vs. 盗版来源
本案最值得关注的部分并非最终的和解金额,而是 2025 年 6 月由时任主审法官 William Alsup 作出的那份核心裁定。Alsup 在判决中明确表示,Anthropic 使用书籍训练 Claude 的行为属于「典型的转换性使用」(quintessentially transformative),构成版权法下的合理使用——这对 AI 行业而言是一个关键性的法律认可。
但 Alsup 同时指出,Anthropic 从 LibGen 和 PiLiMi 等盗版网站批量下载超过 700 万本受版权保护的书籍,并将其保存到一个未必完全用于 AI 训练的「中央图书馆」中,构成了独立的侵权行为。按照 Alsup 的逻辑框架,这批书籍若仅用于 AI 训练可能构成合理使用,但 Anthropic 获取它们的方式——大规模盗版下载——本身就已经违法。
Cardozo 法学院兼职教授 James Rubinowitz 在接受 LA Times 采访时一针见血地总结了这一转变:「关于 AI 训练是否属于合理使用的争论已经是昨天的战争。2026 年的核心问题是获取——书从哪来、谁付了钱、公司在点击下载时对数据来源知道多少。」
15 亿美元的和解结构
和解协议的具体结构如下:15 亿美元将在四年内分期支付(首期 3 亿美元此前已付出,终审批准后再付 3 亿美元,后续两期各 4.5 亿美元)。覆盖范围超过 48.2 万本受版权保护的作品,每本作品的赔偿金额约为 3,000 美元——法官指出,这一数字已经是版权法法定最低赔偿额的四倍。
律师费成为和解过程中的争议焦点。原告律师最初要求获得和解金额的 20%(约 3 亿美元),随后降至 12.5%(约 1.875 亿美元)。Martínez-Olguín 法官最终将律师费压缩至不到总和解金额的 7%,约为 1.016 亿美元。三位代表集体诉讼的原告作家原本申请每人 5 万美元的服务奖励金,也被法官削减至 1.5 万美元,理由是更高金额「不合理」。
在 48.2 万本覆盖作品中,约 91% 的版权持有人已主动提交了赔偿申领。仅 350 名集体成员选择退出和解,另有 54 人试图提出异议或逾期申请退出。Anthropic 副总法律顾问 Aparna Sridhar 在声明中强调:「法院关于训练 AI 使用书籍属于合理使用的里程碑式裁决至今仍是法律。我们感到欣慰的是,超过 91% 的被覆盖作者和出版商已经申领了他们的款项。」
和解不等于判例
尽管本案是 AI 训练版权诉讼中首个获得实质性判决并达成和解的案件,但它并不会自动成为具有约束力的法律先例。TechCrunch 的分析指出,Alsup 的裁决仅仅是联邦地区法院层面的单一判决,而 Anthropic 选择和解意味着案件永远不会进入上诉法院,因而无法形成对全美有约束力的判例。
这意味着其他法官在处理类似案件时仍然可以得出不同结论。事实上,多起同类诉讼仍在推进中:《纽约时报》起诉 OpenAI 和 Microsoft 训练使用版权新闻内容、Hachette 和 Elsevier 等出版商近期对 Google 提起集体诉讼指控其在训练 Gemini 时使用版权作品、迪士尼和环球则起诉图像生成公司 Midjourney 涉嫌使用未经授权的内容训练模型并生成著名角色的复制品。
值得注意的是,部分作者和出版商选择了退出本次和解,单独对 Anthropic 提起诉讼。他们押注通过个体诉讼可以获得远高于每本书 3,000 美元的赔偿。娱乐律师兼作家 Donald Passman 试图在截止日期三个月后退出和解——他声称自己的行业著作《关于音乐产业你需要知道的一切》价值远超和解赔偿金——但法官以「不可原谅的延迟」为由拒绝了其请求。
从「合理使用」到「来源合规」
Anthropic 案的终审批准标志着一个更深层的转变:AI 训练数据的法律焦点正在从「用数据做什么」转向「数据从哪来」。Alsup 的判决实际上为 AI 公司提供了一条清晰的合规路径——购买正版书籍并扫描数字化(Anthropic 也确实做了这件事,且被法院认定为合法),但大规模地从盗版网站爬取受版权保护的内容则不被允许。
对正在筹备 IPO 的 OpenAI 和 Anthropic 而言,这一区分具有直接商业影响。训练数据的「来源合规」将从法律风险管理问题升级为投资者尽职调查的核心项目。对于整个 AI 行业,Anthropic 15 亿美元的和解账单设定了一个基准价格:如果被证明使用了盗版来源的训练数据,代价至少是这个数量级。
本案的原告律师 Justin Nelson 称之为「历史上已知最大的版权赔偿」,但最畅销作家 Bartz 在 Instagram 上的表态或许更能代表作者群体的复杂心情:「这是我们集体诉讼的最终批准。正如我从一开始所说的,这是追究大型 AI 公司惊人盗窃行为的第一步——我很高兴作者和出版商能够告诉 Anthropic 显而易见的事:你不能偷我们的东西。」