
2026 年 7 月 20 日,旧金山联邦法院法官 Araceli Martínez-Olguín 签署了一项裁决,正式批准 Anthropic 以 15 亿美元和解一场集体版权诉讼。这场诉讼的原告是数千名作者和出版商,他们指控 Anthropic 使用盗版书籍训练 Claude 聊天机器人。
从公开信息来看,这是美国版权法历史上金额最高的和解案。
数字
和解覆盖了大约 48.2 万本书籍。每个符合条件的权利人每本书可获得约 3000 美元赔偿。截至法官批准时,超过 91% 的书籍已被作者或出版商认领,意味着大部分赔偿款将进入实际权利人的口袋。
原告律师 Justin Nelson 称这是「历史上已知最大规模的版权赔偿」。从社区讨论判断,这个数字本身具有标志性意义——它为 AI 训练素材的定价建立了第一个参照系。
案件始末:Andrea Bartz 的诉讼之路
这起集体诉讼最初由畅销惊悚小说作家 Andrea Bartz 在 2024 年提起,另外两名作者共同参与了起诉。Bartz 的代表律师发现,Anthropic 在训练 Claude 时使用了大量受版权保护的书籍,其中相当一部分来自 Library Genesis 和 Pirate Library Mirror 这类影子图书馆。
诉讼的核心指控并非仅仅是「用版权内容训练 AI」——这在法律上还是一个模糊地带。更致命的是 Anthropic 获取这些书籍的方式:直接从盗版网站下载,而非通过合法渠道购买或授权。
2025 年夏天,主审法官 William Alsup 作出了一个在行业内引起广泛讨论的混合裁决。
Alsup 的「混合裁决」:训练无罪,下载有罪
Alsup 的判决分成了两个部分。首先,他裁定「用版权书籍训练 AI 模型本身」构成合理使用(fair use)。这一判断被 AI 行业视为重大利好。Anthropic 的副总法律顾问 Aparna Sridhar 在裁决后公开表示,这确立了「用书籍训练 AI 属于合理使用」的先例地位。
但裁决的另一面完全站在了作者们一边。Alsup 认定 Anthropic 从盗版网站下载数百万本书籍的行为,超出了合理使用的保护范围,构成侵权。在法庭看来,训练数据来源的合法性是独立于训练方式的另一个问题。AI 公司不能因为训练本身可能合法,就放任数据获取手段违法。
这一区分意味着:Anthropic 虽然赢了「原则」,但在「事实」上需要承担赔偿。
为何和解而非上诉
Alsup 在发布初步裁决后已经退休。Anthropic 面临的选择很明确——要么接受侵权问题进入陪审团审判,要么与作者方达成和解。考虑到陪审团可能裁定的惩罚性赔偿金额,15 亿美元的和解对 Anthropic 来说更像是「可控的成本」。
但从法律效力来看,双方选择和解也意味着 Alsup 的「训练属于合理使用」裁决不会经过上诉法院的检验。它只是地区法院的一位法官的个人判断,对其他案件没有约束力。TechCrunch 的报道指出,其他法官仍可以在自己的案件中作出完全不同的结论。
律师费与代表赔偿
一个值得提及的细节是,法官将集体诉讼律师费从索赔金额的 12.5%(约 1.875 亿美元)砍到了 6.8%(约 1.01 亿美元)。三位集体诉讼代表每人仅获得 1.5 万美元的额外赔偿。从公开信息来看,法院对律师费用的把控相当严格。
对 AI 行业的连锁影响
这起案件的意义不止于 Anthropic 一家公司。
就在同一个月,包括 Hachette、Cengage、Elsevier 在内的出版商,以及作家 Scott Turow 等人,针对 Google 提起了类似的集体诉讼,指控 Google 使用版权作品训练 Gemini 平台。这起新案由同一家律师事务所代理,几乎可以看作是 Bartz 案的模式复制。
Google、Meta、Midjourney、OpenAI 目前都面临类似的版权诉讼。从社区讨论判断,Bartz 案虽然和解收场,但它确立了一个核心区分框架:训练行为本身与数据获取行为在法律上可以被分开审视。
对于 AI 公司来说,这意味着未来不能仅仅依赖「合理使用」作为全面免责的理由。训练数据的供应商审核、来源授权链的合规性,正在从「可做可不做」变成实际上的法律要求。

15 亿美元,定价了什么
和解金额虽然巨大,但放在 AI 行业的资本投入背景中看并不算离谱。Anthropic 在 2025 年完成的融资轮次总额超过百亿美元,15 亿美元相当于几个月到半年的融资额度。
但更值得关注的是「每本书 3000 美元」这个单价。如果把 AI 模型看作一个知识产品,训练素材的成本终归要被量化。3,000 美元一本书——这是市场第一次给「AI 训练用数据」标出实际价格。
这一定价必然被后续案件引用。无论是 OpenAI 与纽约时报的拉锯战,还是 Getty Images 起诉 Stability AI 的图像版权案,权利人和 AI 公司都会基于这个数字来谈判和博弈。
从更宏观的视角来看,AI 训练数据的版权问题处于法律定性与产业博弈的交汇点上。15 亿美元的数字本身不会解决所有争议,但它给出了一个起点。
各方的反应
Anthropic 方面对和解结果表示满意。Aparna Sridhar 在一份声明中说:「超过 91% 的作者和出版商已经认领了他们的赔偿份额,我们期待尽快了结此事。」
作者方面的态度更为复杂。一方面,这是历史上最大规模的版权赔偿;另一方面,训练 AI 本身被认定为合理使用,意味着作者无法从根本上阻止 AI 模型使用他们的作品。对于许多创作者来说,和解更像是一个「被动的价格接受」,而非主动的权利主张。
从社区讨论中也能看到这种分歧。HN 上的一位用户指出,法官在案件中削减了律师费,同时代表赔偿金额偏低,暗示法院并不认为这是一个可以让律师暴富的案件。
尚未结束的故事
这起案件的和解虽然画上了句号,但它引发的连锁诉讼远未结束。Google 的新案还处于早期阶段,OpenAI 的音乐版权案、Midjourney 的图像版权案都在推进中。
从公开信息来看,美国法院系统目前对这些案件的处理方式——分开审视训练行为和获取行为——可能会成为后续案件的参考框架。AI 公司需要证明两件事:一是「我的模型是用公开数据训练的」,二是「我的数据是通过合法途径获取的」。
对于全球范围内的 AI 监管来说,这个案例也提供了一个有用的切割点:监管者可以在不否定 AI 训练本身的情况下,对数据获取环节提出更严格的要求。
15 亿美元是 AI 与版权制度第一次真正意义上的碰撞结果,后续还会有更多。
本文的素材来自公开信息和社区讨论。如果你对这个话题有更深入的一手经验,欢迎指出文中的不足。