2026年7月20日,加利福尼亚州一名联邦法官批准了版权史上规模最大的一项和解:15亿美元,涉及482,460本书。做除法可知,平均每部作品约合3109美元,大约是美国17 U.S.C. 504条规定的故意侵犯版权法定最低赔偿额的四倍。这个数字并不是Anthropic为用书籍训练AI模型而谈判出的罚款。它更接近于这样一种代价:公司无法就数十万部单独作品证明自己一开始就拥有持有该副本的合法权利。
法院究竟裁定了什么
该案名为Bartz v. Anthropic,在美国加利福尼亚北区联邦地区法院审理。法官Araceli Martínez-Olguín于2026年7月20日对这项集体诉讼和解作出终审批准,结束了一起被出版商、作者以及每一家拥有以书籍构建的训练数据集的AI实验室密切关注的案件。获认证的集体涵盖482,460部作品,Authors Guild称其为美国版权诉讼史上金额最大的一笔赔偿。
15亿美元除以482,460部作品,得出的结果非常接近每本书3109美元。这个数字的重要性,与其说在于Anthropic为此付出了多少代价,不如说在于是什么触发了它:对于其中每一部作品,都没有人能拿出许可证、购买凭证或任何其他能够证明持有该副本权利的文件记录。这类和解并非孤立事件。Copyright Alliance的数据显示,仅在2025年一年,与AI相关的版权诉讼就从约30起增加到70多起,这意味着法院提出同样问题的案件数量还在持续上升。
训练与存储:真正起作用的那条界线
很容易把这项和解解读为"用书籍训练AI是违法的"。但基础裁决说的并不是这个意思,把两者混为一谈是一个值得避免的错误。此前那项为这次和解铺路的法院裁决认为,用受版权保护的书籍训练AI模型可以构成合理使用。而没有被开脱的,是Anthropic最初获取大量书籍的方式:从Library Genesis和Pirate Library Mirror等影子图书馆获取并存储盗版副本。训练是一个法律问题。持有盗版副本是另一个问题,正是后者产生了那15亿美元的数字。
对任何想从这起案件中总结经验的人来说,这一区分很重要。风险并非来自训练模型这一行为本身,而是来自来源证明上的缺口:无法逐部作品准确说明一份副本究竟是在何时、以何种方式落入公司手中的。
如果你没有被起诉,这意味着什么
大多数创作者和公司永远不会成为这类案件的被告。但同样的来源证明缺口在桌子的另一边同样存在,无论你是提出主张的一方,还是被要求作出回应的一方。如果你的作品最终出现在别人的训练数据集里,或者竞争对手对你围绕某项内容建立的产品或品牌提出权利质疑,法院或谈判对手首先会问的问题,与决定Bartz v. Anthropic案结果的那个问题是同一个:你能否用一个日期和一份可核实的记录,证明在任何人提出主张之前,这件作品就已属于你?
对一份文件加盖有日期、可通过密码学核实的印章,并不能让一场诉讼消失,也不能改写一场纠纷的事实。它改变的是起点。你不必在事后、在截止期限压力下、在对方律师面前重新拼凑文件记录,而是直接拿出一份早已存在的记录。AI训练纠纷中的计算,恰恰建立在这种证明之上:谁在什么时候拥有了什么。
如果你想在纠纷迫使你回答这个问题之前,了解自己的内容在这个尺度上处于什么位置,IP风险计算器会梳理与此类主张相同的变量:你已发表的作品中有多少拥有带日期的所有权记录、这些作品是如何获得授权的,以及缺口出在哪里。





