我的立场:大家争论的焦点如果停留在「AI 训练算不算侵权」,就已经跟错了这场判决真正划出的边界。Alsup 明确说了训练本身「高度转化性」(exceedingly transformative),受合理使用保护——这条线其实对 AI 公司是利好。真正让 Anthropic 掏钱的,是另一条完全独立的线:留存盗版副本建一个永久性「中央图书馆」,这件事本身不受合理使用保护,跟这些书后来有没有被拿去训练模型没有关系。这个区分,才是这场判决对后续所有类似案子最有参考价值的部分。

判决拆成了两件事,不是一件事

Alsup 在 2025 年 6 月的判决里,把 Anthropic 的行为拆成了两条独立的线索来判断:

  • 用书训练 LLM 这个行为本身——法官认定这是「高度转化性」的合理使用,无论书是合法购买获得,还是(在训练这个动作本身的意义上)来自其他渠道,训练这件事本身受合理使用保护。
  • 下载并留存盗版副本,建立一个永久性「研究图书馆」——Anthropic 从 LibGen 和 Pirate Library Mirror 这类盗版站点下载了数百万本书,不仅用于训练,还留作公司内部长期资源库。法官认定这一部分不受合理使用保护,这是纯粹的版权侵权。

换句话说,「AI 训练需要用书」这件事本身没有被判违法,被判违法的是「用盗版渠道拿书、且长期留存」这个动作。这个区分解释了为什么后续 15 亿美元的和解,赔的是「盗版下载并留存」这部分,不是「训练模型用了受版权保护的内容」这部分。

大家争的焦点为什么搞错了

公众讨论习惯把这类案子简化成「AI 用了我的书,该不该赔」,这个框架下,唯一的问题是「用了多少、赔多少」。但 Alsup 的判决实际上在回答一个更根本的问题:谁有权决定一本书可以被怎样使用、以什么渠道被获取。训练本身被认定为转化性使用,意味着「内容被 AI 消化后用于生成新内容」这条路径,本身不需要额外授权——这实际上是在重新划定「使用」和「获取」这两件事各自的权利边界:使用方式可以被判定为高度转化、无需额外授权;但获取渠道必须合法,无法用「反正后来是拿去做转化性使用了」来倒推获取行为本身也合法。

这才是我认为「知识的解释权」这个说法比「版权赔偿」更准确的地方:这场判决没有回答「AI 能不能用书」,它回答的是「谁有资格决定一份内容进入训练管线的正当路径是什么」。出版社、平台、盗版站点、AI 公司之间关于「谁能合法地把内容变成训练数据」的博弈,才是这场官司真正的赌注,赔偿金额只是这场博弈的一个阶段性结算。

评论员视角

我认为这个先例最大的影响不在 Anthropic 身上,而在于它给行业里所有还没被起诉的公司划了一条清晰的操作红线:合法获取的内容用于训练大概率能获得合理使用的保护,但通过盗版渠道获取并留存,无法靠「后续用途正当」来洗白。这意味着接下来这类诉讼的焦点会从「AI 训练是否侵权」这种宏大命题,转移到更具体、更可举证的「数据来源是否合法」这个技术性问题上——这对原告方(作者、出版社)反而是更容易打赢的战场,因为证明「渠道是盗版站点」比证明「转化性使用不成立」容易得多。

我也想指出这个判决留下的一个悬而未决的问题:如果一家公司从一开始就只用合法购买的内容训练,这场官司里对 Anthropic 不利的那部分风险就完全不存在。这意味着「数据来源合规」这件事,正在从一个道德加分项,变成一个有真实法律成本差异的工程决策——数据团队现在必须像对待安全漏洞一样对待数据来源审计。