> 来源：UsefulAI（实用 AI / Useful AI）— https://usefulai.cloud/insights/anthropic-copyright-interpretation/
> 作者：CarryChang · 最近更新：2026-09-13 · 语言：zh-CN

[实用 AI 指南](https://usefulai.cloud/) › [深度阅读](https://usefulai.cloud/insights/)

Bartz v. Anthropic
版权
合理使用
法官 Alsup

# 我们可能误读了 Anthropic 的「销毁书籍」：它争的从来不是版权，是知识的解释权

Bartz v. Anthropic 这场官司，大多数报道停留在「AI 公司用了盗版书训练模型，该赔钱」这个层面——15 亿美元、约 50 万部作品、每部约 3000 美元，数字确实抓眼球。但主审法官 William Alsup 的判决逻辑比这复杂得多：他把「用书训练模型」和「训练用的书是从哪来的」拆成了两件事分别判。我认为这个拆分本身，比赔偿金额更值得说清楚。

**我的立场：**大家争论的焦点如果停留在「AI 训练算不算侵权」，就已经跟错了这场判决真正划出的边界。Alsup 明确说了训练本身「高度转化性」（exceedingly transformative），受合理使用保护——这条线其实对 AI 公司是利好。真正让 Anthropic 掏钱的，是另一条完全独立的线：留存盗版副本建一个永久性「中央图书馆」，这件事本身不受合理使用保护，跟这些书后来有没有被拿去训练模型没有关系。这个区分，才是这场判决对后续所有类似案子最有参考价值的部分。

### 判决拆成了两件事，不是一件事

Alsup 在 2025 年 6 月的判决里，把 Anthropic 的行为拆成了两条独立的线索来判断：

- **用书训练 LLM 这个行为本身**——法官认定这是「高度转化性」的合理使用，无论书是合法购买获得，还是（在训练这个动作本身的意义上）来自其他渠道，训练这件事本身受合理使用保护。

- **下载并留存盗版副本，建立一个永久性「研究图书馆」**——Anthropic 从 LibGen 和 Pirate Library Mirror 这类盗版站点下载了数百万本书，不仅用于训练，还留作公司内部长期资源库。法官认定这一部分不受合理使用保护，这是纯粹的版权侵权。

换句话说，**「AI 训练需要用书」这件事本身没有被判违法**，被判违法的是「用盗版渠道拿书、且长期留存」这个动作。这个区分解释了为什么后续 15 亿美元的和解，赔的是「盗版下载并留存」这部分，不是「训练模型用了受版权保护的内容」这部分。

### 大家争的焦点为什么搞错了

公众讨论习惯把这类案子简化成「AI 用了我的书，该不该赔」，这个框架下，唯一的问题是「用了多少、赔多少」。但 Alsup 的判决实际上在回答一个更根本的问题：**谁有权决定一本书可以被怎样使用、以什么渠道被获取**。训练本身被认定为转化性使用，意味着「内容被 AI 消化后用于生成新内容」这条路径，本身不需要额外授权——这实际上是在重新划定「使用」和「获取」这两件事各自的权利边界：使用方式可以被判定为高度转化、无需额外授权；但获取渠道必须合法，无法用「反正后来是拿去做转化性使用了」来倒推获取行为本身也合法。

这才是我认为「知识的解释权」这个说法比「版权赔偿」更准确的地方：这场判决没有回答「AI 能不能用书」，它回答的是「谁有资格决定一份内容进入训练管线的正当路径是什么」。出版社、平台、盗版站点、AI 公司之间关于「谁能合法地把内容变成训练数据」的博弈，才是这场官司真正的赌注，赔偿金额只是这场博弈的一个阶段性结算。

评论员视角
我认为这个先例最大的影响不在 Anthropic 身上，而在于它给行业里所有还没被起诉的公司划了一条清晰的操作红线：**合法获取的内容用于训练大概率能获得合理使用的保护，但通过盗版渠道获取并留存，无法靠「后续用途正当」来洗白**。这意味着接下来这类诉讼的焦点会从「AI 训练是否侵权」这种宏大命题，转移到更具体、更可举证的「数据来源是否合法」这个技术性问题上——这对原告方（作者、出版社）反而是更容易打赢的战场，因为证明「渠道是盗版站点」比证明「转化性使用不成立」容易得多。

我也想指出这个判决留下的一个悬而未决的问题：如果一家公司从一开始就只用合法购买的内容训练，这场官司里对 Anthropic 不利的那部分风险就完全不存在。这意味着「数据来源合规」这件事，正在从一个道德加分项，变成一个有真实法律成本差异的工程决策——数据团队现在必须像对待安全漏洞一样对待数据来源审计。

#### 判决拆成了什么

- 用书训练模型本身：认定为「高度转化性」合理使用

- 下载留存盗版副本建永久图书馆：不受合理使用保护，判定侵权

- 后续和解：约 15 亿美元，覆盖约 50 万部作品，每部约 3000 美元

- 盗版来源：LibGen 与 Pirate Library Mirror

#### 我的判断

- 真正的赌注是「谁有权决定内容进入训练管线的正当路径」

- 数据来源合规正在从道德加分项变成有真实成本差异的工程决策

- 接下来的诉讼焦点会转向更容易举证的「数据渠道是否合法」

## 继续阅读

[如何从零构建你自己的大语言模型：GPT 和 Claude 背后的 5 阶段流水线 → 所有前沿模型都由同样的五个阶段构建：数据 → 预训练 → 监督微调 → 奖励建模 → 强化学习。学会这套骨架，你就不会再把模型当作魔法。](https://usefulai.cloud/insights/how-llms-are-built/)
[Anthropic 工程师：我们日常如何使用 Claude Code → 用一个真实 repo 演示 Anthropic 工程师怎样配置 Claude Code、让它问问题、生成 HTML 规格稿，再把验证流程做进 React 组件和浏览器。](https://usefulai.cloud/insights/anthropic-how-we-use-claude-code/)
[深度阅读 → 15 篇 AI 长文的完整中文解读：Claude Code、Skill、Agent、大模型原理、LLM 资源地图。](https://usefulai.cloud/insights/)
