TechCrunch刊文称,围绕 AI 模型能否使用受版权保护的书籍训练,美国法律目前仍没有清晰结论。现有判决显示,法院并不一定把“训练”本身视为侵权,但如果训练材料来自盗版渠道,相关公司仍可能面临巨额赔偿。
Anthropic案释放复杂信号
文章提到,去年美国法官 William Alsup 在一起作家集体诉讼中,要求 Anthropic 支付 15 亿美元版权和解金。不过,这一裁决并未直接否定 AI 训练行为本身。法官的处罚重点,是 Anthropic 从非法“影子图书馆”获取书籍。
按该案的裁判思路,模型学习海量文本,更接近“阅读并吸收内容”,而不是简单复制作品。文章援引知识产权律师 Cathy Gellis 的说法称,这种认定对 AI 公司整体上更有利,因为版权法主要约束复制行为,而不直接禁止阅读、使用或接触作品内容。
争议集中在合理使用
报道指出,美国现行版权法制定于 1976 年,面对今天的生成式 AI,法院只能用旧规则解释新问题。当前多数案件的关键,在于 AI 训练是否属于“合理使用”,尤其要看这种使用是否具有足够的“转换性”。
法院通常会考量几项因素,包括使用目的、作品性质、使用比例,以及对原有市场的影响。文章援引律师 Jason Henderson 的观点称,如果一家公司使用他人内容训练模型,是为了直接打造竞争产品,法院通常会更谨慎;如果不构成直接竞争,获得支持的空间会更大。
是否构成竞争仍是焦点
文章举例称,Thomson Reuters 起诉 Ross Intelligence 一案中,法院认定后者使用前者内容开发 AI 法律平台,不属于合理使用,原因之一是双方产品存在直接竞争关系。
相比之下,作家虽然可以主张聊天机器人利用其作品生成新内容,进而挤压作者收入,但这一论点目前尚未在法院取得决定性胜利。也就是说,AI 输出是否足以替代原作者市场,仍是后续案件的重要争点。
AI生成内容也有另一层问题
文章还提到,AI 训练是否合法,与 AI 生成内容能否获得版权,其实是两套不同问题。此前在 Thaler v. Perlmutter 一案中,美国法院认定,完全由 AI 生成的作品不能获得版权保护。
这也带来新的现实问题:如果一部作品部分由 AI 辅助完成,如何界定人类创作比例,未来仍可能继续引发争议。TechCrunch认为,在大量案件仍处于审理阶段的情况下,美国法院短期内很难给出统一答案,但现有判决已经开始影响 AI 公司的训练和数据使用方式。












