Sony 和 Warner 再诉 Anthropic,争点不只训练是否公平使用,而是语料怎么拿到
Sony Music Publishing、Warner Chappell 等音乐出版商在美国加州北区联邦法院起诉 Anthropic,并把联合创始人 Dario Amodei、Benjamin Mann 列为被告。原告称 Anthropic 通过非法下载和抓取取得含歌词、乐谱在内的大量版权作品,用于训练 Claude
作者:韩启明|OC 政策与安全编辑
Sony Music Publishing、Warner Chappell 等音乐出版商在美国加州北区联邦法院起诉 Anthropic,并把联合创始人 Dario Amodei、Benjamin Mann 列为被告。原告称 Anthropic 通过非法下载和抓取取得含歌词、乐谱在内的大量版权作品,用于训练 Claude。
一句话结论:这起案件最关键的法律分叉不是模型训练抽象上能否构成合理使用,而是 Anthropic 获取和保存训练材料的方式是否本身构成侵权。
过去两年,AI 版权争论经常被简化成一个问题:模型“学习”作品是否类似人的阅读。但法院正在把链条拆得更细。即使某种训练用途可能被认定为转换性使用,获取语料时复制盗版文件、建立永久资料库,仍可能是另一项独立行为。音乐出版商正试图沿着这条路径推进案件。
这一策略与此前书籍作者针对 Anthropic 的诉讼有关。相关法院区分了训练用途与盗版获取:训练过程获得过对 Anthropic 有利的合理使用判断,但通过影子图书馆取得并保存书籍的行为没有因此自动合法化。案件之后出现高额和解。新诉状显然希望把相同的“来源链条”问题延伸到歌词和乐谱。

音乐作品还有自己的复杂性。歌词、曲谱、录音制品不是同一组权利,出版商主张的通常是词曲作品权利。报道所述诉状长 48 页,但起诉指控并不等于法院认定;Anthropic 已否认相关主张并表示将抗辩。现阶段不能把“盗版训练”直接写成既成事实。
对模型公司,风险控制也不能只留在“输出是否复现作品”。训练数据治理需要回答:文件从哪里来、当时依据什么许可、是否保留原始副本、谁批准数据集、删除请求如何传递到衍生版本。数据量越大,缺失的来源记录越可能在诉讼中变成成本。
对创作者,案件结果也不必然回答所有生成式 AI 版权问题。法院可能只就特定数据来源、特定复制行为或程序问题作出判断,而不是一次性规定所有训练是否合法。风险要拆开看:获取、存储、训练、输出和产品分发,各有不同事实与抗辩。
关键事实
- 来源:TechCrunch、Axios、此前相关法院案件报道
- 原告:Sony Music Publishing、Warner Chappell 等音乐出版商
- 被告:Anthropic 及两位联合创始人
- 核心指控:通过未经授权的下载或抓取取得版权歌词、乐谱等训练材料
OC 判断
把所有争议压缩成“训练是不是合理使用”,会错过这轮诉讼真正锋利的部分。模型公司即使能为训练目的辩护,也需要为语料进入系统的每一步提供可审计依据。内容行业则要证明具体作品、具体复制和具体权利,而不是只靠对 AI 的普遍不满。
为什么重要
- 对开发者:模型与数据管线需要记录来源、授权和删除处理,而不只是输出过滤。
- 对企业:采购模型时,训练数据赔偿条款和来源治理会继续成为合同重点。
- 对创作者:案件可能强化对语料取得方式的追责,但不会自动解决所有训练争议。
评论
围绕这篇文章补充信息、提出问题或分享观察。