索尼与华纳起诉Anthropic,指控其大规模盗用版权音乐训练Claude
摘要:索尼音乐、华纳音乐等唱片公司起诉Anthropic及其CEO Dario Amodei和联合创始人Benjamin Mann,指控其未经许可使用数万首受版权保护的音乐作品(主要是歌词)训练Claude模型。原告称Amodei明确指示并促成侵权行为,每件侵权作品索赔最高15万美元。此前Anthropic已于2025年9月就盗版书籍训练达成15亿美元和解。
诉讼核心:从数据抓取到个人追责
诉状关键细节
这场诉讼的靶心非常明确。2026年8月29日晚间,索尼音乐出版与华纳查佩尔音乐联合多家音乐出版商,向美国加州北区联邦地区法院提起重磅诉讼。诉状长达48页,指控Anthropic开展了一场「明目张胆的知识产权盗窃」行动。

被告摊上事了
根据诉状披露的关键信息,Anthropic在开发Claude系列模型的过程中,通过种子下载(torrent)、网页爬取等非法手段,大规模获取了数千部受版权保护的音乐作品,包括歌词与乐谱。这些作品涵盖了泰勒·斯威夫特、玛丽亚·凯莉、马文·盖伊等知名音乐人的经典曲目,以及《Eye of the Tiger》等家喻户晓的作品。原告将此定性为「史上规模最大、性质最为恶劣的持续性知识产权盗窃行为之一」。
更引人注目的是,原告首次将Anthropic创始人及高管列为个人被告。诉状明确指出,CEO达里奥·阿莫代伊和联合创始人本杰明·曼「明确指示并促成」了相关侵权行为。这种将个人卷入的责任追究方式,在美国科技公司的版权纠纷中并不常见,也显示出版权方的施压策略:通过提高个人法律风险,迫使AI团队回到谈判桌。
每件侵权作品的索赔金额高达15万美元。如果法院支持原告请求,Anthropic面临的赔偿总额可能极为惊人。

索尼与华纳起诉Anthropic的核心指控链路
被告方的回应
Anthropic方面迅速作出回应。公司发言人在声明中明确表示:「我们不同意出版商的说法,我们打算在法庭上有力地捍卫自己。」这一表态与2025年9月书籍版权案的和解姿态形成鲜明对比——彼时Anthropic选择支付15亿美元和解,而非继续对抗。
不过,诉状中有一个细节值得关注:原告指控Anthropic不仅使用了音乐作品训练Claude,还盗用了数百万书籍的内容。这一指控将案件从「音乐版权纠纷」延伸到了更广泛的「AI训练数据合法性」争议。
这场诉讼的显著特征之一,是将Anthropic的两位创始人Dario Amodei和Benjamin Mann列为个人被告。
在美国著作权诉讼实践中,这种「个人追责」策略并非首次出现,但在AI行业仍属少见。通常版权诉讼针对的是公司实体,创始人个人很少被列为共同被告。此次原告选择将个人纳入被告范围,传递的信号是:他们试图证明侵权行为不是单纯的「团队决策」或「技术探索」,而是由高层直接指挥、促成甚至积极参与的系统性行为。
这种做法的法律依据主要指向著作权法中的「诱导侵权」理论(induced infringement)——如果被告明知侵权行为的存在,却积极诱导、鼓励或促成他人实施侵权,可能需要承担连带责任。诉状中提到的「Amodei明确指示并促成侵权行为」,正是试图建立这一连接点。
从实务角度看,个人追责的意义不在于最终判决能否执行到位,而在于提高谈判杠杆。一旦创始人的个人资产面临风险,和解的压力会显著上升。

这锅得有人背

个人追责的法律逻辑链
关于索赔金额的计算逻辑,每件侵权作品最高15万美元,是基于美国著作权法中的法定赔偿(statutory damages)条款。在证明实际损失困难的情况下,版权方可以选择按件索赔而非按实际收益计算。
如果原告主张的「数万件」作品得到法院认可,且每件均按上限计算,潜在赔偿金额可能达到数十亿美元级别。当然,最终赔偿数额需要经过审判或和解谈判确定,15万美元/件只是诉状中的上限主张。
诉讼涉及的核心证据之一,是Anthropic获取训练数据的具体路径。诉状明确指出,公司通过torrent(种子下载)、网页爬取等方式,从盗版平台获取了数千首受版权保护的音乐作品,包括泰勒·斯威夫特、玛丽亚·凯莉等歌手的经典曲目歌词。
这里需要区分两种数据获取方式:合法授权渠道与盗版渠道。Spotify、Apple Music等流媒体平台通过与唱片公司和出版商签订授权协议,获得音乐内容的传播权。但这些授权通常仅限于播放服务,不包含将作品内容用于训练AI模型的权利。
Torrent种子下载和网页抓取则完全绕过了授权机制。前者直接从P2P网络获取未授权复制的文件,后者通过自动化程序收集公开网页上的受保护内容——即便这些内容在网站端是「可见」的,也不意味着可以无偿用于商业训练。

你说的有用吗
歌词版权的复杂性在于,一首歌曲涉及多重权利:词作者拥有词曲版权,表演者和唱片公司拥有录音版权。本次诉讼主要针对的是歌词和乐谱——即词曲层面的版权,而非录音本身。这意味着即使Anthropic声称未使用任何音频文件,只要训练数据中包含受保护的歌词文本,就可能构成侵权。
Claude能输出与原作高度重合的歌词,这一事实本身就是最直接的技术证据。模型在训练中接触了某段歌词,随后在特定提示下复现了这段歌词,这在法律上构成了从「学习」到「再现」的跨越。

证据链闭环
与2025年9月达成的15亿美元书籍版权和解案相比,此次音乐版权诉讼呈现出几个显著延续。
首先,两者都涉及通过盗版渠道获取训练数据的问题。书籍案的核心发现是,Anthropic未能证明其数据获取的合法性,法院认定通过盗版途径复制作品构成侵权。音乐案的逻辑与此一致:不管数据「看起来」是否公开,获取方式本身违法。
其次,两案都聚焦于模型输出与原始作品的高度相似性。书籍案中,Claude能生成与版权书籍内容相近的段落;音乐案中,Claude能输出与歌词几乎一致的文本。这种输出层面的再现能力,是推翻「合理使用」抗辩的关键。
不过,音乐版权与书籍版权也存在差异。书籍是完整的文学作品,有明确的作者、出版商和定价体系;而歌词更接近短诗或微型文学,其独立价值有时被低估。本次诉讼强调歌词的版权属性,实际上是推动司法系统确认:即使是音乐作品中的歌词部分,也具有独立的版权价值。

书籍案与音乐案的核心对比
对于音乐行业而言,这场诉讼还有一个独特背景:音乐授权市场已经相当成熟。Spotify、Apple Music等平台每年向唱片公司和出版商支付数十亿美元的授权费用,形成了清晰的市场价格基准。
这意味着AI公司不能再以「缺乏参考价」为由,主张训练数据成本无从计算。相反,版权方可以参照流媒体授权费率,推算出合理的使用费标准。当原告主张每件作品最高15万美元的法定赔偿时,这个数字本身就在向市场传递信号:未经授权使用受版权保护内容的成本,远高于通过正常授权渠道获取的成本。
从行业影响来看,索尼和华纳的这次起诉,配合此前书籍案的和解结果,正在推动AI训练数据获取规则的重塑。过去行业内流行的「先抓取、后谈判」策略,正逐渐失去可行性。未来AI公司可能需要转向「先付费授权、后模型训练」的模式。

成本要重新算了
对于Anthropic而言,这场诉讼与其书籍案和解之间存在一定的策略张力。一方面,15亿美元的和解金额已经显示了公司在版权问题上的高成本承担能力;另一方面,创始人被列为个人被告,意味着公司层面的和解无法完全隔离个人法律风险。
目前Anthropic的回应是「不同意原告说法,将在法庭上捍卫自己」。这一表态与书籍案中最终选择和解的路径不同,也预示这场音乐版权诉讼可能需要经过较长时间的审理。
无论最终结果是和解还是判决,这场诉讼已经在重塑AI行业的规则边界:未经授权的数据获取不再是一个可以被忽视的灰色地带,版权方有能力通过精确的技术证据和法律策略,将风险从公司层面延伸至个人层面。
从书籍到音乐:诉讼范围的扩大
Sony Music Publishing 与 Warner Chappell 的诉状将案件范围延伸至数千首音乐作品。与之前的书籍侵权案相比,音乐版权方的证据链更加具象。诉状列举了包括泰勒·斯威夫特、玛丽亚·凯莉、马文·盖伊等艺术家的作品,并指认 Claude 在交互中能生成与原作高度重合的歌词。
这种「输出端可验证」的侵权证据,在书籍案中是难以直接获得的。书籍的创意表达通过模型训练后被压缩为权重参数,几乎无法追溯具体出处;而歌词具有强辨识度,一旦模型输出与原作雷同,版权方可以直接比对。这也解释了为何音乐出版商选择在此时发起诉讼。

证据链更硬了

书籍侵权 vs 音乐侵权的证据差异
训练数据获取方式的司法定性
这次诉讼中,原告特别强调 Anthropic 通过 torrent 种子下载和网页爬取获取数据。2025年的书籍案中,法院已明确判定通过盗版途径获取内容属于侵权,即便后续使用可能构成合理使用,数据获取行为本身不受豁免。
这一司法逻辑被复制到音乐案中。诉状中提到的「非法种子下载、抓取和下载」,正是试图建立与书籍案相同的违法路径。如果法院沿用上位判决,训练数据获取的合法性将被直接否定,Anthropic 的「合理使用」抗辩空间会大幅收窄。

路径已被锁定
Anthropic 的回应与抗辩方向
Anthropic 发言人声明「不同意出版商的说法,打算在法庭上有力捍卫自己」。这句话的潜台词是:公司仍可能主张训练行为属于合理使用,但不会否认数据获取方式存在问题。
从过往案例看,Anthropic 的选择是「先和解、后规范」。书籍案最终以15亿美元和解收场,OpenAI 同样面临类似诉讼并走向谈判桌。音乐案短期内演变为和解的可能性较高,但金额预期会更低——因为音乐作品的单件价值与书籍不同,且原告数量更多、诉求分散。

和解谈判桌上见
这场诉讼的行业影响
「先抓取、后谈判」的模式正在失去效力。
书籍案和音乐案的叠加信号明确:法院不再接受「我用于训练,所以合法」的论点。数据获取的合法性将成为审判前置问题,而非事后谈判筹码。这意味着 AI 公司的训练数据策略必须从「能抓多少就抓多少」转向「授权优先、补充次要」。

合规成本上台

训练数据策略的范式迁移
授权成本如何影响 AI 商业模式
音乐版权的规模化授权并非小事。Sony Music Publishing 和 Warner Chappell 管理的曲库涵盖数万首作品,每件作品索赔上限15万美元。即便最终赔偿额远低于诉请,和解成本也会显著拉高模型训练预算。
对中小企业而言,这是额外的进入壁垒。拥有自有数据池或提前锁定授权的公司,将在成本结构上形成优势。Anthropic 的估值逻辑中,数据成本是一个隐藏变量,一旦这个变量被司法判决显性化,市场定价需要重新校准。

钱要付了
模型输出侵权与训练数据侵权的双线战场
音乐案的特殊性在于,它同时进攻两条战线:一是训练数据获取的合法性,二是模型输出歌词的重合度。
前者关注输入,后者关注输出。即使 Anthropic 能证明训练数据获取方式合法,如果 Claude 的输出能够生成与受保护歌词高度相似的内容,仍可能构成衍生侵权。这对 Anthropic 的产品安全框架提出了新的要求——输出过滤和版权识别机制需要从「可选项」变成「必选项」。

双重防线
对开发者的可执行判断
从实务角度,这件事给出三条可执行的判断。
第一,如果你的团队还在依赖公开爬取的数据集训练模型,尽快评估版权风险。优先切换到有明确授权来源的数据,或者使用已开源、许可清晰的替代数据集。短期成本高,但法律风险低。
第二,检查模型的输出端是否有歌词或文本重合格式。如果产品面向消费级用户,建议加入简单的相似度检测和输出过滤。这不是技术问题,是合规问题。
第三,关注 Anthropic 和 OpenAI 的后续和解方案。这两家大厂的谈判结果将为整个行业设定基准价格。在你决定自建数据授权策略之前,等这波案子落地。

先守住底线
这起诉讼不只是一次版权维权,更是 AI 行业数据获取规则的一次重新定义。当司法逻辑从「结果导向」转向「过程审查」,依赖灰色地带的训练策略将全面失效。对开发者来说,现在不是观望的时候,而是调整数据采购和输出管控策略的最佳窗口。
参考文献
[1] 索尼与华纳联合起诉Anthropic,指控其大规模盗用版权音乐 .... https://m.sohu.com/a/1069583688_122014422?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334
[2] 索尼华纳起诉Anthropic大规模盗用版权音乐训AI. https://www.cfi.net.cn/p20260830000005.html
[3] 索尼与华纳联合起诉Anthropic,指控其大规模盗用版权音乐 .... https://finance.sina.com.cn/stock/t/2026-08-30/doc-iniqakfv5106268.shtml
[4] 索尼与华纳联合起诉Anthropic,指控其大规模盗用版权音乐 .... https://finance.sina.com.cn/wm/2026-08-30/doc-iniqakfx8410293.shtml
[5] 索尼和华纳起诉Anthropic,因Claude训练中使用数万首歌曲. https://www.huxiu.com/ainews/14802.html?content_id=51884
[6] 索尼起诉Anthropic:Claude盗用歌词训练索赔 | 热门动态 | HyperAI超神经. https://hyper.ai/cn/stories/9b166dff59dac0c225cfe409064d7f80
[7] Music publishers sue Anthropic, allege "blantant theft" of copyrighted music. https://www.axios.com/2026/08/29/anthropic-sony-warner-music-copyright
[8] 科技新聞:⚖️ 訓練AI 用的音樂,原來是torrent 下載回來的?. https://www.threads.com/@whaleagent/post/Dcpv48ek5LM/media
浙公网安备 33010602011771号