2026年8月28日,索尼音乐出版、华纳查佩尔音乐及其关联出版商在美国加利福尼亚北区联邦地区法院起诉Anthropic,同时将联合创始人Dario Amodei和Benjamin Mann列为被告。诉状指控Anthropic通过种子下载、网页抓取等方式获取受版权保护的音乐作品,并在Claude系列模型的训练及部分输出中实施未经授权的复制。需要强调的是,这些目前均为原告主张,法院尚未认定Anthropic构成侵权。Anthropic则表示不同意相关指控,并将积极应诉。相关事实可对照起诉状原文与TechCrunch报道。
这场诉讼争议的不只是“模型有没有学过歌曲”
本案最值得关注的地方,是原告把多种行为放进了同一条侵权链条:训练资料如何获得、作品如何进入内部数据库、训练过程中是否形成复制件,以及Claude是否会输出受保护的歌词或其他音乐作品内容。根据诉状,原告提出的请求包括直接版权侵权、帮助侵权以及删除或篡改版权管理信息等,并要求陪审团审理、销毁涉嫌侵权的复制件、披露相关训练数据和方法。Music Business Worldwide的案件梳理与诉状均显示,原告试图证明的不是单一技术动作,而是一套持续发生的数据获取和利用行为。
因此,讨论“AI训练是否属于合理使用”还不够。即使法院认为某些训练行为具有转换性,也不意味着模型开发者可以从未经授权的来源取得作品。数据来源是否合法、复制是否超出技术必要范围、模型输出是否替代原作市场,可能要分别判断,不能用一个“训练是学习”的概念全部覆盖。
责任认定可能分成四个层次
一、训练资料的取得是否合法
原告首先需要证明自己拥有相关音乐作品的有效版权,并证明Anthropic实际接触、下载或复制了这些作品。如果资料确实来自被指称的盗版资源库或未经许可的下载渠道,Anthropic就要面对一个独立问题:即使后续训练具有新的技术目的,前端取得和保存盗版复制件是否已经构成侵权。
这一“来源与用途分开审查”的思路已有可参照案例。在Bartz诉Anthropic案中,法院曾区分合法购买后用于训练的书籍与从盗版网站取得的书籍。法院认为特定训练用途可以构成转换性合理使用,但并未因此豁免盗版资料的获取和持续保存。该案后来以15亿美元和解,并于2026年7月获得法院最终批准。需要注意,和解本身不等于本案的责任结论,但它显著提高了训练数据来源审计的重要性。可参见美联社2026年7月21日报道及Bartz案裁判分析。
二、训练复制能否适用合理使用
美国版权法通常依据使用目的与性质、作品属性、复制数量与实质程度,以及对潜在市场的影响等因素综合判断合理使用。音乐作品具有较强的表达性,完整复制大量歌词或乐谱可能对被告不利;但如果复制只服务于模型分析,最终输出不再现原作,Anthropic可能主张训练具有转换性。
美国版权局于2025年5月发布的生成式AI训练报告没有给出“所有训练都合法”或“所有训练都侵权”的统一答案,而是强调具体事实审查。报告同时指出,商业性、训练作品的表达程度、输出替代风险以及许可市场受影响的程度,都可能改变结论。由此看,本案结果将高度依赖Anthropic实际使用了什么数据、保留了多久、进行了多少次复制,以及Claude能否重现作品。相关框架可查阅美国版权局AI专题页面和生成式AI训练报告。
三、模型输出是否构成新的侵权
训练输入与模型输出是两个不同的责任环节。原告若主张Claude输出歌词构成侵权,通常还需证明输出与受保护表达达到实质性相似,而不能只证明作品曾出现在训练集中。法院还可能考察输出是否由普通提示即可触发、是否需要刻意规避安全措施,以及Anthropic获知风险后是否采取了有效过滤措施。
这一区分直接影响平台治理。如果高度近似的歌词只是极端提示下偶发生成,被告可能据此质疑因果关系和损害范围;如果普通用户能够稳定获得大段受保护内容,原告关于直接侵权、市场替代和禁令救济的主张就会更有力量。诉状所述输出案例仍需在证据开示和技术测试中接受核验,不能直接视为法院已确认的事实。
四、创始人个人是否承担责任
本案还将两名联合创始人列为被告,意味着原告希望追查获取训练资料的决策链。如果证据显示个人直接参与种子下载、指挥相关行为,或明知侵权仍提供实质帮助,个人责任主张可能继续推进;反之,仅凭管理职务或创始人身份,通常不足以自动成立责任。邮件、内部审批记录、数据采购政策和风险警告将成为关键证据。
对AI企业和内容平台的实际启示
- 建立数据来源账本:记录每批数据的来源、授权范围、获取时间、处理方式和删除规则,避免无法证明数据合法 provenance。
- 把数据取得与训练用途分别评估:合理使用分析不能替代对下载、缓存、去重、长期保存等行为的合规审查。
- 加强输出测试:针对歌词、乐谱、文章和代码等高风险内容进行记忆性测试,并为权利人提供通知与快速处置机制。
- 保存管理层决策依据:重大数据方案应经过法律审查,明确责任人并记录纠正措施,降低帮助侵权或个人责任风险。
- 评估许可方案:当训练内容高度集中于特定权利人,且模型可能与其授权市场竞争时,批量许可可能比事后诉讼更可控。
总结
索尼音乐出版与华纳查佩尔对Anthropic的诉讼,真正要回答的不是“AI能不能学习音乐”这一抽象问题,而是模型公司能否证明训练资料来源合法、训练复制具有合理目的、输出不会替代受保护作品,并且管理层已经采取了必要的风险控制。未来法院即使认可部分AI训练具有转换性,也可能同时认定通过盗版渠道取得资料属于独立侵权。对生成式AI行业而言,模型能力不再是唯一竞争要素,可追溯的数据来源、清晰的授权边界和可验证的输出防护,正在成为同样重要的基础设施。
事件及资料日期:
起诉状提交日期:2026年8月28日,见Sony Music Publishing等诉Anthropic起诉状。
新闻核验日期:2026年8月29日,见TechCrunch报道与Music Business Worldwide报道。
参考资料日期:美国版权局生成式AI训练报告预发布于2025年5月9日,见官方报告;Bartz案和解最终批准信息更新于2026年7月21日,见美联社报道。