索尼音乐与华纳起诉 Anthropic:版权训练争议转向“盗版获取”
导语
生成式 AI 公司与内容产业之间的版权冲突,正在从抽象的训练合法性问题,转向数据来源是否合规的具体争议。索尼音乐出版、华纳音乐出版以及其他音乐出版商日前在美国加州北区联邦地区法院起诉 Anthropic 及其联合创始人 Dario Amodei、Benjamin Mann,指控这家 AI 公司实施了一场“公然的知识产权盗窃行动”。
据诉状相关指控,Anthropic 曾通过非法种子下载、抓取和下载等方式获取受版权保护的作品,并将其中数以千计的内容用于训练 Claude。Anthropic 则回应称不同意出版商的主张,将在法庭上进行有力抗辩。
核心要点
- 原告范围较广。 起诉方不仅包括索尼音乐出版和华纳音乐出版,还包括多家音乐出版商,代表音乐行业对 AI 训练数据来源的集体担忧。
- 争议重点是获取方式。 案件不只是讨论 AI 是否可以使用版权作品训练模型,还特别指向 Anthropic 是否通过种子等渠道非法取得这些作品。
- 涉及歌词与乐谱。 出版商称,被获取的数百万本书籍中包括含有歌词和乐谱的内容,因此案件可能影响音乐出版商对文本及音乐著作权的维护方式。
- 与既有诉讼相互关联。 部分代理本案的律师也参与了 Concord Music Group、环球音乐集团相关案件,以及作者提起的 Bartz v. Anthropic 案。
- 此前判决已区分使用与取得。 在 Bartz 案中,法官认定 Anthropic 使用受版权保护的作品训练 AI 在当时并非当然违法,但通过盗版方式取得内容不合法,并判令其支付 15 亿美元。
意义与影响
这起新诉讼的关键价值,在于它可能进一步强化一个对 AI 公司非常重要的合规区分:即使某些训练用途最终可能被认定具有合法性,数据获取过程本身仍可能构成独立的侵权或违法问题。对于模型开发商而言,训练语料的来源、下载路径、内部留存记录和授权证明,可能与模型能力本身同样重要。
对音乐出版行业来说,歌词、乐谱和其他音乐文本并非边缘数据,而是具有明确商业价值的版权资产。若法院接受原告关于大规模非法获取的主张,行业或将更重视数据供应链审计、授权交易和内容过滤机制。反之,如果 Anthropic 的抗辩获得支持,案件也可能推动法院进一步界定 AI 训练、缓存、复制和数据采购之间的法律边界。
目前案件仍处于诉讼阶段,原告指控尚未获得最终司法认定。可以确定的是,AI 版权诉讼正在从“训练能否使用版权内容”扩展到“数据从哪里来、如何获得、是否留下合规证据”等更具体的问题,这将持续影响模型公司的数据策略与内容行业的授权模式。
评论
正在确认登录状态……
正在加载评论……