Sony与环球再次起诉Suno:AI音乐模型能否“洗白”训练数据?
导语
AI音乐公司的模型升级,正在变成一场关于“训练来源是否会随模型迭代被继承”的法律争论。Sony和环球音乐集团近日再次起诉Suno,指控其最新的v6模型并非真正摆脱了旧模型的版权风险,而是通过用户创作、模型输出和蒸馏等环节,延续了此前训练过程留下的影响。
争议焦点:新模型是否真的从零开始
两家唱片公司是没有与Suno签署授权协议的主要音乐集团之一。在最新诉状中,它们认为,Suno早期模型曾使用从YouTube等来源获取的未经授权音乐,而v6又可能吸收了这些模型产生的内容,因此侵权影响并不会因为模型名称、架构或训练数据表面变化而自动消失。
唱片公司将这一过程称为“模型洗白”。其核心论点是:如果一个新模型学习了侵权模型的输出,那么原始录音中的表达价值可能仍会沿着“未经授权录音—旧模型—模型输出—新模型”的链条传递。换言之,模型没有直接读取某首录音,并不必然意味着它没有受到相关数据的影响。
Sony还指称,Suno可能使用知识蒸馏,让v6学习旧模型的结果。若这一说法成立,法律争点就不再局限于训练集里是否出现了具体录音,也会涉及模型行为、参数知识和生成能力是否构成对受保护表达的延续性利用。不过,相关指控仍是诉讼中的一方主张,最终是否成立需要法院审理。
Suno的说法仍不完整
v6发布时,Suno高管曾向媒体表示,该模型是“从头训练”的,并使用了一套新的数据。随后,Suno发言人补充称,训练信息包括合作伙伴授权内容、社区互动、用户创作和偏好信号,以及团队积累的经验。但公司没有明确说明,其中是否包含用户上传的音频,或基于用户上传音频产生的输出,也没有公开足以核验完整数据链条的细节。
这留下了关键空白:所谓“新数据”究竟是全新的原始素材,还是包含旧模型产物、人工筛选结果和用户行为信号的组合?如果模型研发依赖前代系统产生的大量内容,企业需要如何证明这些内容本身具有合法来源,也会成为后续诉讼的重要问题。
对AI音乐行业的影响
这起案件的意义不只在于Suno一家公司的风险。它可能推动法院进一步讨论三类问题:第一,使用模型输出训练下一代模型,是否会继承前代模型的版权瑕疵;第二,蒸馏、微调和偏好学习是否属于需要单独说明的训练环节;第三,用户生成内容在被平台用于改进模型时,平台获得的授权范围究竟有多大。
如果唱片公司的观点得到支持,AI公司将不能只通过更换模型版本或重新包装数据来源来回应版权质疑,而需要建立更可审计的训练数据记录、授权证明和模型谱系。对音乐权利人而言,这也意味着维权对象可能从最终生成内容,扩展到模型开发和版本传承过程。
目前,这仍是一场围绕事实与法律解释的诉讼。案件最终结果,将影响AI音乐公司如何设计训练流程,也可能为“模型输出能否成为下一代训练材料”建立新的行业边界。
来源:The Verge AI
评论
正在确认登录状态……
正在加载评论……