索尼音乐与华纳查佩尔起诉Anthropic 指控其未经授权使用歌词训练Claude模型

两家音乐公司指控Anthropic未经授权,通过BitTorrent等渠道非法下载、抓取MusixMatch与LyricFind等歌词网站数据,使用“数万部”受版权保护的音乐作品用于训练与输出Claude模型。

8月29日,索尼音乐出版(Sony Music Publishing)与华纳查佩尔音乐(Warner Chappell Music)向美国加州北区联邦地区法院提起诉讼,指控人工智能公司Anthropic及其两位联合创始人未经授权抓取、下载并使用“数万部”受版权保护的音乐作品歌词,用于训练Claude系列AI模型。根据8月28日公示的起诉文件,被告包括Anthropic公司及联合创始人达里奥·阿莫代伊(Dario Amodei)、本杰明·曼(Benjamin Mann)。

索尼音乐出版是全球最大的音乐出版公司,隶属于索尼娱乐(Sony Entertainment),管理着全球规模最大的歌曲版权曲库之一。华纳查佩尔音乐是美国华纳音乐集团(Warner Music Group)旗下的音乐出版公司,为全球第三大音乐出版机构,拥有超过140万首音乐作品和约10万名作曲家。两家公司联合提起诉讼,指控Anthropic在未获得授权的情况下,通过BitTorrent等渠道非法下载、抓取MusixMatch与LyricFind等歌词网站的数据,将大量受版权保护的音乐作品(含歌词、乐谱等)用于Claude模型的训练和输出。

诉状指出,Anthropic的行为属于“历史上规模最大、最公然持续的知识产权盗窃之一”。原告提出每部作品最高15万美元、每次删除版权管理信息最高2.5万美元的索赔要求。若法院按最高标准支持“数万部作品”及多次删除行为的赔偿请求,总赔偿金额可能达到数十亿美元。此外,原告还要求法院责令Anthropic销毁侵权副本,并披露其训练数据的具体来源和使用情况。

这起诉讼是Anthropic面临的又一起版权争议。此前,多家内容版权方已针对AI公司未经授权使用受保护内容训练模型提起诉讼。2023年,多位作家曾起诉Anthropic及其他AI公司,指控其使用受版权保护的书籍训练大语言模型。今年早些时候,一家新闻出版商联盟也曾对Anthropic提起类似诉讼,指控其抓取新闻文章用于模型训练。

Anthropic是人工智能领域估值最高的初创公司之一,其开发的Claude系列大语言模型广泛应用于企业级AI应用场景。该公司尚未对此次诉讼发表公开回应。值得注意的是,Anthropic在训练数据合规方面曾采取过一定措施,包括与部分内容版权方达成授权协议,但此次涉及音乐出版领域的诉讼表明,AI训练数据的版权边界问题仍在持续发酵。

从行业角度看,这起诉讼反映了大模型训练数据版权问题的复杂性。音乐作品歌词作为受版权保护的内容,其使用权限与一般文本数据存在差异。AI公司在训练模型时,往往需要从互联网大规模抓取数据,但如何界定合理使用与侵权行为的边界,目前法律层面尚无统一标准。此次诉讼的判决结果可能对AI训练数据的合规使用产生示范效应,影响后续类似案件的审理方向。

目前,美国法院尚未对此案作出裁决。案件进展将取决于法院对AI训练数据使用行为的法律定性,以及原告方能否证明Anthropic的行为超出合理使用范畴。对于Anthropic而言,若败诉,不仅面临巨额赔偿,还可能影响其训练数据获取方式及模型迭代节奏。对于整个AI行业而言,此案的结果或将推动训练数据版权规则的进一步明确。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
微软推送Windows 11 26H2预览版,任务栏可四边移动并默认启用时间点还原
上一篇 3小时前
Anthropic宣布9月14日起Claude Code标准周限额永久上调25%
下一篇 2小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部