8月28日,由索尼音乐华纳查普尔及关联公司组成的35家音乐出版实体,在美国加州北区联邦法院对AI公司Anthropic及其CEO达里奥·阿莫迪、联合创始人本杰明·曼提起诉讼,指控其未经授权使用受版权保护的歌词和曲谱训练AI模型。这是继年初环球音乐在同一法院起诉Anthropic之后,又一起大型音乐出版商的集体诉讼,至此全球三大音乐集团均已加入对Anthropic的围剿。

诉讼的核心并非音频,而是歌词与曲谱。原告方指出,Anthropic在训练其Claude模型时,曾从盗版网站下载了至少700万本盗版书,其中包含数百部歌曲集、歌词书和曲谱,加上通过爬虫从LyricFind等网站抓取的歌词,涉嫌侵权的作品可能达数万部。根据美国法律,每部被故意侵权的作品最高可追索15万美元赔偿,因此原告要求的赔偿总额可能高达数十亿美元

这一指控与去年曝光的Bartz图书版权案密切相关。在那起集体诉讼中,Anthropic已同意支付15亿美元和解金,以了结其下载盗版图书的指控。当时法院裁定,用书籍训练大模型本身属于“合理使用”,但Anthropic的盗版下载行为不在此列。这一裁定虽无约束力,却给了版权方一个信号:Anthropic愿意和解且有能力赔偿,从而吸引了更多版权持有人跟进诉讼。

从法律角度看,AI训练数据是否构成侵权存在争议。美国法院曾多次认可,大规模复制有时可视为“合理使用”,尤其是当模型仅学习知识而不原文输出时。但音乐出版商提出,歌词的商业价值恰恰在于原文展示,而测试显示Claude在某些提示词下能输出完整或近乎完整的歌词,这相当于向外发行新副本,与现有付费歌词服务形成竞争。若此点被法院采信,将显著有利于原告。

更深层看,音乐出版商的目标远不止于索赔。它们长期构建了高度细分的版权授权体系,从iTunes到Spotify再到TikTok,每当新技术创造新使用方式,它们总能迅速设立新的授权收费点。如今,它们希望借诉讼确立一种“AI训练歌词授权”市场,将生成式AI纳入其版权版图。此前,AI音乐生成公司Suno和Udio已与大型唱片集团达成和解,准备用正版曲库训练新模型,这为索尼、华纳等提供了可参照的路径。

对Anthropic而言,诉讼风险不仅关乎赔偿。庭审可能迫使公司公开高管决策记录及“数据清洗”环节是否故意删除版权信息,进而影响其上市进程、估值与商业合作。因此,分析认为双方最终大概率走向和解,条件可能包括一次性赔偿、保留歌词输出护栏及签订未来付费授权协议。但即便和解,AI训练素材是否需授权、盗版来源与训练行为如何区分评价等根本问题仍悬而未决,类似诉讼预计还将持续出现。这场冲突本质上是内容版权方与AI厂商围绕下一代商业模式利益分配的博弈,短期内难有定论。