8月28日,由索尼音樂、華納查普爾及關聯公司組成的35家音樂出版實體,在美國加州北區聯邦法院對AI公司Anthropic及其CEO達里奧·阿莫迪、聯合創始人本傑明·曼提起訴訟,指控其未經授權使用受版權保護的歌詞和曲譜訓練AI模型。這是繼年初環球音樂在同一法院起訴Anthropic之後,又一起大型音樂出版商的集體訴訟,至此全球三大音樂集團均已加入對Anthropic的圍剿。
訴訟的核心並非音訊,而是歌詞與曲譜。原告方指出,Anthropic在訓練其Claude模型時,曾從盜版網站下載了至少700萬本盜版書,其中包含數百部歌曲集、歌詞書和曲譜,加上通過爬蟲從LyricFind等網站抓取的歌詞,涉嫌侵權的作品可能達數萬部。根據美國法律,每部被故意侵權的作品最高可追索15萬美元賠償,因此原告要求的賠償總額可能高達數十億美元。
這一指控與去年曝光的Bartz圖書版權案密切相關。在那起集體訴訟中,Anthropic已同意支付15億美元和解金,以了結其下載盜版圖書的指控。當時法院裁定,用書籍訓練大模型本身屬於“合理使用”,但Anthropic的盜版下載行為不在此列。這一裁定雖無約束力,卻給了版權方一個訊號:Anthropic願意和解且有能力賠償,從而吸引了更多版權持有人跟進訴訟。
從法律角度看,AI訓練資料是否構成侵權存在爭議。美國法院曾多次認可,大規模複製有時可視為“合理使用”,尤其是當模型僅學習知識而不原文輸出時。但音樂出版商提出,歌詞的商業價值恰恰在於原文展示,而測試顯示Claude在某些提示詞下能輸出完整或近乎完整的歌詞,這相當於向外發行新副本,與現有付費歌詞服務形成競爭。若此點被法院採信,將顯著有利於原告。
更深層看,音樂出版商的目標遠不止於索賠。它們長期構建了高度細分的版權授權體系,從iTunes到Spotify再到TikTok,每當新技術創造新使用方式,它們總能迅速設立新的授權收費點。如今,它們希望借訴訟確立一種“AI訓練歌詞授權”市場,將生成式AI納入其版權版圖。此前,AI音樂生成公司Suno和Udio已與大型唱片集團達成和解,準備用正版曲庫訓練新模型,這為索尼、華納等提供了可參照的路徑。
對Anthropic而言,訴訟風險不僅關乎賠償。庭審可能迫使公司公開高管決策記錄及“資料清洗”環節是否故意刪除版權資訊,進而影響其上市程序、估值與商業合作。因此,分析認為雙方最終大機率走向和解,條件可能包括一次性賠償、保留歌詞輸出護欄及簽訂未來付費授權協議。但即便和解,AI訓練素材是否需授權、盜版來源與訓練行為如何區分評價等根本問題仍懸而未決,類似訴訟預計還將持續出現。這場衝突本質上是內容版權方與AI廠商圍繞下一代商業模式利益分配的博弈,短期內難有定論。