人工智慧公司 Anthropic 與圖書作者群體達成了一項創紀錄的版權和解協議,金額高達 15 億美元。該協議已獲得舊金山聯邦法院批准,成為美國集體訴訟歷史上金額最高的版權和解案。

此次和解的核心爭議點並非 AI 訓練本身,而是 Anthropic 在 2021 年至 2022 年期間,從兩個知名的盜版資料庫 LibGenPiLiMi 下載了約 482,460 部受版權保護的作品。根據和解條款,其中 91.3% 的作品被權利人成功申報,每部作品可獲得約 3,000 美元的賠償,這一金額是法定最低賠償標準的四倍。作為和解的一部分,Anthropic 必須銷燬所有已下載的盜版檔案。此外,作者們保留了對 Anthropic 未來行為的監督權,以及對 AI 輸出內容中直接複製原作品部分的索賠權利。

值得注意的是,這筆鉅額賠償針對的是“盜版行為”,而非“AI 訓練行為”。審理此案的法官 William Alsup 此前已在相關裁決中明確表示,AI 模型在合法獲取的書籍上進行訓練,屬於“轉換性使用——而且是極具轉換性的”,因此應被認定為 合理使用。這一法律觀點為 AI 實驗室的核心訓練方式提供了重要的司法支援。

分析人士指出,雖然 Anthropic 為盜版行為付出了沉重代價,但該和解協議實際上為 AI 行業劃出了一條關鍵的法律紅線:未經授權從盜版網站抓取資料是明確的侵權行為,必須嚴懲;但 AI 公司若從合法渠道(如公開網路、授權資料庫)獲取資料進行模型訓練,則更有可能受到合理使用原則的保護。這一定位對依賴大規模網路資料訓練的 AI 公司而言,無疑是一場重要的法律勝利。

不過,關於“大規模抓取網際網路內容(即使未經網站所有者明確同意)是否構成‘合法獲取’”這一更廣泛的問題,目前仍懸而未決。因此,圍繞 AI 訓練資料的合理使用之爭遠未結束,未來仍可能出現更多針對網路資料抓取的訴訟。本次和解為 AI 產業的資料合規策略提供了關鍵判例,但並未徹底解決所有版權爭議。