印度德里高等法院近日作出臨時裁決,駁回了新聞機構亞洲國際新聞社(ANI)針對OpenAI的初步禁令申請。ANI此前起訴OpenAI在訓練AI模型及ChatGPT輸出中侵犯其版權,但法官Amit Bansal認為ANI未能證明其主張,拒絕授予禁令救濟。

ANI向法庭提交了多份ChatGPT輸出內容,聲稱這些內容大量複製了其文章。然而,OpenAI指出,ANI引用的文章大多發表於2024年8月至9月,而涉案模型GPT-4GPT-4o的訓練資料分別截止於2022年4月2024年4月,因此這些文章不可能被用於訓練。法官初步認為,輸出內容的相似性可能源於檢索增強生成(RAG)技術——該技術允許模型即時從網際網路檢索資訊,類似搜尋引擎的工作方式。ANI在訴狀中未提及RAG,法院將在主審中進一步裁定RAG輸出是否構成“向公眾傳播”。

ANI還使用了對抗性提示,明確要求模型“完全”複製文章,但即便如此,也未能提供任何逐字複製的例項。法官指出,新聞中的事實本身不受版權保護,而模型僅複述主題和標題,不構成與ANI的直接競爭。此外,ANI未能證明OpenAI在模型中永久儲存訓練資料並可隨時按需複製其作品。

在AI訓練的法律定性上,法官依據印度版權法中的“私人或個人使用(包括研究)”例外條款,將“研究”作廣義解釋,認為其可涵蓋AI訓練。但法官設定了條件:訓練資料必須來自合法來源,不得使用未經授權的影子圖書館或付費牆內容;且OpenAI僅內部處理訓練副本,未對外公開。法官通過三要素公平性測試,認定OpenAI的使用符合合理使用:訓練使用範圍有限,未證明存在記憶或複製行為;雙方分屬不同行業,ANI未遭受經濟損失;使用者向ChatGPT詢問ANI新聞時,模型僅返回主題和少量標題。

法官還援引了美國相關判例,包括Bartz訴AnthropicKadrey訴Meta案,認為語言模型輸出具有變革性,並引用Google Books案的先例。法官強調,訓練後的語言模型有助於改善資訊獲取、支援教育、推動科學研究、輔助軟體開發、實現翻譯功能,併為殘障人士提供工具。

這一裁決使印度成為全球AI版權爭議中的關鍵戰場。此前,美國法院在Raw Story和AlterNet訴OpenAI案中因原告未能證明損害而駁回訴訟;GitHub Copilot同樣因原告無法提供程式碼逐字複製的證據而敗訴。但Ross Intelligence訴Thomson Reuters案中,法院因AI研究工具與Westlaw資料庫直接競爭而否定合理使用。Anthropic案中,法院雖認為AI訓練具有“驚人”的變革性,但因使用盜版書籍而作出不利裁決。

版權法專家Andres Guadamuz評論稱,這是法院首次明確將AI訓練歸入私人使用例外,對OpenAI而言是一次重要勝利。不過,該裁決僅為臨時禁令階段,主審程式仍待進行,最終判決可能影響全球AI訓練版權規則的走向。