印度德里高等法院近日作出临时裁决,驳回了新闻机构亚洲国际新闻社(ANI)针对OpenAI的初步禁令申请。ANI此前起诉OpenAI在训练AI模型及ChatGPT输出中侵犯其版权,但法官Amit Bansal认为ANI未能证明其主张,拒绝授予禁令救济。
ANI向法庭提交了多份ChatGPT输出内容,声称这些内容大量复制了其文章。然而,OpenAI指出,ANI引用的文章大多发表于2024年8月至9月,而涉案模型GPT-4和GPT-4o的训练数据分别截止于2022年4月和2024年4月,因此这些文章不可能被用于训练。法官初步认为,输出内容的相似性可能源于检索增强生成(RAG)技术——该技术允许模型实时从互联网检索信息,类似搜索引擎的工作方式。ANI在诉状中未提及RAG,法院将在主审中进一步裁定RAG输出是否构成“向公众传播”。
ANI还使用了对抗性提示,明确要求模型“完全”复制文章,但即便如此,也未能提供任何逐字复制的实例。法官指出,新闻中的事实本身不受版权保护,而模型仅复述主题和标题,不构成与ANI的直接竞争。此外,ANI未能证明OpenAI在模型中永久存储训练数据并可随时按需复制其作品。
在AI训练的法律定性上,法官依据印度版权法中的“私人或个人使用(包括研究)”例外条款,将“研究”作广义解释,认为其可涵盖AI训练。但法官设定了条件:训练数据必须来自合法来源,不得使用未经授权的影子图书馆或付费墙内容;且OpenAI仅内部处理训练副本,未对外公开。法官通过三要素公平性测试,认定OpenAI的使用符合合理使用:训练使用范围有限,未证明存在记忆或复制行为;双方分属不同行业,ANI未遭受经济损失;用户向ChatGPT询问ANI新闻时,模型仅返回主题和少量标题。
法官还援引了美国相关判例,包括Bartz诉Anthropic案和Kadrey诉Meta案,认为语言模型输出具有变革性,并引用Google Books案的先例。法官强调,训练后的语言模型有助于改善信息获取、支持教育、推动科学研究、辅助软件开发、实现翻译功能,并为残障人士提供工具。
这一裁决使印度成为全球AI版权争议中的关键战场。此前,美国法院在Raw Story和AlterNet诉OpenAI案中因原告未能证明损害而驳回诉讼;GitHub Copilot案同样因原告无法提供代码逐字复制的证据而败诉。但Ross Intelligence诉Thomson Reuters案中,法院因AI研究工具与Westlaw数据库直接竞争而否定合理使用。Anthropic案中,法院虽认为AI训练具有“惊人”的变革性,但因使用盗版书籍而作出不利裁决。
版权法专家Andres Guadamuz评论称,这是法院首次明确将AI训练归入私人使用例外,对OpenAI而言是一次重要胜利。不过,该裁决仅为临时禁令阶段,主审程序仍待进行,最终判决可能影响全球AI训练版权规则的走向。