一纸判决,把AI训练该不该为新闻内容付费的争论,在印度先分出了一边倒的胜负。
当地时间7月24日,印度德里高等法院就ANI诉OpenAI案作出临时裁定:OpenAI利用亚洲国际新闻社(ANI)的内容训练ChatGPT,不构成侵犯版权。这是印度法院首次就AI公司能否在无需授权的情况下,使用受版权保护的新闻内容训练大模型作出实质性法律认定。
两条核心理由,从根上撬动了ANI的诉讼地基
主审法官Amit Bansal摆出了两条核心理由。
其一,OpenAI存储ANI新闻作品用于训练大语言模型(LLM)的行为,落在印度《版权法》第52(1)(a)条所定义的 “私人或个人使用,包括研究” 的合理使用例外之内。法官解释,训练LLM推动了科学知识进步、开发了创新计算工具、促进了信息传播和教育,虽然版权人的权利重要,但此类科技研究带来的社会效益是相关考量因素。法官还采取了“更新解释”的原则:即使未来人类教师被AI机器人取代,若机械地认为法律保护就此消失,将是“倒退的”,会“限制社会进步”。
其二,ANI始终未能向法院提交证据,证明ChatGPT的回复中存在对ANI受版权保护内容的直接复制或实质性相似的输出。法院指出,ANI未能证明ChatGPT在生成回复时“记忆”或“复制”了其版权作品。ChatGPT采用检索增强生成(RAG)技术生成的答案,与原作并不相似。
比判决本身更关键的一句话:禁令会掐死本土大模型
法官在拒绝ANI临时禁令申请时直言:此时若签发临时禁令,非但无助于AI的整体发展,反而会狠狠撞上印度本土正在孕育的大语言模型项目。
“如果训练LLM需要向多个来源获取许可,经济上将不可行。”法院指出。大语言模型的开发与成功依赖于公共领域数据的可获得性。任何临时禁令都将对公共利益产生不利影响,包括印度境内大量免费使用ChatGPT的用户。
法院的推理与印度政府此前一份政策文件存在明显分歧——该文件曾建议AI开发者应为使用版权作品支付法定版税。但德里高院基于ANI案的事实,直接认定OpenAI的训练使用落在合理使用范围内。
换言之,法院把“保护一个内容方”和“拖累整个产业与公众”放在了天平两端,最终押注了后者。
案件背景:印度首例ChatGPT版权诉讼
ANI于2024年11月向德里高院提起诉讼,指控OpenAI未经许可使用其发布的新闻内容训练AI模型,并要求赔偿2000万卢比(约23万美元)。这是印度首例涉及ChatGPT的诉讼。
案件还吸引了多方介入:印度出版商联合会、数字新闻出版商协会(成员包括《印度时报》《印度斯坦时报》《今日印度》等几乎所有主流媒体)支持ANI;Flux AI Labs、印度治理与政策项目等机构则支持OpenAI。
一场临时裁定,可能重塑印度AI版权法的走向
这只是一项临时裁定,正式诉讼仍在审理中。但印度知识产权诉讼有一个特点:大量判决来自临时申请阶段。一位资深律师透露,他撰写专利法评注时,最初决定不使用临时申请阶段的判决,结果发现排除后“没什么可讨论的了”,最终还是引用了这些临时裁定。
因此,这份135页的判决,虽非终局,却极有可能深刻影响印度版权法的发展走向。
这不是孤例。《纽约时报》等媒体已在美国对OpenAI提起类似诉讼,至今仍在审理中。当同一类争端在不同法域各自推进,印度这份裁决,至少为“训练即侵权”的指控撕开了一道缺口。



