7月24日,印度德里高等法院就新闻机构ANI与OpenAI之间的版权争议作出了一项关键裁定:认定OpenAI使用ANI的新闻内容训练人工智能模型不构成版权侵权,同时确认印度法院对该案件拥有管辖权。这一临时裁决,为全球AI训练数据的版权争议提供了重要的司法参照。
一、案件背景:印度首例AI版权诉讼
ANI是印度最大的通讯社之一,于2024年对OpenAI提起诉讼,指控OpenAI未经授权使用其新闻报道内容训练ChatGPT。随后,多家印度主流媒体机构加入诉讼阵营,包括Digital News Publishers Association(DNPA)及其成员——Times Group、Hindustan Times、India Today Group、The Hindu等几乎印度所有主要媒体机构。
ANI在诉讼中提出了两项核心主张:一是“训练主张”——OpenAI复制并存储ANI作品用于训练ChatGPT构成版权侵权;二是“输出主张”——ChatGPT生成的回复中复制了ANI受版权保护的内容。ANI还申请了针对OpenAI的临时禁令,试图阻止其继续使用ANI内容。
二、法院的三项核心认定
德里高等法院法官Amit Bansal在审理中作出了三项关键认定:
第一,AI模型训练属于“合理使用”。 法官认为,OpenAI使用ANI的新闻内容训练大语言模型的行为,符合印度《版权法》第52(1)(a)条中定义的研究类“合理使用”(fair dealing)例外情形。法院进一步指出,如果AI训练需要从多个来源逐一获取授权,大语言模型的开发将在经济上变得不可行。
第二,ChatGPT输出不构成侵权。 ANI未能向法院提供充分证据,证明ChatGPT生成的回复中存在对ANI受版权保护内容的直接复制。法院还注意到,ANI提交的所谓“复制”示例中,相关材料实际上是在模型训练完成之后才创建的,因此不可能是模型“记忆”后的输出。法院推断,这些回复更可能是ChatGPT在用户提问时实时进行了网页搜索,而非依赖预训练知识。
第三,印度法院拥有管辖权。 OpenAI辩称,复制和训练行为发生在印度境外,训练数据存储在美国服务器,因此印度版权法不应适用。但法院驳回了这一观点,认定ANI作品在印度被获取并传输至海外,存储在美国服务器是“事件链条中的终端步骤”,不能仅因最后一步发生在境外就切断整个链条。
三、判决背后的深层逻辑:公共利益压倒个体诉求
法院在权衡是否颁发临时禁令时,明确将公共利益置于优先位置。
法官指出,现阶段颁布任何临时禁令都将不利于人工智能的整体发展,尤其将冲击印度本土正在开发的大语言模型项目。禁令一旦落地,还将对公共利益产生广泛的负面影响——印度境内大量免费使用ChatGPT的用户将首当其冲。
法院在初步裁决中认定,大语言模型的公共效益超过了版权所有者的个体利益。至少在目前阶段,授予ANI临时禁令将对公共利益造成不可弥补的损害。
四、全球AI版权博弈的“印度变量”
此次判决发生的时间节点颇为微妙。就在全球多国新闻出版机构集体向AI公司施压、要求为训练数据付费的背景下,印度法院的这一裁定为AI行业提供了罕见且有力的法律支撑。
此前,《纽约时报》等媒体已在美国对OpenAI提起类似诉讼,案件仍在审理中。美国、欧洲等地区也陆续出现围绕AI训练数据的版权诉讼。印度的这一裁定虽然只是临时裁决,但为全球相关争议提供了新的司法参考。
对于印度本土AI产业而言,这一判决的意义更为直接:它为印度AI开发者使用本国语言和内容训练大模型提供了明确的法律边界。正如法院所指出的,如果训练需要从多方获取授权,LLM开发将变得经济上不可行——这一逻辑同样适用于全球任何一个正在发展AI产业的国家。
五、结语
德里高等法院的裁定并非终局判决,案件仍将继续审理。但它已经确立了印度在AI训练数据版权问题上的初步司法立场:合理使用原则可以覆盖模型训练行为,公共利益可以作为拒绝禁令的充分理由。
这一判决是否会为其他司法管辖区的法官提供参考,将成为接下来全球AI版权博弈中一个值得紧密追踪的信号。当全球AI产业在“创新”与“版权”之间寻找平衡点时,印度给出的答案,正在成为全球天平上一枚越来越有分量的砝码。



