《纽约时报》等新闻出版商与OpenAI之间的版权诉讼出现重大升级。出版商指控OpenAI在证据开示阶段隐藏了能够识别ChatGPT输出中受版权保护的新闻内容的工具和数据集,并据此提出制裁动议。

发生了什么

根据《纽约时报》等原告方提交的法庭文件,OpenAI在诉讼过程中未披露某些内部工具和训练数据集,这些材料据称可用于检测ChatGPT生成的文本是否包含来自受版权保护的新闻文章的内容。原告认为,OpenAI故意隐匿这些证据,阻碍了法院对案件事实的全面审查。目前,原告已请求法院对OpenAI实施制裁,包括可能的不利推定或罚款。

为什么重要

此案是AI版权领域最受关注的诉讼之一。《纽约时报》于2023年底起诉OpenAI和微软,指控其未经授权使用数百万篇新闻文章训练ChatGPT等AI模型,构成版权侵权。OpenAI则主张其使用属于合理使用范畴。

隐匿证据的指控如果成立,将严重损害OpenAI的辩护立场。法院可能因此做出不利于OpenAI的程序性裁决,甚至影响案件最终结果。更重要的是,该案将确立AI训练数据合规性的法律先例,对整个AI行业的数据获取方式产生深远影响。

影响与看点

  • 对AI开发者的影响:此案结果将直接影响AI公司使用受版权保护内容训练模型的法律边界。如果法院认定隐匿证据行为不当,可能促使更多版权方提起诉讼,并推动更严格的训练数据披露要求。
  • 对新闻出版业的意义:新闻出版商一直主张其内容被AI公司无偿使用,损害了商业模式。此次动议若获支持,将增强出版商在版权谈判中的地位。
  • 值得关注的点:法院是否批准制裁动议、OpenAI如何回应、以及后续证据开示中是否会公开更多训练数据细节。本案的进展可能比最终判决更快地改变行业实践。

独立判断:OpenAI在版权案中面临的压力正在加大,隐匿证据的指控若被证实,将对其“合理使用”辩护构成实质性打击,并可能迫使AI公司重新审视训练数据的合规流程。