当公司内部的直言不讳被摆上法庭,最有力的指控往往来自被告自己。

发生了什么

据 The Decoder 报道,在围绕 AI 训练数据的版权诉讼中,OpenAI 和微软一直以“合理使用”作为核心抗辩——即认为用受版权保护的作品训练模型属于转化性使用,不构成侵权。但最新披露的内部邮件与宣誓证词正在削弱这一立场。

一名微软总监在内部沟通中将 AI 训练实践描述为“人类史上最大规模的劳动窃取”。与此同时,OpenAI 的 ChatGPT 负责人写道,这些产品“在很大程度上是替代性的,就是这样”。这些表述并非来自外部批评者,而是来自两家公司内部身处关键岗位的人。

为什么重要

合理使用抗辩的成立,通常取决于几个要素:使用的目的与性质、原作品的性质、使用部分的数量与实质性,以及对原作品潜在市场的影响。其中“是否具有替代性”是判断市场影响的关键——如果 AI 产品直接替代了原作品的市场,合理使用的空间就会被大幅压缩。

问题在于,被告自己的员工似乎已经承认了这种替代性。ChatGPT 负责人的表述指向一个核心事实:生成式 AI 的输出可以在相当程度上取代人类创作者的作品,而不是仅仅作为评论、研究或转化性再创作。微软总监的“劳动窃取”措辞则更进一步,触及了训练数据背后人类劳动的价值剥夺问题。

这些内部表述的法律意义在于:它们可能被原告用来证明,被告在主观上清楚其行为的性质和后果。合理使用虽不要求使用者“善意”,但主观认知往往会影响法院对使用目的和市场影响的判断。

影响与看点

对 AI 公司而言,这意味着依赖合理使用作为主要法律屏障的策略正变得脆弱。如果法院倾向于采纳内部邮件作为证据,训练数据的授权成本可能被迫上升,进而改变整个行业的成本结构。

对开发者和用户来说,短期内的直接影响有限,但中长期看,模型训练数据的来源合规性会逐渐成为产品能否持续运营的前提。依赖大规模未授权数据训练的开源模型和商业 API,都可能面临更严格的审视。

值得关注的下一个节点是:法院是否会在裁决中直接引用这些内部表述,以及两家公司是否会调整其公开法律策略。当公司自己的员工用“窃取”和“替代”来描述工作时,合理使用这面盾牌还能挡多久,是一个悬而未决的问题。