2026-09-18 08:42 1018 次浏览

版权诉讼新证据曝光:OpenAI内部曾承认AI对出版商构成生存威胁

最新法庭文件显示,OpenAI高管曾内部承认AI产品对出版商构成生存威胁,微软员工更称用版权内容训练模型是规模空前的盗窃。纽约时报诉OpenAI及微软案寻求数十亿美元赔偿,合理使用抗辩面临严峻挑战。

法庭文件揭示内部认知与公开立场矛盾

一起备受瞩目的版权侵权诉讼正在进入关键阶段。根据最新提交的法庭文件,OpenAI在内部讨论中早已意识到其AI产品可能对新闻出版商造成根本性冲击,这与该公司公开主张的合理使用立场形成鲜明对比。

文件显示,ChatGPT负责人曾在一份内部交流中写道,AI产品对出版商构成生存威胁,这些工具在很大程度上具有替代性,并且随着能力提升,替代程度只会不断加深。这一表述直接指向了AI聊天机器人对传统新闻流量模式的侵蚀。

纽约时报与其他媒体机构正向OpenAI及其共同被告微软寻求数十亿美元损害赔偿。案件核心争议在于,利用出版商内容训练AI模型是否构成版权法下的合理使用。原告方律师指出,被告反复完整复制了数百万篇受版权保护的文章,用于开发具有替代性的商业AI产品。

高管言论与用户行为数据成焦点证据

诉讼文件还引述了OpenAI联合创始人格雷格·布罗克曼早年的一封内部信件,其中提到被天文数字般的财富深深驱动,希望通过技术商业化获取回报。原告方以此论证OpenAI的行为受商业利益驱动,而非单纯的技术创新。

微软方面同样面临不利证据。该公司应用科学总监布伦特·赫克特据称曾写道,用受版权保护的内容训练大语言模型是一场规模空前的惊人盗窃,并认为若原告胜诉将彻底嘲弄合理使用理念。微软回应称,这些言论仅代表员工个人观点,并非法律分析。

更引人关注的是用户行为数据。微软内部发现,与传统搜索引擎相比,使用其AI回答工具的用户对原始内容的点击率低了83%至93%。这一数据为出版商关于AI产品替代原始内容的主张提供了量化支撑。

  • 布罗克曼据称在知悉存在绕过纽约时报付费墙的方法后回应道:啊,不错。
  • 微软CEO萨蒂亚·纳德拉在证词中表示,若当时得知OpenAI抓取付费墙后信息用于训练,会依据协议要求重新训练模型。
  • 微软称纳德拉的证词谈的是广泛原则与信息消费方式的变化,并非对版权问题的结论。

合理使用抗辩面临多重挑战

OpenAI一直辩称,利用公开可获得内容训练模型属于合理使用,其法律依据与搜索引擎访问内容类似。该公司强调大语言模型对原始内容进行转换而非复制,不会成为出版物的替代品。然而,内部文件与用户行为数据正在削弱这一论证的说服力。

案件还涉及获取付费墙后内容的手段争议。诉讼文件称OpenAI采用了越界且具有欺骗性的方式获取内容,而布罗克曼当时已知悉相关做法。这一指控若被法庭采信,可能对合理使用抗辩造成进一步打击。

OpenAI此前曾回应称,本案不是人类创作与AI之争,而是纽约时报想以牺牲惠及所有人的进步为代价谋求一笔不该得的横财。截至目前,OpenAI未对最新文件立即置评。

行业影响与趋势观察

这起案件是版权持有人针对AI公司提起的数十起诉讼中最受关注的一起,其判决结果可能为AI训练数据的合法边界确立重要判例。随着生成式AI产品日益渗透信息获取场景,出版商与AI企业之间的利益冲突正从谈判桌走向法庭。

从技术脉络看,大语言模型对高质量语料的依赖短期内难以改变,而版权方对内容价值的保护意识正在快速觉醒。双方能否在授权许可框架下找到平衡点,将直接影响AI行业的训练数据获取成本与内容生态的可持续性。此案的走向,或将成为观察AI与内容产业博弈的关键风向标。