OpenAI版权案新进展:作者要求法院认定侵权,GPT
美国作家协会诉OpenAI及微软案进入关键阶段,原告提交简易判决动议,指控OpenAI未经授权使用其图书训练AI,并援引员工言论称GPT-5可代写《冰与火之歌》续作。
集体诉讼进入关键阶段,作者寻求责任认定
围绕人工智能训练数据版权问题的法律博弈再度升级。本周,多名图书作者向纽约联邦法院提交了简易判决动议,要求法官认定OpenAI在未获授权的情况下使用其作品训练AI模型,且这一行为不满足合理使用的法律条件。此举标志着自2023年美国作家协会对OpenAI及微软提起集体诉讼以来,案件进入了决定性的法律审查环节。
此次动议共涉及194部图书,原告方目前仅寻求法院对责任归属作出裁决,并未要求具体的赔偿金额。案件的核心争议点在于,OpenAI是否在明知版权状态的情况下,仍将受保护的文字作品用于大模型的预训练,以及这种行为是否超越了合理使用的边界。
LibGen数据来源与命名变更引发质疑
根据动议披露的文件细节,原告指控OpenAI曾从知名电子书资源站LibGen获取图书内容,并在其GPT-3研究论文中刻意将数据源的标注从“Libgen1”和“Libgen2”更改为“Books1”和“Books2”。原告律师认为,这一命名上的调整并非偶然,而是意在淡化训练数据与LibGen这一争议性来源之间的直接联系,从而规避外界对数据合法性的审查。
值得注意的是,《冰与火之歌》系列作者乔治·R·R·马丁正是本案的原告之一。该系列小说被HBO改编为热门剧集《权力的游戏》,其全球影响力使得此案在文学与科技领域均受到高度关注。原告在动议中援引了OpenAI员工Tarun Gogineni在2025年发布的公开社交媒体帖子,后者于2022年加入OpenAI,专职负责提升模型的写作质量。Gogineni在帖文中将训练模型续写《冰与火之歌》形容为其“研究任务”,并进一步假设,即便马丁本人离世,未来的GPT-5模型也能“自动补全”该系列的最后两本书。原告认为,这一言论表明OpenAI内部对AI可能冲击作者职业的后果有所认知,并将其视为一种“可接受的经济扰动”。
微软投资关系与连带责任争议
本案的另一被告微软公司同样成为焦点。原告主张,微软作为OpenAI的重要投资方和合作伙伴,有能力对后者的数据使用行为进行监督并从中获得商业利益,因此理应对侵权行为承担连带责任。诉讼材料显示,微软在2019年、2021年和2023年签署的三项协议中,累计向OpenAI投资约130亿美元,这一数字已得到双方公开披露信息的印证。
动议还透露,OpenAI于2022年夏季因法律顾虑删除了两个包含LibGen数据的文件集合。原告指出,这似乎是OpenAI迄今删除过的仅有的两个训练语料库,这一事实侧面印证了早期GPT模型确实使用了这些数据。然而,OpenAI在同一天提交了交叉动议,坚持其对图书的模型训练行为符合版权法中的合理使用原则,认为AI学习文本模式与人类阅读借鉴并无本质区别。
行业影响:AI版权边界的司法界定
此案的审理结果可能为AI训练数据的版权使用设定重要先例。当前,全球范围内对AI模型训练是否构成合理使用的法律解释仍存在分歧,不同司法管辖区尚未形成统一标准。若法院支持原告的简易判决请求,将迫使AI开发商在数据获取和模型训练环节采取更为审慎的合规措施,甚至可能影响现有模型的迭代路径。反之,若OpenAI的抗辩成立,则可能进一步巩固“合理使用”在AI领域的适用空间,为后续技术发展提供更宽松的法律环境。无论最终判决如何,围绕数据来源透明度与创作者权益保障的讨论,都将继续推动AI产业在创新与合规之间寻求平衡。