内部文件揭示:微软与OpenAI高管曾担忧AI对新闻业构成生存威胁
随着《纽约时报》等新闻机构诉讼推进,微软与OpenAI内部机密文件公开,显示高管曾警告AI训练可能对新闻机构造成毁灭性影响,包括流量暴跌、收入锐减等。
机密文件公开,高管担忧浮出水面
随着美国《纽约时报》等新闻机构针对微软与OpenAI训练数据版权问题的诉讼持续推进,一批此前被标记为机密的内部文件正式公开。这些文件揭示了微软和OpenAI内部员工对AI技术冲击新闻行业的深切忧虑。
微软应用科学部门主管Brent Hecht在内部文件中将新闻内容用于AI训练描述为“前所未有的大规模盗窃”,甚至称其可能是“人类历史上规模最大的劳动力盗窃”。他还对微软和OpenAI主张的合理使用观点提出质疑,认为大规模抓取新闻内容的做法与合理使用理念相悖。
“毁灭循环”风险与流量数据
微软内部文件还提出了所谓“毁灭循环”风险:AI产品不断减少新闻网站流量和收入,导致新闻机构减少内容生产,最终使AI模型本身失去可靠信息来源。微软数据显示,部分涉诉新闻机构的点击率下降了83%至93%,另一些机构则下降了51%至94%。
新闻机构援引ChatGPT搜索结果点击率较低以及自身流量下降的报道,认为AI聊天机器人正在逐渐取代用户直接访问新闻网站的需求。微软CEO Satya Nadella在作证时承认,聊天机器人能够直接在AI平台向用户提供信息,从而减少用户访问原始新闻网站的需求,相当于“从新闻网站那里拿走了点击量”。
OpenAI内部观点与诉讼指控
OpenAI内部也存在类似担忧。ChatGPT负责人Nick Turley曾在内部确认,使用新闻内容训练商业AI产品,并让这些产品能够取代新闻提供商,可能会给出版商带来“生存性威胁”。他认为,当聊天机器人已经直接提供信息时,用户“没有充分理由”再点击原始链接,并将聊天机器人描述为“基本上具有替代性”,且这种替代关系会随着产品能力提升而进一步增强。
以《纽约时报》为首的新闻机构还指控微软和OpenAI内部人员早已意识到AI产品可能输出与训练数据高度相似的内容。原告方表示,他们进行了多种测试,尝试让AI产品直接复现新闻文章内容,结果发现出现大段内容复现。新闻机构认为微软和OpenAI并未充分采取措施阻止这些输出,甚至采取了让新闻机构更难测试AI模型的措施。Brent Hecht的一份内部文件称,公司开发了一项过滤机制,可能让训练数据版权方“更难了解哪些内容被用于训练”。
微软回应与事件影响
对于上述指控,微软发言人回应称,微软的AI产品属于具有转换性质的合理使用,并不会取代新闻网站。微软还表示,Hecht的内部文件仅代表一名员工的个人观点,并非法律分析,也不能代表微软公司的立场。而OpenAI截至报道发布时尚未回应相关置评请求。
这一事件凸显了AI技术与传统新闻行业之间日益紧张的版权与商业模式冲突。随着诉讼推进,科技公司与内容提供者之间的利益平衡将成为行业关注焦点,可能推动相关法律框架和授权模式的调整。