OpenAI 莉莉计划浮出水面:人工审阅聊天记录优化模型引发隐私争议
OpenAI 内部莉莉计划曝光,提示词审核员人工查看匿名化聊天记录以评估回复质量,时薪超50美元。用户隐私担忧加剧,行业普遍存在类似做法,OpenAI 事后修改帮助页面但未明确提及人工阅读。
ChatGPT 等对话平台的聊天日志被用于模型优化早已不是秘密,但具体的操作流程一直鲜为人知。近日,一份深度调查揭开了 OpenAI 内部一项名为“莉莉计划”(Project Lily)的人工评估项目,展示了其如何组织人员审阅用户对话,并由此引发对隐私边界的关注。
提示词审核员:机械重复却报酬优厚
根据获取到的操作指引、内部沟通记录以及真实对话样本,OpenAI 将从事该项工作的人员称为“提示词审核员”。他们的核心任务是查看经过匿名化处理的用户聊天记录,评判 ChatGPT 回复的质量。评估维度包括回答是否切题,以及是否过度出现“AI 式话术”、说教语气、表情符号或谄媚口吻。此外,回复被禁止拟人化,也不允许编造“个人经历”——例如,可以说“我查到了一些相关信息”,但不能写成“身为一名厨师,我喜欢……”或“我明白这种感受”。
一名审核员透露,这份工作“十分机械重复”,但时薪超过 50 美元(约合 336.3 元人民币),对于难度不高的任务而言报酬相当可观。该审核员还提到,项目指引频繁改动,不同版本之间常自相矛盾,多数软件开发人员对此应深有体会。
匿名化并非万无一失,用户倾诉内容可能被阅读
尽管聊天记录在交给审核员前会经过匿名处理,审核人员看不到用户名,但 OpenAI 向调查媒体承认,过滤环节仍有可能漏掉部分个人数据,简短会话出现此类问题的概率更高。调查还指出,大量对话中用户明确请求 ChatGPT 对谈话内容保密。交给审核员的会话版本甚至附带一份“用户记忆摘要”,汇总了用户的提问、兴趣偏好、上下文信息,甚至可能包含位置信息。
这名工作人员认为,绝大多数用户并不知道自己的聊天内容会被他人阅读。尤其令人担忧的是,不少用户将 ChatGPT 当作临时倾诉对象或心理疏导工具,向 AI 吐露内心深处的秘密。
评估与安全审查分离,人工参与不可或缺
值得注意的是,莉莉计划并不专门核查回答内容事实上是否准确,仅标记显而易见的错误。这意味着至少还有另外一支或多支团队在开展独立的效果评估。同样,这套评分审核与排查用户是否存在伤害他人或自身意图的人工安全审查属于两套独立流程。
该项目的存在也说明,与 AI 公司力图塑造的公众印象相反,大模型的迭代进步并不仅仅依靠技术升级与更优质的训练数据集;依然需要相当数量具备相应能力的人类参与其中。
默认开启的开关与无法回溯的删除
绝大多数面向普通用户的聊天机器人都带有类似设置:“允许使用你的对话记录改进产品”。几乎所有聊天产品的该项开关默认都是开启状态,不少付费订阅方案也不例外。不过 ChatGPT 面向企业版、商业版以及教育版客户时,该项设置默认关闭。
但这个切换开关不具备回溯效力。已经存入 ChatGPT 数据库里的历史聊天记录会继续保留,除非用户主动申请删除。另外,删除操作同样无法追溯:即便用户删除对话,对应的内容或许早已被抓取、完成匿名处理,并留存于某个数据集当中。
调查媒体就此发起问询,起初 OpenAI 没有回应用户是否被明确告知聊天记录可能交由人工审阅。之后该公司仅提供了一份常见问题页面链接,该页面提到出于模型优化目的会开展人工审核。经核实,这份公示至少已经存在两年,实际年限可能更久。在深度报道发布后,OpenAI 修改了帮助页面,补充说明用户如何选择退出数据收集;但修改后的文档中依旧没有提及会有工作人员人工读取会话内容。
行业普遍做法与隐私透明度困境
这类数据收集与人工审阅的做法在各大服务商当中普遍存在。谷歌的 Gemini 在隐私中心明确写明“部分保存的聊天记录可能由人工审核”。Anthropic 也持有相似立场,专门开设网页说明该事项。而 Perplexity 的态度尚不明确,其隐私政策既没有确认、也没有否认工作人员可以访问聊天日志。
随着大模型竞争进入精细化阶段,人工评估在提升回复质量方面的作用愈发凸显,但用户对隐私的期待也在同步上升。如何在模型优化与数据伦理之间取得平衡,并提升操作透明度,将成为 AI 服务商必须直面的长期课题。