OpenAI内部Lily项目曝光,人工审核员正翻阅用户私密聊天记录?

OpenAI存在一项名为“莉莉计划”的人工评估项目,工作人员审核ChatGPT用户的真实聊天记录以评估模型回复质量。

文章作者、来源:AIBase

在人工智能大模型飞速迭代的今天,外界普遍认为技术的进化完全依靠算法升级和庞大的自动化训练数,OpenAI 内部其实长期存在一项代号为“莉莉计划”(Project Lily)的人工评估项目,专门安排人类审核员对 ChatGPT 用户的真实聊天记录进行人工审阅与打分。

在这项工作中,被称作“提示词审核员”的工作人员需要查看经过匿名化处理的真实用户会话样本,以此评判模型的回复质量。他们的审核重点包括评估回答是否切题,以及检查文本中是否存在过度“AI 化”、高高在上的说教语气、表情符号或谄媚口吻。值得注意的是,该项目的操作指引严格禁止 AI 使用任何拟人化表述或编造“个人经历”,例如允许说“我查到了一些相关信息”,但不准写成“身为一名厨师,我喜欢……”或“我明白这种感受”。虽然工作内容相对机械,但对于难度不高的任务而言,其时薪发布后,OpenAI 悄然修改了帮助页面并补充了用户选择退出数据收集的方法,但修改后的文档中依然避而不谈会有工作人员直接阅读会话内容的事实。

事实上,这种依赖人工审核来优化模型的做法在科技行业中并非个例。谷歌的 Gemini 在隐私中心明确写明部分保存的聊天记录可能由人工审核,Anthropic 也持有相似立场并专门开设网页进行说明,而 Perplexity 的态度则相对模糊,其隐私政策既未确认也未否认工作人员可以访问聊天日志。这也表明,在 AI 走向极致的道路上,人类的深度参与依然是不可或缺的底层支撑