AI公司在版权和用户隐私问题上的双重标准屡受诟病,除非它们自身成为受害者。业界早已知晓ChatGPT等平台利用用户聊天记录优化模型,但具体操作细节长期成谜。近日,一份关于OpenAI人工审核流程的报告揭开了这一黑箱,详细披露了名为“Project Lily”的内部项目及其涉及的人类阅读私人信息的情况。

据获取的内部指导手册、Slack频道记录及真实对话样本显示,“Project Lily”操作员被称为“提示词审核员”。其核心任务并非核查事实准确性,而是评估回答质量:判断AI是否真正解决问题,并剔除过度使用“AI腔调”、居高临下的语气、表情符号或奉承之词。此外,严禁拟人化表述及虚构“个人”经历,例如允许说“我找到了一些信息”,但禁止声称“作为一名厨师,我喜欢……”或表达共情。

知情人士透露,这项工作虽“非常机械”,但时薪超过50美元,远高于同类简单任务的市场水平。然而,审核员也指出指导原则频繁变动且常自相矛盾,令从业者倍感困扰。

隐私边界模糊与数据残留风险

尽管聊天内容经过匿名化处理,审核员无法直接看到用户名,但OpenAI承认过滤机制可能存在漏洞,尤其在较短的对话中,个人数据仍有泄露风险。更令人不安的是,提供给审核员的版本包含“用户记忆摘要”,涵盖用户兴趣、上下文甚至位置信息。许多用户在将ChatGPT视作倾诉对象时,并未意识到其隐私正被他人审视。

值得注意的是,“Project Lily”仅关注回答形式与质量,不涉及事实真伪校验,这意味着另有团队负责准确性评估。该审核流程也与旨在防止自我伤害或危害他人的手动安全检查相互独立。

这一项目的存在打破了AI公司塑造的“纯技术驱动”形象,证实模型改进仍高度依赖大量合格人力的介入。目前,大多数面向消费者的聊天机器人默认开启“使用聊天内容改进产品”选项,包括部分付费计划。仅ChatGPT的企业版、商业版和教育版默认关闭此设置。

然而,该开关不具备追溯效力。已存入数据库的聊天记录除非用户主动请求删除,否则将永久保留。即便执行删除操作,此前已被匿名化并纳入训练数据集的内容可能无法彻底清除。OpenAI此前未正面回应关于“用户是否明确被告知人类会阅读聊天”的质疑,仅提供了两年前已存在的常见问题解答链接。报道发布后,该公司更新了帮助页面说明退出数据收集的方法,但仍未明确提及人工操作员的存在。

这种数据收集与审查模式在行业内普遍存在。Google Gemini隐私中心明确指出“人类可能会审查部分保存的聊天记录”,Anthropic亦持类似立场。相比之下,Perplexity的隐私声明对此模棱两可,既未确认也未否认人类访问聊天日志的可能性。