OpenAI内部Lily项目曝光人工审记录
IT时代网9月15日消息,众所周知,ChatGPT 这类平台的对话日志会被用来优化模型,但处理机制一直是个谜。404 Media 日前发布报道,披露了 OpenAI 对聊天记录开展人工审核的整套流程。OpenAI 内部这项评估项目代号为莉莉计划(Project Lily),媒体获取到了操作指引文档、Slack 工作群组记录、真实对话样本与评分体系。
从事这项工作的人员被称作「提示词审核员」,他们查看经过匿名化处理的真实用户聊天记录,评判 ChatGPT 回复的质量,检查回复是否过度出现「AI 式话术」、居高临下的说教语气、表情符号与谄媚口吻,并禁止回复拟人化表述或编造「个人经历」。一名审核员表示,这份工作十分机械重复,但时薪据称超过 50 美元(约 336.3 元人民币)。
多数用户并不知道自己的聊天内容会被其他人阅读。虽然聊天记录会先经过匿名处理,但过滤环节仍可能漏掉部分个人数据,简短会话出现此类问题的概率更高。交付审核的会话版本甚至附带「用户记忆摘要」,汇总用户的提问、兴趣偏好、上下文,甚至可能包含位置信息。莉莉计划并不专门核查回答的事实准确性,仅标记显而易见的错误。
类似的数据收集与人工审阅做法在各大服务商中普遍存在。谷歌 Gemini 在隐私中心写明「部分保存的聊天记录可能由人工审核」,Anthropic 也持有相似立场。而 Perplexity 的态度尚不明确,其隐私政策既没有确认、也没有否认工作人员可以访问聊天日志。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。
编辑:林一舟