行业资讯

OpenAI被曝人工审核用户聊天记录

Heooo 09月16日15时34分 23 阅读

「外媒曝光OpenAI内部代号莉莉计划的人工评估项目,安排审核员查看经匿名化处理的真实用户会话样本,评判回复是否切题、是否存在说教语气或谄媚口吻,时薪据称超过50美元。但审核版本常附带用户记忆摘要,过滤环节也可能漏掉个人数据,引发隐私担忧。」

在大模型能力不断迭代的当下,外界通常把技术进步归因于算法升级与海量自动化训练数据。但据外媒404Media报道,OpenAI内部长期存在一项代号为“莉莉计划”的人工评估项目,专门安排人类审核员对ChatGPT用户的真实聊天记录进行人工审阅与打分,这一机制的存在让外界重新审视人工参与在模型优化中的分量。

在这项工作中,被称作“提示词审核员”的工作人员需要查看经过匿名化处理的真实用户会话样本,用来评判模型回复质量。他们的审核重点包括回答是否切题,以及文本中是否存在过度“AI化”、高高在上的说教语气、表情符号或谄媚口吻。值得注意的是,项目操作指引严格禁止AI使用任何拟人化表述或编造“个人经历”,例如允许说“我查到了一些相关信息”,但不准写成“身为一名厨师,我喜欢……”,也不允许说“我明白这种感受”。

虽然工作内容相对机械,但对于难度不高的任务而言,其时薪据称超过50美元,吸引了不少人参与其中。

然而这一机制背后的隐私隐患引发了广泛担忧。许多用户把ChatGPT视为临时倾诉对象或心理疏导伴侣,向其吐露内心深处的秘密。尽管OpenAI宣称聊天记录会经过匿名化处理并隐藏用户名,但该公司也向媒体承认,过滤环节依然有可能漏掉部分个人数据,尤其是简短会话出现这类风险的概率更高。更令人意外的是,交到审核员手上的会话版本往往附带一份“用户记忆摘要”,其中详细汇总了用户的提问、兴趣偏好、上下文信息,甚至可能包含位置信息。

需要厘清的是,“莉莉计划”并不会专门核查模型回答在事实上是否准确,仅会标记那些显而易见的错误,这意味着效果评估和安全审查通常由其他独立团队负责。此外,绝大多数普通聊天机器人都默认开启了“允许使用你的对话记录改进产品”这一选项,虽然面向企业、商业及教育版客户时该设置默认关闭,但手动切换开关并不具备回溯效力。已经存入数据库的历史记录会继续保留,而即使用户主动删除对话,相关内容也可能早已被抓取并匿名化存留在某个数据集中。

面对媒体问询,OpenAI最初并未直接回应用户是否被明确告知聊天记录可能交由人工审阅,仅提供了一份提及出于模型优化目的会开展人工审核的常见问题页面。在这篇深度报道发布后,OpenAI悄然修改了帮助页面并补充了用户选择退出数据收集的方法,但修改后的文档中依然避而不谈会有工作人员直接阅读会话内容的事实。

事实上,这种依赖人工审核来优化模型的做法在科技行业中并非个例。谷歌的Gemini在隐私中心明确写明部分保存的聊天记录可能由人工审核,Anthropic也持有相似立场并专门开设网页进行说明,而Perplexity的态度则相对模糊,其隐私政策既未确认也未否认工作人员可以访问聊天日志。这也表明,在AI走向极致智能的道路上,人类的深度参与依然是不可或缺的底层支撑,而这层参与如何与用户隐私边界共存,仍是整个行业需要正面回答的问题。

# OpenAI # ChatGPT # 数据隐私 # 人工审核

来源:Heooo AI工具导航