OpenAI人工审核ChatGPT对话机制曝光
「据404Media调查,OpenAI雇佣数百名合同工审核真实ChatGPT用户对话,按1至7分为模型回复评分,重点减少过度奉承与过度拟人化。这些合同工由Crossing Hurdles招募、Mercor支付薪酬,北美评论员时薪超50美元。匿名化对话仍可能含敏感信息,OpenAI默认开启数据改进选项,用户可关闭或使用临时聊天模式。」
据404Media调查报道,OpenAI雇佣了数百名合同工,对真实ChatGPT用户的对话内容进行人工审核,目的是持续改进模型回复的质量。泄露的内部文件与消息人士透露,审核人员会对ChatGPT生成的回复按照1至7分的标准进行打分,其中重点关注的问题包括减少模型过度奉承用户以及过度拟人化的表达倾向。
在薪酬与用工结构方面,报道指出这些合同工由Crossing Hurdles负责招募,并由AI培训公司Mercor支付薪酬,一名北美地区的评论员称自己的时薪超过50美元。这一链条显示出,大模型厂商在模型优化环节已形成较长的外包用工体系。
隐私层面的争议是此次曝光的核心。部分评论员认为,用户并不清楚自己的聊天记录可能被真人阅读。报道进一步指出,即使是经过匿名化处理的对话,其中仍可能包含敏感个人信息。OpenAI虽然部署了隐私过滤器,但也承认该机制可能出现误判,从而让部分信息未被有效遮蔽。
需要指出的是,OpenAI并非近期才披露人工审核机制。其FAQ至少自2023年起就已说明,授权人员及服务提供商可能查看用户数据以提升模型性能,并建议用户不要输入敏感信息。404Media认为,这一披露方式较为隐晦,用户可能难以直观理解人工审核的实际范围与边界。
在产品设置层面,OpenAI目前默认开启“为所有人改进模型”选项,用户可以主动关闭该选项,从而阻止新创建的聊天记录被用于模型训练及相关人工审核流程。此外,临时聊天模式也不会使用用户输入的数据来训练模型,为注重隐私的用户提供了另一条路径。
人工反馈已成为大模型优化的重要环节,并非OpenAI一家的做法。Anthropic也确认会对启用相关隐私设置的Claude对话进行人工审核,并在审核前进行匿名化处理;谷歌同样允许人工审核员检查部分Gemini聊天记录。此次事件再次凸显出模型训练效率与用户数据隐私之间的平衡难题,也提醒用户在使用对话式AI时留意默认设置与数据用途说明。
来源:Heooo AI工具导航