据404Media调查,OpenAI雇佣数百名合同工审核真实ChatGPT用户对话,以改进模型回复质量。泄露的内部文件及消息人士显示,审核人员会对ChatGPT生成的回复按1至7分进行评分,重点帮助减少模型过度奉承及过度拟人化等问题。
部分评论员认为,用户并不清楚自己的聊天记录可能被真人阅读;经匿名化处理的对话中仍可能包含敏感个人信息,OpenAI虽部署隐私过滤器,但也承认其可能出现误判。

据报道,这些合同工由Crossing Hurdles招募,并由AI培训公司Mercor支付薪酬,一名北美地区评论员称其时薪超过50美元。OpenAI目前默认开启“为所有人改进模型”设置,用户可关闭该选项,阻止新创建的聊天记录用于模型训练及相关人工审核;临时聊天模式则不会使用输入数据训练模型。
值得注意的是,OpenAI并非近期才披露人工审核机制。其FAQ至少自2023年起就说明,授权人员及服务提供商可能查看用户数据以提升模型性能,并建议用户不要输入敏感信息。404Media认为,这一披露较为隐晦,用户可能难以直观理解人工审核的实际范围。
人工反馈已成为大模型优化的重要环节。Anthropic也确认会对启用相关隐私设置的Claude对话进行人工审核,并在审核前进行匿名化处理;谷歌同样允许人工审核员检查部分Gemini聊天记录。此次事件再次凸显AI模型训练效率与用户数据隐私之间的平衡问题。
VIP会员