OpenAI 有数百名合同工在阅读你的 ChatGPT 对话
据 404 Media 调查,OpenAI 雇佣数百名合同工阅读真实 ChatGPT 对话以改进模型,审核员按 1 到 7 分评分并减少过度奉承与拟人化。对话虽匿名化仍可能含敏感数据,用户可通过关闭默认设置或临时聊天降低风险。Anthropic、谷歌也被指采用人工审核,行业隐私披露与同意机制再受关注。
原贴
查看原文原文
中文翻译
据 404 Media 调查,OpenAI 雇佣了数百名合同工,他们阅读真实的 ChatGPT 用户对话,以改进聊天机器人的回复。
该媒体获得了泄露的内部文件,并采访了其他消息源。审核员按 1 到 7 分对 ChatGPT 的回复评分,任务是减少模型输出中过度的奉承和拟人化行为。
一名审核员告诉 404 Media,他认为用户不知道有人正在阅读他们的聊天。被审核的提示词支持这一点:一些对话中,用户明确要求 ChatGPT 对内容保密。这些提示词经过匿名化处理,但仍可能包含敏感个人数据。OpenAI 使用隐私过滤器,但承认它可能出错。
据 404 Media 报道,这些合同工通过 Crossing Hurdles 招募,并通过 AI 训练公司 Mercor 支付报酬。一名北美审核员表示,他们每小时收入超过 50 美元。
用户可以关闭默认启用的“Improve the model for everyone”设置,以阻止他们的聊天被用于模型训练并可能被人类阅读。该设置仅适用于新对话。OpenAI 还提供临时聊天模式;据该公司称,该模式不会将输入数据用于模型训练。
当 404 Media 询问用户在哪里被明确告知人工审核时,OpenAI 最初没有回应。在一个 FAQ 页面上,该公司解释称,授权人员和服务提供商可能查看用户数据以改进模型性能,并建议不要输入敏感信息。该通知至少自 2023 年起就在线存在,多年来只略有变化。
404 Media 认为,这一披露过于隐蔽和模糊,无法让用户意识到实际发生的人工审核有多少。而“Improve the model for everyone”读起来更像友好的社区贡献,而不是同意让人类阅读你的对话。但这种模糊表述很可能是经过深思熟虑的。如果 OpenAI 请求明确同意,退出率可能会很高。不过,对 AI 实验室来说,这种人工反馈是改进模型的关键部分。这种做法也很普遍。
Anthropic 向 404 Media 确认,它使用人工审核员检查 Claude 的回复并改进未来模型。这适用于在隐私设置中开启“Help improve our AI models”的用户。Anthropic 还会在人工审核前匿名化对话,删除电子邮件地址等账户细节。谷歌也使用人工审核员,并在 Gemini 中指出人类可能会审核已保存的聊天。
核心信息
据 404 Media 调查,OpenAI 雇佣数百名合同工阅读真实 ChatGPT 对话以改进模型,审核员按 1 到 7 分评分并减少过度奉承与拟人化。对话虽匿名化仍可能含敏感数据,用户可通过关闭默认设置或临时聊天降低风险。Anthropic、谷歌也被指采用人工审核,行业隐私披露与同意机制再受关注。
- 据 404 Media 调查,OpenAI 雇佣数百名合同工阅读真实 ChatGPT 对话以改进模型,审核员按 1 到 7 分评分并减少过度奉承与拟人化。对话虽匿名化仍可能含敏感数据,用户可通过关闭默认设置或临时聊天降低风险。Anthropic、谷歌也被指采用人工审核,行业隐私披露与同意机制再受关注。
- 原贴提到:OpenAI employs hundreds of contract workers who read real ChatGPT user c
- 来源:the-decoder.com
详细解读
这是什么信号:据 404 Media 调查,OpenAI 雇佣数百名合同工阅读真实 ChatGPT 用户对话,用于改进模型回复。审核员按 1 到 7 分评分,并重点减少过度奉承和拟人化输出。合同工通过 Crossing Hurdles 招募、由 Mercor 支付,一名北美审核员称时薪超过 50 美元。OpenAI 使用隐私过滤器,但承认可能出错;用户可通过关闭默认开启的“Improve the model for everyone”来阻止新对话被用于训练和潜在人工阅读,也可使用临时聊天模式。
为什么重要:这不是单纯的模型训练细节,而是 AI 产品隐私边界和用户同意机制的问题。被审核提示虽经匿名化,仍可能包含敏感个人数据;有些用户明确要求保密,却未必知道人工审核存在。OpenAI 的 FAQ 虽提到授权人员和服务提供商可能查看数据,但 404 Media 认为披露过于隐蔽和模糊。模糊措辞可能降低退出率,却会削弱用户信任。Anthropic 和谷歌也被确认或说明使用人工审核,表明这是行业普遍做法。
对谁有价值:对 AI 产品负责人,这是设计隐私设置、同意文案和审核链路的现实案例;对隐私与合规团队,是评估数据出境、匿名化和供应商管理的信号;对企业采购者,是审查 AI 供应商是否会用企业数据训练和人工查看的依据;对数据标注与外包从业者,则展示了 AI 训练劳动市场的规模和报酬区间;对普通用户,是检查 ChatGPT 设置和输入习惯的直接提醒。
可以怎么行动:用户可关闭“Improve the model for everyone”,注意它只影响新对话,并使用临时聊天模式,避免输入身份证、财务、医疗、商业机密等敏感信息。企业应要求供应商提供数据保留、匿名化、人工审核和退出机制的书面说明,必要时关闭训练用途。产品团队应把人工审核和训练用途做成清晰、分层、可撤回的同意,而不是藏在 FAQ 里。AI 团队若依赖人工反馈,应建立审核员保密、最小必要访问和敏感数据过滤流程。
风险或限制:第一,匿名化不等于无风险,隐私过滤器也可能犯错。第二,退出设置只适用于新对话,历史对话和默认设置可能仍带来覆盖盲区。第三,行业普遍采用人工审核,意味着用户很难完全避开,但披露质量差异很大。第四,若改成强明确同意,退出率可能很高,模型改进效率会受影响,因此平台有动机维持模糊表述。第五,本信号来自媒体调查和公司回应,未提供全面审计数据,不能据此断言所有对话都被人工阅读。
信息差价值
这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 the-decoder.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。
如果把《OpenAI 有数百名合同工在阅读你的 ChatGPT 对话》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。
参考来源
TOPIC HUBS
延伸专题
AI SUMMARY
这篇文章回答了什么
OpenAI 有数百名合同工在阅读你的 ChatGPT 对话主要讲什么?
据 404 Media 调查,OpenAI 雇佣数百名合同工阅读真实 ChatGPT 对话以改进模型,审核员按 1 到 7 分评分并减少过度奉承与拟人化。对话虽匿名化仍可能含敏感数据,用户可通过关闭默认设置或临时聊天降低风险。Anthropic、谷歌也被指采用人工审核,行业隐私披露与同意机制再受关注。
这篇文章最值得关注的要点是什么?
据 404 Media 调查,OpenAI 雇佣数百名合同工阅读真实 ChatGPT 对话以改进模型,审核员按 1 到 7 分评分并减少过度奉承与拟人化。对话虽匿名化仍可能含敏感数据,用户可通过关闭默认设置或临时聊天降低风险。Anthro…;原贴提到:OpenAI employs hundreds of contract workers who read real ChatGPT user c;来源:the-decoder.com
这篇文章和哪些AI专题相关?
它适合放在AI日报、AI工具、Agent工作流专题里阅读。 关联原因:这篇内容命中「热点解读」等主题信号。;这篇内容命中「模型」等主题信号。;这篇内容来自该专题长期覆盖的栏目。
阅读这篇文章建议先理解哪些关键词?
建议先理解AI日报、每日AI日报、AI信号、热点解读、BuilderPulse这些关键词,再结合正文判断工具、机会或风险是否值得进入自己的工作流。