- 类型
- 新闻
- 来源
- The Decoder AI News
- 发布
- 2026年9月14日 17:15
- 状态
- 单一信源
发生了什么
据 404 Media 报道,OpenAI 雇佣数百名合同工阅读真实的 ChatGPT 对话,并按 1 到 7 分进行评分,部分目的是减少模型的迎合式表达和拟人化行为。这些提示词虽已匿名化,但仍可能包含敏感数据。用户若不希望对话被人工查看,必须主动关闭默认开启的“Improve the model for everyone”设置。
为什么重要
此前公众对 ChatGPT 数据使用的讨论多集中在模型训练,而这次披露的是人工逐条阅读与评分环节,且相关对话即使匿名化仍可能含敏感信息。更关键的是,用户须主动关闭默认开启的设置才能退出,默认同意而非默认拒绝,改变了用户对隐私边界的实际控制方式。
底层逻辑
OpenAI 通过人工评分来校准模型行为,评分维度包含减少迎合和拟人化表达,说明部分对齐工作仍依赖人工判断而非纯自动化。合同工模式可降低标注成本并快速扩充人力;而将“Improve the model for everyone”默认开启,则让数据收集成为默认路径,用户退出需要额外操作。
产品与商业机会
对产品团队而言,需重新审视默认开启的数据使用开关是否符合目标市场的隐私预期,尤其是欧洲等监管严格地区。对研发团队而言,依赖合同工阅读真实对话意味着数据管道、匿名化与访问控制需要更强的审计与权限管理,否则敏感数据泄露风险会推高合规成本。
- 在隐私敏感市场推出默认关闭数据用于改进的版本,把“不用于训练”作为付费或企业版的差异化卖点。
- 为企业客户提供对话内容本地化处理或零人工审阅的部署方案,并附可验证的审计日志。
- 开发面向用户的对话数据使用仪表盘,实时展示哪些对话被人工或自动审阅,并提供一键批量撤回。
- 为合规团队提供标注流程的权限分级与敏感信息自动脱敏工具,降低人工审阅带来的数据暴露风险。
仍待确认
- 合同工阅读的对话具体覆盖哪些地区、语言和用户类型,是否存在企业版数据被纳入的情况?
- 匿名化具体采用何种方式,能否阻止通过上下文重新识别个人身份?
- 默认开启的“Improve the model for everyone”在各地上线策略是否一致,是否会因监管而调整?
- 人工评分的 1 到 7 分具体评估维度及这些评分如何进入模型训练或对齐流程?
原文与媒体展开查看
