深夜对机器人说的私密真心话,千里之外正有人按时薪逐字审阅
深夜对机器人说的私密真心话,千里之外正有人按时薪逐字审阅
很多人在深夜打开对话框时,会把它当成一个绝对不会泄密的树洞。有人在里面排解长期的焦虑,有人倾诉职场里的隐秘心事,甚至在发完一大段文字后,还会特意在结尾补上一句:这件事请替我严格保密。
你以为屏幕对面只有冷冰冰的代码在云端飞速运转,但事实可能完全相反。此时此刻,很可能正有一位拿着五十多美元时薪的陌生人,坐在千里之外的电脑前,一边喝着咖啡,一边逐字逐句审阅你刚刚发出的那段隐私,顺便给系统的回复打上一个分数。

一、代号百合花:数百名外包正在盯着你的屏幕
这套隐秘的人工运作网络在 OpenAI 内部拥有一个代号,叫做百合花项目(Project Lily)。根据科技媒体 404 Media 获得的内部泄露文件、内部通讯频道讨论记录以及流转在后台的真实对话,OpenAI 正在雇佣数百名合同工,日复一日地阅读海量真实用户的对话记录。
很多普通用户一直以为,这类大语言模型的飞速进化,完全归功于海量的全网公开数据抓取、顶尖技术团队的高薪研发,或者是算法底层架构的自我演进。但绝大多数人都忽视了极为关键的一环:为了让机器人的回答更加自然、更符合人类的表达习惯,背后其实站着大量拿报酬的外部审核员,正在人工进行精细的修剪与打分。
根据公开报道披露的数据,该聊天机器人在全球的每周活跃用户已经超过了 9 亿。面对如此庞大的用户群体,其中绝大多数人在日常使用时,根本不会想到自己的输入内容会被真人肉眼逐字查看。
这批外包审核员并不是 OpenAI 编制内的正式技术人员。调查显示,他们由一家名为 Crossing Hurdles 的人力机构负责招募,并通过专门的人工智能训练供应商 Mercor 来结算薪资,审核员的时薪通常超过 50 美元。一位长期在后台与这些真实输入打交道的工作人员坦言,如果去问普通用户是否知情,得到的答案肯定是否定的,因为绝大多数人压根想不到屏幕背后会有一群拿时薪的外包人员,正在逐条剖析他们的私人文字。
根据参与该项目的人员描述,这项工作在日常执行中其实非常机械。审核员每天登录专门的操作后台,在任务面板里不断认领新的对话切片,把真实用户的日常倾诉当成工作原料,逐条完成规定的阅读、总结与评分要求。
二、打分面板上的秘密:从记忆摘要到七分制考卷
在审核员的操作后台里,整个工作流程被严格拆解为标准化的三个步骤。审核员首先在任务面板中挑选并认领自己想要处理的任务,点击进入后,第一步就是阅读一条来自真实用户的完整输入;第二步是用简练的语言写下摘要,总结他们认为这个用户实际想让机器人做什么;第三步则是对着系统生成的四条备选回答进行逐一打分和批评。
这套评分系统采用非常严格的 1 到 7 分量表。在具体的分值定义中,1 分代表该回答糟糕至极,属于不可接受、完全不可用的废话;而 7 分则代表回答极为完美,在逻辑、语气和内容上都挑不出毛病,属于难以做出任何有意义改进的顶尖水平。
更让人意想不到的是,审核员在后台看到的往往不仅是一句孤立的提问。在打分面板的上方区域,经常会直接显示出一栏名为用户记忆摘要的背景信息。这个区域会系统地概括该用户以往使用聊天机器人的主要历史记录、平时的提问习惯与兴趣偏好,在某些特定情况下,甚至会直接标注出该用户可能居住在世界上的哪个具体区域。
虽然打分面板经过了一定的处理,不会直接显示出用户的账号名称,但很多用户在日常使用时,本身就会把未公开的商业计划、复杂的家庭矛盾、个人财务状况甚至极其隐秘的生活经历一股脑敲进对话框。许多人还会在输入的末尾加上一句别告诉任何人,天真地以为这是一条对系统的保密指令,殊不知这行字连同上方的记忆摘要,全都被原原本本地推送到审核员的屏幕中央。
审核员在打分时,还被要求在每条备选回复中至少挑出三处与训练规则对齐或者不对齐的具体细节,并详细写下扣分理由。面对包含高风险领域的咨询,例如医疗、法律或金融等话题,如果系统生成的回答缺乏权威来源支持,审核员也必须严格予以扣分处理。

三、机器人的戒律:不许装人,更不许疯狂拍马屁
这些审核员每天拿着高昂的时薪,到底在纠正机器人的哪些毛病?内部标有机密与专有字样的培训手册明确列出了几条硬性红线,其中最核心的两项任务,就是严格防止机器人出现拟人化以及减少过度谄媚。
在过往的模型版本中,过度迎合用户、盲目顺从用户偏见的谄媚倾向带来了极为严重的负面后果。内部文件特别提到,过度谄媚的 4o 模型在现实中引发了多起诉讼,被指在部分案例中放大了当事人的负面情绪,甚至间接导致了多人走向自杀的悲剧。正因如此,审核员的重要职责之一就是给机器人的盲目迎合踩下刹车。如果系统在回复中过度奉承、盲目认同用户的非理性想法、无端放大挫败感,或者采用居高临下的傲慢语气,都会被审核员当场标记并扣分。
与此同时,系统被严格禁止假装自己拥有人类的情感、意识或个人经历。培训手册里给出了非常具体的语言界限:机器人可以说我为你找到了一些相关信息,但绝不能使用作为一名资深厨师,我平时最喜欢如何处理食材,或者我完全懂你此刻的那种痛苦感觉这类带有主观经历的表述。
在日常语言风格上,审核员甚至需要用挑剔的眼光去清除多余的符号修饰。例如在系统生成的条目清单里,如果带有了绿色的对勾表情符号,就会因为不必要地使用表情符号、带有过多生硬的机器腔而被判定为不对齐。
根据官方指引,一个完全合规的优秀回复,必须大体匹配用户的语气但要比用户更弱一些,保持自然、克制、诚实且谦逊的专业风格。至于更深层次的事实核查,指引特别说明 OpenAI 并不要求百合花项目的审核员借助外部搜索去逐一验证事实,只要标记出明显的常识错误即可,因为还有其他专门的项目团队负责更深入的内容核实工作。
四、漏风的过滤器与悄悄开启的默认开关
面对外界对用户隐私泄露的巨大担忧,OpenAI 曾解释称,所有真实对话在推送到人工审核员的屏幕之前,都会先经过一套专门的隐私过滤模型处理,用来检测并自动移除其中的个人身份信息。
但这一层技术过滤网显然算不上密不透风。OpenAI 在公开说明中也承认,这套隐私过滤模型和所有大模型一样都会犯错。当遇到不常见的姓名标识、模糊的私人指代,或者上下文极其有限的短对话时,过滤器往往会出现遮蔽不足或者过度遮蔽的情况,导致大量真实的个人敏感细节被直接漏掉,毫无保留地呈现在外包人员面前。
更关键的分歧在于用户的知情权与平台的默认设置。在个人免费版以及两档个人付费版本中,允许系统调取用户对话用于改进模型的选项,在系统底层默认全都是开启的;只有针对企业、商业机构与教育类别的专门客户,这个数据抓取开关才会在初始状态下保持关闭。
即使用户察觉到了这一风险,手动打开设置面板,进入数据控制页面关掉那个名为为所有人改进模型的开关,这种退出机制也仅仅对之后产生的新对话生效,并不具备向前追溯的效力。那些在关闭开关之前已经被系统抓取、脱敏并进入任务队列的旧对话,依然会停留在后端的训练循环之中。
在合规与法律层面,这种做法已经引发了监管机构的重罚。欧洲监管机构依据数据保护条例明确判定,数据控制者的告知义务在信息被收集的那一刻就已经成立,而不管接收方后续能否准确拼凑出具体的个人身份。此前,意大利监管机构就曾因为缺乏充分的法律依据处理用户数据,对 OpenAI 开出了高达 1500 万欧元的罚款,其中 900 万欧元直接源于非法处理行为,并责令其在当地的电视和广播渠道连续投放六个月的公开信息公告。
这种依赖人工审核改进模型的操作在整个行业内其实相当普遍。Anthropic 方面已经确认,当用户开启相关数据选项时,他们同样会对旗下的 Claude 模型使用人工审核员;Google 旗下的 Gemini 也在使用条款中明确写明,人类审核员可能会审查部分已保存的聊天记录;而另一家搜索工具 Perplexity 在其隐私声明中,则对是否存在人类访问保持了既不确认也不否认的态度。

在很多消费者的普遍认知里,自己既然已经掏钱购买了高级订阅服务,就理应获得更高规格的数据隐私防护。然而现实中的商业逻辑却是,真正昂贵的企业级客户买到了彻底的数据隔离,而普通的个人付费用户所得到的,依然是一个在后台默认开启的数据收割开关。
随着越来越多的 AI 应用开始积极引导用户绑定个人日程、同步生活习惯,甚至进一步尝试整合个人银行账户等核心资产信息,那个看似安静纯粹的空白输入框,背后其实直接连接着一条庞大、精密且昼夜不停的人工数据加工流水线。
如果你在日常工作和生活中,也习惯了把聊天窗口当成无话不说的知己或数字心理医生,或许应该时刻牢记那条最根本的防线:只要那段文字是你绝对不愿让任何一个现实中的陌生人读到的,就永远不要把它敲进任何聊天机器人的输入框里。
DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。
更多推荐

所有评论(0)