资讯中心

  • 首页
  • 资讯中心
  • OpenAI外包员工因使用AI工具被解雇:我只是在寻求帮助

OpenAI外包员工因使用AI工具被解雇:我只是在寻求帮助

2026-09-29

本周,404 Media对OpenAI的内部运营进行了深入调查,揭示出一些负责训练AI的外包人员竟因工作中使用AI工具而被解雇。这一事件显得讽刺,因为OpenAI一直在鼓励全球开发者、写作者和各类职场人积极应用AI技术。据了解,这些外包人员的主要工作是阅读ChatGPT用户的真实对话并对AI的回复进行评价,再将这些反馈提供给模型进行进一步训练。

根据404 Media的报告,这一被称为“Project Lily”的项目涉及数百名外包人员,他们的任务就是对用户和ChatGPT之间的互动进行评估。具体来说,他们需要判断AI给出的回答是否正确,是否过于迎合用户,还是表现得像个真正的人。换句话说,这个过程就是一种典型的人工反馈机制:AI生成内容,外包人员专注于评判这些回答的质量并给出反馈。这一工作量庞大,参与人数甚至可能超过了一万人,显示出人类外包在大型AI模型训练中的重要性。

值得注意的是,这些外包人员所处理的内容并不都是经过OpenAI特别设计的测试数据,而是可能来自真实用户提交给ChatGPT的请求。在之前的关于Project Lily的报道中,曾提到即使经过隐私过滤,部分敏感信息依然可能被审核人员看到。对此,OpenAI承认过滤系统可能会遗漏一些敏感标识符,因此可能会涉及到用户的私人对话。

除了负责评价AI回答的外包人员外,还有一类专职审核其他外包人员的工作人员。他们的职责是确保其他人的工作符合标准,并监督是否有违规使用AI的情况。根据内部工作指南,这类审核人员也被禁止使用AI工具,包括Grammarly和任何翻译工具,以保证监督的有效性。如果审核人员依赖AI,那么这一监督机制本身就失去了意义。因此,整个流程实际上变成了:一类人负责评分,另一类人负责监督,并需证明工作的真实性。

由于规定的限制,审核人员还收到了一份专门的指南,指导他们识别可能由于AI参与而产生的特征,如重复性表达、明显的AI写作风格以及工作完成速度异常等。文件中还提到,审核人员不能仅依赖单一的迹象或工具进行判断,而是要综合考虑整体情况,不可草率下结论。

在接受404 Media采访的外包人员中,有人承认在工作中使用了AI工具,其中一名甚至表示有机会向媒体展示他的解雇信。信中提到,他的工作在“真实性”方面存在问题。这名外包人员感叹:“我并不是一个坏人,也不是一个不称职的员工,只是需要一点帮助而已,结果却到了这样的地步。”他进一步表示,工作中的快乐逐渐消失,感觉自己并没有为社会贡献真正的价值。

此外,还有两名受访者曾为名为Mercor的AI训练公司工作,该公司负责招募专家与外包人员进行AI模型训练的项目。关于外包人员使用AI的问题,Mercor的发言人表示,他们重视每位雇员的专业知识与判断能力,并在合同中明确禁止利用大型语言模型(LLM)完成相关工作。