Despedidos por usar ChatGPT: los evaluadores del foso humano de OpenAI

A los contratistas que dejan que ChatGPT evalúe a ChatGPT los expulsan en el acto. El proveedor, que gestiona a más de 30.000 de ellos, negocia ya una valoración de 20.000 millones de dólares, y las etiquetas entregadas siguen en los datos de entrenamiento.

Leer el original

In this storyOpenAIMercor
Vincent JiangVincent Jiang · 2 min read
Share
Sam Altman, consejero delegado de OpenAI, durante su intervención en el escenario de TechCrunch Disrupt San Francisco 2019.
El consejero delegado de OpenAI, Sam Altman. A los contratistas que evalúan las respuestas de ChatGPT pueden expulsarlos en el acto por dejar que un modelo haga el trabajo.

Despedidos por el único atajo disponible

Quienes cobran por mantener humano a ChatGPT tienen una sola vía segura para perder el empleo: que el trabajo lo haga un modelo. Los contratistas que evalúan respuestas de ChatGPT describen compañeros expulsados «constantemente» por usar IA en la tarea, «prácticamente lo único que hace que te expulsen de inmediato», en proyectos que pueden movilizar a más de 10.000 personas 12. OpenAI declinó hacer comentarios 1.

Autenticidad auditada por el guion largo

Las reglas internas son tajantes: «No utilice herramientas de detección de IA, ni IA usted mismo». GPTZero queda descartado por poco fiable, e incluso Grammarly y la traducción automática están prohibidos para los revisores cuyo oficio es cazar el uso de IA en otros evaluadores. «Juzgue el patrón general, no una sola pista», indica una de las guías. Los indicios son estilísticos: palabras repetidas, abuso del guion largo, tiempos de entrega sospechosamente rápidos. Un evaluador compartió una carta de despido que citaba la «autenticidad» de su trabajo 12.

Las cuentas del foso del proveedor

Mercor, que suministró a dos de los contratistas entrevistados, confirma que la norma se aplica: los contratos «prohíben estrictamente» el uso de grandes modelos de lenguaje (LLM) y, si se confirma, la expulsión es inmediata 12. El negocio que hay debajo está en pleno auge: más de 30.000 contratistas, pagos superiores a 1,5 millones de dólares al día, una comisión equivalente por cada hora y una valoración multiplicada por diez desde febrero de 2025 3456. El argumento de venta es, precisamente, lo que se vigila: su consejero delegado presenta ese trabajo como la manera de enseñar a las máquinas «el criterio, el matiz y el gusto que solo poseen los seres humanos» 3.

La valoración de Mercor se ha multiplicado por diez desde febrero de 2025

  • Valoración
  • Estimate
$0B$5B$10B$15B$20Bfeb 2025oct 2025jul 2026 (en negociación)$10Bhoja de términos conocida, rondasin cerrar
Data
Valoración
feb 2025$2B
oct 2025$10B
jul 2026 (en negociación) (estimate)$20B
Valoración post-money en cada ronda comunicada: serie B anunciada en febrero de 2025, serie C en octubre de 2025 y una ronda en negociación a julio de 2026, sin cerrar. Fuentes: Benzinga vía Yahoo Finance; TechCrunch; The Information vía Stocktwits.4,5,6

Las etiquetas se quedan, el evaluador se va

Nada en los documentos contempla volver a auditar el trabajo ya incorporado a los datos de entrenamiento: el control descrito se queda en expulsar a la gente 12. Lo que evaluaban eran conversaciones reales de consumidores, usadas por defecto para entrenar y leídas por más de 50 dólares la hora en un trabajo que un revisor calificó de «muy rutinario» 27. Una demanda colectiva propuesta, notificada a OpenAI el 2 de septiembre, sostiene que a los usuarios nunca se les avisó con claridad de que una persona leería sus conversaciones; la empresa responde ante el tribunal el 13 de octubre, y los demandantes piden que se exija consentimiento antes de cualquier revisión humana 8. Un artículo de Nature de 2024 constató que entrenar de forma indiscriminada con texto generado por modelos provoca defectos irreversibles; nada de lo publicado muestra que eso haya ocurrido en los modelos de OpenAI 9.

Sabotaje en la cola

El caso del proveedor es real: prohibición, inversión en detección, expulsión al confirmarse el uso 12. No llega al cuarto contratista, que cuenta que a veces escoge a propósito la peor respuesta, «pagado para empeorar la IA», y de quien no se describe detección alguna 1.

Lo que hay que vigilar

Habrá que vigilar el 13 de octubre, el plazo judicial de OpenAI, y comprobar si cierra la comentada ronda de 20.000 millones de dólares de Mercor 58. Cada detección sustituye a un evaluador. Nada de lo que consta en el expediente sustituye sus etiquetas.

How this brief was made

01Gathered & sourced344 channels · 1,772 articles▾

Agents swept 344 channels and ingested 1,772 articles, then de-duplicated and ranked them for signal.

02Verified & cross-validated9 claims · 12 data feeds▾
03Reviewed & edited1 human editor▾

One editor read the draft against the evidence, tuned the framing, and signed off before it shipped.

Become a contributor

Reporting on the business of AI and want it read? We take pitches from outside contributors who bring primary sources and a number worth arguing about.

Share

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio