Demitidos por usar o ChatGPT: os avaliadores dentro do fosso humano da OpenAI

Contratados que deixam o ChatGPT avaliar o ChatGPT são demitidos na hora. O fornecedor que mobiliza mais de 30 mil deles negocia um valuation de US$ 20 bilhões — e os rótulos já entregues permanecem nos dados de treinamento.

Ler o original

In this storyOpenAIMercor
Vincent JiangVincent Jiang · 2 min read
Share
Sam Altman, CEO da OpenAI, discursando no palco do TechCrunch Disrupt São Francisco 2019
O CEO da OpenAI, Sam Altman. Os contratados que avaliam as respostas do ChatGPT podem ser demitidos na hora por deixar um modelo fazer o trabalho.

Demitidos pelo único atalho disponível

Quem é pago para manter o ChatGPT humano tem uma forma certa de perder o emprego: deixar um modelo fazer o trabalho. Em projetos que podem mobilizar mais de 10 mil pessoas, contratados que avaliam respostas do ChatGPT dizem que colegas são removidos "o tempo todo" por usar IA no serviço — "praticamente a única coisa que faz você ser cortado na hora" 12. A OpenAI declinou comentar 1.

Autenticidade, auditada pelo travessão

As regras internas são diretas: "Não use ferramentas de detecção de IA, nem IA você mesmo." O GPTZero é considerado não confiável, e até o Grammarly e a tradução por IA estão vetados para os revisores cuja função é detectar uso de IA por outros avaliadores. "Julgue o padrão geral, não uma pista isolada", orienta um dos guias. Os indícios são estilísticos: repetição de palavras, excesso de travessão, entrega suspeitamente rápida. Um avaliador compartilhou uma carta de rescisão que citava a "autenticidade" do trabalho 12.

A conta do fosso do fornecedor

A Mercor, que forneceu dois dos contratados ouvidos pela reportagem, confirma a fiscalização: os contratos "proíbem estritamente" o uso de LLMs, e o uso confirmado implica remoção imediata 12. O negócio por trás disso prospera: são mais de 30 mil contratados, pagamentos acima de US$ 1,5 milhão por dia, uma taxa de intermediação sobre cada hora e um valuation que se multiplicou por dez desde fevereiro de 2025 3456. O argumento de venda é justamente o que se fiscaliza: o CEO da empresa vende o trabalho como ensinar às máquinas "o julgamento, a nuance e o bom gosto que só os humanos possuem" 3.

Valuation da Mercor multiplicou por dez desde fevereiro de 2025

  • Valuation
  • Estimate
$0B$5B$10B$15B$20Bfev. 2025out. 2025jul. 2026 (negociação)$10Bterm sheet divulgado, rodada nãofechada
Data
Valuation
fev. 2025$2B
out. 2025$10B
jul. 2026 (negociação) (estimate)$20B
Valuation pós-money em cada rodada divulgada: Série B anunciada em fevereiro de 2025, Série C em outubro de 2025 e uma rodada em negociação em julho de 2026, ainda não fechada. Fontes: Benzinga via Yahoo Finance; TechCrunch; The Information via Stocktwits.4,5,6

Os rótulos ficam, o avaliador sai

Nada nos documentos descreve uma reauditoria do trabalho já entregue ao treinamento; a fiscalização descrita termina na remoção das pessoas 12. O que eles avaliavam eram conversas reais de consumidores, que por padrão alimentam o treinamento. Eram lidas por quem ganhava mais de US$ 50 por hora, num trabalho que um revisor chamou de “muito mecânico” 27. Uma ação coletiva proposta, protocolada contra a OpenAI em 2 de setembro, sustenta que os usuários nunca foram claramente informados de que um humano leria suas conversas; a empresa responde em juízo em 13 de outubro, e os autores querem que o consentimento seja exigido antes de qualquer revisão humana 8. Um estudo de 2024 na Nature constatou que o treinamento indiscriminado com textos gerados por modelos causa defeitos irreversíveis; nada publicado mostra que isso tenha ocorrido nos modelos da OpenAI 9.

Sabotagem na fila

A fiscalização do fornecedor é real: proibição, investimento em detecção e remoção mediante confirmação 12. Só que ela não alcança o quarto contratado, que disse às vezes escolher de propósito a pior resposta — “pago para piorar a IA” —, sem detecção alguma descrita 1.

No radar

Fique de olho em 13 de outubro, o prazo judicial da OpenAI, e no fechamento — ou não — da rodada de US$ 20 bilhões da Mercor, da qual tanto se fala 58. Cada flagrante substitui um avaliador. Nada no registro substitui seus rótulos.

How this brief was made

01Gathered & sourced344 channels · 1,772 articles▾

Agents swept 344 channels and ingested 1,772 articles, then de-duplicated and ranked them for signal.

02Verified & cross-validated9 claims · 12 data feeds▾
03Reviewed & edited1 human editor▾

One editor read the draft against the evidence, tuned the framing, and signed off before it shipped.

Become a contributor

Reporting on the business of AI and want it read? We take pitches from outside contributors who bring primary sources and a number worth arguing about.

Share

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio