Licenciés pour avoir utilisé ChatGPT : les évaluateurs du rempart humain d'OpenAI

Les contractuels qui laissent ChatGPT noter ChatGPT sont écartés sur-le-champ. Le fournisseur qui en mobilise plus de 30 000 est en pourparlers pour une valorisation de 20 milliards de dollars, et les annotations déjà livrées restent dans les données d'entraînement.

Lire l’original

In this storyOpenAIMercor
Vincent JiangVincent Jiang · 2 min read
Share
Sam Altman, PDG d'OpenAI, prenant la parole sur la scène de TechCrunch Disrupt San Francisco en 2019
Sam Altman, PDG d'OpenAI. Les contractuels qui évaluent les réponses de ChatGPT peuvent être écartés sur-le-champ pour avoir laissé un modèle faire le travail.

Le seul raccourci possible mène à la sortie

Les personnes rémunérées pour garder ChatGPT humain n'ont qu'une manière sûre de perdre leur poste : laisser un modèle le faire à leur place. Les contractuels qui évaluent les réponses de ChatGPT décrivent des collègues écartés « tout le temps » pour avoir utilisé l'IA dans ce travail, « quasiment la seule chose qui vous vaut une exclusion immédiate », sur des projets pouvant mobiliser plus de 10 000 personnes 12. OpenAI n'a pas souhaité commenter 1.

L'authenticité, passée au crible du tiret cadratin

Les règles internes sont sans détour : « N'utilisez pas d'outils de détection d'IA, ni l'IA vous-même. » GPTZero est jugé peu fiable, et même Grammarly et la traduction automatique sont proscrits pour les contrôleurs dont le métier est de repérer l'usage de l'IA chez les autres évaluateurs. « Jugez le schéma d'ensemble, pas un indice isolé », indique un guide. Les signes révélateurs sont stylistiques : vocabulaire répétitif, surutilisation du tiret cadratin, délais suspectement rapides. Un évaluateur a partagé une lettre de licenciement invoquant « l'authenticité » de son travail 12.

Le rempart du fournisseur, en chiffres

Mercor, qui a fourni deux des contractuels interrogés, confirme l'application de la règle : les contrats « interdisent strictement » l'usage des grands modèles de langage (LLM), et tout usage confirmé entraîne une exclusion immédiate 12. L'activité sous-jacente est en plein essor : plus de 30 000 contractuels, plus de 1,5 million de dollars versés chaque jour, une commission sur chaque heure travaillée et une valorisation multipliée par dix depuis février 2025 3456. L'argument de vente est très exactement ce qui est contrôlé : son PDG vend ce travail comme un apprentissage donné aux machines, « le jugement, la nuance et le goût que seuls les humains possèdent » 3.

La valorisation de Mercor multipliée par dix depuis février 2025

  • Valorisation
  • Estimate
$0B$5B$10B$15B$20Bfévr. 2025oct. 2025juil. 2026 (pourparlers)$10Bterm sheet révélé, tour non bouclé
Data
Valorisation
févr. 2025$2B
oct. 2025$10B
juil. 2026 (pourparlers) (estimate)$20B
Valorisation post-money à chaque tour rapporté : série B annoncée en février 2025, série C en octobre 2025, et un tour en pourparlers en juillet 2026, non bouclé. Sources : Benzinga via Yahoo Finance ; TechCrunch ; The Information via Stocktwits.4,5,6

Les annotations restent, l'évaluateur part

Rien, dans les documents, n'évoque un réexamen du travail déjà versé dans les données d'entraînement. Le dispositif décrit s'arrête à l'éviction des personnes 12. Leur travail portait sur de véritables conversations de consommateurs, intégrées par défaut à l'entraînement et relues par des humains payés plus de 50 dollars de l'heure. Un travail qu'un contrôleur jugeait « très mécanique » 27. Une demande d'action collective signifiée à OpenAI le 2 septembre soutient que les utilisateurs n'ont jamais été clairement informés qu'un humain lirait leurs conversations. La société doit répondre devant la justice le 13 octobre, et les plaignants exigent, eux, un consentement préalable à toute relecture humaine 8. Une étude parue dans Nature en 2024 a établi que l'entraînement sans discernement sur du texte généré par des modèles provoque des défauts irréversibles ; rien de publié ne montre qu'un tel scénario s'est produit dans les modèles d'OpenAI 9.

Sabotage dans la file d'attente

Le dispositif du fournisseur est bien réel : interdiction, investissement dans la détection, exclusion dès confirmation des faits 12. Mais il n'atteint pas le quatrième contractuel, qui se dit « payé pour rendre l'IA moins bonne » et affirme choisir parfois délibérément la pire réponse, sans qu'aucune détection ne soit décrite 1.

Les échéances à surveiller

Rendez-vous le 13 octobre, échéance judiciaire pour OpenAI. À surveiller aussi : la conclusion, ou non, du tour à 20 milliards de dollars évoqué pour Mercor 58. Chaque détection remplace un évaluateur. Rien, dans le dossier, ne remplace leurs annotations.

How this brief was made

01Gathered & sourced344 channels · 1,772 articles▾

Agents swept 344 channels and ingested 1,772 articles, then de-duplicated and ranked them for signal.

02Verified & cross-validated9 claims · 12 data feeds▾
03Reviewed & edited1 human editor▾

One editor read the draft against the evidence, tuned the framing, and signed off before it shipped.

Become a contributor

Reporting on the business of AI and want it read? We take pitches from outside contributors who bring primary sources and a number worth arguing about.

Share

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio