Wegen ChatGPT entlassen: Die Bewerter in OpenAIs menschlichem Burggraben

Freelancer, die ChatGPT von ChatGPT benoten lassen, fliegen sofort raus. Der Vermittler mit mehr als 30.000 von ihnen im Einsatz verhandelt über eine Bewertung von 20 Milliarden Dollar – und die bereits gelieferten Labels bleiben in den Trainingsdaten.

Original lesen

In this storyOpenAIMercor
Vincent JiangVincent Jiang · 2 min read
Share
Sam Altman, Chef von OpenAI, bei einer Rede auf der Bühne der TechCrunch Disrupt in San Francisco 2019
OpenAI-Chef Sam Altman. Die Freelancer, die ChatGPTs Antworten benoten, können auf der Stelle entfernt werden, wenn sie ein Modell die Arbeit erledigen lassen.

Gefeuert für die eine Abkürzung, die es gibt

Für die Leute, die dafür bezahlt werden, ChatGPT menschlich zu halten, gibt es einen verlässlichen Weg, den Job zu verlieren: ein Modell machen lassen. Freelancer, die ChatGPT-Antworten bewerten, berichten von Kollegen, die „ständig“ rausfliegen, weil sie bei der Arbeit KI einsetzen – „so ziemlich das Einzige, wofür man sofort rausfliegt“. Auf den Projekten können mehr als 10.000 Menschen eingesetzt sein 12. OpenAI lehnte eine Stellungnahme ab 1.

Authentizität, geprüft am Gedankenstrich

Die internen Regeln sind unverblümt: „Verwenden Sie keine KI-Erkennungstools – und benutzen Sie selbst keine KI.“ GPTZero wird als unzuverlässig eingestuft; selbst Grammarly und KI-Übersetzungen sind den Prüfern verboten, deren Aufgabe es ist, KI-Nutzung bei anderen Bewertern aufzudecken. „Beurteilen Sie das Gesamtbild, nicht einen einzelnen Hinweis“, heißt es in einer Anleitung. Die verräterischen Merkmale sind stilistischer Art: Wortwiederholungen, zu viele Gedankenstriche, verdächtig schnelle Bearbeitungszeiten. Ein Bewerter machte ein Kündigungsschreiben publik, das die „Authentizität“ seiner Arbeit anführte 12.

Die Burggraben-Mathematik des Vermittlers

Mercor, das zwei der befragten Freelancer vermittelte, bestätigt das Vorgehen: Verträge „untersagen strikt“ die Nutzung von LLMs (großen Sprachmodellen), bei bestätigter Nutzung folgt die sofortige Entfernung 12. Unter all dem boomt das Geschäft: mehr als 30.000 Freelancer, Auszahlungen von mehr als 1,5 Millionen Dollar pro Tag, für jede Stunde eine Gebühr in gleicher Höhe und eine Bewertung, die sich seit Februar 2025 verzehnfacht hat 3456. Das Verkaufsargument ist ausgerechnet das, was überwacht wird: Mercors Chef verkauft die Arbeit damit, Maschinen „das Urteil, das Feingefühl und den Geschmack beizubringen, die nur Menschen besitzen“ 3.

Mercors Bewertung hat sich seit Februar 2025 verzehnfacht

  • Bewertung
  • Estimate
$0B$5B$10B$15B$20BFeb. 2025Okt. 2025Juli 2026 (Verhandlungen)$10BTerm Sheet vor Berichten zufolge,Runde nicht geschlossen
Data
Bewertung
Feb. 2025$2B
Okt. 2025$10B
Juli 2026 (Verhandlungen) (estimate)$20B
Post-Money-Bewertung je gemeldeter Runde: Serie B angekündigt im Februar 2025, Serie C im Oktober 2025, dazu eine Runde in Verhandlungen, Stand Juli 2026, nicht abgeschlossen. Quellen: Benzinga über Yahoo Finance; TechCrunch; The Information über Stocktwits.4,5,6

Die Labels bleiben, der Bewerter geht

Von einer Nachprüfung der Arbeit, die bereits ins Training geliefert wurde, ist in den Dokumenten nirgends die Rede; die beschriebene Kontrolle endet mit der Entfernung von Personen 12. Bewertet wurden echte Gespräche von Verbrauchern – Dialoge, die standardmäßig ins Training einfließen und für deren Durchsicht Menschen mehr als 50 Dollar pro Stunde erhalten. Ein Prüfer nannte die Arbeit „sehr schematisch“ 27. Eine beantragte Sammelklage, die OpenAI am 2. September zugestellt wurde, macht geltend, die Nutzer hätten nie klar erfahren, dass Menschen ihre Chats lesen. Am 13. Oktober muss das Unternehmen vor Gericht Stellung nehmen. Die Kläger verlangen, dass vor jeder menschlichen Durchsicht eine Einwilligung nötig ist 8. Eine Nature-Studie aus dem Jahr 2024 kommt zum Ergebnis, dass unterschiedsloses Training mit modellgeneriertem Text irreversible Schäden verursacht; veröffentlicht wurde nichts, wonach das in OpenAIs Modellen geschehen wäre 9.

Sabotage in der Warteschlange

Dass der Vermittler durchgreift, stimmt: Verbot, Investitionen in die Erkennung, Entfernung nach Bestätigung 12. Den vierten Freelancer erreicht die Kontrolle nicht. Er sagt, er wähle mitunter absichtlich die schlechteste Antwort aus – er sei „dafür bezahlt, KI schlechter zu machen“. Eine Erkennung wird nicht beschrieben 1.

Der Blick nach vorn

Zu beobachten sind der 13. Oktober, OpenAIs Termin vor Gericht, und die Frage, ob Mercors viel diskutierte 20-Milliarden-Dollar-Runde zustande kommt 58. Jede Enttarnung ersetzt einen Bewerter. Nichts in den Unterlagen ersetzt seine Labels.

How this brief was made

01Gathered & sourced344 channels · 1,772 articles▾

Agents swept 344 channels and ingested 1,772 articles, then de-duplicated and ranked them for signal.

02Verified & cross-validated9 claims · 12 data feeds▾
03Reviewed & edited1 human editor▾

One editor read the draft against the evidence, tuned the framing, and signed off before it shipped.

Become a contributor

Reporting on the business of AI and want it read? We take pitches from outside contributors who bring primary sources and a number worth arguing about.

Share

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio