OpenAI macht Tempo zum Produkt mit Sechsfachpreis – wessen Chips es liefern, ist die 48-Milliarden-Dollar-Frage
Auf OpenAIs DevDay wurde Ultrafast zum ausgelieferten Tarif – zum Sechsfachen des Preises. Am selben Tag meldete ein Fachbeitrag, die Stufe laufe auf Nvidia-Chips, und eine Führungskraft von Cerebras reichte den Verkauf von Aktien ein. Wann der Auftragsbestand zu Umsatz wird, bestimmt OpenAIs Kalender; der finanzierte Neocloud-Kanal ist der Teil, den Cerebras selbst kontrolliert.
Richard Tang · 4 min read
Auf der DevDay von OpenAI am 29. September wurde Ultrafast zum ausgelieferten Produkt: bis zu 300 Output-Tokens pro Sekunde, zum Sechsfachen der Standard-API-Preise, live für GPT-6 Astra; die Version für GPT-6.1 Sol soll binnen Tagen folgen 1. Entwickler optimieren inzwischen drei Variablen – Intelligenz, Kosten, Latenz –, und nur bei einer schlägt ein Vielfaches zu Buche: beim Tempo 1. Die Frage, wer dieses Tempo liefert, ist heute für einen Chiphersteller 48 Milliarden Dollar wert – und diese Woche wurde sie auf die Probe gestellt 2.
Agentenbasiertes Coden ist die Arbeitslast, die den Aufschlag zahlt
Den Sechsfach-Aufschlag zahlt am Ende die Arbeitslast der Agenten. Ein Coding-Agent setzt Hunderte oder Tausende sequenzieller Inferenz-Aufrufe ab, und jeder einzelne liegt auf dem kritischen Pfad 3. Das Rechenbeispiel von General Compute: Ein Agent, der 400 Modellaufrufe benötigt, braucht bei 100 Tokens pro Sekunde rund 20 Minuten, bei 300 weniger als sieben Minuten 3.
Beim langsamen Tempo legt der Entwickler die Arbeit weg und kommt später zurück; beim schnellen bleibt er drin 3. Genau diesen Verhaltenswechsel kauft der Aufschlag – deshalb zählt das Silizium unter Ultrafast.
Plötzlich ist das Silizium unter der Stufe die Frage
Im August war Ultrafast eine begrenzte Vorschau: GPT-5.6 Sol lief dort auf Cerebras-Hardware mit bis zu 750 Tokens pro Sekunde, rund das Vierzehnfache des Standardtempos 14. Die Stufe, die diese Woche ausgerollt wurde, erreicht maximal 300 und tauscht, so die Deutung von VentureBeat, Rekordtempo gegen neuere Intelligenz ein 1. Dann postete am Abend des Starts SemiAnalysis in einem Beitrag, GPT-6.1 Sol Ultrafast laufe mit geringer Batchgröße, und zwar auf Nvidia-GPUs – nicht auf Cerebras-Hardware, also ausgerechnet in dem Regime, in dem alles auf niedrige Latenz ankommt und in dem der On-Chip-Speicher von Cerebras eigentlich die Nase vorn haben soll 56. Das ist ein einzelner Fachbeitrag, keine Bestätigung – und Cerebras hat bislang weder bestätigt noch dementiert, ob das Unternehmen beim Betrieb der Stufe eine Rolle spielt 6. Der Markt wartete nicht: Die Aktie rutschte am 30. September um rund 7 Prozent ab 6.
OpenAIs ausgelieferte Ultrafast-Stufe bleibt unter der Cerebras-Vorschau vom August
Data
| Value | |
|---|---|
| Celeris-1 | 1,491 tok/s |
| Mercury 2 | 769 tok/s |
| GPT-5.6 Sol Ultrafast (Aug., Cerebras) | 750 tok/s |
| GPT-6 Astra Ultrafast (Sep.) | 300 tok/s |
| Gemini 3.5 Flash | 201 tok/s |
Was CBRS-Aktionäre wirklich besitzen
Vor dem Kursrutsch bezifferte The Motley Fool den Börsenwert von Cerebras auf rund 48 Milliarden Dollar 2. Aus der Einreichung hinter diesem Kurswert geht ein Auftragsbestand von 25,4 Milliarden Dollar hervor, von dem ein erheblicher Betrag auf eine einzige Vereinbarung mit OpenAI zurückgeht. Nur rund 22 Prozent davon – etwa 5,6 Milliarden Dollar – sollen bis zum 30. Juni 2028 in Umsatz umgesetzt werden, nach einem Zeitplan, den der Kunde verschieben kann 2. Am selben Tag, an dem Ultrafast ausgeliefert wurde, meldete die Führungskraft Dhiraj Mallick den geplanten Verkauf von 396.000 Aktien im Wert von 77,9 Millionen Dollar an – im Rahmen eines am 30. Juni aufgelegten Handelsplans, nachdem er bereits am 18. August 38.889 Aktien für 8.642.077,14 Dollar verkauft hatte: Verkäufe in die Nachfrage, verteilt auf zwei Termine 7. Crowd-Beiträge auf r/CBRS_stock hatten Ultrafast als Cerebras-Silizium gedeutet und auf Call-Käufe verwiesen; das war die Überzeugung, die diese Woche neu bepreist wurde, kein Beleg 8.
Nur rund ein Fünftel des Cerebras-Auftragsbestands von 25,4 Milliarden Dollar soll bis Mitte 2028 umgesetzt werden
Data
| Value | |
|---|---|
| Auftragsbestand gesamt | $25.4B |
| Umsetzung später | $19.8B |
| Umsetzung bis 30. Juni 2028 | $5.6B |
Der Teil, den Cerebras kontrolliert
Die Antwort des Unternehmens: ein Vertrieb, der nicht davon abhängt, wen OpenAI mit der Bedienung seiner Stufen betraut. General Compute, eine für alternative Chips gebaute Neocloud, hat eine mehrjährige Vereinbarung über den Einsatz von Cerebras-Systemen für agentenbasiertes Coden geschlossen. Finanziert wird das aus einer Kreditlinie über 400 Millionen Dollar, die sich das Unternehmen im Juli bei Upper90 gesichert hat; ans Netz gehen soll die Kapazität im ersten Quartal 2027 3. Der schärfste Satz in dieser Geschichte stammt von General Compute selbst: Chips gewinnen über installierte Kapazität – und installierte Kapazität ist ein Finanzierungsproblem, bevor sie ein technisches ist 3. Die Kreditgeber tragen die Hardware; Cerebras kassiert für Geschwindigkeit – nach Verträgen, die OpenAI nicht kontrolliert 9.
Was bewiesen ist – und was eingepreist ist
Bewiesen: Geschwindigkeit verkauft sich mit Aufschlag, Agenten sind die Workload, die ihn bezahlt, und es gibt inzwischen einen finanzierten Kanal, der Cerebras-Geschwindigkeit ohne OpenAI vertreibt. Nicht bewiesen: dass die Flaggschiff-Stufe Cerebras zu ihrer Bedienung braucht. OpenAI hat eine niedrigere Obergrenze ausgeliefert als in der eigenen Vorschau im August, und die Verträge hinter dem Auftragsbestand legen den Zeitplan in die Hand des Kunden. Es folgen zwei Tests: wo GPT-6.1 Sol Ultrafast landet – und ob die 2027er-Racks Abnehmer finden.
Die Staffelung selbst ist eindeutig gut für die Verbreitung, denn Agenten, die in Minuten fertig sind, halten Menschen im Prozess und holen mehr Arbeit aus dem Warten auf den Menschen heraus. Doch zu dieser Bewertung ist Cerebras als das Unternehmen eingepreist, das sie bedient. OpenAI hat bewiesen, dass sich Geschwindigkeit verkauft; dass Cerebras den Aufschlag kassiert, hat es nicht bewiesen.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.


