Cerebras halbiert den eigenen Burggraben – und nennt es ein Upgrade um den Faktor fünf

Laut SemiAnalysis läuft OpenAIs GPT-6.1 Sol Ultrafast auf Nvidia-GPUs – nicht auf den Wafern von Cerebras. Cerebras antwortete nicht mit einem Dementi, sondern mit einem Redesign, das nur die Decode-Hälfte der Inferenz auf dem eigenen Silizium behält. Und das in der Woche, in der die Aktie unter ihren Börsengangspreis von 185 Dollar fiel.

Original lesen

In this storyNVDAOpenAIAMD
Vincent JiangVincent Jiang · 2 min read
Share
Andrew Feldman, Chef von Cerebras, auf der Bühne der Collision-Konferenz
1 / 6Slide 1 of 6
Cerebras-Chef Andrew Feldman. Auf die Behauptung, Nvidias Chips bedienten die Ultrafast-Stufe von OpenAI, reagierte sein Unternehmen mit einem Redesign – nicht mit einem Dementi.

Der Vorwurf, den niemand dementierte

SemiAnalysis postete am 30. September, OpenAIs GPT-6.1 Sol Ultrafast laufe bei niedriger Batch-Größe auf Nvidia-GPUs – nicht auf dem Silizium von Cerebras 12. Niedrige Batch-Größe ist das Regime, für das Cerebras gebaut wurde: wenige Anfragen gleichzeitig, jede davon schnell beantwortet 2. Die DevDay-Materialien von OpenAI, einen Tag zuvor veröffentlicht, schalteten Astra Ultrafast live, nannten die 6.1-Sol-Version „coming soon“, legten die Stufe auf das Sechsfache der Standard-API-Preise fest und bezeichneten keinen Chip 3.

Die CBRS-Aktie rutschte auf rund 181 Dollar ab – unter die 185 Dollar des Börsengangs im Mai 45. OpenAI ist gemessen an den zugesagten Umsätzen der größte Kunde von Cerebras 15. Die August-Vorschau der Stufe, damals noch auf GPT-5.6 Sol, lief auf Cerebras-Hardware mit bis zu 750 Token pro Sekunde 3; die jetzt angekündigte Version erreicht maximal 300 3. Keines der beiden Unternehmen hat die Behauptung bislang bestätigt oder dementiert 14.

Der Prefill wird ausgelagert

Cerebras antwortete am 1. Oktober – mit einem Redesign, nicht mit einem Dementi. Sein Beitrag zur Disaggregation verlagert den Prefill, die rechenaufwendige erste Hälfte der Inferenz, an Beschleuniger von Partnern; gezeigt werden AWS-Trainium- und AMD-Helios-Systeme, die einen Cerebras-Decode-Pool speisen. In frühen Tests meldet der Beitrag daraus einen Kapazitätsgewinn um den Faktor fünf – bei unveränderter Waferfläche 6. Diese Zahl stammt vom Unternehmen selbst und ist nicht verifiziert. Was die Wafer behalten, gewinnen sie noch immer: Beim Decode-Durchsatz auf GPT-oss-120B liegt Cerebras laut Artificial Analysis bei 1.669 Output-Token pro Sekunde, der dichteste Verfolger bei 708 – Zahlen, die der Beitrag wiedergibt 6.

Die Hälfte, die Cerebras behielt: Decode läuft noch immer mehr als doppelt so schnell wie bei jedem Rivalen

0 t/s500 t/s1,000 t/s1,500 t/s2,000 t/sCerebrasSambaNovaGroqMicrosoft AzureNebiusBaseten293 t/s1,669 t/s
Data
Output-Token pro Sekunde
Cerebras1,669 t/s
SambaNova708 t/s
Groq475 t/s
Microsoft Azure319 t/s
Nebius294 t/s
Baseten293 t/s
Output-Token pro Sekunde auf GPT-oss-120B, hohes Reasoning, 10.000 Input-Token. Messungen von Artificial Analysis vom 10. September 2026, wiedergegeben im Cerebras-Beitrag zur Disaggregation vom 1. Oktober; Werte je Nutzer bei geringer Parallelität, kein Durchsatz im Produktionsbetrieb. Quelle: Unite.ai-Bericht über den Cerebras-Beitrag [6].6

Halber Burggraben, verkauft auf Kredit

Die schmalere Architektur verkauft sich bereits über Reseller. Gimlet Labs plant 100 Megawatt Cerebras-Kapazität und will gemeinsam mit Cerebras bis zu 3.000 Token pro Sekunde erreichen 78. Die Bestellung von General Compute – der erste Abruf einer Upper90-Kreditfazilität über bis zu 400 Millionen Dollar – startet im ersten Quartal 2027 910. Bei der Versorgung reihen sich beide hinter OpenAI, G42 und AWS ein – angesichts von 25,4 Milliarden Dollar an verbleibenden Leistungsverpflichtungen aus dem zweiten Quartal. Neben ihnen verkauft Cerebras auch selbst: Der Cloud- und Serviceumsatz stieg im Jahresvergleich um 281 Prozent auf 126,0 Millionen Dollar 78.

Mit den Chips läuft auch die Uhr. Form-144-Meldungen über geplante Verkäufe von zusammen 84,3 Millionen Dollar von COO und CFO gingen am 29. September ein – auf Basis am 30. Juni beschlossener Handelspläne. Rund 19,4 Millionen Aktien durften ab dem folgenden Morgen verkauft werden 411. Angezeigt ist nicht verkauft – und die Pläne sind älter als der Kursrutsch 4.

Warten auf das Urteil

Zwei Fakten werden diesen Kurs bestimmen: welches Silizium OpenAI für GPT-6.1 Sol Ultrafast nennt – und ob der Faktor fünf die Parallelität des Produktionsbetriebs übersteht. Nvidia produktisiert die Disaggregation auf seiner Rubin-Roadmap bereits als Feature aus einer Hand 8. Cerebras besitzt noch immer die schnellste Hälfte der Inferenz; diese Woche begann der Markt einzupreisen, was die andere Hälfte wert ist.

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio