Cerebras halbiert den eigenen Burggraben – und nennt es ein Upgrade um den Faktor fünf
Laut SemiAnalysis läuft OpenAIs GPT-6.1 Sol Ultrafast auf Nvidia-GPUs – nicht auf den Wafern von Cerebras. Cerebras antwortete nicht mit einem Dementi, sondern mit einem Redesign, das nur die Decode-Hälfte der Inferenz auf dem eigenen Silizium behält. Und das in der Woche, in der die Aktie unter ihren Börsengangspreis von 185 Dollar fiel.
Vincent Jiang · 2 min read
Der Vorwurf, den niemand dementierte
SemiAnalysis postete am 30. September, OpenAIs GPT-6.1 Sol Ultrafast laufe bei niedriger Batch-Größe auf Nvidia-GPUs – nicht auf dem Silizium von Cerebras 12. Niedrige Batch-Größe ist das Regime, für das Cerebras gebaut wurde: wenige Anfragen gleichzeitig, jede davon schnell beantwortet 2. Die DevDay-Materialien von OpenAI, einen Tag zuvor veröffentlicht, schalteten Astra Ultrafast live, nannten die 6.1-Sol-Version „coming soon“, legten die Stufe auf das Sechsfache der Standard-API-Preise fest und bezeichneten keinen Chip 3.
Die CBRS-Aktie rutschte auf rund 181 Dollar ab – unter die 185 Dollar des Börsengangs im Mai 45. OpenAI ist gemessen an den zugesagten Umsätzen der größte Kunde von Cerebras 15. Die August-Vorschau der Stufe, damals noch auf GPT-5.6 Sol, lief auf Cerebras-Hardware mit bis zu 750 Token pro Sekunde 3; die jetzt angekündigte Version erreicht maximal 300 3. Keines der beiden Unternehmen hat die Behauptung bislang bestätigt oder dementiert 14.
Der Prefill wird ausgelagert
Cerebras antwortete am 1. Oktober – mit einem Redesign, nicht mit einem Dementi. Sein Beitrag zur Disaggregation verlagert den Prefill, die rechenaufwendige erste Hälfte der Inferenz, an Beschleuniger von Partnern; gezeigt werden AWS-Trainium- und AMD-Helios-Systeme, die einen Cerebras-Decode-Pool speisen. In frühen Tests meldet der Beitrag daraus einen Kapazitätsgewinn um den Faktor fünf – bei unveränderter Waferfläche 6. Diese Zahl stammt vom Unternehmen selbst und ist nicht verifiziert. Was die Wafer behalten, gewinnen sie noch immer: Beim Decode-Durchsatz auf GPT-oss-120B liegt Cerebras laut Artificial Analysis bei 1.669 Output-Token pro Sekunde, der dichteste Verfolger bei 708 – Zahlen, die der Beitrag wiedergibt 6.
Die Hälfte, die Cerebras behielt: Decode läuft noch immer mehr als doppelt so schnell wie bei jedem Rivalen
Data
| Output-Token pro Sekunde | |
|---|---|
| Cerebras | 1,669 t/s |
| SambaNova | 708 t/s |
| Groq | 475 t/s |
| Microsoft Azure | 319 t/s |
| Nebius | 294 t/s |
| Baseten | 293 t/s |
Halber Burggraben, verkauft auf Kredit
Die schmalere Architektur verkauft sich bereits über Reseller. Gimlet Labs plant 100 Megawatt Cerebras-Kapazität und will gemeinsam mit Cerebras bis zu 3.000 Token pro Sekunde erreichen 78. Die Bestellung von General Compute – der erste Abruf einer Upper90-Kreditfazilität über bis zu 400 Millionen Dollar – startet im ersten Quartal 2027 910. Bei der Versorgung reihen sich beide hinter OpenAI, G42 und AWS ein – angesichts von 25,4 Milliarden Dollar an verbleibenden Leistungsverpflichtungen aus dem zweiten Quartal. Neben ihnen verkauft Cerebras auch selbst: Der Cloud- und Serviceumsatz stieg im Jahresvergleich um 281 Prozent auf 126,0 Millionen Dollar 78.
Mit den Chips läuft auch die Uhr. Form-144-Meldungen über geplante Verkäufe von zusammen 84,3 Millionen Dollar von COO und CFO gingen am 29. September ein – auf Basis am 30. Juni beschlossener Handelspläne. Rund 19,4 Millionen Aktien durften ab dem folgenden Morgen verkauft werden 411. Angezeigt ist nicht verkauft – und die Pläne sind älter als der Kursrutsch 4.
Warten auf das Urteil
Zwei Fakten werden diesen Kurs bestimmen: welches Silizium OpenAI für GPT-6.1 Sol Ultrafast nennt – und ob der Faktor fünf die Parallelität des Produktionsbetriebs übersteht. Nvidia produktisiert die Disaggregation auf seiner Rubin-Roadmap bereits als Feature aus einer Hand 8. Cerebras besitzt noch immer die schnellste Hälfte der Inferenz; diese Woche begann der Markt einzupreisen, was die andere Hälfte wert ist.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



