Cerebras coupe en deux son propre avantage concurrentiel et y voit un gain d'un facteur 5

Selon SemiAnalysis, l'offre GPT-6.1 Sol Ultrafast d'OpenAI est servie par des GPU Nvidia, et non par les wafers de Cerebras. Cerebras a répondu sans démenti, par une refonte qui ne conserve sur son silicium que la moitié « décodage » de l'inférence — la semaine même où le titre est tombé sous les 185 dollars de son introduction en Bourse.

Lire l’original

In this storyNVDAOpenAIAMD
Vincent JiangVincent Jiang · 2 min read
Share
Andrew Feldman, directeur général de Cerebras, s'exprimant sur la scène de la conférence Collision
1 / 6Slide 1 of 6
Andrew Feldman, directeur général de Cerebras. Son entreprise a répondu par une refonte, et non par un démenti, à l'affirmation selon laquelle Nvidia sert l'offre Ultrafast d'OpenAI.

Une accusation que personne n'a démentie

SemiAnalysis a affirmé le 30 septembre que l'offre GPT-6.1 Sol Ultrafast d'OpenAI tourne sur des GPU Nvidia à faible taille de lot, et non sur le silicium de Cerebras 12. La faible taille de lot, c'est justement le régime pour lequel Cerebras a été conçu : peu de requêtes en cours, chacune servie très vite 2. Les documents de la DevDay d'OpenAI, publiés la veille, ont rendu Astra Ultrafast disponible, qualifié la version 6.1 Sol de « à venir prochainement » et fixé le prix de cette offre à six fois les tarifs standards de l'API — sans nommer de puce 3.

Le titre CBRS a glissé à environ 181 dollars, sous les 185 dollars de son introduction en Bourse en mai 45. OpenAI est le premier client de Cerebras en revenus engagés 15. L'aperçu de l'offre, présenté en août sur GPT-5.6 Sol, tournait sur du matériel Cerebras jusqu'à 750 tokens par seconde 3 ; la version aujourd'hui promise plafonne à 300 3. Aucune des deux sociétés n'a ni confirmé ni démenti l'information 14.

Le pré-remplissage sort du circuit

Cerebras a répondu le 1er octobre par une refonte, pas par un démenti. Son billet sur la désagrégation de l'inférence confie le pré-remplissage (prefill) — la première moitié de l'inférence, celle qui consomme le plus de calcul — à des accélérateurs partenaires. Il y montre des systèmes AWS Trainium et AMD Helios alimentant un pool de décodage Cerebras, et fait état d'un gain de capacité d'un facteur 5 dans ses premiers tests, à empreinte de wafers identique 6. Un chiffre revendiqué par l'entreprise et non vérifié. Ce que les wafers gardent, ils l'emportent encore : sur GPT-oss-120B, le débit de décodage atteint 1 669 tokens par seconde en sortie, contre 708 pour le plus proche concurrent, selon des chiffres d'Artificial Analysis repris dans le billet 6.

La moitié que Cerebras a gardée : le décodage reste plus de deux fois plus rapide que n'importe quel concurrent

0 t/s500 t/s1,000 t/s1,500 t/s2,000 t/sCerebrasSambaNovaGroqMicrosoft AzureNebiusBaseten293 t/s1,669 t/s
Data
Tokens par seconde en sortie
Cerebras1,669 t/s
SambaNova708 t/s
Groq475 t/s
Microsoft Azure319 t/s
Nebius294 t/s
Baseten293 t/s
Tokens par seconde en sortie sur GPT-oss-120B, en mode raisonnement élevé, avec 10 000 tokens en entrée. Mesures d'Artificial Analysis datées du 10 septembre 2026, reprises dans le billet du 1er octobre de Cerebras sur la désagrégation ; vitesses par utilisateur à faible concurrence, et non débits de production. Source : Unite.ai, compte rendu du billet de Cerebras [6].6

Un demi-avantage concurrentiel, vendu à crédit

L'architecture resserrée circule déjà chez les revendeurs. Gimlet Labs prévoit 100 mégawatts de capacité Cerebras et vise, avec Cerebras, jusqu'à 3 000 tokens par seconde 78. La commande de General Compute, premier tirage sur une ligne de crédit Upper90 pouvant atteindre 400 millions de dollars, démarrera au premier trimestre 2027 910. Tous deux font la queue derrière OpenAI, G42 et AWS pour l'approvisionnement, face à 25,4 milliards de dollars d'obligations de performance restantes au deuxième trimestre, tandis que Cerebras vend parallèlement sa propre offre de cloud et de services — un chiffre d'affaires en hausse de 281 % sur un an, à 126,0 millions de dollars 78.

L'horloge tourne au rythme des puces. Des avis de cession Form 144 portant au total sur 84,3 millions de dollars de ventes envisagées, déposés par le directeur des opérations et le directeur financier, sont arrivés le 29 septembre au titre de plans de cession adoptés le 30 juin. Environ 19,4 millions d'actions sont devenues cessibles le lendemain matin 411. Une cession envisagée n'est pas une cession réalisée — et les plans datent d'avant la chute du titre 4.

En attendant le verdict

Deux faits feront le prix de ce titre : le silicium qu'OpenAI désignera pour GPT-6.1 Sol Ultrafast, et la survie du facteur 5 sous la charge concurrente de la production. Nvidia transforme déjà la désagrégation en fonctionnalité mono-fournisseur sur sa feuille de route Rubin 8. Cerebras détient toujours la moitié la plus rapide de l'inférence ; cette semaine, le marché a commencé à chiffrer ce que vaut l'autre moitié.

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio