Cerebras parte su propio foso por la mitad y lo llama mejora de 5x
SemiAnalysis afirma que el GPT-6.1 Sol Ultrafast de OpenAI corre sobre GPUs de Nvidia, no sobre las obleas de Cerebras. La compañía respondió sin desmentido, con un rediseño que deja en su silicio solo la mitad de decodificación de la inferencia, en la semana en que la acción cayó por debajo de los 185 dólares de su salida a bolsa.
Vincent Jiang · 2 min read
La acusación que nadie desmintió
SemiAnalysis publicó el 30 de septiembre que el GPT-6.1 Sol Ultrafast de OpenAI corre sobre GPUs de Nvidia con tamaños de lote (batch) reducidos, y no sobre el silicio de Cerebras 12. El lote bajo es el régimen para el que fue diseñada Cerebras: pocas peticiones en vuelo, cada una respondida con rapidez 2. Los materiales del DevDay de OpenAI, publicados un día antes, pusieron en marcha Astra Ultrafast, calificaron la versión 6.1 Sol de «próximamente», fijaron el nivel a seis veces las tarifas estándar de la API y no mencionaron ningún chip 3.
CBRS cayó hasta alrededor de los 181 dólares, por debajo de los 185 de su salida a bolsa de mayo 45. OpenAI es el mayor cliente de Cerebras por ingresos comprometidos 15. La vista previa del nivel, presentada en agosto sobre GPT-5.6 Sol, corría sobre hardware de Cerebras a un máximo de 750 tokens por segundo 3; la versión ahora prometida no supera los 300 3. Ninguna de las dos compañías ha confirmado ni negado la afirmación 14.
El prefill, fuera de las obleas
Cerebras respondió el 1 de octubre con un rediseño, no con un desmentido. Su publicación sobre desagregación cede el prefill —la primera mitad de la inferencia y la que más cómputo exige— a aceleradores de sus socios, muestra sistemas AWS Trainium y Helios de AMD alimentando un pool de decodificación de Cerebras e informa de una mejora de capacidad de 5x en pruebas iniciales con la misma superficie de oblea 6. Esa cifra la afirma la propia compañía y sigue sin verificarse. En lo que las obleas conservan, siguen ganando: el rendimiento de decodificación en GPT-oss-120B se sitúa en 1.669 tokens de salida por segundo, frente a los 708 del rival más cercano, según cifras de Artificial Analysis que reproduce la publicación 6.
La mitad que Cerebras conservó: la decodificación sigue siendo más del doble de rápida que cualquier rival
Data
| Tokens de salida por segundo | |
|---|---|
| Cerebras | 1,669 t/s |
| SambaNova | 708 t/s |
| Groq | 475 t/s |
| Microsoft Azure | 319 t/s |
| Nebius | 294 t/s |
| Baseten | 293 t/s |
Medio foso, vendido con deuda
La arquitectura, ahora más estrecha, ya se vende a través de revendedores. Gimlet Labs planea 100 megavatios de capacidad de Cerebras y, junto con la compañía, se propone llegar hasta 3.000 tokens por segundo 78. El pedido de General Compute, primera disposición de una línea de deuda de hasta 400 millones de dólares concedida por Upper90, arranca en el primer trimestre de 2027 910. Ambos hacen cola detrás de OpenAI, G42 y AWS para conseguir suministro, frente a 25.400 millones de dólares en obligaciones de rendimiento pendientes del segundo trimestre, mientras Cerebras vende junto a ellos su propia nube y sus servicios, con ingresos que subieron un 281% interanual, hasta 126,0 millones de dólares 78.
El reloj corre al ritmo de los chips. Formularios 144 por ventas propuestas que suman 84,3 millones de dólares, presentados por su director de operaciones y su director financiero, llegaron el 29 de septiembre al amparo de planes de negociación adoptados el 30 de junio, y unos 19,4 millones de acciones quedaron liberadas para la venta la mañana siguiente 411. Anunciar no es vender, y los planes son anteriores a la caída 4.
A la espera del veredicto
Dos hechos marcarán el precio de este valor: qué silicio anuncia OpenAI para el 6.1 Sol Ultrafast y si el 5x sobrevive a la concurrencia de producción. Nvidia ya está convirtiendo la desagregación en una función de un solo proveedor dentro de su hoja de ruta Rubin 8. Cerebras sigue siendo dueña de la mitad más rápida de la inferencia; esta semana el mercado empezó a poner precio a la otra mitad.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



