DeepSeek acaba de regalar la capa de software sobre la que se asienta el foso de Nvidia en China
Seis módulos de código abierto para Ascend, entre ellos un rival de CUDA llamado TileLang, trasladan la apuesta de China por el software de sus chips de la hoja de ruta al repositorio. Para Nvidia, la tesis alcista de una China reabierta descansa ya solo en el permiso de Pekín.
Richard Tang · 3 min read
DeepSeek ha publicado este miércoles en código abierto seis módulos de software para los chips de IA Ascend de Huawei 1. El paquete apunta a la única capa que la ofensiva de Pekín por los chips no podía comprar sin más: el software que hace que un chip sea programable. La apuesta de Huawei por las líneas de producción, sobre la que este diario ya informó, ha dado ahora código listo para distribuir.
Bloomberg califica el lanzamiento de TileLang de respuesta china a CUDA, descargable gratis, como todo lo demás del paquete 2. Desde el miércoles, el repositorio de TileLang incluye oficialmente el Ascend 950 de Huawei como backend compatible, con generación de código nativo y planificación automática 3.
El cuello de botella eran los kernels, no los transistores
Un chip de IA vale lo que valen sus kernels: ese código de multiplicación de matrices y de atención, ajustado a mano, donde se gana o se pierde el rendimiento. Ese oficio ha vivido dentro de CUDA durante una década. TileLang comprime el trabajo: se escribe un kernel una sola vez, con una sintaxis parecida a la de Python, y el compilador genera código optimizado para los chips de Nvidia, AMD y Apple y, ahora, también para Ascend 3.
DeepSeek lo ha combinado con DeepGEMM, para la multiplicación de matrices, y con DeepEP, para mover datos entre los 128 procesadores Ascend 950 del supernodo de Huawei sobre el que se hizo el ajuste; en sus propias pruebas, informa de un rendimiento que roza los límites del hardware 14.
Las cargas de trabajo del propio DeepSeek ya se ejecutan sobre él
Esto no es una pila de demostración. Los ejemplos de TileLang para las cargas de trabajo de la V4 de DeepSeek figuran en el repositorio desde mayo 3; el laboratorio ejecuta la inferencia de V4 sobre Ascend desde abril, con el apoyo pleno de Huawei 1, y la compañía prestó una amplia asistencia técnica en el software 4.
Huawei asegura que los supernodos Ascend 950 ya están en uso comercial y que hay desplegados más de 1.000 supernodos del anterior 910C 5, mientras que el chip de entrenamiento 960DT se ha adelantado al primer trimestre de 2027, tres trimestres antes de lo previsto 1. Inferencia hoy, entrenamiento desde el año que viene: la pila cubre ya ambas mitades de la factura de cómputo de un laboratorio chino.
El silicio nacional ya se vendía antes de que existiera el software
La demanda nunca fue el problema. Los ingresos de Cambricon del primer semestre subieron un 108%, hasta 6.000 millones de yuanes, mientras que Hygon ha previsto hasta 9.300 millones y Moore Threads hasta 1.750 millones en esos mismos seis meses, impulsados por la apuesta de Pekín por la autosuficiencia y por los controles de exportación estadounidenses 6. Cambricon, Moore Threads y T-Head, la filial de chips de Alibaba, ya habían confirmado que sus chips ejecutan los modelos de DeepSeek 1.
Lo revelador es que los ingresos llegaron antes que las herramientas: los compradores no esperaban a tener software para hacer pedidos. El repositorio de TileLang ya incluye backends para el hardware de Moore Threads y de Hygon 3, y el lanzamiento del miércoles aporta los kernels, el compilador y las librerías de comunicación para Ascend 1. Para un comprador chino que deba elegir entre el hardware de Nvidia con contador y el silicio nacional, ha desaparecido el último motivo para esperar.
Los fabricantes de chips nacionales ya escalaban antes de que llegara el software de DeepSeek
- Ingresos del primer semestre de 2026
- Estimate
Data
| Ingresos del primer semestre de 2026 | |
|---|---|
| Hygon (estimate) | ¥9.3B |
| Cambricon | ¥6B |
| Moore Threads (estimate) | ¥1.75B |
La tesis de Nvidia en China se sostiene ya solo en un permiso
Nvidia ha previsto 108.000 millones de dólares de ingresos para el trimestre en curso partiendo de que no habrá ingresos procedentes de China por cómputo de centros de datos 7. Jensen Huang ha dicho que la cuota de Nvidia en el mercado chino de chips de IA pasó de en torno al 95% a cero 7. Todavía facturó el pasado trimestre 7.900 millones de dólares a clientes con sede en China, prácticamente nada de ello en cómputo de IA 7.
La tesis alcista de una China reabierta se apoya en dos pilares: el contador de Pekín, que, según se informa, se está poniendo a prueba con las posibles aprobaciones de la RTX Pro 5500 para ByteDance y Alibaba 8, y la supuesta inexpugnabilidad de CUDA. La primera es política. La segunda ya tiene un contraejemplo de varios fabricantes en un repositorio. Las herramientas de CUDA siguen ganando fuera de China, pero la brecha de software era la única tesis bajista que los controles de exportación no podían cerrar, y esta semana se ha cerrado en código.
Habrá que estar atentos a dos confirmaciones: que un laboratorio chino ejecute en Ascend un entrenamiento de vanguardia y que el 960DT llegue en el primer trimestre tal y como se ha prometido 1. La primera es decisión de un laboratorio; la segunda, una fecha.
El premio, para quien hizo programable el hardware
DeepSeek y Huawei han hecho por sí mismas el trabajo intermedio, en abierto, y son ellas quienes deben capturar el valor: no quien está más cerca de los transistores, sino quien ha hecho programable el hardware. El foso siempre fue el software. La respuesta de China ya es pública, y gratuita.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



