DeepSeek выложила в открытый доступ программный слой, на котором держится «ров» Nvidia в Китае
Шесть модулей с открытым кодом для чипов Ascend, включая TileLang — конкурента CUDA, — переводят китайскую ставку на софт для чипов из дорожной карты в репозиторий. Бычий сценарий Nvidia, связанный с открытием Китая, теперь держится только на разрешении Пекина.
Richard Tang · 3 min read
DeepSeek в среду открыла исходный код шести программных модулей для ИИ-чипов Ascend компании Huawei 1. Пакет нацелен на тот единственный слой, который Пекину нельзя было просто купить в погоне за собственными чипами: софт, делающий чип программируемым. Ставка на производственную линию Huawei, о которой мы уже писали, дала на выходе готовый к поставке код.
Bloomberg называет релиз TileLang китайским ответом на CUDA; как и всё остальное в пакете, его можно скачать бесплатно 2. По состоянию на среду репозиторий TileLang официально указывает Ascend 950 как поддерживаемый бэкенд — с генерацией нативного кода и автоматическим планированием вычислений 3.
Узкое место — ядра, а не транзисторы
ИИ-чип хорош ровно настолько, насколько хороши его ядра (kernel) — вручную выверенный код матричного умножения и механизма внимания, где производительность и выигрывается, и теряется. Десять лет это ремесло жило внутри CUDA. TileLang схлопывает работу: ядро достаточно написать один раз на питоноподобном синтаксисе, а оптимизированный код компилятор генерирует сам — для кремния Nvidia, AMD, Apple, а теперь и Ascend 3.
DeepSeek дополнила его модулем DeepGEMM для матричного умножения и DeepEP для передачи данных между 128 процессорами Ascend 950 в суперузле Huawei, на котором велась настройка; по собственным тестам компании, производительность вплотную приблизилась к пределу возможностей железа 14.
Собственные нагрузки DeepSeek уже работают на этом стеке
Это не демонстрационный стек. Примеры TileLang под нагрузки V4 лежат в репозитории с мая 3, лаборатория с апреля выполняет инференс V4 на Ascend при полной поддержке Huawei 1, а сама Huawei оказала обширную техническую помощь по софту 4.
По словам Huawei, суперузлы Ascend 950 уже находятся в коммерческой эксплуатации, а более 1 тыс. суперузлов предыдущего поколения 910C развёрнуты 5; при этом запуск обучающего чипа 960DT ускорили на три квартала — до первого квартала 2027 года 1. Инференс — уже сегодня, обучение — со следующего года: стек закрывает обе половины счёта китайской лаборатории за вычислительные мощности.
Китайский кремний продавался ещё до появления софта
Ограничением никогда был не спрос. Выручка Cambricon за первое полугодие выросла на 108%, до 6 млрд юаней; у Hygon прогноз на те же шесть месяцев — до 9,3 млрд юаней, у Moore Threads — до 1,75 млрд. Рост обеспечивают курс Пекина на самообеспечение и экспортные ограничения США 6. Cambricon, Moore Threads и подразделение Alibaba T-Head уже подтвердили, что их чипы работают с моделями DeepSeek 1.
Показательно, что выручка пришла раньше инструментария: покупатели размещали заказы, не дожидаясь софта. В репозитории TileLang уже есть бэкенды для аппаратных платформ Moore Threads и Hygon 3, а выпущенный в среду пакет добавляет для Ascend ядра, компилятор и библиотеки коммуникаций 1. Для китайского покупателя, выбирающего между железом Nvidia «по счётчику» и местным кремнием, последняя причина ждать отпала.
Китайские производители чипов наращивали обороты ещё до появления софта DeepSeek
- Выручка за первое полугодие 2026 года
- Estimate
Data
| Выручка за первое полугодие 2026 года | |
|---|---|
| Hygon (estimate) | ¥9.3B |
| Cambricon | ¥6B |
| Moore Threads (estimate) | ¥1.75B |
Китайские перспективы Nvidia теперь держатся на одном лишь разрешении
Nvidia прогнозирует $108 млрд выручки на текущий квартал, исходя из того, что продаж вычислительных чипов для дата-центров в Китай не будет 7. Дженсен Хуанг говорил, что доля Nvidia на китайском рынке ИИ-чипов упала примерно с 95% до нуля 7. При этом за минувший квартал на клиентов со штаб-квартирами в Китае пришлось $7,9 млрд выставленных счетов — почти ничего из этой суммы не связано с ИИ-вычислениями 7.
У бычьего сценария возвращения Nvidia на китайский рынок две опоры: «счётчик» Пекина, который, как сообщается, уже проходит обкатку — в частности, на возможных одобрениях закупок RTX Pro 5500 для ByteDance и Alibaba 8 — и мнимая неприступность CUDA. Первая опора — политика. У второй теперь есть контрпример в репозитории — код, поддерживающий чипы сразу нескольких производителей. Вне Китая инструментарий CUDA по-прежнему вне конкуренции, но программный разрыв был единственным пунктом медвежьего сценария, который экспортные ограничения США не могли закрыть, — и на этой неделе он закрыт кодом.
Ждать осталось двух подтверждений: обучение фронтирной модели на чипах Ascend силами китайской лаборатории и выход 960DT в обещанном первом квартале 1. Первое — выбор лаборатории; второе — дата.
Выигрыш достанется тому, кто сделал железо программируемым
DeepSeek и Huawei проделали эту промежуточную работу сами и открыто — и именно им должна достаться ценность: не тем, кто сидит ближе всего к транзисторам, а тем, кто сделал железо программируемым. Ров всегда был софтом. Китайский ответ теперь выложен в открытый доступ — и бесплатен.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



