DeepSeek vient d'offrir la couche logicielle sur laquelle reposait la barrière protectrice de Nvidia en Chine
Six modules open source pour les puces Ascend, dont un rival de CUDA baptisé TileLang, font passer l'offensive chinoise sur le logiciel des puces de la feuille de route au dépôt de code. Pour Nvidia, le scénario haussier d'une réouverture du marché chinois ne tient plus qu'à l'autorisation de Pékin.
Richard Tang · 3 min read
DeepSeek a publié mercredi en open source six modules logiciels pour les puces d'IA Ascend de Huawei 1. Ce paquet cible la seule couche que l'offensive de Pékin sur les puces ne pouvait pas simplement acheter : le logiciel qui rend une puce programmable. Le pari sur la chaîne de production de Huawei, déjà relaté dans ces colonnes, a désormais produit du code livrable.
Bloomberg qualifie la publication de TileLang de réponse chinoise à CUDA, téléchargeable gratuitement, comme tout le reste du paquet 2. Depuis mercredi, le dépôt TileLang fait officiellement figurer l'Ascend 950 de Huawei parmi les backends pris en charge, avec génération de code natif et ordonnancement automatique 3.
Goulot d'étranglement : les noyaux, pas les transistors
Une puce d'IA n'est jamais meilleure que ses noyaux, ces codes de multiplication de matrices et d'attention réglés à la main où la performance se gagne ou se perd — un savoir-faire resté enfermé dans CUDA pendant une décennie. TileLang condense ce travail : le noyau s'écrit une seule fois, dans une syntaxe proche de Python, et le compilateur génère un code optimisé pour les puces de Nvidia, AMD et Apple, et désormais pour Ascend 3.
DeepSeek l'a assorti de DeepGEMM, dédié à la multiplication de matrices, et de DeepEP, chargé de faire circuler les données entre les 128 processeurs Ascend 950 du supernœud Huawei sur lequel il a fait ses réglages. Le laboratoire fait état, dans ses propres tests, de performances proches des limites du matériel 14.
Les propres charges de travail de DeepSeek tournent déjà dessus
Ce n'est pas une pile de démonstration. Les exemples TileLang pour les charges de travail V4 de DeepSeek figurent dans le dépôt depuis mai 3, le laboratoire fait tourner l'inférence V4 sur Ascend depuis avril, avec le plein soutien de Huawei 1, et l'équipementier a fourni une aide technique étendue sur le logiciel 4.
Selon Huawei, des supernœuds Ascend 950 sont déjà en usage commercial et plus de 1 000 supernœuds 910C, plus anciens, sont déployés 5. La puce d'entraînement 960DT a été avancée au premier trimestre 2027, trois trimestres plus tôt que prévu 1. L'inférence aujourd'hui, l'entraînement dès l'an prochain : la pile couvre désormais les deux moitiés de la facture de calcul d'un laboratoire chinois.
Le silicium chinois se vendait avant même que le logiciel n'existe
La demande n'a jamais été la contrainte. Cambricon a vu son chiffre d'affaires du premier semestre bondir de 108 %, à 6 milliards de yuans. Hygon prévoit pour sa part jusqu'à 9,3 milliards de yuans et Moore Threads jusqu'à 1,75 milliard sur la même période, un élan nourri par l'offensive d'autosuffisance de Pékin et par les contrôles américains à l'exportation 6. Cambricon, Moore Threads et T-Head, la filiale d'Alibaba, avaient déjà confirmé que leurs puces exécutent les modèles de DeepSeek 1.
Le plus révélateur : les revenus sont arrivés avant les outils. Les acheteurs n'attendaient pas le logiciel pour passer commande. Le dépôt de TileLang embarque déjà des backends pour les matériels Moore Threads et Hygon 3, et la publication de mercredi apporte les noyaux, le compilateur et les bibliothèques de communication pour Ascend 1. Pour un acheteur chinois qui arbitre entre le matériel Nvidia au compteur et le silicium national, la dernière raison d'attendre vient de disparaître.
Les fabricants de puces chinois montaient déjà en puissance avant l'arrivée du logiciel de DeepSeek
- Chiffre d'affaires S1 2026
- Estimate
Data
| Chiffre d'affaires S1 2026 | |
|---|---|
| Hygon (estimate) | ¥9.3B |
| Cambricon | ¥6B |
| Moore Threads (estimate) | ¥1.75B |
Le pari chinois de Nvidia ne tient plus qu'à une autorisation
Nvidia vise 108 milliards de dollars de chiffre d'affaires pour le trimestre en cours, en supposant qu'elle ne réalise aucun revenu de calcul en centre de données en Chine 7. Jensen Huang a indiqué que la part de marché de Nvidia sur les puces IA en Chine est tombée d'environ 95 % à zéro 7. Le groupe a néanmoins encore facturé 7,9 milliards de dollars au dernier trimestre à des clients dont le siège social est en Chine, mais quasiment rien de ce montant ne relève du calcul IA 7.
Le scénario haussier d'une Chine rouverte repose sur deux piliers : le compteur de Pékin, que la capitale serait en train de tester via d'éventuelles autorisations du RTX Pro 5500 pour ByteDance et Alibaba 8, et l'infranchissabilité supposée de CUDA. Le premier relève de la politique. Le second a désormais un contre-exemple multi-constructeurs dans un dépôt. Hors de Chine, l'outillage CUDA continue de l'emporter, mais l'écart logiciel était le seul élément du scénario baissier que les contrôles à l'exportation ne parvenaient pas à combler, et cette semaine, il a été comblé dans le code.
Deux confirmations restent à guetter : qu'un laboratoire chinois lance un entraînement de modèle de pointe sur Ascend, et que le 960DT arrive au premier trimestre, comme promis 1. La première est un choix de laboratoire ; la seconde, une date.
La récompense revient à ceux qui ont rendu le matériel programmable
DeepSeek et Huawei ont accompli ce travail de couche intermédiaire eux-mêmes, en plein jour, et ce sont eux qui devraient capter la valeur : pas ceux qui sont assis au plus près des transistors, mais ceux qui ont rendu le matériel programmable. La barrière protectrice a toujours été logicielle. La réponse de la Chine est désormais publique — et gratuite.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



