डीपसीक ने मुफ्त में बाँट दिया वह सॉफ्टवेयर लेयर, जिस पर एनवीडिया की चीन-खाई टिकी है
CUDA को टक्कर देने वाले TileLang समेत एसेंड (Ascend) के छह ओपन-सोर्स मॉड्यूल चीन की चिप-सॉफ्टवेयर कोशिश को रोडमैप से निकालकर रिपॉजिटरी (repository) तक ले आए हैं। एनवीडिया के लिए चीन के दोबारा खुलने पर बना तेज़ी वाला तर्क (bull case) अब सिर्फ़ बीजिंग की इजाज़त पर टिका है।
Richard Tang · 3 min read
डीपसीक ने बुधवार को हुआवे के एआई चिप एसेंड (Ascend) के लिए छह सॉफ्टवेयर मॉड्यूल ओपन-सोर्स कर दिए 1। बीजिंग का चिप अभियान जिस एक लेयर को सिर्फ़ खरीदकर हासिल नहीं कर सका, यह पैकेज उसी पर निशाना है: वह सॉफ्टवेयर, जो एक चिप को प्रोग्राम करने लायक बनाता है। हुआवे की प्रोडक्शन लाइन पर लगे उस दांव की खबर यहाँ पहले दी जा चुकी है — अब उस दांव से बाज़ार में उतारने लायक कोड निकल आया है।
ब्लूमबर्ग इस TileLang रिलीज़ को CUDA का चीनी जवाब कहता है, जो पैकेज में शामिल बाक़ी हर चीज़ की तरह मुफ्त डाउनलोड के लिए उपलब्ध है 2। बुधवार तक TileLang की रिपॉजिटरी हुआवे के एसेंड 950 को आधिकारिक तौर पर समर्थित बैकएंड (backend) के रूप में सूचीबद्ध करती है — नेटिव कोड जनरेशन और ऑटोमैटिक शेड्यूलिंग के साथ 3।
अड़चन ट्रांजिस्टर नहीं, कर्नल (kernel) थे
एक एआई चिप उतनी ही अच्छी होती है, जितने उसके कर्नल — हाथ से फ़ाइन-ट्यून किए मैट्रिक्स गुणन और अटेंशन कोड, जहाँ परफॉर्मेंस की जीत-हार तय होती है। एक दशक से यह हुनर CUDA के भीतर ही बसा है। TileLang यह पूरा काम सिमटा देता है: पायथन जैसे सिंटैक्स में कर्नल एक बार लिखिए, कंपाइलर एनवीडिया, एएमडी और ऐपल के चिप्स, अब एसेंड तक के लिए ऑप्टिमाइज़्ड कोड बना देता है 3।
डीपसीक ने इसके साथ DeepGEMM दिया है, जो मैट्रिक्स गुणन संभालता है, और DeepEP, जो उस हुआवे सुपरनोड (supernode) के 128 एसेंड 950 प्रोसेसर के बीच डेटा आगे-पीछे करता है — ट्यूनिंग उसी सुपरनोड पर हुई है। डीपसीक के अपने टेस्ट में परफॉर्मेंस हार्डवेयर की हद के करीब पहुँच गई 14।
डीपसीक के अपने वर्कलोड (workload) पहले से ही इस पर चल रहे हैं
यह कोई डेमो भर का स्टैक नहीं है। डीपसीक के V4 वर्कलोड के TileLang उदाहरण मई से ही रिपॉजिटरी में मौजूद हैं 3। लैब अप्रैल से हुआवे के पूरे सहयोग के साथ एसेंड पर V4 का इंफरेंस (inference) चला रहा है 1, और सॉफ्टवेयर पर हुआवे ने व्यापक तकनीकी मदद भी दी है 4।
हुआवे का कहना है कि एसेंड 950 सुपरनोड पहले से व्यावसायिक इस्तेमाल में हैं और पुराने 910C के 1,000 से ज़्यादा सुपरनोड तैनात हो चुके हैं 5। वहीं 960DT ट्रेनिंग चिप की शुरुआत तीन तिमाही पहले खींचकर 2027 की पहली तिमाही कर दी गई है 1। आज इंफरेंस, अगले साल से ट्रेनिंग — एक चीनी लैब के कंप्यूट बिल के दोनों हिस्से अब इस स्टैक के दायरे में आ गए हैं।
सॉफ्टवेयर के आने से पहले ही घरेलू सिलिकॉन बिक रहा था
रुकावट कभी मांग की नहीं थी। कैम्ब्रिकॉन की पहली छमाही की आमदनी 108% बढ़कर 6 अरब युआन पहुंच गई है, जबकि उसी छह महीने के लिए हायगॉन ने 9.3 अरब युआन तक और मूर थ्रेड्स ने 1.75 अरब युआन तक का अनुमान रखा है — यह उछाल बीजिंग की आत्मनिर्भरता की मुहिम और अमेरिका के निर्यात नियंत्रणों की देन है 6। कैम्ब्रिकॉन, मूर थ्रेड्स और अलीबाबा की टी-हेड ने पहले ही पुष्टि कर दी है कि उनकी चिपें डीपसीक के मॉडल चला लेती हैं 1।
अहम बात यह है कि आमदनी टूलिंग से पहले आ गई — खरीदार ऑर्डर देने के लिए सॉफ्टवेयर का इंतज़ार नहीं कर रहे थे। TileLang की रिपॉजिटरी में मूर थ्रेड्स और हायगॉन के हार्डवेयर के लिए बैकएंड पहले से मौजूद हैं 3, और बुधवार की रिलीज़ एसेंड के लिए कर्नल, कंपाइलर और कम्युनिकेशन लाइब्रेरी लेकर आई है 1। बीजिंग के मीटर वाले एनवीडिया हार्डवेयर और घरेलू सिलिकॉन के बीच से चुन रहे चीनी खरीदार के लिए इंतज़ार की आख़िरी वजह भी अब खत्म हो गई है।
डीपसीक के सॉफ्टवेयर के आने से पहले ही घरेलू चिप कंपनियां बढ़ोतरी पर थीं
- 2026 की पहली छमाही की आमदनी
- Estimate
Data
| 2026 की पहली छमाही की आमदनी | |
|---|---|
| हायगॉन (estimate) | ¥9.3B |
| कैम्ब्रिकॉन | ¥6B |
| मूर थ्रेड्स (estimate) | ¥1.75B |
अब एनवीडिया का चीन वाला दांव सिर्फ़ इजाज़त पर टिका है
चीन से डेटा सेंटर कंप्यूट की कोई आमदनी नहीं मानते हुए एनवीडिया ने मौजूदा तिमाही के लिए 108 अरब डॉलर का गाइडेंस दिया है 7। जेन्सेन हुआंग का कहना है कि चीन के AI चिप बाज़ार में एनवीडिया की हिस्सेदारी करीब 95% से गिरकर शून्य पर आ गई 7। इसके बावजूद पिछली तिमाही में कंपनी ने मुख्यालय चीन में रखने वाले ग्राहकों से 7.9 अरब डॉलर की बिलिंग की, जिसमें AI कंप्यूट का हिस्सा लगभग न के बराबर रहा 7।
चीन के दोबारा खुलने को लेकर बने तेज़ी वाले तर्क के दो सहारे हैं। पहला है बीजिंग का मीटर, जिसकी परख कथित तौर पर बाइटडांस और अलीबाबा के लिए RTX Pro 5500 की संभावित मंज़ूरी के ज़रिए हो रही है 8। दूसरा है यह धारणा कि CUDA की चढ़ाई नहीं की जा सकती। पहला सहारा राजनीति का सवाल है। दूसरे सहारे के सामने अब एक रिपॉजिटरी में कई वेंडरों वाला जवाबी उदाहरण खड़ा है। चीन के बाहर CUDA की टूलिंग अब भी जीत रही है, लेकिन सॉफ्टवेयर का अंतर ही वह इकलौता मंदी वाला तर्क (bear case) था जिसे निर्यात नियंत्रण ख़त्म नहीं कर सके थे — और इस हफ़्ते वह कोड के ज़रिए ख़त्म हो गया।
आगे दो पुष्टियों पर नज़र रखें: कोई चीनी लैब एसेंड पर फ्रंटियर दर्जे की ट्रेनिंग चलाए, और 960DT वादे के मुताबिक पहली तिमाही में आ जाए 1। पहली चीज़ किसी लैब की मर्ज़ी है; दूसरी बस एक तारीख़।
इनाम उसी का है जिसने हार्डवेयर को प्रोग्राम करने योग्य बनाया
यह बीच का काम डीपसीक और हुआवे ने खुद, खुलेआम किया, और इसका मूल्य हथियाने के हकदार भी यही दोनों हैं: वे नहीं जो ट्रांजिस्टरों के सबसे करीब बैठे हैं, बल्कि वे जिन्होंने हार्डवेयर को प्रोग्राम करने योग्य बनाया। खाई हमेशा सॉफ्टवेयर की ही थी। चीन का जवाब अब सार्वजनिक है, और मुफ़्त।
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



