अमेज़न ने डिसाइडर मुफ्त बांट दिया, एजेंट की सबसे सस्ती कॉल अब मीटर से बाहर

एडब्ल्यूएस (AWS) ने इस हफ्ते Strands Decider 2B मुफ्त जारी किया—ठीक उसी हफ्ते, जब ओपनएआई ने अपना खुद का निर्णय मॉडल प्रीव्यू किया और टाइपसेफ (TypeSafe) की फंडिंग राउंड की बातचीत की खबर सामने आई। एजेंट (agent) के लूप में आने वाली सबसे सस्ती कॉल्स की स्टिकर कीमत अब जीरो हो चुकी है।

मूल लेख पढ़ें

In this storyAMZNOpenAI
Vincent JiangVincent Jiang · 3 min read
Share
लकड़ी की सतह पर रखा गीगाबाइट GeForce RTX 3090 ग्राफिक्स कार्ड, जिस पर तीन कूलिंग फैन लगे हैं।
1 / 6Slide 1 of 6
गीगाबाइट GeForce RTX 3090—एडब्ल्यूएस ने अपने मुफ्त Strands Decider 2B डिसाइडर मॉडल की बेंचमार्किंग इसी कंज्यूमर GPU पर की थी, और हर कॉल का मीडियन समय 106 मिलीसेकंड आया था।

खुद बनाया क्लोन अब अमेज़न का मुफ्त प्रोडक्ट

टाइपसेफ के मॉडल जेव (Jev) को देखकर एडब्ल्यूएस के डिस्टिंग्विश्ड इंजीनियर मार्क ब्रूकर ने अपनी तरह से उसका एक वर्जन बनाया 12। अपने साइज़ के मॉडलों की जेवबेंच रैंकिंग में यह घर पर बना डिसाइडर—यानी निर्णय मॉडल—कुछ देर के लिए सबसे ऊपर आ गया 1। इसके बाद अमेज़न ने उसे निखारकर 1 अक्टूबर को Strands Decider 2B के नाम से जारी कर दिया। Qwen3.5-2B बेस पर बने इस मॉडल में करीब 2 अरब पैरामीटर हैं, यह अपाचे 2.0 (Apache 2.0) लाइसेंस के तहत ओपन है, और इसमें न कोई होस्टेड API है, न हर कॉल का कोई शुल्क 2। यह एजेंट की स्थिति पढ़कर स्कोर सहित एक विकल्प और एक कॉन्फिडेंस नंबर लौटाता है 12।

एजेंट के बार-बार दोहराए जाने वाले कदम अब मीटर से बाहर

मॉडल जिन स्टेप्स को संभालना चाहता है, वे बार-बार आने वाले हैं: रिक्वेस्ट रूट करना, कोई टूल चुनना, किसी एक्शन की समीक्षा करना 2। एडब्ल्यूएस ने मॉडल का एक पुराना चेकपॉइंट, यानी वर्जन 18, लोकल RTX 3090 पर हर निर्णय के लिए मीडियन 106 मिलीसेकंड पर नापा था; जो वर्जन आखिरकार रिलीज़ हुआ है, उसकी अपनी लेटेंसी अब तक प्रकाशित नहीं है 2।

15 सितंबर को लॉन्च हुआ जेव हर दस लाख टोकन के इनपुट पर 0.042 डॉलर वसूलता है और आउटपुट टोकन मुफ्त हैं, जबकि टाइपसेफ LLMs के लिए 0.20 से 10 डॉलर की इनपुट रेंज सूचीबद्ध करता है 3। एक हैकाथॉन टेस्ट में एजेंट के एक रन के हर एक्शन की समीक्षा पर जेव पर 2.94 डॉलर और एक फ्रंटियर मॉडल पर 372 डॉलर का खर्च आया 4। इसके लिए कोई प्रति-टोकन कीमत सूची बनाई ही नहीं गई।

दस लाख इनपुट टोकन का मोल: फ्रंटियर के टॉप दाम पर 10 डॉलर, जेव पर 4 सेंट, एडब्ल्यूएस से मुफ्त

$0/M$2/M$4/M$6/M$8/M$10/Mफ्रंटियर LLM इनपुट$10/Mसबसे सस्ता LLM इनपुट$0.2/Mटाइपसेफ जेव$0.04/MStrands Decider 2Bfreeसिर्फ स्टिकर कीमत; कंप्यूट आपको खुद जुटाना है
Data
Value
फ्रंटियर LLM इनपुट$10/M
सबसे सस्ता LLM इनपुट$0.2/M
टाइपसेफ जेव$0.04/M
Strands Decider 2Bfree
दस लाख इनपुट टोकन की स्टिकर या API कीमत। LLM वाले बार टाइपसेफ की फ्रंटियर मॉडलों के लिए जारी की गई इनपुट रेंज दिखाते हैं; जेव का आंकड़ा टाइपसेफ की लॉन्च कीमत है। Strands Decider 2B अपाचे 2.0 के तहत मुफ्त डाउनलोड है, बिना किसी प्रति-कॉल शुल्क के, और एडब्ल्यूएस ने इसकी संचालन लागत का कोई अनुमान सार्वजनिक नहीं किया है। स्रोत: टाइपसेफ की लॉन्च पोस्ट [3]; VentureBeat [2]।3,2

मुफ्त वेट्स फिर भी किसी का GPU जलाते हैं

अमेज़न के अपने चार्ट इस मॉडल को उसी साइज़ के सार्वजनिक मॉडलों में दूसरे नंबर पर रखते हैं — मापिका के डिसाइडर से पीछे। पहला नंबर यह सिर्फ उन मॉडलों में पाता है जो पूरी ट्रेनिंग रेसिपी (training recipe) सार्वजनिक करते हों। जेव खुद इन चार्टों में है ही नहीं, इसलिए दोनों का कोई सीधा मुकाबला मौजूद नहीं है 2। एडब्ल्यूएस (AWS) ने प्रति-अनुरोध संचालन लागत का कोई अनुमान नहीं दिया है, और जेव के वेट्स बंद रखने वाली टाइपसेफ एक अरब इनपुट टोकन के लिए 42 डॉलर वसूलती है 23। मुफ्त है तो स्टिकर कीमत, असली लागत नहीं।

हज़ार डॉलर में बन जाता क्लोन, स्कोरबोर्ड अब भी जेव के पक्ष में

ओपनएआई ने 29 सितंबर को अपने DevDay इवेंट में Decisions API का प्रीव्यू दिखाया, जिसमें सैम ऑल्टमैन ने लैब के लूना (Luna) मॉडल को पहले से तय एक विकल्प तक सीमित करके बेहद तेज़ रफ्तार का वादा किया 4। जेव के आने के बाद दो हफ्तों में ही दर्जनों क्लोन बाज़ार में आ गए 12, और ब्रूकर एक क्लोन बनाने की लागत "सैकड़ों या हज़ारों डॉलर" बताते हैं 1। लेकिन स्कोरबोर्ड अब भी इससे असहमत है: जेव 1.13 ने 25 स्टारक्राफ्ट रन में से 21 जीत दर्ज की हैं, ओपन-सोर्स OpenJev का स्कोर 0–9 पड़ा है और जेव की सबसे सस्ती सत्यापित जीत 0.016 डॉलर की पड़ी है 6।

तेज़ और सस्ता बनाना आसान है, असली खाई डेटा की है

टाइपसेफ के सीईओ दियोगो अल्मीदा कहते हैं, "अगर बस बेहद तेज़ और सस्ता चाहिए, तो पासा फेंक लीजिए।" "मुश्किल तो इंटेलिजेंस है," और उनकी खाई (moat) मॉडल के पीछे का सिंथेटिक डेटा है 4। मौजूदा क्लोन उन्हें "ऐसे लगते हैं जैसे ML करने वालों को कोई कूल आर्किटेक्चर लागू करने का चाव हो" 1।

पैसा इस खाई को लेकर अब भी बहस कर रहा है। 15 सितंबर को 20 करोड़ डॉलर की वैल्यूएशन पर 4 करोड़ डॉलर की सीड फंडिंग मिली थी 5, और The Information में अब रिपोर्ट की गई बातचीत 10 अरब डॉलर के आंकड़े से ऊपर 1 अरब डॉलर या उससे ज़्यादा की है — डील वहीं तय हुई, तो यह सीड वैल्यूएशन का पचास गुना होगा 7। श्रेय भी विवादित है: फंडिंग की खबर सामने आने पर Latent Space के swyx ने शिकायत की कि यूट्यूब के एक वीडियो में उनका लोगो काटकर हटा दिया गया था और कोई श्रेय नहीं दिया गया था, साथ में लिखा, "pls support smol creators" 89।

मुफ्त निर्णय बाज़ार नहीं तोड़ते, मांग बढ़ाते हैं

जेव का नाम विलियम स्टैनली जेवोंस के नाम पर रखा गया है। टाइपसेफ की थीसिस है — "इंटेलिजेंस की लागत में हर दस गुना की गिरावट, उससे कई गुना ज़्यादा यूज़ केस खोल देती है" 3। यह बात सच उतरी, तो अमेज़न का मुफ्त डिसाइडर कंप्यूट कम नहीं, ज़्यादा बेचेगा — ज़्यादा एजेंट, ज़्यादा निर्णय, और उस हार्डवेयर का किराया आज भी कोई न कोई देता ही रहेगा।

असली इशारा दो तारीखों पर मिलेगा। पहली — वह दिन जब ओपनएआई अपने Decisions API के लिए कीमत जारी करेगा; यह API अभी लिमिटेड प्रीव्यू (limited preview) में है और उसकी कोई दर अब तक सामने नहीं आई है 4। दूसरी — क्या टाइपसेफ का फंडिंग राउंड 10 अरब डॉलर के ऊपर तय होता है 7। निर्णय की कीमत टोकन जैसी रही, तो मीटर चलता रहेगा; कीमत शून्य के आसपास पहुंची, तो यह दांव सही साबित हो जाएगा।

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio