← सभी लेख

DeepSeek V4 Pro 0813 एक ऐतिहासिक मोड़ है

चमकदार डिजिटल व्हेल - अंतिम संस्करण में DeepSeek V4 Pro

मुख्य बात के बारे में संक्षेप में (BLUF)

DeepSeek ने अंतिम संस्करण V4 Pro - संशोधन 0813 जारी किया: अद्यतन प्रस्तुति या संदर्भ के बिना, एपीआई के माध्यम से स्वचालित रूप से आया। हम बेंचमार्क का उपयोग करके देखते हैं कि वास्तव में क्या वृद्धि हुई है, ईमानदारी से क्लाउड और जीपीटी के साथ अंतर की गणना करते हैं और बताते हैं कि कीमत अभी तक क्यों नहीं बदली है।

आज DeepSeek ने अंतिम संस्करण V4 Pro - संशोधन 0813 जारी किया। कोई सम्मेलन या उलटी गिनती काउंटर नहीं: बस एपीआई अपडेट किया गया। जो लोग पहले से ही `डीपसीक-वी4-प्रो` के साथ काम कर चुके हैं उन्हें कोड में कुछ भी बदलाव किए बिना स्वचालित रूप से एक नया मॉडल प्राप्त हो गया। अप्रैल वाला एक पूर्वावलोकन था, यह GA है, और अंतर मुख्य रूप से ध्यान देने योग्य है जहां मॉडल से चैट में प्रतिक्रिया देने की नहीं, बल्कि सुसंगत रूप से काम करने की अपेक्षा की जाती है।

चमकदार डिजिटल व्हेल - अंतिम संस्करण में DeepSeek V4 Pro

आज वह दिन है जब ओपस-स्तरीय कोडिंग वास्तव में सुलभ हो गई है। यह प्रस्ताव सुबह में एक विपणक का सपना होता, और शाम को यह बूट करने के लिए बेंचमार्क के साथ एक तथ्य होता।

NeuralSpace में मॉडल पहले से ही खड़ा है: चैट पर, वी "कोड" अनुभाग और में एपीआई. इसमें "इसके शुरू होने का इंतज़ार" नहीं है - आप इसे खोलें और इसका उपयोग करें।

कौन सा मॉडल

तकनीकी रूप से, यह अप्रैल जैसा ही जानवर है: 1.6 ट्रिलियन मापदंडों के साथ विशेषज्ञों का मिश्रण, जिनमें से 49 बिलियन प्रत्येक चरण पर सक्रिय हैं। संदर्भ एक लाख टोकन का है, और मॉडल एक प्रतिक्रिया में 384 हजार टोकन तक उत्पादन करने में सक्षम है। तुलना के लिए: यह पड़ोसी टैब के अधिकांश मॉडलों से लगभग बीस गुना अधिक है।

मॉडल दो तरीकों से सोच सकता है - सोच और गैर-सोच, और रीजनिंग_एफर्ट के अब तीन स्तर हैं: अधिकतम, उच्च, निम्न। व्यवहार में, इसका मतलब यह है कि एक छोटे से मुद्दे को सस्ते में हल किया जा सकता है, और एक जटिल श्रृंखला को मॉडल को बदले बिना, अधिकतम विचार के साथ हल किया जा सकता है।

बेंचमार्क: वास्तव में क्या बढ़ा है

अंतिम संस्करण के जारी होने के बाद बेंचमार्क की वृद्धि DeepSeek V4 Pro

कृत्रिम विश्लेषण ने अंतिम संस्करण को फिर से मापा। इंटेलिजेंस इंडेक्स 43.7 से बढ़कर 45.3 हो गया. कोडिंग इंडेक्स - 58.7 से 59.4 तक. लेकिन एजेंटिक सूचकांक सबसे अधिक उछला: 35.3 से 37.8 तक। यह कोई दुर्घटना नहीं है - संशोधन 0813 को विशेष रूप से एजेंट-आधारित परिदृश्यों के लिए सही किया गया था, जहां मॉडल एक बैठक में प्रतिक्रिया नहीं देता है, बल्कि आगे-पीछे होता है: फ़ाइलें पढ़ता है, टूल को कॉल करता है, परिणाम देखता है और खुद को सही करता है।

गति के संदर्भ में, सब कुछ पिछले संस्करण के स्तर पर है: आउटपुट पर प्रति सेकंड लगभग 76 टोकन, पहला टोकन लगभग डेढ़ से दो सेकंड में आता है। इस आकार के मॉडल के लिए यह तेज़ है। ईमानदार नकारात्मक पक्ष: मॉडल बातूनी है। एए माप पर, यह बाजार के औसत से डेढ़ से दो गुना अधिक टोकन बांटता है - विचार करें कि विस्तृत तर्क के लिए आप अतिरिक्त टोकन और प्रतीक्षा के अतिरिक्त सेकंड दोनों के साथ भुगतान कर रहे हैं।

क्लाउड और जीपीटी के विरुद्ध: निष्पक्ष अंकगणित

नवीनतम तालिका में सबसे उल्लेखनीय चीज़ क्लाउड ओपस 4.8, एंथ्रोपिक के पूर्व फ्लैगशिप वाली लाइन है। DeepSeek V4 Pro 0813 ने इसे दोनों तरफ कोडिंग बेंचमार्क में हराया: टर्मिनल-बेंच 2.1 - 87.9 बनाम 85.0, डीपएसडब्ल्यूई - 62.7 बनाम 58.0। वहीं, ओपस 4.8 की लागत $5 प्रति मिलियन इनपुट टोकन और $25 प्रति मिलियन आउटपुट टोकन है - 11 और 29 गुना अधिक महंगा। यहाँ तालिका है:

कोडिंग बेंचमार्क तालिका: DeepSeek V4 Pro 0813 ने टर्मिनल-बेंच 2.1 और डीपएसडब्ल्यूई में क्लाउड ओपस 4.8 को हराया

अंतिम संस्करण क्लाड फैबल 5 के सबसे करीब आया: टर्मिनल-बेंच में 87.9 बनाम 88.0—एक-दसवें का अंतर। डीपएसडब्ल्यूई के अनुसार, फैबल अधिक स्पष्ट रूप से आगे है: 70.0 बनाम 62.7। यदि आप तालिका DeepSeek से सभी दस एजेंट-आधारित बेंचमार्क की गणना करते हैं, तो फैबल औसतन 5.3% से आगे है - लेकिन दस में से दो DeepSeek जीत पर, और एकमात्र आउटलायर (उपकरण के बिना मानवता की अंतिम परीक्षा: 42.7 बनाम 53.3) के बिना औसत बढ़त 2.8% तक कम हो जाती है।

कीमत प्रतिशत से नहीं, बल्कि कई गुना भिन्न होती है। कल्पित 5 की लागत $10 प्रति मिलियन इनपुट और $50 प्रति मिलियन आउटपुट टोकन है; V4 Pro में $0.435 और $0.87 हैं। मिश्रित दर पर यह लगभग $30 बनाम $0.65 बैठता है। यानी परीक्षणों में कुछ प्रतिशत के अंतर के लिए एंथ्रोपिक लगभग 46 गुना अधिक भुगतान करने को कहता है। ईमानदारी की चेतावनी: मैंने अपने स्वयं के अप्रकाशित बुनियादी ढांचे पर तुलना तालिका DeepSeek को स्वयं मापा, दस में से दो परीक्षण आंतरिक हैं, और 0813 का अभी तक कोई स्वतंत्र माप नहीं है - मॉडल केवल आज जारी किया गया था।

पैमाने को समझने के लिए किमी K3 के बारे में सोचें। एक महीने पहले, वह क्लाउड ओपस से आगे निकलने वाली पहली चीनी मॉडल थीं - यह एक सनसनी थी। लेकिन किमी K3 खरबों मापदंडों वाला एक मॉडल है, इसे चलाने के लिए एक महंगे सर्वर की आवश्यकता होती है, इसलिए खुदरा क्षेत्र में यह क्लाउड फैबल से केवल तीन गुना सस्ता है और क्लाउड ओपस से केवल 40% सस्ता है। प्रभावशाली, लेकिन इसमें कोई लोकतंत्रीकरण नहीं है।

लेकिन DeepSeek V4 Pro वास्तव में एक ऐतिहासिक क्षण है। वास्तव में कोडिंग के मामले में ओपस की बराबरी करते हुए, इसकी लागत ओपस से 30 गुना कम और फैबल से 60 गुना कम है। आज, वाइबकोडिंग हर किसी के लिए सुलभ हो गई है - "उपलब्ध" के विज्ञापन अर्थ में नहीं, बल्कि इसमें प्रवेश की कीमत पर।

जीपीटी के साथ स्थिति अधिक जटिल है। कृत्रिम विश्लेषण सूचकांक में जीपीटी-5.5 का स्कोर 56.3 है, जबकि DeepSeek के लिए 45.3 है - यह अंतर स्पष्ट रूप से ध्यान देने योग्य है। लेकिन टैरिफ तुलनीय नहीं हैं: $5/$30 प्रति मिलियन बनाम $0.435/$0.87। लेकिन सस्ते GPT-5.6 लूना की कीमत पहले से ही $0.10/$0.60 है - यानी, DeepSeek से सस्ता - और स्कोर 52.3 है। यह पता चला है कि "सबसे सस्ता" अब एकमात्र नहीं है: V4 Pro की कीमत पर यह लूना के साथ प्रतिस्पर्धा करता है, और अंकों के मामले में यह टेरा और सोल दोनों से हार जाता है।

मैं बाहर से एक शांत उद्धरण जोड़ूंगा: अमेरिकी एनआईएसटी (सीएआईएसआई) के हालिया आकलन में कहा गया है कि V4 Pro बाजार के नेताओं से लगभग आठ महीने पीछे है। सच है, उन्होंने एक पूर्वावलोकन संस्करण मापा। क्या 0813 ने इस अंतर को कम किया है, यह स्वतंत्र बेंचमार्क द्वारा दिखाया जाएगा, लेकिन वे अभी तक मौजूद नहीं हैं।

कीमत नहीं बदली है. अलविदा

प्रवेश - $0.435 प्रति मिलियन टोकन, निकास - $0.87। कैश हिट अभी भी लगभग मुफ़्त है: $0.003625 प्रति मिलियन, नियमित प्रविष्टि से 120 गुना सस्ता। एजेंट श्रृंखलाओं के लिए, यह मुख्य बिंदु है: परियोजना संदर्भ को बार-बार पढ़ा जाता है, और यह कैश है जो तय करता है कि एजेंट के एक घंटे के काम की लागत कितनी है।

एक चेतावनी: DeepSeek ने पहले ही दस्तावेज़ में चेतावनी दी है कि वह समग्र रूप से अपने एपीआई के लिए कीमतें बढ़ाने जा रहा है। कब और कितने समय तक कहा नहीं जाता. अप्रैल के टैरिफ अभी भी प्रभावी हैं, और यह तुलनीय वर्ग के पश्चिमी एनालॉग्स की तुलना में काफी कम है।

इसे अभी कहां आज़माएं

  • बात करना: खुला मॉडल पृष्ठ - अंतिम 0813 पहले से ही डिफ़ॉल्ट है।
  • कोड: वी "कोड" अनुभाग मॉडल प्रोजेक्ट से जुड़ता है और रिपॉजिटरी, फाइलों और टर्मिनल के साथ काम करता है।
  • एपीआई: कुंजी अनुभाग में जारी की गई है एपीआई कुंजियाँ NeuralSpace, OpenAI के साथ संगत प्रारूप।

भुगतान - सामान्य शेष राशि से रूबल में, बिना सदस्यता, वीपीएन या विदेशी कार्ड के। वास्तविक उपयोग को बट्टे खाते में डाल दिया जाता है, न कि "महीने पहले" पैकेज को।

मॉडल जो नहीं कर सकता वह चित्रों को देखना है: इनपुट केवल पाठ है। यदि आपको स्क्रीनशॉट या फोटो के विश्लेषण की आवश्यकता है, तो यह अन्य मॉडलों के लिए है। लेकिन टेक्स्ट, कोड और लंबे एजेंट कार्यों के लिए, अंतिम V4 Pro अब शक्ति और मूल्य अनुपात के मामले में सबसे ईमानदार प्रस्तावों में से एक है। आप इसे चैट में चेक कर सकते हैं, और यदि आपको इसे अपने उत्पाद में बनाने की आवश्यकता है - कुंजी एपीआई कुंजी पृष्ठ से ली गई है.

अक्सर पूछे जाने वाले प्रश्न (FAQ)

प्रश्न: शुरुआत कैसे करें? उत्तर: प्लेटफ़ॉर्म पर पंजीकरण करें और परीक्षण के लिए निःशुल्क टोकन प्राप्त करें।

प्रश्न: क्या उत्पन्न सामग्री व्यावसायिक उपयोग के लिए उपयुक्त है? उत्तर: हां, आपको बनाई गई सभी सामग्री पर पूर्ण व्यावसायिक अधिकार प्राप्त होते हैं।