← सभी models

DeepSeek V4 Pro: मॉडल का ऐतिहासिक संदर्भ

1M tokens · Text / Code · Prompt cache

Okou अब DeepSeek V4 Pro नहीं चलाता। यह पेज इसके स्पेसिफिकेशन, कीमत और बेंचमार्क के संदर्भ के लिए रखा गया है। इसी तरह के काम के लिए GPT 6 Luna का उपयोग करें।

GPT 6 Luna देखें

DeepSeek V4 Pro, DeepSeek की V4 पीढ़ी का फ्लैगशिप है — MIT लाइसेंस के तहत एक ओपन-वेट 1.6T-पैरामीटर MoE। मुख्य बात है कीमत-से-गुणवत्ता अनुपात: वेंडर-रिपोर्टेड SWE-bench Verified 80.6% है, Claude Opus 4.6 से एक अंक के अंश के भीतर, Anthropic की वेंडर लागत के लगभग एक-सातवें हिस्से पर। यह रीज़निंग-भारी एजेंट — बल्क PR रिव्यू, बैच डॉक्यूमेंट विश्लेषण, शेड्यूल किया गया सारांशन — को उच्च मात्रा में किफ़ायती बनाता है।

वेंडर लिस्ट प्राइस $1.74 / $3.48 प्रति 1M टोकन है, कैश रीड $0.028 / 1M पर और मुफ़्त कैश राइट (लाइनअप में अद्वितीय)। 1M-टोकन कॉन्टेक्स्ट, Anthropic-संगत API। जब प्रोडक्शन टूल-रूटिंग विश्वसनीयता निर्णायक कारक हो तब Sonnet 4.6 चुनें, और जब सिंगल-शॉट बल्क काम को V4 Pro की रीज़निंग गहराई की ज़रूरत न हो तब GPT-5.4 Mini या Kimi K2.7 Code चुनें।

DeepSeek V4 Pro क्या है?

24 अप्रैल, 2026

DeepSeek V4 Pro, DeepSeek की V4 पीढ़ी का फ्लैगशिप है, जो 24 अप्रैल, 2026 को MIT License के तहत रिलीज़ हुआ। यह एक ओपन-वेट Mixture-of-Experts मॉडल है जिसमें कुल 1.6T पैरामीटर और प्रति टोकन 49B सक्रिय हैं।

V4 Pro एक 1M-टोकन कॉन्टेक्स्ट विंडो, 384K अधिकतम आउटपुट, तीन रीज़निंग एफ़र्ट मोड (standard, think, think-max), JSON आउटपुट, टूल कॉल, और non-think मोड में FIM कम्प्लीशन का समर्थन करता है। Pro मॉडल नाटकीय रूप से बेहतर लंबे-कॉन्टेक्स्ट दक्षता के लिए एक हाइब्रिड अटेंशन आर्किटेक्चर (Compressed Sparse Attention + Heavily Compressed Attention) जोड़ता है। 1M कॉन्टेक्स्ट पर DeepSeek V3.2 की तुलना में सिंगल-टोकन इन्फ़रेंस FLOPs का 27% और KV कैश का 10%।

DeepSeek V4 Pro में क्या उल्लेखनीय है

मुख्य architecture और capability विशेषताएँ।

V4 Pro एक Mixture-of-Experts मॉडल है जिसमें कुल 1.6T पैरामीटर और प्रति टोकन 49B सक्रिय हैं, इसके आगे एक हाइब्रिड अटेंशन स्टैक (Compressed Sparse Attention साथ ही Heavily Compressed Attention) है जो लंबे-कॉन्टेक्स्ट इन्फ़रेंस को सस्ता रखता है। यह 384K अधिकतम आउटपुट के साथ 1M-टोकन कॉन्टेक्स्ट विंडो का समर्थन करता है, तीन रीज़निंग एफ़र्ट मोड (standard, think, और think-max), और स्थिर सिग्नल प्रोपेगेशन के लिए Manifold-Constrained Hyper-Connections का उपयोग करता है। मॉडल को Muon ऑप्टिमाइज़र के साथ 32T+ टोकन पर प्रशिक्षित किया गया और इसे ओपन वेट्स के साथ MIT License के तहत रिलीज़ किया गया है।

एक नज़र में specs

परिवारDeepSeek V4 सीरीज़
पैरामीटर1.6T कुल / 49B सक्रिय (MoE)
मोडैलिटीटेक्स्ट, कोड
भाषाएँबहुभाषी
कॉन्टेक्स्ट विंडो1M टोकन
अधिकतम आउटपुट384K टोकन
लाइसेंसMIT (ओपन वेट्स)

DeepSeek V4 Pro benchmarks

DeepSeek की V4 Pro रिलीज़ से वेंडर-रिपोर्टेड स्कोर। स्वतंत्र समीक्षाएँ (Geeky Gadgets, Code Arena) V4 Pro को Code Arena पर GLM-5.1 और Kimi K2.7 Code के पीछे तीसरे स्थान पर रखती हैं। सबसे मज़बूत बेंचमार्क दावे DeepSeek की अपनी सामग्री से आते हैं। इन्हें पूर्ण सत्य के बजाय दिशात्मक रूप से लें।

SWE-bench Verifiedवेंडर-रिपोर्टेड; Opus 4.6 से 0.2pts के भीतर
80.6%
Terminal-Bench 2.0वेंडर-रिपोर्टेड; Opus 4.6 से आगे
67.9%
LiveCodeBenchवेंडर-रिपोर्टेड
93.5%
Codeforces रेटिंगवेंडर-रिपोर्टेड
3206
MMLU-Proवेंडर-रिपोर्टेड
GPT-5.4 के बराबर
Artificial Analysis Intelligence Indexmax effort
52
गतिArtificial Analysis
~36 टोकन/सेकंड

DeepSeek V4 Pro pricing

प्रति दस लाख टोकन प्रदाता की ऐतिहासिक सूची कीमतें। ये संदर्भ आंकड़े Okou के मौजूदा शुल्क नहीं हैं।

Input$1.74
Output$3.48
Cache read$0.14
Cache writeबिल नहीं किया गया

DeepSeek V4 Pro व्यवहार में कैसा प्रदर्शन करता है

Production agent runs से देखा गया व्यवहार।

रीज़निंग

हमारे लाइनअप में सबसे मज़बूत सब-Sonnet रीज़निंग। बहु-चरणीय काम पर टिका रहता है जहाँ सस्ते मॉडल भटकने लगते हैं। वेंडर-रिपोर्टेड MMLU-Pro, GPT-5.4 के बराबर है।

कोडिंग बेंचमार्क

वेंडर-रिपोर्टेड SWE-bench Verified 80.6% (Opus 4.6 से 0.2 के भीतर), Terminal-Bench 2.0 67.9% (Opus 4.6 से आगे), LiveCodeBench 93.5%।

गति

Artificial Analysis के अनुसार max effort पर लगभग 36 टोकन/सेकंड। Kimi K2.7 Code से धीमा, Opus 4.6 से थोड़ा धीमा।

DeepSeek V4 Pro के लिए सर्वश्रेष्ठ agent tasks

वह PR-रिव्यू एजेंट जो हर कमिट पर चलता है

Sonnet की वेंडर लागत के एक अंश पर Sonnet-स्तरीय सटीकता ही "हर कमिट की समीक्षा करो, सिर्फ़ बड़े PRs की नहीं" को वाकई व्यवहार्य बनाती है। V4 Pro डिफ़, संबंधित फ़ाइलें, और लिंक किया गया इश्यू पढ़ता है, फिर एक संरचित कमेंट लिखता है — और प्रति-कॉल कीमत इतनी कम है कि हर पुश पर इसे CI स्टेप के रूप में चलाना कोई ध्यान देने योग्य लाइन आइटम नहीं बनता।

वह शेड्यूल किया गया सारांशकर्ता जो हर रात चलता है

कल की ग्राहक बातचीत, सपोर्ट टिकट, या सेल्स कॉल खींचता है और एक डाइजेस्ट लिखता है। सिस्टम प्रॉम्प्ट और टूल स्कीमा रन के बीच नहीं बदलते, और DeepSeek कैश राइट बिल नहीं करता — इसलिए लंबा निश्चित प्रीफ़िक्स एक बार चुकाया जाता है और कैश रीड सामान्य इनपुट के एक अंश पर पड़ते हैं। यहीं V4 Pro का मूल्य निर्धारण मॉडल वाकई बदल देता है कि क्या किफ़ायती है।

वह पूरे-रेपो वाला कोड एजेंट जिसकी लागत Opus से कम है

हाइब्रिड अटेंशन (Compressed Sparse Attention साथ ही Heavily Compressed Attention) के साथ 1M-टोकन कॉन्टेक्स्ट का मतलब है कि एक मध्यम-आकार का कोडबेस एक ही प्रॉम्प्ट में फ़िट हो जाता है और विंडो भरने पर भी इन्फ़रेंस लागत प्रबंधनीय रहती है। क्रॉस-फ़ाइल रीफैक्टर और आर्किटेक्चर-स्तर की समीक्षाओं के लिए, यहीं आपको Opus-शैली का "सब कुछ एक साथ देखो" वर्कफ़्लो Opus-शैली के बिल के बिना मिलता है।

DeepSeek V4 Pro को कब छोड़ें

सबसे कठिन टूल-रूटिंग एज केस पर V4 Pro से बचें जहाँ Sonnet 4.6 अब भी आगे है, और उस बल्क सिंगल-शॉट काम पर जहाँ GPT-5.4 Mini या Kimi K2.7 Code कम लागत पर पर्याप्त है।

DeepSeek V4 Pro बनाम अन्य models

DeepSeek V4 Pro बनाम Claude Sonnet 4.6

कठिन tool-routing edge cases के लिए Sonnet 4.6 अधिक भरोसेमंद विकल्प बना रहता है। V4 Pro की लागत कम है और vendor-reported coding benchmarks पर प्रतिस्पर्धी है। मानकीकरण से पहले दोनों को वास्तविक agent पर A/B test करें।

DeepSeek V4 Pro बनाम Kimi K2.7 Code

Kimi में मज़बूत लंबे-कॉन्टेक्स्ट रिकॉल और उच्च Intelligence Index है (54 बनाम 52); V4 Pro में बेहतर कैश अर्थशास्त्र (मुफ़्त राइट) और Kimi के 256K बनाम 1M कॉन्टेक्स्ट विंडो है। जो गुण ज़्यादा मायने रखता है उसके अनुसार चुनें।

अक्सर पूछे जाने वाले सवाल

DeepSeek V4 Pro कब रिलीज़ हुआ?

DeepSeek ने V4 Pro को 24 अप्रैल, 2026 को ओपन वेट्स के साथ MIT License के तहत रिलीज़ किया।

कैश राइट मुफ़्त क्यों हैं?

DeepSeek कैश-राइट हिस्से को बिल नहीं करता। केवल कैश रीड बिल होते हैं, $0.145 प्रति 1M टोकन पर। स्थिर सिस्टम प्रॉम्प्ट और बड़े रेफ़रेंस कॉन्टेक्स्ट को कैश करने में कोई अतिरिक्त लागत नहीं।

V4 Pro का कॉन्टेक्स्ट विंडो क्या है?

1 मिलियन टोकन, 384K टोकन तक के आउटपुट के साथ। हाइब्रिड अटेंशन आर्किटेक्चर पूरे विंडो को V3.2 की तुलना में काफ़ी कम इन्फ़रेंस लागत पर उपयोग योग्य बनाता है।

V4 Pro की Claude Opus 4.6 से तुलना कैसी है?

वेंडर-रिपोर्टेड SWE-bench Verified 0.2 अंक के भीतर है (80.6 बनाम 80.8)। Terminal-Bench 2.0 V4 Pro के पक्ष में है (67.9 बनाम 65.4)। Opus 4.6 HLE (40.0 बनाम 37.7) और HMMT 2026 गणित (96.2 बनाम 95.2) में आगे है। ~7× कम वेंडर लागत पर, V4 Pro सही चुनाव है जब रीज़निंग गुणवत्ता मानक हो पर लागत मायने रखती हो।

Okou पर DeepSeek V4 Pro की उपलब्धता

DeepSeek V4 Pro अब Okou पर उपलब्ध नहीं है। समर्थित विकल्प के लिए GPT 6 Luna देखें। इस पेज पर मॉडल की ऐतिहासिक जानकारी है, Okou की मौजूदा कीमतें नहीं।