संक्षेप में: DeepSeek ने ऐलान किया है कि V4 API पर समय-आधारित गतिशील मूल्य निर्धारण लागू होगा — कार्यदिवस के चरम घंटों (बीजिंग समय 9:00–12:00, 14:00–18:00) में कीमतें सीधे दोगुनी हो जाएंगी, जबकि ऑफ-पीक घंटों में मौजूदा दर बरकरार रहेगी। V4 का आधिकारिक वर्शन जुलाई 2026 के मध्य में लॉन्च होने के लिए तय है। दोगुनी चरम दर पर भी DeepSeek अभी भी दुनिया का सबसे सस्ता फ्रंटियर AI API है — और फ़र्क़ थोड़ा-सा नहीं, काफ़ी ज़्यादा है।

⚡ क्या हुआ?

29 जून को DeepSeek ने अपने यूज़र्स को एक मेल भेजा, जिसका विषय था "DeepSeek V4 正式版发布计划及计费调整" (DeepSeek V4 आधिकारिक रिलीज़ योजना और बिलिंग बदलाव)। सबसे बड़ा बदलाव: समय-स्लॉट के हिसाब से गतिशील मूल्य निर्धारण — यह किसी भी बड़े AI API प्रदाता के लिए पहली बार हो रहा है।

कार्यदिवस के चरम घंटों (बीजिंग समय 9:00–12:00, 14:00–18:00) में सभी V4 API कीमतें सीधे दोगुनी हो जाएंगी; बाकी समय में कीमतें नहीं बदलेंगी और अपने मौजूदा (पहले से ही बेतुके तौर पर कम) स्तर पर ही रहेंगी।

इसे Uber के पीक-आवर सर्ज प्राइसिंग की तरह समझ लीजिए, बस इकाई AI token है। जब सब एक साथ कोड लिख रहे हों, तो आपको प्रीमियम चुकाना होगा; बैच टास्क को रात के तीन बजे चलाने का शेड्यूल बनाया? छूट का आनंद लीजिए।

📊 मूल्य तालिका

DeepSeek V4 Pro

बिलिंग आइटमऑफ-पीक (¥/M tokens)चरम घंटे (¥/M tokens)
इनपुट (कैश हिट)¥0.025¥0.05
इनपुट (कैश मिस)¥3.00¥6.00
आउटपुट¥6.00¥12.00

DeepSeek V4 Flash

बिलिंग आइटमऑफ-पीक (¥/M tokens)चरम घंटे (¥/M tokens)
इनपुट (कैश हिट)¥0.02¥0.04
इनपुट (कैश मिस)¥1.00¥2.00
आउटपुट¥2.00¥4.00
⚡ याद रखें: चरम दर पर भी, DeepSeek V4 Flash का आउटपुट सिर्फ़ ¥4/M tokens है, यानी लगभग $0.56/M tokens। तुलना कीजिए: GPT-5.5 $30/M है, Claude Opus 4.8 $25/M है। यानी DeepSeek अपने सबसे महंगे पड़ाव पर भी OpenAI के फ़्लैगशिप मॉडल से 45–50 गुना सस्ता है।

📋 असली लागत

सिर्फ़ यूनिट कीमत से कोई अंदाज़ा नहीं होता? आइए असली बिल देखते हैं। Appinn के 青小蛙 ने अपनी वास्तविक खपत साझा की: DeepSeek V4 Flash से एक विश्व कप कैलेंडर को ऑटो-अपडेट करना — स्कोर, गोल, मैच डेटा स्क्रेप करना — पूरा एक महीना चलाया:

  • सामान्य दिन: लगभग ¥2 (करीब $0.28)
  • भारी दिन (बग फ़िक्स, दोबारा चलाना): ¥13 (करीब $1.82)
  • पूरे महीने का कुल: ¥60 (करीब $8.40)

बिल्कुल सही — एक रोज़ाना चलने वाली ऑटोमेटेड पाइपलाइन, पूरा महीना चली, और उसका ख़र्चा सैन फ़्रांसिस्को के एक दोपहर के खाने से भी कम रहा।

🏆 प्रतिद्वंद्वियों से तुलना

नीचे मुख्य मॉडलों की आउटपुट कीमतें (डॉलर में, प्रति मिलियन tokens) दी गई हैं:

मॉडलआउटपुट $/Mकॉन्टेक्स्ट विंडो
DeepSeek V4 Flash (ऑफ-पीक / पीक)$0.28 / $0.561,000,000
DeepSeek V4 Pro (ऑफ-पीक / पीक)$0.87 / $1.741,000,000
Xiaomi MiMo V2.5$0.281,000,000
Xiaomi MiMo V2.5 Pro$0.871,000,000
MiniMax M3$1.201,000,000
GLM-5.1 (Zhipu)$4.40200,000
Kimi K2.6¥27 ≈ $3.78262,000
Qwen3.7 Plus¥8 ≈ $1.121,000,000
GPT-5.5 (OpenAI)$30.001,100,000
Claude Opus 4.8 (Anthropic)$25.001,000,000

"10 लाख कॉन्टेक्स्ट + बेहद कम कीमत" वाले वर्ग में सबसे क़रीबी प्रतिद्वंद्वी Xiaomi MiMo V2.5 है — आउटपुट $0.28/M, जो DeepSeek V4 Flash की ऑफ-पीक कीमत के बराबर है, लेकिन इसमें कोई पीक प्रीमियम नहीं है। अगर आप लागत-संवेदनशील हैं और समय-स्लॉट की टेंशन नहीं लेना चाहते, तो MiMo ज़्यादा पक्का विकल्प हो सकता है।

🤔 ऐसा क्यों किया?

कारण बहुत सीधा है: क्षमता प्रबंधन। चीनी कामकाजी घंटों में DeepSeek के सर्वर ज़बरदस्त लोड से भर जाते हैं। सेवा अस्वीकार करने (या ओवरलोड से गुणवत्ता गिरने देने) के बजाय, कीमत के संकेत से मांग को पीक से उतार कर घाटी में भरना बेहतर है।

यह असल में काफ़ी समझदारी भरा इंफ़्रास्ट्रक्चर इकॉनमी है। AWS, Google Cloud जैसे बड़े क्लाउड प्रदाता यह सब सालों से कर रहे हैं — spot इंस्टेंस, रिज़र्व्ड कैपेसिटी यही लॉजिक हैं। DeepSeek ने बस इसी सोच को भाषा-मॉडल इन्फ़रेंस पर सबसे पहले उतारा है।

अनुसरण करने वाले और भी होंगे। अगर DeepSeek का यह मॉडल सफल रहा, तो Kimi और Qwen लगभग निश्चित रूप से अपनी खुद की समय-आधारित बिलिंग टियर निकालेंगे।

🎯 आपको क्या करना चाहिए?

  1. कीमत-संवेदनशील: भारी वर्कलोड (बैच प्रोसेसिंग, ट्रेनिंग डेटा जनरेशन, बड़े पैमाने पर एनालिसिस) को बीजिंग कामकाजी घंटों (9:00–12:00, 14:00–18:00) के बाहर शेड्यूल करें। आपका बटुआ आपका शुक्रिया अदा करेगा।
  2. 24×7 ऑनलाइन चाहिए: पीक कीमत पर बजट बनाएं, या एक फ़ॉलबैक चेन बनाएं — पीक घंटों में ट्रैफ़िक को MiMo V2.5 या Qwen3.7 Plus पर रूट करें, ऑफ-पीक में वापस DeepSeek पर।
  3. फ्री-टियर या कम बजट वाले: ऑफ-पीक दर पर V4 Flash लगभग मुफ़्त है। इनपुट (कैश मिस) ¥1/M का मतलब है कि आप 10 लाख token इनपुट प्लस 10 लाख token आउटपुट को करीब ¥3 (41 सेंट) में प्रोसेस कर सकते हैं। एक पूरा लंबा उपन्यास — पढ़ा, एनालाइज़ किया, वापस निकाला — इतने ही पैसों में।
🔮 भविष्यवाणी: DeepSeek V4 का समय-आधारित प्रीमियम सिर्फ़ पहला संकेत है। 2026 की चौथी तिमाही तक कम-से-कम दो और चीनी AI प्रदाता समय-आधारित मूल्य निर्धारण लाएंगे। "एक ही दर पर असीमित AI" का दौर ख़त्म हो रहा है — और यह असल में अच्छी बात है। इसका मतलब है कि AI असली इंफ़्रास्ट्रक्चर बन रहा है, न कि नुक़सान में चलने वाला कोई डेमो।

⏳ नतीजा

दोगुनी कीमत पर भी DeepSeek V4 दुनिया का सबसे सस्ता फ्रंटियर AI API है। समय-आधारित मूल्य निर्धारण एक फ़ीचर है, बग नहीं — यह दिखाता है कि DeepSeek की मांग इतनी बड़ हो गई है कि उसे क्षमता प्रबंधन की ज़रूरत है, और इसे उसने कीमत में साफ़-साफ़ बयान कर दिया है।

अगर आप Chinese AI API इस्तेमाल कर रहे हैं (सच कहूं तो आपको करने ही चाहिए — अमेरिकी प्रदाताओं से कीमत का फासला बेतुके स्तर तक हो चुका है), तब तक DeepSeek V4 Flash डिफ़ॉल्ट पहला विकल्प रहता है जब तक आपके टास्क को मल्टीमॉडल इनपुट की ज़रूरत न हो। बस भारी काम को रात के खाने के बाद चलाने का शेड्यूल बना लें।


स्रोत: DeepSeek यूज़र मेल (29 जून, 2026), Appinn रिपोर्ट, DevTk.AI मूल्य निर्देशिका। कीमतें जाँची गईं: 3 जुलाई, 2026।