संक्षेप में: DeepSeek ने ऐलान किया है कि V4 API पर समय-आधारित गतिशील मूल्य निर्धारण लागू होगा — कार्यदिवस के चरम घंटों (बीजिंग समय 9:00–12:00, 14:00–18:00) में कीमतें सीधे दोगुनी हो जाएंगी, जबकि ऑफ-पीक घंटों में मौजूदा दर बरकरार रहेगी। V4 का आधिकारिक वर्शन जुलाई 2026 के मध्य में लॉन्च होने के लिए तय है। दोगुनी चरम दर पर भी DeepSeek अभी भी दुनिया का सबसे सस्ता फ्रंटियर AI API है — और फ़र्क़ थोड़ा-सा नहीं, काफ़ी ज़्यादा है।
⚡ क्या हुआ?
29 जून को DeepSeek ने अपने यूज़र्स को एक मेल भेजा, जिसका विषय था "DeepSeek V4 正式版发布计划及计费调整" (DeepSeek V4 आधिकारिक रिलीज़ योजना और बिलिंग बदलाव)। सबसे बड़ा बदलाव: समय-स्लॉट के हिसाब से गतिशील मूल्य निर्धारण — यह किसी भी बड़े AI API प्रदाता के लिए पहली बार हो रहा है।
कार्यदिवस के चरम घंटों (बीजिंग समय 9:00–12:00, 14:00–18:00) में सभी V4 API कीमतें सीधे दोगुनी हो जाएंगी; बाकी समय में कीमतें नहीं बदलेंगी और अपने मौजूदा (पहले से ही बेतुके तौर पर कम) स्तर पर ही रहेंगी।
इसे Uber के पीक-आवर सर्ज प्राइसिंग की तरह समझ लीजिए, बस इकाई AI token है। जब सब एक साथ कोड लिख रहे हों, तो आपको प्रीमियम चुकाना होगा; बैच टास्क को रात के तीन बजे चलाने का शेड्यूल बनाया? छूट का आनंद लीजिए।
📊 मूल्य तालिका
DeepSeek V4 Pro
| बिलिंग आइटम | ऑफ-पीक (¥/M tokens) | चरम घंटे (¥/M tokens) |
|---|---|---|
| इनपुट (कैश हिट) | ¥0.025 | ¥0.05 |
| इनपुट (कैश मिस) | ¥3.00 | ¥6.00 |
| आउटपुट | ¥6.00 | ¥12.00 |
DeepSeek V4 Flash
| बिलिंग आइटम | ऑफ-पीक (¥/M tokens) | चरम घंटे (¥/M tokens) |
|---|---|---|
| इनपुट (कैश हिट) | ¥0.02 | ¥0.04 |
| इनपुट (कैश मिस) | ¥1.00 | ¥2.00 |
| आउटपुट | ¥2.00 | ¥4.00 |
📋 असली लागत
सिर्फ़ यूनिट कीमत से कोई अंदाज़ा नहीं होता? आइए असली बिल देखते हैं। Appinn के 青小蛙 ने अपनी वास्तविक खपत साझा की: DeepSeek V4 Flash से एक विश्व कप कैलेंडर को ऑटो-अपडेट करना — स्कोर, गोल, मैच डेटा स्क्रेप करना — पूरा एक महीना चलाया:
- सामान्य दिन: लगभग ¥2 (करीब $0.28)
- भारी दिन (बग फ़िक्स, दोबारा चलाना): ¥13 (करीब $1.82)
- पूरे महीने का कुल: ¥60 (करीब $8.40)
बिल्कुल सही — एक रोज़ाना चलने वाली ऑटोमेटेड पाइपलाइन, पूरा महीना चली, और उसका ख़र्चा सैन फ़्रांसिस्को के एक दोपहर के खाने से भी कम रहा।
🏆 प्रतिद्वंद्वियों से तुलना
नीचे मुख्य मॉडलों की आउटपुट कीमतें (डॉलर में, प्रति मिलियन tokens) दी गई हैं:
| मॉडल | आउटपुट $/M | कॉन्टेक्स्ट विंडो |
|---|---|---|
| DeepSeek V4 Flash (ऑफ-पीक / पीक) | $0.28 / $0.56 | 1,000,000 |
| DeepSeek V4 Pro (ऑफ-पीक / पीक) | $0.87 / $1.74 | 1,000,000 |
| Xiaomi MiMo V2.5 | $0.28 | 1,000,000 |
| Xiaomi MiMo V2.5 Pro | $0.87 | 1,000,000 |
| MiniMax M3 | $1.20 | 1,000,000 |
| GLM-5.1 (Zhipu) | $4.40 | 200,000 |
| Kimi K2.6 | ¥27 ≈ $3.78 | 262,000 |
| Qwen3.7 Plus | ¥8 ≈ $1.12 | 1,000,000 |
| GPT-5.5 (OpenAI) | $30.00 | 1,100,000 |
| Claude Opus 4.8 (Anthropic) | $25.00 | 1,000,000 |
"10 लाख कॉन्टेक्स्ट + बेहद कम कीमत" वाले वर्ग में सबसे क़रीबी प्रतिद्वंद्वी Xiaomi MiMo V2.5 है — आउटपुट $0.28/M, जो DeepSeek V4 Flash की ऑफ-पीक कीमत के बराबर है, लेकिन इसमें कोई पीक प्रीमियम नहीं है। अगर आप लागत-संवेदनशील हैं और समय-स्लॉट की टेंशन नहीं लेना चाहते, तो MiMo ज़्यादा पक्का विकल्प हो सकता है।
🤔 ऐसा क्यों किया?
कारण बहुत सीधा है: क्षमता प्रबंधन। चीनी कामकाजी घंटों में DeepSeek के सर्वर ज़बरदस्त लोड से भर जाते हैं। सेवा अस्वीकार करने (या ओवरलोड से गुणवत्ता गिरने देने) के बजाय, कीमत के संकेत से मांग को पीक से उतार कर घाटी में भरना बेहतर है।
यह असल में काफ़ी समझदारी भरा इंफ़्रास्ट्रक्चर इकॉनमी है। AWS, Google Cloud जैसे बड़े क्लाउड प्रदाता यह सब सालों से कर रहे हैं — spot इंस्टेंस, रिज़र्व्ड कैपेसिटी यही लॉजिक हैं। DeepSeek ने बस इसी सोच को भाषा-मॉडल इन्फ़रेंस पर सबसे पहले उतारा है।
अनुसरण करने वाले और भी होंगे। अगर DeepSeek का यह मॉडल सफल रहा, तो Kimi और Qwen लगभग निश्चित रूप से अपनी खुद की समय-आधारित बिलिंग टियर निकालेंगे।
🎯 आपको क्या करना चाहिए?
- कीमत-संवेदनशील: भारी वर्कलोड (बैच प्रोसेसिंग, ट्रेनिंग डेटा जनरेशन, बड़े पैमाने पर एनालिसिस) को बीजिंग कामकाजी घंटों (9:00–12:00, 14:00–18:00) के बाहर शेड्यूल करें। आपका बटुआ आपका शुक्रिया अदा करेगा।
- 24×7 ऑनलाइन चाहिए: पीक कीमत पर बजट बनाएं, या एक फ़ॉलबैक चेन बनाएं — पीक घंटों में ट्रैफ़िक को MiMo V2.5 या Qwen3.7 Plus पर रूट करें, ऑफ-पीक में वापस DeepSeek पर।
- फ्री-टियर या कम बजट वाले: ऑफ-पीक दर पर V4 Flash लगभग मुफ़्त है। इनपुट (कैश मिस) ¥1/M का मतलब है कि आप 10 लाख token इनपुट प्लस 10 लाख token आउटपुट को करीब ¥3 (41 सेंट) में प्रोसेस कर सकते हैं। एक पूरा लंबा उपन्यास — पढ़ा, एनालाइज़ किया, वापस निकाला — इतने ही पैसों में।
⏳ नतीजा
दोगुनी कीमत पर भी DeepSeek V4 दुनिया का सबसे सस्ता फ्रंटियर AI API है। समय-आधारित मूल्य निर्धारण एक फ़ीचर है, बग नहीं — यह दिखाता है कि DeepSeek की मांग इतनी बड़ हो गई है कि उसे क्षमता प्रबंधन की ज़रूरत है, और इसे उसने कीमत में साफ़-साफ़ बयान कर दिया है।
अगर आप Chinese AI API इस्तेमाल कर रहे हैं (सच कहूं तो आपको करने ही चाहिए — अमेरिकी प्रदाताओं से कीमत का फासला बेतुके स्तर तक हो चुका है), तब तक DeepSeek V4 Flash डिफ़ॉल्ट पहला विकल्प रहता है जब तक आपके टास्क को मल्टीमॉडल इनपुट की ज़रूरत न हो। बस भारी काम को रात के खाने के बाद चलाने का शेड्यूल बना लें।
स्रोत: DeepSeek यूज़र मेल (29 जून, 2026), Appinn रिपोर्ट, DevTk.AI मूल्य निर्देशिका। कीमतें जाँची गईं: 3 जुलाई, 2026।