Kort door de bocht: DeepSeek kondigde aan dat de V4-API dynamische prijsstelling per tijdvak krijgt — op werkdagen tijdens de spits (Beijing-tijd 9:00–12:00 en 14:00–18:00) verdubbelt de prijs, buiten de spits blijft hij ongewijzigd. De officiële V4-release staat gepland voor medio juli 2026. Zelfs tegen het verdubbelde spittarief blijft DeepSeek veruit de goedkoopste frontier-AI-API ter wereld, en niet zo'n beetje ook.
⚡ Wat is er aan de hand
Op 29 juni stuurde DeepSeek zijn gebruikers een mail met als onderwerp "DeepSeek V4 Official Release Plan and Billing Adjustment". De grootste verandering: prijsstelling op basis van tijdvak — een primeur onder de grote AI-API-aanbieders.
Tijdens de spitsuren op werkdagen (Beijing-tijd 9:00–12:00 en 14:00–18:00) verdubbelt de prijs van alle V4-API's. Buiten die uren blijft alles op het huidige, allang belachelijk lage tarief.
Zie het als surgepricing bij Uber, maar dan voor AI-tokens. Als iedereen tegelijk codeert, betaal je een premie. Batch-jobs om drie uur 's nachts draaien? Dan krijg je de korting.
📊 De prijzentabellen
DeepSeek V4 Pro
| Post | Daluren (¥/M tokens) | Spitsuren (¥/M tokens) |
|---|---|---|
| Invoer (cache-hit) | ¥0.025 | ¥0.05 |
| Invoer (cache-miss) | ¥3.00 | ¥6.00 |
| Uitvoer | ¥6.00 | ¥12.00 |
DeepSeek V4 Flash
| Post | Daluren (¥/M tokens) | Spitsuren (¥/M tokens) |
|---|---|---|
| Invoer (cache-hit) | ¥0.02 | ¥0.04 |
| Invoer (cache-miss) | ¥1.00 | ¥2.00 |
| Uitvoer | ¥2.00 | ¥4.00 |
📋 De echte rekening
Cijfers zeggen weinig zonder context. Kijk naar een echte factuur. 青小蛙 van Appinn deelde zijn werkelijke verbruik: met DeepSeek V4 Flash werkte hij een maand lang een WK-kalender automatisch bij — scores, doelpunten en wedstrijddata scrapen:
- Een normale dag: ongeveer ¥2 (~$0.28)
- Een drukke dag (bugfixes, herstarts): ¥13 (~$1.82)
- De hele maand samen: ¥60 (~$8.40)
Inderdaad — een pijplijn die elke dag een maand lang automatisch draait, kost minder dan één lunch in San Francisco.
🏆 Hoe DeepSeek zich verhoudt tot concurrenten
Onderstaand de uitvoerprijzen van de belangrijkste modellen, in dollars per miljoen tokens:
| Model | Uitvoer $/M | Contextvenster |
|---|---|---|
| DeepSeek V4 Flash (dal / spits) | $0.28 / $0.56 | 1,000,000 |
| DeepSeek V4 Pro (dal / spits) | $0.87 / $1.74 | 1,000,000 |
| Xiaomi MiMo V2.5 | $0.28 | 1,000,000 |
| Xiaomi MiMo V2.5 Pro | $0.87 | 1,000,000 |
| MiniMax M3 | $1.20 | 1,000,000 |
| GLM-5.1 (Zhipu) | $4.40 | 200,000 |
| Kimi K2.6 | ¥27 ≈ $3.78 | 262,000 |
| Qwen3.7 Plus | ¥8 ≈ $1.12 | 1,000,000 |
| GPT-5.5 (OpenAI) | $30.00 | 1,100,000 |
| Claude Opus 4.8 (Anthropic) | $25.00 | 1,000,000 |
In de categorie "1 miljoen context voor een appel en een ei" is Xiaomi MiMo V2.5 de dichtstbijzijnde concurrent — $0.28/M uitvoer, gelijk aan DeepSeek V4 Flash in de daluren, maar zonder spittarief. Als prijsgevoeligheid belangrijk is en je niet over tijdslots wilt nadenken, is MiMo misschien de veiligere keuze.
🤔 Waarom doet DeepSeek dit?
Het antwoord is simpel: capaciteitsbeheer. De servers van DeepSeek worden tijdens Chinese kantooruren kort en klein geslagen. Liever dan gebruikers af te wijzen (of de kwaliteit te laten instorten door overbelasting), zetten ze prijssignalen in om de vraag af te vlakken.
Dat is best slimme infrastructuureconomie. AWS, Google Cloud en elke grote cloudprovider doen dit al jaren met spot-instances en gereserveerde capaciteit. DeepSeek is simpelweg de eerste AI-API-aanbieder die dezelfde logica op taalmodelinferentie loslaat.
Reken erop dat anderen volgen. Als DeepSeek aantoont dat dit werkt, komen Kimi en Qwen vrijwel zeker met eigen dal/spittarieven.
🎯 Wat jij moet doen
- Bij prijsgevoeligheid: Plan zware workloads (batchverwerking, trainingsdata genereren, grootschalige analyses) buiten Chinese kantooruren (9:00–12:00, 14:00–18:00). Je portemonnee zal je dankbaar zijn.
- Bij 24/7-beschikbaarheid: Begroot op het spittarief, of bouw een fallback-keten — verwijs spitssubscriptionverkeer door naar MiMo V2.5 of Qwen3.7 Plus, en ga buiten de spits terug naar DeepSeek.
- Bij een gratis tier of klein budget: V4 Flash tegen daltarief is vrijwel gratis. ¥1/M invoer (cache-miss) betekent dat je 1 miljoen tokens invoer én 1 miljoen tokens uitvoer verwerkt voor ongeveer ¥3 (41 dollarcent). Een hele roman erin, analyseren en eruit — voor dat bedrag.
⏳ Conclusie
DeepSeek V4 tegen de dubbele prijs is nog steeds de goedkoopste frontier-AI-API ter wereld. De surgepricing is een feature, geen bug — het signaleert dat DeepSeek genoeg vraag heeft om capaciteitsbeheer nodig te hebben, en de prijsstelling is er transparant over.
Als je bouwt op Chinese AI-API's (en dat zou je moeten doen — het prijsverschil met Amerikaanse aanbieders is absurd), dan blijft DeepSeek V4 Flash de standaardkeuze voor alles wat geen multimodale invoer nodig heeft. Draai je zware jobs gewoon na het eten.
Bron: DeepSeek-gebruikersmail (29 juni 2026), Appinn-artikel, DevTk.AI-prijslijst. Prijzen gecheckt op 3 juli 2026.