Kort door de bocht: DeepSeek kondigde aan dat de V4-API dynamische prijsstelling per tijdvak krijgt — op werkdagen tijdens de spits (Beijing-tijd 9:00–12:00 en 14:00–18:00) verdubbelt de prijs, buiten de spits blijft hij ongewijzigd. De officiële V4-release staat gepland voor medio juli 2026. Zelfs tegen het verdubbelde spittarief blijft DeepSeek veruit de goedkoopste frontier-AI-API ter wereld, en niet zo'n beetje ook.

⚡ Wat is er aan de hand

Op 29 juni stuurde DeepSeek zijn gebruikers een mail met als onderwerp "DeepSeek V4 Official Release Plan and Billing Adjustment". De grootste verandering: prijsstelling op basis van tijdvak — een primeur onder de grote AI-API-aanbieders.

Tijdens de spitsuren op werkdagen (Beijing-tijd 9:00–12:00 en 14:00–18:00) verdubbelt de prijs van alle V4-API's. Buiten die uren blijft alles op het huidige, allang belachelijk lage tarief.

Zie het als surgepricing bij Uber, maar dan voor AI-tokens. Als iedereen tegelijk codeert, betaal je een premie. Batch-jobs om drie uur 's nachts draaien? Dan krijg je de korting.

📊 De prijzentabellen

DeepSeek V4 Pro

PostDaluren (¥/M tokens)Spitsuren (¥/M tokens)
Invoer (cache-hit)¥0.025¥0.05
Invoer (cache-miss)¥3.00¥6.00
Uitvoer¥6.00¥12.00

DeepSeek V4 Flash

PostDaluren (¥/M tokens)Spitsuren (¥/M tokens)
Invoer (cache-hit)¥0.02¥0.04
Invoer (cache-miss)¥1.00¥2.00
Uitvoer¥2.00¥4.00
⚡ Let op: Zelfs in de spits kost de uitvoer van DeepSeek V4 Flash maar ¥4/M tokens, grofweg $0.56/M tokens. Ter vergelijking: GPT-5.5 staat op $30/M en Claude Opus 4.8 op $25/M. DeepSeek is dus op zijn duurst nog steeds 45–50× goedkoper dan OpenAI's flagshipmodel.

📋 De echte rekening

Cijfers zeggen weinig zonder context. Kijk naar een echte factuur. 青小蛙 van Appinn deelde zijn werkelijke verbruik: met DeepSeek V4 Flash werkte hij een maand lang een WK-kalender automatisch bij — scores, doelpunten en wedstrijddata scrapen:

  • Een normale dag: ongeveer ¥2 (~$0.28)
  • Een drukke dag (bugfixes, herstarts): ¥13 (~$1.82)
  • De hele maand samen: ¥60 (~$8.40)

Inderdaad — een pijplijn die elke dag een maand lang automatisch draait, kost minder dan één lunch in San Francisco.

🏆 Hoe DeepSeek zich verhoudt tot concurrenten

Onderstaand de uitvoerprijzen van de belangrijkste modellen, in dollars per miljoen tokens:

ModelUitvoer $/MContextvenster
DeepSeek V4 Flash (dal / spits)$0.28 / $0.561,000,000
DeepSeek V4 Pro (dal / spits)$0.87 / $1.741,000,000
Xiaomi MiMo V2.5$0.281,000,000
Xiaomi MiMo V2.5 Pro$0.871,000,000
MiniMax M3$1.201,000,000
GLM-5.1 (Zhipu)$4.40200,000
Kimi K2.6¥27 ≈ $3.78262,000
Qwen3.7 Plus¥8 ≈ $1.121,000,000
GPT-5.5 (OpenAI)$30.001,100,000
Claude Opus 4.8 (Anthropic)$25.001,000,000

In de categorie "1 miljoen context voor een appel en een ei" is Xiaomi MiMo V2.5 de dichtstbijzijnde concurrent — $0.28/M uitvoer, gelijk aan DeepSeek V4 Flash in de daluren, maar zonder spittarief. Als prijsgevoeligheid belangrijk is en je niet over tijdslots wilt nadenken, is MiMo misschien de veiligere keuze.

🤔 Waarom doet DeepSeek dit?

Het antwoord is simpel: capaciteitsbeheer. De servers van DeepSeek worden tijdens Chinese kantooruren kort en klein geslagen. Liever dan gebruikers af te wijzen (of de kwaliteit te laten instorten door overbelasting), zetten ze prijssignalen in om de vraag af te vlakken.

Dat is best slimme infrastructuureconomie. AWS, Google Cloud en elke grote cloudprovider doen dit al jaren met spot-instances en gereserveerde capaciteit. DeepSeek is simpelweg de eerste AI-API-aanbieder die dezelfde logica op taalmodelinferentie loslaat.

Reken erop dat anderen volgen. Als DeepSeek aantoont dat dit werkt, komen Kimi en Qwen vrijwel zeker met eigen dal/spittarieven.

🎯 Wat jij moet doen

  1. Bij prijsgevoeligheid: Plan zware workloads (batchverwerking, trainingsdata genereren, grootschalige analyses) buiten Chinese kantooruren (9:00–12:00, 14:00–18:00). Je portemonnee zal je dankbaar zijn.
  2. Bij 24/7-beschikbaarheid: Begroot op het spittarief, of bouw een fallback-keten — verwijs spitssubscriptionverkeer door naar MiMo V2.5 of Qwen3.7 Plus, en ga buiten de spits terug naar DeepSeek.
  3. Bij een gratis tier of klein budget: V4 Flash tegen daltarief is vrijwel gratis. ¥1/M invoer (cache-miss) betekent dat je 1 miljoen tokens invoer én 1 miljoen tokens uitvoer verwerkt voor ongeveer ¥3 (41 dollarcent). Een hele roman erin, analyseren en eruit — voor dat bedrag.
🔮 Voorspelling: De surgepricing van DeepSeek V4 is de kanarie in de kolenmijn. Tegen Q4 2026 zullen minstens nog twee Chinese AI-aanbieders met tijdgebonden prijsstelling komen. Het tijdperk van "AI vlaktarief onbeperkt" loopt ten einde — en dat is eigenlijk goed nieuws voor het ecosysteem. Het betekent dat AI echte infrastructuur wordt, geen verlieslijdende demo.

⏳ Conclusie

DeepSeek V4 tegen de dubbele prijs is nog steeds de goedkoopste frontier-AI-API ter wereld. De surgepricing is een feature, geen bug — het signaleert dat DeepSeek genoeg vraag heeft om capaciteitsbeheer nodig te hebben, en de prijsstelling is er transparant over.

Als je bouwt op Chinese AI-API's (en dat zou je moeten doen — het prijsverschil met Amerikaanse aanbieders is absurd), dan blijft DeepSeek V4 Flash de standaardkeuze voor alles wat geen multimodale invoer nodig heeft. Draai je zware jobs gewoon na het eten.


Bron: DeepSeek-gebruikersmail (29 juni 2026), Appinn-artikel, DevTk.AI-prijslijst. Prijzen gecheckt op 3 juli 2026.