⚡ Wat er gebeurde

Eind juni 2026 liet DeepSeek een bom vallen: tijdgebonden prijsstelling voor AI-API's. Dat is ongehoord — geen enkele grote AI-aanbieder (OpenAI, Anthropic, Google, Meta) heeft dit ooit gedaan. Energiebedrijven doen het. Ride-sharing-apps doen het. Maar AI-API's? DeepSeek is de eerste, en het verandert de economie van grootschalig taalmodelgebruik fundamenteel.

De korte versie: tijdens Chinese kantooruren (spits) verdubbelen de prijzen. 's Nachts en in het weekend (dal) blijven ze op het huidige lage tarief. De prijsstelling gaat in met de officiële V4-release medio juli 2026, en gebruikers krijgen 24 uur vóór de omschakeling een e-mail.

📊 De cijfers: spits versus dal

De spitsuren zijn werkdagen 9:00–12:00 en 14:00–18:00 Beijing-tijd (UTC+8). Alles daarbuiten — weekends, lunchpauzes en de hele nacht — is dal tegen de halve prijs.

PostV4 Pro (dal)V4 Pro (spits)V4 Flash (dal)V4 Flash (spits)
Cache-hit¥0.025 / M tokens¥0.05 / M tokens¥0.02 / M tokens¥0.04 / M tokens
Cache-miss¥3 / M tokens¥6 / M tokens¥1 / M tokens¥2 / M tokens
Uitvoer¥6 / M tokens¥12 / M tokens¥2 / M tokens¥4 / M tokens

🕐 Hoe laat is de Beijing-spits in jouw tijdzone?

Beijing-spits (ma–vr)Amerikaans westen PDTAmerikaans oosten EDTLonden BSTTokio JST
9:00 – 12:00vorige dag 18:00 – 21:00vorige dag 21:00 – 00:0002:00 – 05:0010:00 – 13:00
14:00 – 18:0023:00 – 03:0002:00 – 06:0007:00 – 11:0015:00 – 19:00
💡 Het kerninzicht
De spitsuren van Beijing (hierboven in het rood) vallen voor de VS in de avond en nacht. Dat betekent: als Amerikanen overdag aan het werk zijn, slaapt China — en draait DeepSeek op daltarief. Het omgekeerde geldt ook: als China werkt, slaapt de VS. Dat creëert een perfecte tweerichtingen-arbitragelus.

🌍 Het tweerichtingen-arbitrage-speelboek

Omdat het dal/spits-schema van DeepSeek is gekoppeld aan Beijing-tijd, creëert dezelfde klok tegenovergestelde realiteiten, afhankelijk van waar jij en je klanten zitten. Hier zijn de twee richtingen, en hoe je er precies één draait.

🅰️ Richting 1: Chinees account → verkopen aan westerse gebruikers

De opzet:
1. Registreer een DeepSeek-account met een Chinees telefoonnummer (krijg het laagste basistarief)
2. Jouw daluren (Beijing-nacht 18:00–09:00, plus het hele weekend) vallen samen met Amerikaanse/Europese overdag — precies wanneer westerse ontwikkelaars het actiefst zijn
3. Draai een eenvoudige API-proxy die verzoeken van westerse gebruikers aanneemt en ze buiten de spits doorstuurt naar DeepSeek

De rekenkunde:
• V4 Flash uitvoer in dal: ¥2/M tokens (≈ $0.27/M)
• OpenAI GPT-4o uitvoer: $10/M tokens
• Prijsverschil: 37× goedkoper. Je kunt doorverkopen tegen $2–5/M en nog steeds 2–5× goedkoper zijn dan OpenAI, terwijl je 7–18× marge opstrijkt.

Best voor: Batchverwerking, contentgeneratie, code-review, vertaling — alles wat een paar minuten vertraging verdraagt. Westerse gebruikers dienen jobs in tijdens hun werkdag, je proxy zet ze in de wachtrij, en ze worden 's nachts (Beijing-tijd) tegen daltarief verwerkt.
🅱️ Richting 2: Westers account → verkopen aan Chinese gebruikers

De opzet:
1. Als DeepSeek regiospecifieke spitsuren biedt (een in de VS geregistreerd account volgt dan Amerikaanse kantooruren), registreer met een Amerikaans/Europees telefoonnummer
2. Jouw dal (VS-nacht) = Beijing-overdag — precies wanneer Chinese ontwikkelaars aan het werk zijn
3. Proxy de verzoeken van Chinese gebruikers via je Amerikaanse account tijdens jouw daluren

⚠️ Belangrijke waarschuwing: Vanaf juli 2026 heeft DeepSeek alleen op Beijing-tijd gebaseerde dal/spits-tarieven aangekondigd voor accounts in de Chinese regio. Het is onduidelijk of internationale accounts hun eigen regionale spitschema krijgen of gewoon Beijing-tijd volgen. We houden dit in de gaten en werken dit artikel bij zodra de officiële launch duidelijkheid geeft. Als internationale accounts ook Beijing-tijd volgen, werkt Richting 2 niet — maar Richting 1 nog steeds, en dat is hoe dan ook de sterkere zet.

Best voor: Als regionale spitsuren worden bevestigd: het bedienen van Chinese ontwikkelaars die tijdens de spits tegen hun DeepSeek-limieten aanlopen en overflow-capaciteit nodig hebben. Jouw Amerikaanse account levert daltarief op hun drukste moment.

🔧 Hoe bouw je de proxy (technische deep dive)

Jij hebt niets fancy's nodig. Een eenvoudige wachtrij-gebaseerde proxy op een goedkope VPS (of zelfs een Raspberry Pi thuis) is al genoeg. De architectuur is simpel:

🔄 Proxy-architectuur (Richting 1)

1. Inlaaglaag — Een OpenAI-compatibel endpoint dat 24/7 verzoeken van je westerse klanten aanneemt
2. Wachtrij — Jobs gaan in een Redis-wachtrij (of zelfs SQLite voor laag volume). Voorzie elke job van prioriteit en deadline.
3. Scheduler — Een cron-achtig proces dat checkt: "Is het nu Beijing-dal?" Zo ja, haal de wachtrij leeg en stuur door naar de DeepSeek-API. Zo nee, wacht.
4. Responslaag — Resultaten komen terug, worden opgeslagen en aan klanten aangeboden (poll-based of webhook-callback)

Belangrijke optimalisatie: Gebruik context-caching van DeepSeek agressief. Cache-hit-tokens kosten ¥0.02–0.025/M (dal) — vrijwel gratis. Structureer je prompts om hergebruik van de cache te maximaliseren (systeemprompts, lange documenten, codebases).

⏰ De scheduler-logica (pseudocode)

# 判断当前是否为北京低峰时段
import datetime

def is_beijing_offpeak():
    now = datetime.datetime.now(datetime.timezone(datetime.timedelta(hours=8)))
    weekday = now.weekday()  # 0=Mon, 6=Sun
    hour = now.hour

    # 周末全天低峰
    if weekday >= 5:
        return True

    # 工作日:9-12 和 14-18 是高峰,其余低峰
    if 9 <= hour < 12:
        return False
    if 14 <= hour < 18:
        return False
    return True

# 主循环:只在低峰时处理队列
while True:
    if is_beijing_offpeak():
        job = queue.pop()
        if job:
            result = deepseek_api.chat(job.prompt, model="deepseek-v4-flash")
            store_result(job.id, result)
    else:
        time.sleep(60)  # 高峰时休眠,等低峰

💰 De weekend-goudmijn

Dit is wat de meeste mensen missen: alle 48 uur van het weekend zijn daluren. Dat zijn twee volledige dagen per week dat je halve-prijs-tokens krijgt, ongeacht je tijdzone. Als je zware workloads bundelt om te draaien van vrijdagavond tot en met zondag, betaal je in de praktijk nooit het spittarief. Voor een SaaS die grote volumes tekst verwerkt — samenvatten, vertalen, contentmoderatie, data-extractie — kan dit alléén al je API-rekening met 30–40% verlagen, zonder ook maar enige tijdzonentruc.

🧠 Pro-strategie: de weekend-batch-pijplijn

1. Verzamel gedurende de week (ma–vr) alle niet-spoedeisende jobs
2. Vrijdag 18:00 Beijing-tijd: start je batch-workers
3. Verwerk 48 uur lang onafgebroken tegen daltarief
4. Maandagochtend: alle resultaten geleverd, de rekening is 50% van wat hij anders zou zijn geweest

Voor bedrijven die dagelijks miljoenen tokens verwerken, is dit geen kleingeld — het is het verschil tussen winst en bloedverlies.

📋 Praktijkvoorbeeld: de WK-kalender-bot

Een Chinese ontwikkelaar (青小蛙) bouwde een bot die automatisch WK-wedstrijdschema's scrapet en agenda-afspraken genereert met DeepSeek V4. Een hele maand draaien in het huidige tijdperk vóór de spittarieven kostte in totaal ¥60 (ongeveer $8.20). Dagelijks gestructureerde data genereren uit webpagina's, 30 dagen lang.

Zelfs tegen spittarief (¥12/M tokens uitvoer voor V4 Pro) zou diezelfde bot ~¥120/maand kosten — nog steeds onder $17. In de daluren is het ¥60/maand. En dat is V4 Pro. Als je voor dit soort batchwerk op V4 Flash overstapt, kijk je naar ¥2–4/M tokens uitvoer. De bot die ¥60 kostte op V4 Pro, zou op V4 Flash in de daluren ¥10–20 kosten. Dat is $1.40–2.80 voor een maand geautomatiseerde dataverwerking. OpenAI's GPT-4o rekent voor dezelfde workload $100–200+.

⚠️ Risico's en valkuilen

1. Servicevoorwaarden

Het doorverkopen van API-toegang kan in strijd zijn met de servicevoorwaarden van DeepSeek. Lees de kleine lettertjes voordat je er een bedrijf op bouwt. Minimaliseer in ieder geval de naam "DeepSeek-doorverkoop" — positioneer het als een dienst met meerwaarde die toevallig DeepSeek onder de motorkap gebruikt. Voeg je eigen UI, wachtrijbeheer, caching-laag of prompt-optimalisatie toe, zodat je een product verkoopt en geen kale API-toegang.

2. Latentie

Een proxy met wachtrij voegt vertraging toe. Als een westerse gebruiker een job indient om 9 uur Pacific (middernacht Beijing — dal), wordt deze meteen verwerkt. Maar indienen om 18 uur Pacific (9 uur Beijing — spits) betekent tot 3 uur wachten (tot de Beijing-lunchpauze) of 9 uur (tot 18 uur Beijing, dal in de avond). Maak dit glashelder aan je klanten. Realtime chat is hier NIET de use case — batchverwerking, asynchrone jobs en overnight-workloads wel.

3. Prijzen kunnen veranderen

DeepSeek heeft beloofd 24 uur vóór een prijswijziging een e-mail te sturen. Dat is redelijk, maar het betekent dat je marges 's nachts kunnen verschuiven. Bouw je bedrijf met genoeg marge om een verdubbeling van de prijs te overleven. Ook: de dal/spits-verhouding kan in de loop der tijd veranderen. Wat begint als 2× kan 3× of 1,5× worden naarmate DeepSeek het systeem afstelt. Bouw geen bedrijfsmodel dat alleen werkt bij precies 2×.

4. Accountvereisten

Momenteel vereist registratie voor het laagst geprijsde DeepSeek-API-account een Chinees telefoonnummer. Vanuit het buitenland heb je een Chinese contactpersoon of een virtueel-nummer-service nodig. Dat is het grootste frictiepunt voor westerse ontwikkelaars die Richting 1 willen draaien. Andersom: als je WEL in China zit of Chinese partners hebt, heb je een asymmetrisch informatievoordeel dat de meeste westerse ontwikkelaars missen — maak er gebruik van.

⏳ Conclusie

De tijdgebonden prijsstelling van DeepSeek is geen exotisch factureringsexperiment — het is een structurele verschuiving die echte arbitragemogelijkheden creëert. De economie is simpel: als je compute een halve dag 50% minder kost, en die halve dag samenvalt met de werkuren van je klanten, heb je een marge gevonden die de moeite waard is.

Doe dit nu:

  1. Registreer een DeepSeek-account vóór de officiële V4-release — zet je toegang vast terwijl het nog makkelijk is. Na juli kunnen het registratiebeleid aanscherpen naarmate de awareness groeit.
  2. Bouw een weekend-batch-pijplijn — ook zonder enige arbitrage of doorverkoop bespaar je meteen 50% door je eigen zware workloads naar het weekend te verplaatsen.
  3. Houd het regionale spitsbeleid in de gaten — als DeepSeek regiospecifieke spitschema's lanceert, gaat Richting 2 open en wordt de arbitrage volledig tweerichtingen.

Dit venster is beperkt. Andere AI-aanbieders volgen DeepSeeks experiment op de voet. Als tijdgebonden prijsstelling een succes blijkt (en dat zal waarschijnlijk zo zijn — het is gewoon vraag- en aanbodeconomie toegepast op GPU-clusters), verwacht dan dat OpenAI en Anthropic binnen 12–18 maanden volgen. Dan versmallen de arbitragemarges omdat iedereen hetzelfde spel speelt. De eerste bewegers — de mensen die nú hun proxy-infrastructuur opzetten, terwijl het nog nieuw is — zullen de vetste marges pakken.

De tijdzone is jouw voorsprong. Gebruik hem voordat iedereen het doorheeft.