⚡ Hva skjedde
I slutten av juni 2026 slapp DeepSeek en bombe: tidsbasert prising for AI-API-er. Dette er uten fortilfelle — ingen stor AI-leverandør (OpenAI, Anthropic, Google, Meta) har gjort dette før. Strømselskaper gjør det. Samkjøring apper gjør det. Men AI-API-er? DeepSeek er den første, og det endrer økonomien i å bruke store språkmodeller i stor skala.
Her er den enkle versjonen: i kinesisk arbeidstid (rush), dobler prisen seg. På kvelder og helger (lavbelastning), holdes de lave prisene uendret. Prisingen trer i kraft med offisiell V4-lansering i midten av juli 2026, og brukerne får e-postvarsel 24 timer før omstillingen.
📊 Tallene: rush mot lavbelastning
Rushtiden er hverdager 9:00–12:00 og 14:00–18:00 kinesisk tid (UTC+8). Alt annet — inkludert helger, lunsjpauser og hele natten — er lavbelastning til halv pris.
| Prisnivå | V4 Pro (lavbelastning) | V4 Pro (rush) | V4 Flash (lavbelastning) | V4 Flash (rush) |
|---|---|---|---|---|
| Cache-treff | ¥0.025 / M tokens | ¥0.05 / M tokens | ¥0.02 / M tokens | ¥0.04 / M tokens |
| Cache-bom | ¥3 / M tokens | ¥6 / M tokens | ¥1 / M tokens | ¥2 / M tokens |
| Utdata | ¥6 / M tokens | ¥12 / M tokens | ¥2 / M tokens | ¥4 / M tokens |
🕐 Hva Beijings rushtid betyr i din tidssone
| Beijing rush (man–fre) | US Vest (PDT) | US Øst (EDT) | London (BST) | Tokyo (JST) |
|---|---|---|---|---|
| 9:00 – 12:00 | 18:00 – 21:00 (foregående dag) | 21:00 – 00:00 (foregående dag) | 02:00 – 05:00 | 10:00 – 13:00 |
| 14:00 – 18:00 | 23:00 – 03:00 | 02:00 – 06:00 | 07:00 – 11:00 | 15:00 – 19:00 |
Beijings rushtid (rødt over) er kveld og natt i USA. Det betyr at når amerikanere jobber på dagen, sover Kina — og DeepSeek ligger på lavbelastningspris. Det motsatte gjelder også: når Kina jobber, sover USA. Det skaper en perfekt toveis arbitrage-sløyfe.
🌍 Toveis arbitrage-spillebok
Siden DeepSeek sin rush-/lavbelastnings-plan er knyttet til Beijing-tid, skaper den samme klokka motsatte realiteter avhengig av hvor du og kundene dine befinner seg. Her er de to retningene, og nøyaktig hvordan du kjører hver av dem.
Oppsettet:
1. Registrer en DeepSeek-konto med et kinesisk telefonnummer (få det laveste basisprisnivået)
2. Dine lavbelastningstimer (Beijing-natt: 18:00–09:00, pluss hele helgen) faller sammen med US/EU-dag — akkurat når vestlige utviklere er mest aktive
3. Kjør en enkel API-proxy som tar imot forespørsler fra vestlige brukere og videresender dem til DeepSeek i lavbelastningsperiodene
Regnestykket:
• V4 Flash lavbelastning-utdata: ¥2/M tokens (≈ $0.27/M)
• OpenAI GPT-4o utdata: $10/M tokens
• Prisforskjell: 37 ganger billigere. Du kan videreselge til $2–5/M og fortsatt være 2–5 ganger billigere enn OpenAI, samtidig som du tar 7–18 ganger margin.
Best for: Batch-prosessering, innholdsproduksjon, kodegjennomgang, oversettelse — alt som tåler noen minutters forsinkelse. Vestlige brukere sender jobber i sin arbeidsdag, proxyen din kø-dem, og de prosesseres til lavbelastningspriser i Beijing-natt.
Oppsettet:
1. Hvis DeepSeek tilbyr regions-spesifikk rushtid (f.eks. en i USA registrert konto følger amerikansk arbeidstid), registrer deg med et US/EU-telefonnummer
2. Din lavbelastning (US-natt) = Beijing-dag — akkurat når kinesiske utviklere jobber
3. Proxy forespørsler fra kinesiske brukere gjennom din USA-konto i dine lavbelastningstimer
⚠️ Viktig forbehold: Per juli 2026 har DeepSeek kunngjort Beijing-tid-basert rush/lavbelastning utelukkende for Kina-region-kontoer. Det er uklart om internasjonale kontoer får egne regionale rush-planer eller rett og slett følger Beijing-tid. Vi følger med og oppdaterer denne artikkelen så snart den offisielle lanseringen avklarer policyen. Hvis internasjonale kontoer også følger Beijing-tid, fungerer ikke Retning 2 — men Retning 1 gjør det fortsatt, og det er uansett det sterkere trekket.
Best for: Hvis regional rushtid bekreftes: å tjene kinesiske utviklere som treffer sine DeepSeek-rategrenser i rushen og trenger overløpskapasitet. Din USA-konto gir lavbelastningspris i deres travleste tid.
🔧 Slik bygger du proxyen (teknisk dykk)
Du trenger ikke noe avansert. En enkel kø-basert proxy på en billig VPS (eller til og med en Raspberry Pi hjemme) ordner dette. Arkitekturen er grei:
1. Inntakslag — et OpenAI-kompatibelt endepunkt som tar imot forespørsler fra vestlige kunder døgnet rundt
2. Kø — Jobber går i en Redis-kø (eller til og med SQLite for lavt volum). Merk hver jobb med prioritet og frist.
3. Planlegger — en cron-lignende prosess som sjekker: «Er det Beijing lavbelastning nå?» Hvis ja, tøm køen og videresend til DeepSeek API. Hvis nei, vent.
4. Svarlag — Resultater kommer tilbake, lagres og serveres til kundene (polling-basert eller webhook-tilbakekalling)
Nøkkeloptimalisering: Bruk DeepSeek sin kontekst-caching aggressivt. Cache-treff-tokens koster ¥0.02–0.025/M (lavbelastning) — nesten gratis. Strukturer promptene dine for å maksimere cache-gjenbruk (systemprompter, lange dokumenter, kodebaser).
⏰ Planlegger-logikken (pseudokode)
# 判断当前是否为北京低峰时段
import datetime
def is_beijing_offpeak():
now = datetime.datetime.now(datetime.timezone(datetime.timedelta(hours=8)))
weekday = now.weekday() # 0=Mon, 6=Sun
hour = now.hour
# 周末全天低峰
if weekday >= 5:
return True
# 工作日:9-12 和 14-18 是高峰,其余低峰
if 9 <= hour < 12:
return False
if 14 <= hour < 18:
return False
return True
# 主循环:只在低峰时处理队列
while True:
if is_beijing_offpeak():
job = queue.pop()
if job:
result = deepseek_api.chat(job.prompt, model="deepseek-v4-flash")
store_result(job.id, result)
else:
time.sleep(60) # 高峰时休眠,等低峰
💰 Helge-gullgruven
Her er det de fleste går glipp av: alle 48 timene av helgen er lavbelastning. Det er to fulle dager hver uke der du får halvpris-tokens uansett tidssone. Legger du de tunge arbeidsbelastningene dine til fredag kveld til søndag, betaler du i praksis aldri rush-pris. For en SaaS som prosesserer store mengder tekst — sammendrag, oversettelse, innholdsmoderasjon, datauttrekk — kan dette alene kutte API-regningen din med 30–40 % uten noen tidssone-triks.
1. Samle alle ikke-akutte jobber i løpet av uken (man–fre)
2. Fredag 18:00 Beijing-tid: start batch-workerne
3. Prosesser kontinuerlig i 48 timer til lavbelastningspris
4. Mandag morgen: alle resultater levert, regningen er 50 % av det den ellers ville vært
For selskaper som prosesserer millioner av tokens daglig, er ikke dette lommepenger — det er forskjellen på å tjene penger og å blø.
📋 Virkeligt eksempel: VM-kalender-boten
En kinesisk utvikler (青小蛙) bygde en automatisert bot som skraper VM-kampprogrammer og genererer kalenderhendelser med DeepSeek V4. Å kjøre den i en hel måned i den nåværende tiden før rush-prising kostet totalt ¥60 (ca. $8.20). Det er generering av strukturerte data fra nettsider daglig, i 30 dager på rad.
Selv til rush-pris (¥12/M tokens utdata for V4 Pro) ville den samme boten kostet ~¥120/måned — fortsatt under $17. I lavbelastning er det ¥60/måned. Og det er V4 Pro. Bytter du til V4 Flash for denne typen batch-arbeid, ser du på ¥2–4/M tokens utdata. Boten som kostet ¥60 på V4 Pro ville kostet ¥10–20 på V4 Flash lavbelastning. Det er $1.40–2.80 for en måneds automatisert databehandling. OpenAI sin GPT-4o ville tatt $100–200+ for den samme arbeidsmengden.
⚠️ Risikoer og fallgruver
1. Vilkår for bruk
Videresalg av API-tilgang kan bryte DeepSeek sine vilkår. Les det som står i liten skrift før du bygger en bedrift på dette. Som et minimum: ikke kall det "DeepSeek-videresalg" — posisjoner det som en verdiøkende tjeneste som tilfeldigvis bruker DeepSeek under panseret. Legg ditt eget UI, kø-håndtering, cache-lag eller prompt-optimalisering på toppen, slik at du selger et produkt, ikke rå API-tilgang.
2. Ventetid
En kø-basert proxy legger til forsinkelse. Sender en vestlig bruker en jobb kl. 9 om morgenen Pacific (midnatt Beijing — lavbelastning), prosesseres den umiddelbart. Men sender de kl. 18 Pacific (9 om morgenen Beijing — rush), venter de opptil 3 timer (til Beijings lunsjpause) eller 9 timer (til kl. 18 Beijing kveld lavbelastning). Gjør dette krystallklart for kundene. Sanntants-chat er IKKE use-casen her — batch-prosessering, asynkrone jobber og overnatt-arbeidsbelastninger er det.
3. Prisene kan endre seg
DeepSeek har forpliktet seg til 24 timers e-postvarsel før prisendringer. Det er rettferdig, men det betyr at marginene dine kan skifte over natten. Bygg bedriften din med nok buffer til at en 2-dobling av prisen ikke tar deg. I tillegg: forholdet mellom rush og lavbelastning kan endre seg over tid. Det som starter som 2× kan bli 3× eller 1,5× etter hvert som DeepSeek finner innstillingene. Ikke bygg en forretningsmodell som bare fungerer ved nøyaktig 2×.
4. Kontokrav
I dag krever registrering av en DeepSeek API-konto et kinesisk telefonnummer for det laveste prisnivået. Er du utenfor Kina, trenger du en kinesisk kontakt eller en tjeneste for virtuelle numre. Dette er det største friksjonspunktet for vestlige utviklere som vil kjøre Retning 1. På den andre siden: er du i Kina eller har kinesiske partnere, har du en informasjonsasymmetri-fordel som de fleste vestlige utviklere mangler — bruk den.
⏳ Konklusjon
DeepSeek sin tidsbaserte prising er ikke bare et rart faktureringseksperiment — det er et strukturelt skifte som skaper reelle arbitrage-muligheter. Økonomien er enkel: når regnekraften din koster 50 % mindre i halve dagen, og den halvdelen faller sammen med kundenes arbeidstid, har du funnet et spenn som er verdt å utnytte.
Tre ting du bør gjøre allerede nå:
- Registrer en DeepSeek-konto før den offisielle V4-lanseringen — sikre deg tilgang mens det fortsatt er enkelt. Etter juli kan registreringspolicyen stramme seg til etter hvert som bevisstheten sprer seg.
- Bygg en helge-batch-pipeline — selv uten noen form for arbitrage eller videresalg sparer du umiddelbart 50 % ved å flytte dine egne tunge belastninger til helgene.
- Følg med på policy for regional rushtid — hvis DeepSeek lanserer regions-spesifikke rush-planer, åpner Retning 2 seg opp og arbitragen blir fullt ut toveis.
Vinduet for dette er begrenset. Andre AI-leverandører følger nøye med på DeepSeek sitt eksperiment. Viser tidsbasert prising seg å fungere (og det vil det sannsynligvis — det er enkel tilbud/etterspørsel-økonomi brukt på GPU-klynger), kan du forvente at OpenAI og Anthropic følger etter innen 12–18 måneder. Når det skjer, smalner arbitrage-spennet fordi alle spiller det samme spillet. De som flytter først — folk som setter opp proxy-infrastrukturen SIN nå, mens det fortsatt er nytt — vil fange de feteste marginene.
Tidssonen er fortrinnet ditt. Bruk det før alle andre skjønner det.