Kort versjon: DeepSeek kunngjorde at V4 API vil få dynamisk pris etter tidspunkt — på hverdager i rushen (kinesisk tid 9:00–12:00 og 14:00–18:00) dobles prisen, mens den holdes uendret i lavbelastningsperiodene. Offisiell V4 lanseres i midten av juli 2026. Selv med dobbel rushpris er DeepSeek fortsatt det desidert billigste frontier-AI-API-et på markedet.

⚡ Hva skjedde

29. juni sendte DeepSeek en e-post til brukerne sine med tittelen «DeepSeek V4 Offisiell lanseringsplan og faktureringsendring». Den store nyheten: prissetting etter tidspunkt — en helt ny terskel blant de store AI-API-leverandørene.

I rushen på hverdager (kinesisk tid 9:00–12:00 og 14:00–18:00) dobles alle V4-API-priser. Resten av tiden ligger prisene uendret, på det nivået som allerede er latterlig lavt.

Tenk på det som Uber sin rush-prising, bare for AI-tokens. Når alle koder samtidig, betaler du et påslag. Kjører du batch-jobbene klokken tre om natten? Da får du rabatt.

📊 Pristabellene

DeepSeek V4 Pro

FakturapostLavbelastning (¥/M tokens)Rush (¥/M tokens)
Inndata (cache-treff)¥0.025¥0.05
Inndata (cache-bom)¥3.00¥6.00
Utdata¥6.00¥12.00

DeepSeek V4 Flash

FakturapostLavbelastning (¥/M tokens)Rush (¥/M tokens)
Inndata (cache-treff)¥0.02¥0.04
Inndata (cache-bom)¥1.00¥2.00
Utdata¥2.00¥4.00
⚡ Merk: Selv i rushen koster utdata fra DeepSeek V4 Flash bare ¥4/M tokens — omtrent $0.56 per million tokens. Sammenlign med GPT-5.5 til $30/M eller Claude Opus 4.8 til $25/M. DeepSeek på sitt dyreste er altså 45–50 ganger billigere enn OpenAI sin flaggskipmodell.

📋 Hva koster det i praksis?

En utvikler (青小蛙 hos Appinn) delte sine faktiske forbrukstall: kjørte DeepSeek V4 Flash for å oppdatere en VM-kalender automatisk — hente resultater, mål og kampdata — i en hel måned:

  • Vanlig dag: ca. ¥2 (omtrent $0.28)
  • Tung dag (feilretting, rekjøring): ¥13 (omtrent $1.82)
  • Totalt for måneden: ¥60 (omtrent $8.40)

Akkurat — en automatisert pipeline som går hver dag i en måned, kostet mindre enn en lunsj i San Francisco.

🏆 Hvordan DeepSeek skiller seg ut

Her er utdata-prising for de ledende modellene i USD per million tokens:

ModellUtdata $/MKontekstvindu
DeepSeek V4 Flash (lavbelastning / rush)$0.28 / $0.561,000,000
DeepSeek V4 Pro (lavbelastning / rush)$0.87 / $1.741,000,000
Xiaomi MiMo V2.5$0.281,000,000
Xiaomi MiMo V2.5 Pro$0.871,000,000
MiniMax M3$1.201,000,000
GLM-5.1 (Zhipu)$4.40200,000
Kimi K2.6¥27 ≈ $3.78262,000
Qwen3.7 Plus¥8 ≈ $1.121,000,000
GPT-5.5 (OpenAI)$30.001,100,000
Claude Opus 4.8 (Anthropic)$25.001,000,000

Nærmeste konkurrent i klassen «ekstremt billig med 1M kontekst» er Xiaomi MiMo V2.5, som matcher DeepSeek V4 Flash på $0.28/M i utdata — men uten rush-påslag. Er du kostnadsfølsom og vil slippe å tenke på tidspunkt, kan MiMo være det tryggeste valget.

🤔 Hvorfor gjør DeepSeek dette?

Svaret er enkelt: kapasitetsstyring. DeepSeek sine servere blir bombet under kinesisk arbeidstid. I stedet for å avvise brukere (eller la kvaliteten synke under overbelastning), bruker de prissignaler for å jevne ut etterspørselen.

Dette er faktisk ganske smart infrastrukturøkonomi. AWS, Google Cloud og alle andre store skyleverandører har gjort dette i årevis med spot-instanser og reservert kapasitet. DeepSeek er bare den første AI-API-leverandøren som tar den samme logikken over i språkmodell-inferens.

Forvent at andre følger etter. Hvis DeepSeek viser at modellen fungerer, vil Kimi og Qwen nesten garantert lansere egne rush-/lavbelastnings-nivåer.

🎯 Hva bør du gjøre?

  1. Er du prisfølsom: Legg tunge arbeidsbelastninger (batch-prosessering, generering av treningsdata, masseanalyse) utenfor kinesisk arbeidstid (9:00–12:00, 14:00–18:00). Lommeboka din vil takke deg.
  2. Trenger du oppetid døgnet rundt: Budsjetter etter rush-pris, eller sett opp en fallback-kjede — rute rush-trafikk til MiMo V2.5 eller Qwen3.7 Plus, og bytt tilbake til DeepSeek i lavbelastningsperiodene.
  3. På gratisnivå eller lavt budsjett: V4 Flash til lavbelastningspris er i praksis gratis. ¥1/M inndata (cache-bom) betyr at du kan behandle 1 million tokens inndata og 1 million tokens utdata for omtrent ¥3 (41 cent). En hel langroman inn, analysert, og ut igjen — for så lite.
🔮 Spådom: DeepSeek V4 sin rush-prising er varsleren. Innen Q4 2026 vil minst to kinesiske AI-leverandører til ha innført tidsbasert prising. Æraen med «flatpris uendelig AI» er i ferd med å ta slutt — og det er faktisk bra for økosystemet. Det betyr at AI blir ekte infrastruktur, ikke en tapsskalaende demo.

⏳ Konklusjon

DeepSeek V4 til dobbel pris er fortsatt det billigste frontier-AI-API-et i verden. Rush-prising er en funksjon, ikke en feil — det signaliserer at DeepSeek har nok etterspørsel til å trenge kapasitetsstyring, og prisene er åpne om det.

Bygger du på kinesiske AI-API-er (og det bør du — prisforskjellen mot amerikanske leverandører er absurd), er DeepSeek V4 Flash fortsatt standardvalget for alt som ikke krever multimodal inndata. Bare kjør de tunge jobbene etter middag.


Kilder: DeepSeek e-post til brukere (29. juni 2026), Appinn-artikkelen, DevTk.AI pris-katalog. Priser sjekket 3. juli 2026.