Kort versjon: DeepSeek kunngjorde at V4 API vil få dynamisk pris etter tidspunkt — på hverdager i rushen (kinesisk tid 9:00–12:00 og 14:00–18:00) dobles prisen, mens den holdes uendret i lavbelastningsperiodene. Offisiell V4 lanseres i midten av juli 2026. Selv med dobbel rushpris er DeepSeek fortsatt det desidert billigste frontier-AI-API-et på markedet.
⚡ Hva skjedde
29. juni sendte DeepSeek en e-post til brukerne sine med tittelen «DeepSeek V4 Offisiell lanseringsplan og faktureringsendring». Den store nyheten: prissetting etter tidspunkt — en helt ny terskel blant de store AI-API-leverandørene.
I rushen på hverdager (kinesisk tid 9:00–12:00 og 14:00–18:00) dobles alle V4-API-priser. Resten av tiden ligger prisene uendret, på det nivået som allerede er latterlig lavt.
Tenk på det som Uber sin rush-prising, bare for AI-tokens. Når alle koder samtidig, betaler du et påslag. Kjører du batch-jobbene klokken tre om natten? Da får du rabatt.
📊 Pristabellene
DeepSeek V4 Pro
| Fakturapost | Lavbelastning (¥/M tokens) | Rush (¥/M tokens) |
|---|---|---|
| Inndata (cache-treff) | ¥0.025 | ¥0.05 |
| Inndata (cache-bom) | ¥3.00 | ¥6.00 |
| Utdata | ¥6.00 | ¥12.00 |
DeepSeek V4 Flash
| Fakturapost | Lavbelastning (¥/M tokens) | Rush (¥/M tokens) |
|---|---|---|
| Inndata (cache-treff) | ¥0.02 | ¥0.04 |
| Inndata (cache-bom) | ¥1.00 | ¥2.00 |
| Utdata | ¥2.00 | ¥4.00 |
📋 Hva koster det i praksis?
En utvikler (青小蛙 hos Appinn) delte sine faktiske forbrukstall: kjørte DeepSeek V4 Flash for å oppdatere en VM-kalender automatisk — hente resultater, mål og kampdata — i en hel måned:
- Vanlig dag: ca. ¥2 (omtrent $0.28)
- Tung dag (feilretting, rekjøring): ¥13 (omtrent $1.82)
- Totalt for måneden: ¥60 (omtrent $8.40)
Akkurat — en automatisert pipeline som går hver dag i en måned, kostet mindre enn en lunsj i San Francisco.
🏆 Hvordan DeepSeek skiller seg ut
Her er utdata-prising for de ledende modellene i USD per million tokens:
| Modell | Utdata $/M | Kontekstvindu |
|---|---|---|
| DeepSeek V4 Flash (lavbelastning / rush) | $0.28 / $0.56 | 1,000,000 |
| DeepSeek V4 Pro (lavbelastning / rush) | $0.87 / $1.74 | 1,000,000 |
| Xiaomi MiMo V2.5 | $0.28 | 1,000,000 |
| Xiaomi MiMo V2.5 Pro | $0.87 | 1,000,000 |
| MiniMax M3 | $1.20 | 1,000,000 |
| GLM-5.1 (Zhipu) | $4.40 | 200,000 |
| Kimi K2.6 | ¥27 ≈ $3.78 | 262,000 |
| Qwen3.7 Plus | ¥8 ≈ $1.12 | 1,000,000 |
| GPT-5.5 (OpenAI) | $30.00 | 1,100,000 |
| Claude Opus 4.8 (Anthropic) | $25.00 | 1,000,000 |
Nærmeste konkurrent i klassen «ekstremt billig med 1M kontekst» er Xiaomi MiMo V2.5, som matcher DeepSeek V4 Flash på $0.28/M i utdata — men uten rush-påslag. Er du kostnadsfølsom og vil slippe å tenke på tidspunkt, kan MiMo være det tryggeste valget.
🤔 Hvorfor gjør DeepSeek dette?
Svaret er enkelt: kapasitetsstyring. DeepSeek sine servere blir bombet under kinesisk arbeidstid. I stedet for å avvise brukere (eller la kvaliteten synke under overbelastning), bruker de prissignaler for å jevne ut etterspørselen.
Dette er faktisk ganske smart infrastrukturøkonomi. AWS, Google Cloud og alle andre store skyleverandører har gjort dette i årevis med spot-instanser og reservert kapasitet. DeepSeek er bare den første AI-API-leverandøren som tar den samme logikken over i språkmodell-inferens.
Forvent at andre følger etter. Hvis DeepSeek viser at modellen fungerer, vil Kimi og Qwen nesten garantert lansere egne rush-/lavbelastnings-nivåer.
🎯 Hva bør du gjøre?
- Er du prisfølsom: Legg tunge arbeidsbelastninger (batch-prosessering, generering av treningsdata, masseanalyse) utenfor kinesisk arbeidstid (9:00–12:00, 14:00–18:00). Lommeboka din vil takke deg.
- Trenger du oppetid døgnet rundt: Budsjetter etter rush-pris, eller sett opp en fallback-kjede — rute rush-trafikk til MiMo V2.5 eller Qwen3.7 Plus, og bytt tilbake til DeepSeek i lavbelastningsperiodene.
- På gratisnivå eller lavt budsjett: V4 Flash til lavbelastningspris er i praksis gratis. ¥1/M inndata (cache-bom) betyr at du kan behandle 1 million tokens inndata og 1 million tokens utdata for omtrent ¥3 (41 cent). En hel langroman inn, analysert, og ut igjen — for så lite.
⏳ Konklusjon
DeepSeek V4 til dobbel pris er fortsatt det billigste frontier-AI-API-et i verden. Rush-prising er en funksjon, ikke en feil — det signaliserer at DeepSeek har nok etterspørsel til å trenge kapasitetsstyring, og prisene er åpne om det.
Bygger du på kinesiske AI-API-er (og det bør du — prisforskjellen mot amerikanske leverandører er absurd), er DeepSeek V4 Flash fortsatt standardvalget for alt som ikke krever multimodal inndata. Bare kjør de tunge jobbene etter middag.
Kilder: DeepSeek e-post til brukere (29. juni 2026), Appinn-artikkelen, DevTk.AI pris-katalog. Priser sjekket 3. juli 2026.