Kort version: DeepSeek meddelade att V4-API:et får tidviss dynamisk prissättning — under vardagar i högtrafik (Pekings tid 9:00–12:00, 14:00–18:00) dubbleras priserna direkt, och under lågtrafik behålls dagens nivåer. Den officiella V4-lanseringen är planerad till mitten av juli 2026. Även räknat med det dubblade högtrafikpriset är DeepSeek fortfarande världens billigaste frontlinje-AI-API — och med god marginal.

⚡ Vad som hände

Den 29 juni skickade DeepSeek ett mejl till sina användare med rubriken «DeepSeek V4 officiella releaseplan och faktureringsjustering». Den största nyheten: tidviss dynamisk prissättning — en braksak bland de stora AI-API-leverantörerna.

Under vardagar i högtrafik (Pekings tid 9:00–12:00 och 14:00–18:00) dubbleras alla V4-API-priser. Övriga tider ligger kvar oförändrade på de redan absurt låga nivåerna.

Tänk dig Ubers pristillägg i högtrafik, men med AI-token som enhet. När alla kodar samtidigt får du betala ett påslag. Kör du batchjobben klockan tre på natten? Då får du rabatten.

📊 Pristabellerna

DeepSeek V4 Pro

FaktureringspostLågtrafik (¥/M token)Högtrafik (¥/M token)
Indata (cache-träff)¥0.025¥0.05
Indata (cache-miss)¥3.00¥6.00
Utdata¥6.00¥12.00

DeepSeek V4 Flash

FaktureringspostLågtrafik (¥/M token)Högtrafik (¥/M token)
Indata (cache-träff)¥0.02¥0.04
Indata (cache-miss)¥1.00¥2.00
Utdata¥2.00¥4.00
⚡ Notis: Även till högtrafikpris kostar DeepSeek V4 Flash-utdata bara ¥4/M token, vilket är ungefär $0.56/M token. Jämför med GPT-5.5 på $30/M eller Claude Opus 4.8 på $25/M. DeepSeek när den är som dyrast är alltså fortfarande 45–50 gånger billigare än OpenAI:s flaggskeppsmodell.

📋 Den verkliga kostnaden

Enhetspriser säger inte så mycket — titta på en verklig nota i stället. 青小蛙 på Appinn delade sina verkliga siffror: han körde DeepSeek V4 Flash för att automatiskt uppdatera en VM-kalender — skrapade resultat, mål och matchdata — i en hel månad:

  • Vanlig dag: ~¥2 (cirka $0.28)
  • Tung dag (buggfixar, omkörningar): ¥13 (cirka $1.82)
  • Totalt för månaden: ¥60 (cirka $8.40)

Du läste rätt — en automatiserad pipeline som kördes dagligen i en månad kostade mindre än en lunch i San Francisco.

🏆 Så står sig DeepSeek mot konkurrenterna

Här är utdatapriset för de ledande modellerna (USD per miljon token):

ModellUtdata $/MKontextfönster
DeepSeek V4 Flash (lågtrafik / högtrafik)$0.28 / $0.561,000,000
DeepSeek V4 Pro (lågtrafik / högtrafik)$0.87 / $1.741,000,000
Xiaomi MiMo V2.5$0.281,000,000
Xiaomi MiMo V2.5 Pro$0.871,000,000
MiniMax M3$1.201,000,000
GLM-5.1 (Zhipu)$4.40200,000
Kimi K2.6¥27 ≈ $3.78262,000
Qwen3.7 Plus¥8 ≈ $1.121,000,000
GPT-5.5 (OpenAI)$30.001,100,000
Claude Opus 4.8 (Anthropic)$25.001,000,000

I klassen «absurt billigt med 1M kontext» är den närmaste konkurrenten Xiaomi MiMo V2.5, som matchar DeepSeek V4 Flash på $0.28/M i utdata — men utan högtrafikprissättning. Om du är kostnadsmedveten och inte vill tänka på tid på dygnet kan MiMo vara det säkrare kortet.

🤔 Varför gör DeepSeek så?

Anledningen är enkel: kapacitetshantering. DeepSeks servrar blir brutalt belastade under kinesisk arbetstid. Istället för att vända bort användare (eller låta kvaliteten försämras av överbelastning) använder de prissignaler för att jämna ut efterfrågan.

Egentligen är det ganska smart infrastrukturekonomi. AWS, Google Cloud och alla stora molnleverantörer har gjort så här i åratal med spot-instanser och reserverad kapacitet. DeepSeek är bara den första AI-API-leverantören som tillämpar samma logik på inferens av språkmodeller.

Räkna med att fler följer efter. Om DeepSeek visar att modellen fungerar kommer Kimi och Qwen nästan garanterat att lansera egna hög-/lågtrafikskikt.

🎯 Vad du bör göra

  1. Om du är priskänslig: Lägg tunga arbetsbelastningar (batchbearbetning, generering av träningsdata, bulkanalys) utanför kinesisk arbetstid (9:00–12:00, 14:00–18:00). Din plånbok kommer att tacka dig.
  2. Om du behöver tillgänglighet dygnet runt: Budgetera för högtrafikpris, eller sätt upp en reservkedja — dirigera högtrafikflödet till MiMo V2.5 eller Qwen3.7 Plus, och byt tillbaka till DeepSeek under lågtrafik.
  3. Om du kör på gratisnivå eller låg budget: V4 Flash till lågtrafikpris är i princip gratis. Indata (cache-miss) på ¥1/M innebär att du kan bearbeta 1 miljon token indata och 1 miljon token utdata för ungefär ¥3 (41 cent). En hel roman in, analyserad och ut — till den priset.
🔮 Prognos: DeepSeks V4 och högtrafikpriset är kanariefågeln i gruvan. Till Q4 2026 kommer åtminstone två kinesiska AI-leverantörer till att införa tidviss prissättning. Eran med «fast pris och obegränsad AI» håller på att ta slut — och det är faktiskt bra. Det betyder att AI håller på att bli riktig infrastruktur, inte en förlustbringande demo.

⏳ Slutsats

Till dubbla priset är DeepSeek V4 fortfarande världens billigaste frontlinje-AI-API. Högtrafikprissättningen är en funktion, inte en bugg — den signalerar att efterfrågan på DeepSeek är tillräckligt stor för att kapacitetshantering ska krävas, och det står tydligt i priset.

Om du bygger på kinesiska AI-API:er (och det borde du — prismellanrummet mot amerikanska leverantörer är absurt) förblir DeepSeek V4 Flash standardvalet för allt som inte kräver multimodal indata. Lägg bara de tunga jobben till efter middagen.


Källor: mejl till DeepSeek-användare (29 juni 2026), Appinn-rapport, DevTk.AI prislista. Priser kontrollerade 3 juli 2026.