Kort version: DeepSeek meddelade att V4-API:et får tidviss dynamisk prissättning — under vardagar i högtrafik (Pekings tid 9:00–12:00, 14:00–18:00) dubbleras priserna direkt, och under lågtrafik behålls dagens nivåer. Den officiella V4-lanseringen är planerad till mitten av juli 2026. Även räknat med det dubblade högtrafikpriset är DeepSeek fortfarande världens billigaste frontlinje-AI-API — och med god marginal.
⚡ Vad som hände
Den 29 juni skickade DeepSeek ett mejl till sina användare med rubriken «DeepSeek V4 officiella releaseplan och faktureringsjustering». Den största nyheten: tidviss dynamisk prissättning — en braksak bland de stora AI-API-leverantörerna.
Under vardagar i högtrafik (Pekings tid 9:00–12:00 och 14:00–18:00) dubbleras alla V4-API-priser. Övriga tider ligger kvar oförändrade på de redan absurt låga nivåerna.
Tänk dig Ubers pristillägg i högtrafik, men med AI-token som enhet. När alla kodar samtidigt får du betala ett påslag. Kör du batchjobben klockan tre på natten? Då får du rabatten.
📊 Pristabellerna
DeepSeek V4 Pro
| Faktureringspost | Lågtrafik (¥/M token) | Högtrafik (¥/M token) |
|---|---|---|
| Indata (cache-träff) | ¥0.025 | ¥0.05 |
| Indata (cache-miss) | ¥3.00 | ¥6.00 |
| Utdata | ¥6.00 | ¥12.00 |
DeepSeek V4 Flash
| Faktureringspost | Lågtrafik (¥/M token) | Högtrafik (¥/M token) |
|---|---|---|
| Indata (cache-träff) | ¥0.02 | ¥0.04 |
| Indata (cache-miss) | ¥1.00 | ¥2.00 |
| Utdata | ¥2.00 | ¥4.00 |
📋 Den verkliga kostnaden
Enhetspriser säger inte så mycket — titta på en verklig nota i stället. 青小蛙 på Appinn delade sina verkliga siffror: han körde DeepSeek V4 Flash för att automatiskt uppdatera en VM-kalender — skrapade resultat, mål och matchdata — i en hel månad:
- Vanlig dag: ~¥2 (cirka $0.28)
- Tung dag (buggfixar, omkörningar): ¥13 (cirka $1.82)
- Totalt för månaden: ¥60 (cirka $8.40)
Du läste rätt — en automatiserad pipeline som kördes dagligen i en månad kostade mindre än en lunch i San Francisco.
🏆 Så står sig DeepSeek mot konkurrenterna
Här är utdatapriset för de ledande modellerna (USD per miljon token):
| Modell | Utdata $/M | Kontextfönster |
|---|---|---|
| DeepSeek V4 Flash (lågtrafik / högtrafik) | $0.28 / $0.56 | 1,000,000 |
| DeepSeek V4 Pro (lågtrafik / högtrafik) | $0.87 / $1.74 | 1,000,000 |
| Xiaomi MiMo V2.5 | $0.28 | 1,000,000 |
| Xiaomi MiMo V2.5 Pro | $0.87 | 1,000,000 |
| MiniMax M3 | $1.20 | 1,000,000 |
| GLM-5.1 (Zhipu) | $4.40 | 200,000 |
| Kimi K2.6 | ¥27 ≈ $3.78 | 262,000 |
| Qwen3.7 Plus | ¥8 ≈ $1.12 | 1,000,000 |
| GPT-5.5 (OpenAI) | $30.00 | 1,100,000 |
| Claude Opus 4.8 (Anthropic) | $25.00 | 1,000,000 |
I klassen «absurt billigt med 1M kontext» är den närmaste konkurrenten Xiaomi MiMo V2.5, som matchar DeepSeek V4 Flash på $0.28/M i utdata — men utan högtrafikprissättning. Om du är kostnadsmedveten och inte vill tänka på tid på dygnet kan MiMo vara det säkrare kortet.
🤔 Varför gör DeepSeek så?
Anledningen är enkel: kapacitetshantering. DeepSeks servrar blir brutalt belastade under kinesisk arbetstid. Istället för att vända bort användare (eller låta kvaliteten försämras av överbelastning) använder de prissignaler för att jämna ut efterfrågan.
Egentligen är det ganska smart infrastrukturekonomi. AWS, Google Cloud och alla stora molnleverantörer har gjort så här i åratal med spot-instanser och reserverad kapacitet. DeepSeek är bara den första AI-API-leverantören som tillämpar samma logik på inferens av språkmodeller.
Räkna med att fler följer efter. Om DeepSeek visar att modellen fungerar kommer Kimi och Qwen nästan garanterat att lansera egna hög-/lågtrafikskikt.
🎯 Vad du bör göra
- Om du är priskänslig: Lägg tunga arbetsbelastningar (batchbearbetning, generering av träningsdata, bulkanalys) utanför kinesisk arbetstid (9:00–12:00, 14:00–18:00). Din plånbok kommer att tacka dig.
- Om du behöver tillgänglighet dygnet runt: Budgetera för högtrafikpris, eller sätt upp en reservkedja — dirigera högtrafikflödet till MiMo V2.5 eller Qwen3.7 Plus, och byt tillbaka till DeepSeek under lågtrafik.
- Om du kör på gratisnivå eller låg budget: V4 Flash till lågtrafikpris är i princip gratis. Indata (cache-miss) på ¥1/M innebär att du kan bearbeta 1 miljon token indata och 1 miljon token utdata för ungefär ¥3 (41 cent). En hel roman in, analyserad och ut — till den priset.
⏳ Slutsats
Till dubbla priset är DeepSeek V4 fortfarande världens billigaste frontlinje-AI-API. Högtrafikprissättningen är en funktion, inte en bugg — den signalerar att efterfrågan på DeepSeek är tillräckligt stor för att kapacitetshantering ska krävas, och det står tydligt i priset.
Om du bygger på kinesiska AI-API:er (och det borde du — prismellanrummet mot amerikanska leverantörer är absurt) förblir DeepSeek V4 Flash standardvalet för allt som inte kräver multimodal indata. Lägg bara de tunga jobben till efter middagen.
Källor: mejl till DeepSeek-användare (29 juni 2026), Appinn-rapport, DevTk.AI prislista. Priser kontrollerade 3 juli 2026.