⚡ Vad som hände
I slutet av juni 2026 släppte DeepSeek en bomb: tidviss prissättning av AI-API:er. Det är utan motstycke — ingen stor AI-leverantör (OpenAI, Anthropic, Google, Meta) har någonsin gjort det förut. Elbolag gör det. Åk-appar gör det. Men AI-API:er? DeepSeek är först, och det förändrar ekonomin i att använda stora språkmodeller i skala.
Kort version: under kinesisk arbetstid (högtrafik) dubbleras priserna. Under nätter och helger (lågtrafik) ligger de kvar på dagens låga nivåer. Prissättningen träder i kraft i samband med den officiella V4-lanseringen i mitten av juli 2026, och användarna får ett mejl 24 timmar före omställningen.
📊 Siffrorna: högtrafik mot lågtrafik
Högtrafik är vardagar 9:00–12:00 och 14:00–18:00 Pekings tid (UTC+8). Allt annat — inklusive helger, lunchraster och natt — är lågtrafik till halva priset.
| Prispost | V4 Pro (lågtrafik) | V4 Pro (högtrafik) | V4 Flash (lågtrafik) | V4 Flash (högtrafik) |
|---|---|---|---|---|
| Cache-träff | ¥0.025 / M token | ¥0.05 / M token | ¥0.02 / M token | ¥0.04 / M token |
| Cache-miss | ¥3 / M token | ¥6 / M token | ¥1 / M token | ¥2 / M token |
| Utdata | ¥6 / M token | ¥12 / M token | ¥2 / M token | ¥4 / M token |
🕐 Vad Pekings högtrafik betyder i din tidszon
| Peking högtrafik (mån–fre) | USA väst (PDT) | USA öst (EDT) | London (BST) | Tokyo (JST) |
|---|---|---|---|---|
| 9:00 – 12:00 | 18:00 – 21:00 (föregående dag) | 21:00 – 00:00 (föregående dag) | 02:00 – 05:00 | 10:00 – 13:00 |
| 14:00 – 18:00 | 23:00 – 03:00 | 02:00 – 06:00 | 07:00 – 11:00 | 15:00 – 19:00 |
Pekings högtrafik (rött ovan) infaller på kväll och natt i USA. Det betyder att när amerikaner jobbar på sin dag sover Kina — och DeepSeek ligger på lågtrafikpris. Det omvända gäller också: när Kina jobbar sover USA. Det skapar en perfekt tvåvägsarbitrageslinga.
🌍 Playbook för tvåvägsarbitrage
Eftersom DeepSeks hög-/lågtrafikschema är knutet till Pekings tid skapar samma klocka motsatta verkligheter beroende på var du och dina kunder befinner er. Här är de två riktningarna, och exakt hur du kör var och en.
Upplägget:
1. Registrera ett DeepSeek-konto med ett kinesiskt telefonnummer (för att få den lägsta prisklassen)
2. Dina lågtrafiktider (Pekings natt: 18:00–09:00, plus hela helgen) motsvarar USA/EU:s dagtid — precis när västerländska utvecklare är mest aktiva
3. Kör en enkel API-proxy som tar emot förfrågningar från västerländska användare och vidarebefordrar dem till DeepSeek under lågtrafik
Uträkningen:
• V4 Flash lågtrafik-utdata: ¥2/M token (≈ $0.27/M)
• OpenAI GPT-4o utdata: $10/M token
• Prisskillnad: 37× billigare. Du kan sälja vidare till $2–5/M och ändå vara 2–5× billigare än OpenAI, samtidigt som du pocketar 7–18× marginal.
Bäst för: Batchbearbetning, innehållsgenerering, kodgranskning, översättning — allt som klarar några minuters fördröjning. Västerländska användare lämnar in jobb under sin arbetsdag, din proxy köar dem, och de bearbetas till lågtrafikpris under Pekings natt.
Upplägget:
1. Om DeepSeek erbjuder regionspecifik högtrafik (t.ex. ett USA-registrerat konto följer amerikansk arbetstid), registrera med ett USA-/EU-telefonnummer
2. Din lågtrafik (USA natt) = Pekings dagtid — precis när kinesiska utvecklare jobbar
3. Proxy:a förfrågningar från kinesiska användare genom ditt USA-konto under dina lågtrafiktider
⚠️ Viktig varning: Per juli 2026 har DeepSeek bara tillkännagett Pekings-tidsbaserad hög-/lågtrafik för kina-regionskonton. Det är oklart om internationella konton får egna regionala högtrafikschema eller bara följer Pekings tid. Vi bevakar läget och uppdaterar artikeln när den officiella lanseringen förtydligar policyn. Om internationella konton också följer Pekings tid fungerar inte Riktning 2 — men Riktning 1 gör det fortfarande, och det är i vilket fall som helst det starkare draget.
Bäst för: Om regional högtrafik bekräftas: att betjäna kinesiska utvecklare som slår i sina DeepSeek-hastighetsgränser under högtrafik och behöver spillkapacitet. Ditt USA-konto ger lågtrafikpris när de som har som mest att göra.
🔧 Hur du bygger proxyn (teknisk djupdykning)
Du behöver inget avancerat. En enkel köbaserad proxy på en billig VPS (eller till och med en Raspberry Pi hemma) räcker. Arkitekturen är enkel:
1. Indatalager — En OpenAI-kompatibel slutpunkt som tar emot förfrågningar från dina västerländska kunder dygnet runt
2. Kö — Jobb går in i en Redis-kö (eller till och med SQLite för låga volymer). Tagga varje jobb med prioritet och deadline.
3. Schemaläggare — En cron-liknande process som kontrollerar: «Är det Pekings lågtrafik just nu?» Om ja, töm kön och vidarebefordra till DeepSeek-API:et. Om nej, vänta.
4. Svarslager — Resultaten kommer tillbaka, lagras och serveras till kunderna (polling-baserat eller via webhook-återkoppling)
Nyckeloptimering: Använd DeepSeks kontextcaching aggressivt. Cache-träffade token kostar ¥0.02–0.025/M (lågtrafik) — nästan gratis. Strukturera dina promptar så att cache-återanvändningen maximeras (systempromptar, långa dokument, kodbaser).
⏰ Schemaläggarlogiken (pseudokod)
# 判断当前是否为北京低峰时段
import datetime
def is_beijing_offpeak():
now = datetime.datetime.now(datetime.timezone(datetime.timedelta(hours=8)))
weekday = now.weekday() # 0=Mon, 6=Sun
hour = now.hour
# 周末全天低峰
if weekday >= 5:
return True
# 工作日:9-12 和 14-18 是高峰,其余低峰
if 9 <= hour < 12:
return False
if 14 <= hour < 18:
return False
return True
# 主循环:只在低峰时处理队列
while True:
if is_beijing_offpeak():
job = queue.pop()
if job:
result = deepseek_api.chat(job.prompt, model="deepseek-v4-flash")
store_result(job.id, result)
else:
time.sleep(60) # 高峰时休眠,等低峰
💰 Helgguldgruvan
Här är det de flesta missar: alla 48 timmar av helgen är lågtrafik. Två hela dagar varje vecka där du får halvpristoken oavsett tidszon. Om du batchar dina tunga arbetsbelastningar till att köras fredag kväll till söndag betalar du i princip aldrig högtrafikpris. För en SaaS som bearbetar stora textvolymer — sammanfattning, översättning, innehållsmoderering, dataextraktion — kan detta ensamt kapa din API-nota med 30–40 % utan några tidszonskonster.
1. Samla alla icke-brådskande jobb under veckan (mån–fre)
2. Fredag 18:00 Pekings tid: starta batcharbetarna
3. Bearbeta oavbrutet i 48 timmar till lågtrafikpris
4. Måndag morgon: alla resultat levererade, notan är 50 % av vad den annars skulle ha varit
För företag som bearbetar miljontals token dagligen är detta inte småpengar — det är skillnaden mellan att gå med vinst och att förblöda pengar.
📋 Verkligt exempel: VM-kalender-boten
En kinesisk utvecklare (青小蛙) byggde en automatiserad bot som skrapar VM-matchscheman och genererar kalenderhändelser med DeepSeek V4. Att köra den en hel månad under den nuvarande eran före högtrafikpriser kostade totalt ¥60 (ungefär $8.20). Det handlar om att generera strukturerad data från webbsidor dagligen, i 30 dagar i sträck.
Även till högtrafikpris (¥12/M token utdata för V4 Pro) skulle samma bot kosta ~¥120/månad — fortfarande under $17. Vid lågtrafik är det ¥60/månad. Och det är V4 Pro. Om du byter till V4 Flash för den här typen av batcharbete ser du på ¥2–4/M token utdata. Botten som kostade ¥60 på V4 Pro skulle kosta ¥10–20 på V4 Flash i lågtrafik. Det är $1.40–2.80 för en månads automatiserad databearbetning. OpenAI:s GPT-4o skulle ta $100–200+ för samma arbetsbelastning.
⚠️ Risker och fallgropar
1. Användarvillkor
Vidareförsäljning av API-åtkomst kan strida mot DeepSeks användarvillkor. Läs det finstilta innan du bygger en verksamhet på detta. Kalla det åtminstone inte för "DeepSeek-vidareförsäljning" — positionera det som en mervärdestjänst som råkar använda DeepSeek under huven. Lägg ditt eget UI, köhantering, cachelager eller promptoptimering ovanpå, så att du säljer en produkt och inte rå API-åtkomst.
2. Latens
En köad proxy lägger till fördröjning. Om en västerländsk användare lämnar in ett jobb klockan 9 på morgonen stillahavstid (midnatt Peking — lågtrafik) bearbetas det omedelbart. Men om den lämnas in klockan 18 stillahavstid (9 Peking — högtrafik) blir det en väntan upp till 3 timmar (till Pekings lunchrast) eller 9 timmar (till 18 Peking och kvällens lågtrafik). Gör detta kristallklart för kunderna. Realtidschatt är INTE användningsfallet här — batchbearbetning, asynkrona jobb och nattarbetsbelastningar är det.
3. Priserna kan ändras
DeepSeek har åtagit sig att varna via mejl 24 timmar innan en prisändring. Det är rättvist, men det betyder att dina marginaler kan skifta över en natt. Bygg verksamheten med tillräcklig buffert för att en 2× prishöjning inte ska vara dödlig. Dessutom: förhållandet hög-/lågtrafik kan förändras över tid. Det som börjar som 2× kan bli 3× eller 1,5× när DeepSeek finställer systemet. Bygg inte en affärsmodell som bara fungerar vid exakt 2×.
4. Kontokrav
För närvarande kräver registrering av ett DeepSeek API-konto ett kinesiskt telefonnummer för den lägsta prisklassen. Om du befinner dig utanför Kina behöver du en kinesisk kontakt eller en tjänst för virtuella nummer. Detta är den största friktionspunkten för västerländska utvecklare som vill köra Riktning 1. Å andra sidan: om du ÄR i Kina eller har kinesiska partners har du en informationsasymmetri som de flesta västerländska utvecklare saknar — använd den.
⏳ Slutsatsen
DeepSeks tidviss prissättning är inte bara ett excentriskt faktureringsexperiment — det är ett strukturellt skifte som skapar genuina arbitragemöjligheter. Ekonomin är enkel: när din beräkningskostnad är 50 % lägre halva dygnet, och den halvan sammanfaller med dina kunders arbetstid, har du hittat ett mellanrum värt att utnyttja.
Tre saker att göra nu:
- Registrera ett DeepSeek-konto före den officiella V4-lanseringen — lås fast åtkomsten medan det fortfarande är enkelt. Efter juli kan registreringspolicyn stramas åt i takt med att medvetenheten sprids.
- Bygg en helgbatch-pipeline — även utan arbitrage eller vidareförsäljning sparar du 50 % omedelbart genom att flytta egna tunga arbetsbelastningar till helger.
- Bevaka regionala högtrafikpolicyer — om DeepSeek lanserar regionspecifika högtrafikschema öppnas Riktning 2 och arbitrage blir fullt dubbelriktat.
Fönstret är begränsat. Andra AI-leverantörer bevakar DeepSeks experiment noga. Om tidviss prissättning visar sig framgångsrik (och det kommer den förmodligen — det är enkel utbuds-/efterfrågeekonomi tillämpad på GPU-kluster), lär OpenAI och Anthropic följa efter inom 12–18 månader. När det händer smalnar arbitragemellanrummen eftersom alla spelar samma spel. De som rör sig först — de som sätter upp sin proxyinfrastrikt NU, medan det fortfarande är nytt — kommer att fånga de fetaste marginalerna.
Tidszonen är din fördel. Använd den innan alla andra har listat ut det.