W skrócie: DeepSeek ogłosił, że ceny API V4 będą podwajane w godzinach pracy (9:00–12:00 i 14:00–18:00 czasu pekińskiego). Oficjalna premiera V4 jest zaplanowana na połowę lipca 2026 r. Nawet w strefie szczytu DeepSeek pozostaje najtańszym ze wszystkich czołowych API dla AI — i to z ogromną przewagą.

⚡ Co się stało

29 czerwca DeepSeek rozesłał użytkownikom maila pod tytułem „DeepSeek V4 Official Release Plan and Billing Adjustment". Najważniejsza zmiana: ceny dynamiczne zależne od pory dnia — precedens wśród dużych dostawców API dla AI.

W godzinach szczytu (w dni robocze, 9:00–12:00 i 14:00–18:00 czasu pekińskiego) wszystkie ceny API V4 rośnie dwukrotnie. Poza szczytem pozostają na dotychczasowym (już i tak absurdalnie niskim) poziomie.

Można o tym myśleć jak o „surge pricing" u Ubera, tylko dla tokenów AI. Gdy wszyscy kodują naraz, dopłacasz. Odpalisz zlecenia batchowe o 3 w nocy — dostajesz zniżkę.

📊 Nowe tabele cen

DeepSeek V4 Pro

Pozycja rozliczeniowaPoza szczytem (¥/M tokenów)W szczycie (¥/M tokenów)
Wejście (trafienie w cache)¥0.025¥0.05
Wejście (pudło w cache)¥3.00¥6.00
Wyjście¥6.00¥12.00

DeepSeek V4 Flash

Pozycja rozliczeniowaPoza szczytem (¥/M tokenów)W szczycie (¥/M tokenów)
Wejście (trafienie w cache)¥0.02¥0.04
Wejście (pudło w cache)¥1.00¥2.00
Wyjście¥2.00¥4.00
⚡ Uwaga: Nawet w szczycie wyjście DeepSeek V4 Flash kosztuje ¥4/M tokenów, czyli około $0.56/M tokenów. Dla porównania: GPT-5.5 kosztuje $30/M, a Claude Opus 4.8 $25/M. DeepSeek w swojej najdroższej chwili nadal jest 45–50 razy tańszy od flagowego modelu OpenAI.

📋 Koszt w praktyce: ile to naprawdę wynosi?

Jeden z deweloperów (青小蛙 z Appinn) udostępnił swoje realne dane: miesięczny ciągły bieg DeepSeek V4 Flash, który automatycznie aktualizował kalendarz Mistrzostw Świata — scraping wyników, bramek i danych o meczach:

  • Normalny dzień: ~¥2 (około $0.28)
  • Ciężki dzień (poprawki bugów, powtórki zadań): ¥13 (około $1.82)
  • Suma za cały miesiąc: ¥60 (około $8.40)

Dokładnie tak — zautomatyzowany pipeline, działający codziennie przez miesiąc, kosztował mniej niż lunch w San Francisco.

🏆 Jak DeepSeek wypada na tle konkurencji

Poniżej ceny wyjścia dla czołowych modeli w USD za milion tokenów:

ModelWyjście $/MOkno kontekstowe
DeepSeek V4 Flash (poza szczytem / szczyt)$0.28 / $0.561,000,000
DeepSeek V4 Pro (poza szczytem / szczyt)$0.87 / $1.741,000,000
Xiaomi MiMo V2.5$0.281,000,000
Xiaomi MiMo V2.5 Pro$0.871,000,000
MiniMax M3$1.201,000,000
GLM-5.1 (Zhipu)$4.40200,000
Kimi K2.6¥27 ≈ $3.78262,000
Qwen3.7 Plus¥8 ≈ $1.121,000,000
GPT-5.5 (OpenAI)$30.001,100,000
Claude Opus 4.8 (Anthropic)$25.001,000,000

Najbliższym konkurentem w segmencie „okno 1M kontekstu po taniości" jest Xiaomi MiMo V2.5, który dorównuje DeepSeek V4 Flash przy $0.28/M wyjścia — ale bez opłat w szczycie. Jeśli jesteś wrażliwy na koszt i nie chcesz myśleć o porze dnia, MiMo może być bezpieczniejszym wyborem.

🤔 Dlaczego DeepSeek to robi?

Odpowiedź jest prosta: zarządzanie przepustowością. Serwery DeepSeek są obciążone na maksa w chińskich godzinach pracy. Zamiast odmawiać obsługi (albo pozwalać, by przeciążenie psuło jakość), firma wykorzystuje sygnał cenowy, aby wygładzić popyt.

To zresztą całkiem sprytna ekonomia infrastruktury. AWS, Google Cloud i każdy duży provider chmurowy robią to od lat — instancje spot i rezerwowana pojemność opierają się na tej samej logice. DeepSeek jest po prostu pierwszym dostawcą API dla AI, który przeniósł ją do wnioskowania modeli językowych.

Spodziewaj się naśladnictwa. Jeśli u DeepSeek ten model się sprawdzi, Kimi i Qwen niemal na pewno wprowadzą własne strefy szczytu i poza szczytem.

🎯 Co powinieneś zrobić

  1. Jeśli jesteś wrażliwy cenowo: Planuj cięższe obciążenia (przetwarzanie batchowe, generowanie danych treningowych, analizy masowe) poza pekińskimi godzinami pracy (9:00–12:00, 14:00–18:00). Twój portfel podziękuje.
  2. Jeśli potrzebujesz ciągłej dostępności 24/7: Licz się z cenami szczytu albo zbuduj łańcuch awaryjny — kieruj ruch w szczycie do MiMo V2.5 lub Qwen3.7 Plus, poza szczytem wracaj do DeepSeek.
  3. Jeśli jesteś na darmowym planie lub przy niskim budżecie: V4 Flash poza szczytem to w zasadzie gratis. ¥1/M wejścia (pudło w cache) oznacza, że milion tokenów wejścia oraz milion tokenów wyjścia przetworzysz za około ¥3 (41 centów). Cała powieść — wczytana, przeanalizowana, zwrócona — za te parę groszy.
🔮 Przewidywanie: Ceny dynamiczne DeepSeek V4 to pierwsza jaskółka. Do czwartego kwartału 2026 r. co najmniej dwóch kolejnych chińskich dostawców AI wprowadzi ceny zależne od pory. Epoka „AI bez limitu w ryczałcie" dobiega końca — i to w gruncie rzeczy dobre dla ekosystemu. Oznacza, że AI staje się realną infrastrukturą, a nie demem prowadzonym na stratę.

⏳ Podsumowanie

DeepSeek V4 za podwójną cenę nadal jest najtańszym ze wszystkich czołowych API dla AI na świecie. Surge pricing to funkcja, nie błąd — sygnalizuje, że DeepSeek ma na tyle duży popyt, by potrzebować zarządzania przepustowością, a ceny mówią o tym wprost.

Jeśli budujesz na chińskich API dla AI (a powinieneś — różnica cenowa względem dostawców z USA jest po prostu absurdalna), DeepSeek V4 Flash pozostaje domyślnym wyborem dla wszystkiego, co nie wymaga wejścia multimodalnego. Po prostu odpalaj cięższe zadania po kolacji.


Źródła: mail do użytkowników DeepSeek (29 czerwca 2026), raport Appinn, katalog cen DevTk.AI. Ceny zweryfikowane 3 lipca 2026.