W skrócie: DeepSeek ogłosił, że ceny API V4 będą podwajane w godzinach pracy (9:00–12:00 i 14:00–18:00 czasu pekińskiego). Oficjalna premiera V4 jest zaplanowana na połowę lipca 2026 r. Nawet w strefie szczytu DeepSeek pozostaje najtańszym ze wszystkich czołowych API dla AI — i to z ogromną przewagą.
⚡ Co się stało
29 czerwca DeepSeek rozesłał użytkownikom maila pod tytułem „DeepSeek V4 Official Release Plan and Billing Adjustment". Najważniejsza zmiana: ceny dynamiczne zależne od pory dnia — precedens wśród dużych dostawców API dla AI.
W godzinach szczytu (w dni robocze, 9:00–12:00 i 14:00–18:00 czasu pekińskiego) wszystkie ceny API V4 rośnie dwukrotnie. Poza szczytem pozostają na dotychczasowym (już i tak absurdalnie niskim) poziomie.
Można o tym myśleć jak o „surge pricing" u Ubera, tylko dla tokenów AI. Gdy wszyscy kodują naraz, dopłacasz. Odpalisz zlecenia batchowe o 3 w nocy — dostajesz zniżkę.
📊 Nowe tabele cen
DeepSeek V4 Pro
| Pozycja rozliczeniowa | Poza szczytem (¥/M tokenów) | W szczycie (¥/M tokenów) |
|---|---|---|
| Wejście (trafienie w cache) | ¥0.025 | ¥0.05 |
| Wejście (pudło w cache) | ¥3.00 | ¥6.00 |
| Wyjście | ¥6.00 | ¥12.00 |
DeepSeek V4 Flash
| Pozycja rozliczeniowa | Poza szczytem (¥/M tokenów) | W szczycie (¥/M tokenów) |
|---|---|---|
| Wejście (trafienie w cache) | ¥0.02 | ¥0.04 |
| Wejście (pudło w cache) | ¥1.00 | ¥2.00 |
| Wyjście | ¥2.00 | ¥4.00 |
📋 Koszt w praktyce: ile to naprawdę wynosi?
Jeden z deweloperów (青小蛙 z Appinn) udostępnił swoje realne dane: miesięczny ciągły bieg DeepSeek V4 Flash, który automatycznie aktualizował kalendarz Mistrzostw Świata — scraping wyników, bramek i danych o meczach:
- Normalny dzień: ~¥2 (około $0.28)
- Ciężki dzień (poprawki bugów, powtórki zadań): ¥13 (około $1.82)
- Suma za cały miesiąc: ¥60 (około $8.40)
Dokładnie tak — zautomatyzowany pipeline, działający codziennie przez miesiąc, kosztował mniej niż lunch w San Francisco.
🏆 Jak DeepSeek wypada na tle konkurencji
Poniżej ceny wyjścia dla czołowych modeli w USD za milion tokenów:
| Model | Wyjście $/M | Okno kontekstowe |
|---|---|---|
| DeepSeek V4 Flash (poza szczytem / szczyt) | $0.28 / $0.56 | 1,000,000 |
| DeepSeek V4 Pro (poza szczytem / szczyt) | $0.87 / $1.74 | 1,000,000 |
| Xiaomi MiMo V2.5 | $0.28 | 1,000,000 |
| Xiaomi MiMo V2.5 Pro | $0.87 | 1,000,000 |
| MiniMax M3 | $1.20 | 1,000,000 |
| GLM-5.1 (Zhipu) | $4.40 | 200,000 |
| Kimi K2.6 | ¥27 ≈ $3.78 | 262,000 |
| Qwen3.7 Plus | ¥8 ≈ $1.12 | 1,000,000 |
| GPT-5.5 (OpenAI) | $30.00 | 1,100,000 |
| Claude Opus 4.8 (Anthropic) | $25.00 | 1,000,000 |
Najbliższym konkurentem w segmencie „okno 1M kontekstu po taniości" jest Xiaomi MiMo V2.5, który dorównuje DeepSeek V4 Flash przy $0.28/M wyjścia — ale bez opłat w szczycie. Jeśli jesteś wrażliwy na koszt i nie chcesz myśleć o porze dnia, MiMo może być bezpieczniejszym wyborem.
🤔 Dlaczego DeepSeek to robi?
Odpowiedź jest prosta: zarządzanie przepustowością. Serwery DeepSeek są obciążone na maksa w chińskich godzinach pracy. Zamiast odmawiać obsługi (albo pozwalać, by przeciążenie psuło jakość), firma wykorzystuje sygnał cenowy, aby wygładzić popyt.
To zresztą całkiem sprytna ekonomia infrastruktury. AWS, Google Cloud i każdy duży provider chmurowy robią to od lat — instancje spot i rezerwowana pojemność opierają się na tej samej logice. DeepSeek jest po prostu pierwszym dostawcą API dla AI, który przeniósł ją do wnioskowania modeli językowych.
Spodziewaj się naśladnictwa. Jeśli u DeepSeek ten model się sprawdzi, Kimi i Qwen niemal na pewno wprowadzą własne strefy szczytu i poza szczytem.
🎯 Co powinieneś zrobić
- Jeśli jesteś wrażliwy cenowo: Planuj cięższe obciążenia (przetwarzanie batchowe, generowanie danych treningowych, analizy masowe) poza pekińskimi godzinami pracy (9:00–12:00, 14:00–18:00). Twój portfel podziękuje.
- Jeśli potrzebujesz ciągłej dostępności 24/7: Licz się z cenami szczytu albo zbuduj łańcuch awaryjny — kieruj ruch w szczycie do MiMo V2.5 lub Qwen3.7 Plus, poza szczytem wracaj do DeepSeek.
- Jeśli jesteś na darmowym planie lub przy niskim budżecie: V4 Flash poza szczytem to w zasadzie gratis. ¥1/M wejścia (pudło w cache) oznacza, że milion tokenów wejścia oraz milion tokenów wyjścia przetworzysz za około ¥3 (41 centów). Cała powieść — wczytana, przeanalizowana, zwrócona — za te parę groszy.
⏳ Podsumowanie
DeepSeek V4 za podwójną cenę nadal jest najtańszym ze wszystkich czołowych API dla AI na świecie. Surge pricing to funkcja, nie błąd — sygnalizuje, że DeepSeek ma na tyle duży popyt, by potrzebować zarządzania przepustowością, a ceny mówią o tym wprost.
Jeśli budujesz na chińskich API dla AI (a powinieneś — różnica cenowa względem dostawców z USA jest po prostu absurdalna), DeepSeek V4 Flash pozostaje domyślnym wyborem dla wszystkiego, co nie wymaga wejścia multimodalnego. Po prostu odpalaj cięższe zadania po kolacji.
Źródła: mail do użytkowników DeepSeek (29 czerwca 2026), raport Appinn, katalog cen DevTk.AI. Ceny zweryfikowane 3 lipca 2026.