Buod: Inanunsyo ng DeepSeek na dadoble ang presyo ng V4 API tuwing oras ng trabaho (9:00–12:00 at 14:00–18:00, oras ng Beijing). Mid-Hulyo 2026 ang opisyal na paglulunsad ng V4. Kahit sa peak rates, DeepSeek pa rin ang pinakamurang frontier AI API nang malayong agwat.

⚡ Anong nangyari

Noong ika-29 ng Hunyo, nagpadala ang DeepSeek ng email sa mga user na may pamagat na "DeepSeek V4 Official Release Plan and Billing Adjustment". Ang pinakamalaking pagbabago: time-based dynamic pricing — ang unang ganitong scheme sa mga malalaking AI API provider.

Sa peak hours (oras ng Beijing 9:00–12:00 at 14:00–18:00 sa araw ng trabaho), lahat ng presyo ng V4 API nadodoble. Sa off-peak, mananatili ang presyo sa kasalukuyang (na sobrang mura na) na antas.

Isipin mo itong parang surge pricing ng Uber, pero ang yunit ay AI tokens. Pag sabay-sabay nagko-code ang lahat, magbabayad ka ng premium. Pinatakbo mo ang batch jobs ng alas-tres ng madaling araw? Nakukuha mo ang discount.

📊 Ang mga presyo

DeepSeek V4 Pro

Billing itemOff-peak (¥/M tokens)Peak hours (¥/M tokens)
Input (cache hit)¥0.025¥0.05
Input (cache miss)¥3.00¥6.00
Output¥6.00¥12.00

DeepSeek V4 Flash

Billing itemOff-peak (¥/M tokens)Peak hours (¥/M tokens)
Input (cache hit)¥0.02¥0.04
Input (cache miss)¥1.00¥2.00
Output¥2.00¥4.00
⚡ Tandaan: Kahit sa peak rates, ang output ng DeepSeek V4 Flash ay ¥4/M tokens lang — humigit-kumulang $0.56 kada milyong tokens. Ikumpara mo sa GPT-5.5 na $30/M o Claude Opus 4.8 na $25/M. Sa pinakamahal na presyo nito, ang DeepSeek ay 45–50x mas mura kaysa flagship model ng OpenAI.

📋 Gastos sa totoong buhay

Walang kuwenta ang pagtingin lang sa presyo kung walang konteksto? Tingnan mo ang tunay na bill. Ibinahagi ni 青小蛙 ng Appinn ang kanyang aktwal na paggamit: pinatakbo niya ang DeepSeek V4 Flash para i-auto-update ang isang World Cup calendar — nang-scrape ng scores, goals, at match data — nang isang buong buwan:

  • Normal na araw: ~¥2 (humigit-kumulang $0.28)
  • Mabigat na araw (pag-aayos ng bug, ulit na pagtakbo): ¥13 (humigit-kumulang $1.82)
  • Buong buwan na total: ¥60 (humigit-kumulang $8.40)

Tama ka bang binasa — isang automated pipeline na tumatakbo araw-araw sa loob ng isang buwan, mas mura pa kaysa sa isang tanghalian sa San Francisco.

🏆 Paghahambing sa mga kakompetensya

Ito ang output pricing ng mga top model sa USD kada milyong tokens:

ModelOutput $/MContext window
DeepSeek V4 Flash (off-peak / peak)$0.28 / $0.561,000,000
DeepSeek V4 Pro (off-peak / peak)$0.87 / $1.741,000,000
Xiaomi MiMo V2.5$0.281,000,000
Xiaomi MiMo V2.5 Pro$0.871,000,000
MiniMax M3$1.201,000,000
GLM-5.1 (Zhipu)$4.40200,000
Kimi K2.6¥27 ≈ $3.78262,000
Qwen3.7 Plus¥8 ≈ $1.121,000,000
GPT-5.5 (OpenAI)$30.001,100,000
Claude Opus 4.8 (Anthropic)$25.001,000,000

Sa tier na "sobrang mura na may 1M context", ang pinakamalapit na kakompetensya ay Xiaomi MiMo V2.5, na pareho ang output ng DeepSeek V4 Flash sa $0.28/M — pero walang peak pricing. Kung cost-sensitive ka at ayaw mong mag-isip pa ng oras, mas ligtas sigurong piliin ang MiMo.

🤔 Bakit ito ginagawa ng DeepSeek?

Simple ang sagot: capacity management. Binabagyo ng trabaho ang servers ng DeepSeek tuwing oras ng trabaho sa China. Imbes na tanggihan ang mga user (o hayaang bumaba ang kalidad dahil sa overload), ginagamit nila ang presyo bilang signal para ihapay ang demand.

Magaling itong infrastructure economics. Ginagawa na ito ng AWS, Google Cloud, at bawat malaking cloud provider nang maraming taon sa pamamagitan ng spot instances at reserved capacity. Una lang ang DeepSeek na AI API provider na nag-apply ng parehong lohika sa language model inference.

Asahan mong susunod ang iba. Kapag napatunayan ng DeepSeek na gumagana ito, halos sigurado na maglalabas din ng sarili nilang peak/off-peak tiers sina Kimi at Qwen.

🎯 Ano ang dapat mong gawin

  1. Kung cost-sensitive ka: I-schedule ang mabibigat na workload (batch processing, training data generation, bulk analysis) sa labas ng oras ng trabaho sa Beijing (9:00–12:00, 14:00–18:00). Magpapasalamat ang pitaka mo.
  2. Kung kailangan mong always-on: Mag-budget para sa peak pricing, o mag-set up ng fallback chain — i-route ang peak-hour traffic sa MiMo V2.5 o Qwen3.7 Plus, at off-peak ay balik sa DeepSeek.
  3. Kung nasa free tier ka o mababa ang budget: Halos libre na ang V4 Flash sa off-peak rates. ¥1/M input (cache miss) = kayang iproseso ang 1 milyong tokens ng input at 1 milyong tokens ng output sa humigit-kulang ¥3 (41 sentimos). Isang buong nobela, pumasok, na-analyze, lumabas — ganoon lang kaunti.
🔮 Hula: Ang surge pricing ng DeepSeek V4 ay unang babala lang. Sa Q4 ng 2026, maglalabas pa ng time-based pricing ang hindi bababa sa dalawang Chinese AI provider. Natatapos na ang era ng "flat-rate unlimited AI" — at maganda ito para sa ecosystem. Ibig sabihin, nagiging tunay na infrastructure ang AI, hindi na demo na lugi lang.

⏳ Buod

Kahit nadoble ang presyo, ang DeepSeek V4 ay pinakamurang frontier AI API sa mundo. Ang surge pricing ay feature, hindi bug — nagpapahiwatig ito na sapat na ang demand ng DeepSeek para mangailangan ng capacity management, at malinaw ito sa presyo.

Kung nakabuild ka sa Chinese AI APIs (at dapat ka nga — absurd na ang agwat ng presyo kumpara sa US providers), ang DeepSeek V4 Flash pa rin ang default na pagpilian para sa kahit anong hindi nangangailangan ng multimodal input. Itakbo mo lang ang mabibigat na jobs pagkatapos ng hapunan.


Mga source: DeepSeek user email (ika-29 ng Hunyo, 2026), Appinn report, DevTk.AI pricing directory. Tinignan ang presyo noong ika-3 ng Hulyo, 2026.