Buod: Inanunsyo ng DeepSeek na dadoble ang presyo ng V4 API tuwing oras ng trabaho (9:00–12:00 at 14:00–18:00, oras ng Beijing). Mid-Hulyo 2026 ang opisyal na paglulunsad ng V4. Kahit sa peak rates, DeepSeek pa rin ang pinakamurang frontier AI API nang malayong agwat.
⚡ Anong nangyari
Noong ika-29 ng Hunyo, nagpadala ang DeepSeek ng email sa mga user na may pamagat na "DeepSeek V4 Official Release Plan and Billing Adjustment". Ang pinakamalaking pagbabago: time-based dynamic pricing — ang unang ganitong scheme sa mga malalaking AI API provider.
Sa peak hours (oras ng Beijing 9:00–12:00 at 14:00–18:00 sa araw ng trabaho), lahat ng presyo ng V4 API nadodoble. Sa off-peak, mananatili ang presyo sa kasalukuyang (na sobrang mura na) na antas.
Isipin mo itong parang surge pricing ng Uber, pero ang yunit ay AI tokens. Pag sabay-sabay nagko-code ang lahat, magbabayad ka ng premium. Pinatakbo mo ang batch jobs ng alas-tres ng madaling araw? Nakukuha mo ang discount.
📊 Ang mga presyo
DeepSeek V4 Pro
| Billing item | Off-peak (¥/M tokens) | Peak hours (¥/M tokens) |
|---|---|---|
| Input (cache hit) | ¥0.025 | ¥0.05 |
| Input (cache miss) | ¥3.00 | ¥6.00 |
| Output | ¥6.00 | ¥12.00 |
DeepSeek V4 Flash
| Billing item | Off-peak (¥/M tokens) | Peak hours (¥/M tokens) |
|---|---|---|
| Input (cache hit) | ¥0.02 | ¥0.04 |
| Input (cache miss) | ¥1.00 | ¥2.00 |
| Output | ¥2.00 | ¥4.00 |
📋 Gastos sa totoong buhay
Walang kuwenta ang pagtingin lang sa presyo kung walang konteksto? Tingnan mo ang tunay na bill. Ibinahagi ni 青小蛙 ng Appinn ang kanyang aktwal na paggamit: pinatakbo niya ang DeepSeek V4 Flash para i-auto-update ang isang World Cup calendar — nang-scrape ng scores, goals, at match data — nang isang buong buwan:
- Normal na araw: ~¥2 (humigit-kumulang $0.28)
- Mabigat na araw (pag-aayos ng bug, ulit na pagtakbo): ¥13 (humigit-kumulang $1.82)
- Buong buwan na total: ¥60 (humigit-kumulang $8.40)
Tama ka bang binasa — isang automated pipeline na tumatakbo araw-araw sa loob ng isang buwan, mas mura pa kaysa sa isang tanghalian sa San Francisco.
🏆 Paghahambing sa mga kakompetensya
Ito ang output pricing ng mga top model sa USD kada milyong tokens:
| Model | Output $/M | Context window |
|---|---|---|
| DeepSeek V4 Flash (off-peak / peak) | $0.28 / $0.56 | 1,000,000 |
| DeepSeek V4 Pro (off-peak / peak) | $0.87 / $1.74 | 1,000,000 |
| Xiaomi MiMo V2.5 | $0.28 | 1,000,000 |
| Xiaomi MiMo V2.5 Pro | $0.87 | 1,000,000 |
| MiniMax M3 | $1.20 | 1,000,000 |
| GLM-5.1 (Zhipu) | $4.40 | 200,000 |
| Kimi K2.6 | ¥27 ≈ $3.78 | 262,000 |
| Qwen3.7 Plus | ¥8 ≈ $1.12 | 1,000,000 |
| GPT-5.5 (OpenAI) | $30.00 | 1,100,000 |
| Claude Opus 4.8 (Anthropic) | $25.00 | 1,000,000 |
Sa tier na "sobrang mura na may 1M context", ang pinakamalapit na kakompetensya ay Xiaomi MiMo V2.5, na pareho ang output ng DeepSeek V4 Flash sa $0.28/M — pero walang peak pricing. Kung cost-sensitive ka at ayaw mong mag-isip pa ng oras, mas ligtas sigurong piliin ang MiMo.
🤔 Bakit ito ginagawa ng DeepSeek?
Simple ang sagot: capacity management. Binabagyo ng trabaho ang servers ng DeepSeek tuwing oras ng trabaho sa China. Imbes na tanggihan ang mga user (o hayaang bumaba ang kalidad dahil sa overload), ginagamit nila ang presyo bilang signal para ihapay ang demand.
Magaling itong infrastructure economics. Ginagawa na ito ng AWS, Google Cloud, at bawat malaking cloud provider nang maraming taon sa pamamagitan ng spot instances at reserved capacity. Una lang ang DeepSeek na AI API provider na nag-apply ng parehong lohika sa language model inference.
Asahan mong susunod ang iba. Kapag napatunayan ng DeepSeek na gumagana ito, halos sigurado na maglalabas din ng sarili nilang peak/off-peak tiers sina Kimi at Qwen.
🎯 Ano ang dapat mong gawin
- Kung cost-sensitive ka: I-schedule ang mabibigat na workload (batch processing, training data generation, bulk analysis) sa labas ng oras ng trabaho sa Beijing (9:00–12:00, 14:00–18:00). Magpapasalamat ang pitaka mo.
- Kung kailangan mong always-on: Mag-budget para sa peak pricing, o mag-set up ng fallback chain — i-route ang peak-hour traffic sa MiMo V2.5 o Qwen3.7 Plus, at off-peak ay balik sa DeepSeek.
- Kung nasa free tier ka o mababa ang budget: Halos libre na ang V4 Flash sa off-peak rates. ¥1/M input (cache miss) = kayang iproseso ang 1 milyong tokens ng input at 1 milyong tokens ng output sa humigit-kulang ¥3 (41 sentimos). Isang buong nobela, pumasok, na-analyze, lumabas — ganoon lang kaunti.
⏳ Buod
Kahit nadoble ang presyo, ang DeepSeek V4 ay pinakamurang frontier AI API sa mundo. Ang surge pricing ay feature, hindi bug — nagpapahiwatig ito na sapat na ang demand ng DeepSeek para mangailangan ng capacity management, at malinaw ito sa presyo.
Kung nakabuild ka sa Chinese AI APIs (at dapat ka nga — absurd na ang agwat ng presyo kumpara sa US providers), ang DeepSeek V4 Flash pa rin ang default na pagpilian para sa kahit anong hindi nangangailangan ng multimodal input. Itakbo mo lang ang mabibigat na jobs pagkatapos ng hapunan.
Mga source: DeepSeek user email (ika-29 ng Hunyo, 2026), Appinn report, DevTk.AI pricing directory. Tinignan ang presyo noong ika-3 ng Hulyo, 2026.