Singkatnya: DeepSeek mengumumkan bahwa harga API V4 akan naik dua kali lipat selama jam kerja (9:00–12:00 dan 14:00–18:00 waktu Beijing). Rilis resmi V4 dijadwalkan pada pertengahan Juli 2026. Bahkan dengan tarif puncak, DeepSeek tetap menjadi API AI frontier termurah di dunia, dan bukan cuma sedikit lebih murah.
⚡ Apa yang Terjadi
Pada 29 Juni, DeepSeek mengirim email massal kepada para penggunanya yang berjudul "Rencana Rilis Resmi DeepSeek V4 dan Penyesuaian Penagihan". Perubahan terbesarnya: harga dinamis berdasarkan waktu — sesuatu yang belum pernah dilakukan oleh penyedia API AI mana pun sebelumnya.
Selama jam puncak (9:00–12:00 dan 14:00–18:00 waktu Beijing, hari kerja), seluruh harga API V4 langsung berlipat ganda. Di luar jam tersebut, harga tetap, bertahan di tingkat yang sudah super rendah saat ini.
Pikirkan seperti harga lonjakan Uber saat jam sibuk, hanya saja tarifnya dihitung dalam token AI. Saat semua orang menulis kode di waktu yang bersamaan, Anda membayar lebih; pindahkan pekerjaan batch ke jam 3 pagi? Anda dapat diskon.
📊 Tabel Harga
DeepSeek V4 Pro
| Pos Penagihan | Jam Sepi (¥/M token) | Jam Puncak (¥/M token) |
|---|---|---|
| Input (cache hit) | ¥0.025 | ¥0.05 |
| Input (cache miss) | ¥3.00 | ¥6.00 |
| Output | ¥6.00 | ¥12.00 |
DeepSeek V4 Flash
| Pos Penagihan | Jam Sepi (¥/M token) | Jam Puncak (¥/M token) |
|---|---|---|
| Input (cache hit) | ¥0.02 | ¥0.04 |
| Input (cache miss) | ¥1.00 | ¥2.00 |
| Output | ¥2.00 | ¥4.00 |
📋 Biaya Nyata
Harga satuan saja belum memberi gambaran utuh? Mari lihat tagihan nyata. 青小蛙 dari Appinn membagikan angka pemakaian aslinya: memakai DeepSeek V4 Flash untuk memperbarui otomatis sebuah kalender jadwal Piala Dunia — mengikis skor, gol, dan data pertandingan — berjalan penuh selama sebulan:
- Hari biasa: sekitar ¥2 (sekitar $0.28)
- Hari sibuk (perbaikan bug, eksekusi ulang): ¥13 (sekitar $1.82)
- Total sebulan: ¥60 (sekitar $8.40)
Benar — sebuah pipeline otomatis yang berjalan setiap hari selama sebulan, biayanya masih lebih murah dari sekadar makan siang di San Francisco.
🏆 Perbandingan dengan Kompetitor
Berikut adalah harga output model-model utama (dalam dolar AS, per juta token):
| Model | Output $/M | Jendela Konteks |
|---|---|---|
| DeepSeek V4 Flash (sepi / puncak) | $0.28 / $0.56 | 1,000,000 |
| DeepSeek V4 Pro (sepi / puncak) | $0.87 / $1.74 | 1,000,000 |
| Xiaomi MiMo V2.5 | $0.28 | 1,000,000 |
| Xiaomi MiMo V2.5 Pro | $0.87 | 1,000,000 |
| MiniMax M3 | $1.20 | 1,000,000 |
| GLM-5.1 (Zhipu) | $4.40 | 200,000 |
| Kimi K2.6 | ¥27 ≈ $3.78 | 262,000 |
| Qwen3.7 Plus | ¥8 ≈ $1.12 | 1,000,000 |
| GPT-5.5 (OpenAI) | $30.00 | 1,100,000 |
| Claude Opus 4.8 (Anthropic) | $25.00 | 1,000,000 |
Di kelas "konteks 1 juta + harga super murah", pesaing terdekatnya adalah Xiaomi MiMo V2.5 — output $0.28/M, sama dengan harga jam sepi DeepSeek V4 Flash, tetapi tanpa surcharge jam puncak. Kalau Anda sensitif terhadap biaya dan tidak mau repot memikirkan jam, MiMo mungkin pilihan yang lebih aman.
🤔 Mengapa DeepSeek Melakukan Ini
Alasannya sederhana: manajemen kapasitas. Server DeepSeek dibombardir habis-habisan selama jam kerja di Tiongkok. Daripada menolak layanan (atau membiarkan kualitas menurun akibat kelebihan beban), mereka memakai sinyal harga untuk meratakan permintaan.
Ini sebenarnya ekonomi infrastruktur yang cukup cerdas. AWS, Google Cloud, dan seluruh penyedia cloud besar sudah lama melakukan hal serupa lewat spot instance dan kapasitas cadangan. DeepSeek hanya yang pertama menerapkan logika yang sama ke inferensi model bahasa.
Bersiaplah untuk pemain lain mengikuti. Jika model DeepSeek terbukti berhasil, Kimi dan Qwen nyaris pasti akan meluncurkan tingkatan harga jam-sibuk/jam-sepi mereka sendiri.
🎯 Apa yang Harus Anda Lakukan
- Sensitif terhadap harga: Jadwalkan beban kerja berat (pemrosesan batch, pembuatan data pelatihan, analisis skala besar) di luar jam kerja waktu Beijing (9:00–12:00, 14:00–18:00). Dompet Anda akan berterima kasih.
- Butuh ketersediaan 24/7: Buat anggaran dengan asumsi harga puncak, atau bangun sebuah rantai fallback — arahkan trafik jam puncak ke MiMo V2.5 atau Qwen3.7 Plus, lalu kembalikan ke DeepSeek saat jam sepi.
- Pemakai gratis atau beranggaran rendah: V4 Flash dengan harga jam sepi praktis gratis. Input (cache miss) ¥1/M berarti Anda bisa memproses 1 juta token input ditambah 1 juta token output hanya dengan sekitar ¥3 (41 sen). Satu novel tebal utuh — dimasukkan, dianalisis, dikeluarkan lagi — hanya seharga itu.
⏳ Kesimpulan
DeepSeek V4 dengan harga berlipat ganda tetaplah API AI frontier termurah di dunia. Harga berbasis waktu ini sebuah fitur, bukan bug — menandakan permintaan DeepSeek sudah sedemikian besar sehingga perlu manajemen kapasitas, dan mereka menuliskannya dengan jelas di harganya.
Jika Anda memakai API AI Tiongkok (dan sejujurnya Anda sebaiknya begitu — selisihnya dengan penyedia AS sudah nggak masuk akal), selama pekerjaan Anda tidak butuh input multimodal, DeepSeek V4 Flash tetap menjadi pilihan utama default. Cukup jalankan pekerjaan berat Anda setelah makan malam.
Sumber: Email pengguna DeepSeek (29 Juni 2026), liputan Appinn, direktori harga DevTk.AI. Harga diperiksa pada 3 Juli 2026.