Singkatnya: DeepSeek mengumumkan bahwa harga API V4 akan naik dua kali lipat selama jam kerja (9:00–12:00 dan 14:00–18:00 waktu Beijing). Rilis resmi V4 dijadwalkan pada pertengahan Juli 2026. Bahkan dengan tarif puncak, DeepSeek tetap menjadi API AI frontier termurah di dunia, dan bukan cuma sedikit lebih murah.

⚡ Apa yang Terjadi

Pada 29 Juni, DeepSeek mengirim email massal kepada para penggunanya yang berjudul "Rencana Rilis Resmi DeepSeek V4 dan Penyesuaian Penagihan". Perubahan terbesarnya: harga dinamis berdasarkan waktu — sesuatu yang belum pernah dilakukan oleh penyedia API AI mana pun sebelumnya.

Selama jam puncak (9:00–12:00 dan 14:00–18:00 waktu Beijing, hari kerja), seluruh harga API V4 langsung berlipat ganda. Di luar jam tersebut, harga tetap, bertahan di tingkat yang sudah super rendah saat ini.

Pikirkan seperti harga lonjakan Uber saat jam sibuk, hanya saja tarifnya dihitung dalam token AI. Saat semua orang menulis kode di waktu yang bersamaan, Anda membayar lebih; pindahkan pekerjaan batch ke jam 3 pagi? Anda dapat diskon.

📊 Tabel Harga

DeepSeek V4 Pro

Pos PenagihanJam Sepi (¥/M token)Jam Puncak (¥/M token)
Input (cache hit)¥0.025¥0.05
Input (cache miss)¥3.00¥6.00
Output¥6.00¥12.00

DeepSeek V4 Flash

Pos PenagihanJam Sepi (¥/M token)Jam Puncak (¥/M token)
Input (cache hit)¥0.02¥0.04
Input (cache miss)¥1.00¥2.00
Output¥2.00¥4.00
⚡ Catatan: Bahkan dengan tarif puncak, output DeepSeek V4 Flash hanya ¥4/M token — sekitar $0.56/M token. Sebagai pembanding: GPT-5.5 seharga $30/M, dan Claude Opus 4.8 seharga $25/M. Artinya, DeepSeek saat paling mahalnya tetap 45–50 kali lebih murah daripada model unggulan OpenAI.

📋 Biaya Nyata

Harga satuan saja belum memberi gambaran utuh? Mari lihat tagihan nyata. 青小蛙 dari Appinn membagikan angka pemakaian aslinya: memakai DeepSeek V4 Flash untuk memperbarui otomatis sebuah kalender jadwal Piala Dunia — mengikis skor, gol, dan data pertandingan — berjalan penuh selama sebulan:

  • Hari biasa: sekitar ¥2 (sekitar $0.28)
  • Hari sibuk (perbaikan bug, eksekusi ulang): ¥13 (sekitar $1.82)
  • Total sebulan: ¥60 (sekitar $8.40)

Benar — sebuah pipeline otomatis yang berjalan setiap hari selama sebulan, biayanya masih lebih murah dari sekadar makan siang di San Francisco.

🏆 Perbandingan dengan Kompetitor

Berikut adalah harga output model-model utama (dalam dolar AS, per juta token):

ModelOutput $/MJendela Konteks
DeepSeek V4 Flash (sepi / puncak)$0.28 / $0.561,000,000
DeepSeek V4 Pro (sepi / puncak)$0.87 / $1.741,000,000
Xiaomi MiMo V2.5$0.281,000,000
Xiaomi MiMo V2.5 Pro$0.871,000,000
MiniMax M3$1.201,000,000
GLM-5.1 (Zhipu)$4.40200,000
Kimi K2.6¥27 ≈ $3.78262,000
Qwen3.7 Plus¥8 ≈ $1.121,000,000
GPT-5.5 (OpenAI)$30.001,100,000
Claude Opus 4.8 (Anthropic)$25.001,000,000

Di kelas "konteks 1 juta + harga super murah", pesaing terdekatnya adalah Xiaomi MiMo V2.5 — output $0.28/M, sama dengan harga jam sepi DeepSeek V4 Flash, tetapi tanpa surcharge jam puncak. Kalau Anda sensitif terhadap biaya dan tidak mau repot memikirkan jam, MiMo mungkin pilihan yang lebih aman.

🤔 Mengapa DeepSeek Melakukan Ini

Alasannya sederhana: manajemen kapasitas. Server DeepSeek dibombardir habis-habisan selama jam kerja di Tiongkok. Daripada menolak layanan (atau membiarkan kualitas menurun akibat kelebihan beban), mereka memakai sinyal harga untuk meratakan permintaan.

Ini sebenarnya ekonomi infrastruktur yang cukup cerdas. AWS, Google Cloud, dan seluruh penyedia cloud besar sudah lama melakukan hal serupa lewat spot instance dan kapasitas cadangan. DeepSeek hanya yang pertama menerapkan logika yang sama ke inferensi model bahasa.

Bersiaplah untuk pemain lain mengikuti. Jika model DeepSeek terbukti berhasil, Kimi dan Qwen nyaris pasti akan meluncurkan tingkatan harga jam-sibuk/jam-sepi mereka sendiri.

🎯 Apa yang Harus Anda Lakukan

  1. Sensitif terhadap harga: Jadwalkan beban kerja berat (pemrosesan batch, pembuatan data pelatihan, analisis skala besar) di luar jam kerja waktu Beijing (9:00–12:00, 14:00–18:00). Dompet Anda akan berterima kasih.
  2. Butuh ketersediaan 24/7: Buat anggaran dengan asumsi harga puncak, atau bangun sebuah rantai fallback — arahkan trafik jam puncak ke MiMo V2.5 atau Qwen3.7 Plus, lalu kembalikan ke DeepSeek saat jam sepi.
  3. Pemakai gratis atau beranggaran rendah: V4 Flash dengan harga jam sepi praktis gratis. Input (cache miss) ¥1/M berarti Anda bisa memproses 1 juta token input ditambah 1 juta token output hanya dengan sekitar ¥3 (41 sen). Satu novel tebal utuh — dimasukkan, dianalisis, dikeluarkan lagi — hanya seharga itu.
🔮 Prediksi: Surcharge jam puncak DeepSeek V4 baru burung pertanda musim semi. Menjelang kuartal keempat 2026, setidaknya dua penyedia AI Tiongkok lainnya akan mengikuti jejak harga berbasis waktu. Era "AI flat-rate tanpa batas" sedang berakhir — dan sebenarnya ini hal bagus. Tanda bahwa AI sedang menjadi infrastruktur sungguhan, bukan sekadar demo yang merugi.

⏳ Kesimpulan

DeepSeek V4 dengan harga berlipat ganda tetaplah API AI frontier termurah di dunia. Harga berbasis waktu ini sebuah fitur, bukan bug — menandakan permintaan DeepSeek sudah sedemikian besar sehingga perlu manajemen kapasitas, dan mereka menuliskannya dengan jelas di harganya.

Jika Anda memakai API AI Tiongkok (dan sejujurnya Anda sebaiknya begitu — selisihnya dengan penyedia AS sudah nggak masuk akal), selama pekerjaan Anda tidak butuh input multimodal, DeepSeek V4 Flash tetap menjadi pilihan utama default. Cukup jalankan pekerjaan berat Anda setelah makan malam.


Sumber: Email pengguna DeepSeek (29 Juni 2026), liputan Appinn, direktori harga DevTk.AI. Harga diperiksa pada 3 Juli 2026.