Ringkasan: DeepSeek mengumumkan bahawa harga API V4 akan naik dua kali ganda semasa waktu perniagaan (9:00–12:00 dan 14:00–18:00 waktu Beijing). Pelancaran rasmi V4 dijadualkan pertengahan Julai 2026. Walaupun pada kadar puncak, DeepSeek kekal sebagai API AI frontier paling murah di dunia dengan margin yang sangat luas.

⚡ Apa yang Berlaku

Pada 29 Jun, DeepSeek menghantar e-mel kepada penggunanya bertajuk "Pelancaran Rasmi DeepSeek V4 dan Pelarasan Bil". Perubahan utama: penetapan harga dinamik berasaskan masa — yang pertama seumpamanya dalam kalangan penyedia API AI utama.

Semasa waktu puncak (waktu Beijing 9:00–12:00 dan 14:00–18:00 pada hari bekerja), semua harga API V4 naik dua kali ganda. Di luar waktu puncak, harga kekal pada kadar semasa (yang sudah pun terlalu murah).

Fikirkan ia seperti surge pricing Uber, tetapi untuk token AI. Bila semua orang menulis kod pada masa yang sama, anda bayar premium. Jalankan kerja batch pada pukul 3 pagi? Anda dapat diskaun.

📊 Jadual Harga Baharu

DeepSeek V4 Pro

Perkara BilLuar Puncak (¥/M token)Puncak (¥/M token)
Input (cache hit)¥0.025¥0.05
Input (cache miss)¥3.00¥6.00
Output¥6.00¥12.00

DeepSeek V4 Flash

Perkara BilLuar Puncak (¥/M token)Puncak (¥/M token)
Input (cache hit)¥0.02¥0.04
Input (cache miss)¥1.00¥2.00
Output¥2.00¥4.00
⚡ Perhatian: Walaupun pada kadar puncak, output DeepSeek V4 Flash hanya ¥4/M token — lebih kurang $0.56 setiap juta token. Bandingkan dengan GPT-5.5 pada $30/M atau Claude Opus 4.8 pada $25/M. DeepSeek pada tahap paling mahal masih 45–50 kali lebih murah daripada model frontier OpenAI.

📋 Kos Sebenar

Harga tunggal tak bermakna tanpa konteks? Mari lihat bil sebenar. Seorang pembangun (青小蛙 dari Appinn) berkongsi jumlah penggunaan sebenar beliau: menggunakan DeepSeek V4 Flash untuk mengemas kini kalendar Piala Dunia secara automatik — mengikis skor, gol, dan data perlawanan — sepanjang satu bulan penuh:

  • Hari biasa: ~¥2 (lebih kurang $0.28)
  • Hari sibuk (pembetulan pepijat, jalan semula): ¥13 (lebih kurang $1.82)
  • Jumlah sebulan: ¥60 (lebih kurang $8.40)

Betul — satu saluran automatik yang berjalan setiap hari selama sebulan berharga kurang daripada satu makan tengahari di San Francisco.

🏆 Perbandingan dengan Pesaing

Berikut ialah harga output untuk model-model utama dalam USD setiap juta token:

ModelOutput $/MTetingkap Konteks
DeepSeek V4 Flash (luar puncak / puncak)$0.28 / $0.561,000,000
DeepSeek V4 Pro (luar puncak / puncak)$0.87 / $1.741,000,000
Xiaomi MiMo V2.5$0.281,000,000
Xiaomi MiMo V2.5 Pro$0.871,000,000
MiniMax M3$1.201,000,000
GLM-5.1 (Zhipu)$4.40200,000
Kimi K2.6¥27 ≈ $3.78262,000
Qwen3.7 Plus¥8 ≈ $1.121,000,000
GPT-5.5 (OpenAI)$30.001,100,000
Claude Opus 4.8 (Anthropic)$25.001,000,000

Dalam kategori "sangat murah dengan konteks 1 juta", pesaing terdekat ialah Xiaomi MiMo V2.5, yang menyamai DeepSeek V4 Flash pada $0.28/M output — tetapi tanpa harga waktu puncak. Jika anda sensitif terhadap kos dan tak mahu risau tentang masa, MiMo mungkin pilihan yang lebih selamat.

🤔 Kenapa DeepSeek Buat Begini

Jawapannya ringkas: pengurusan kapasiti. Pelayan DeepSeek dibombardir semasa waktu perniagaan China. Daripada menolak pengguna (atau membiarkan kualiti merosot akibat beban berlebihan), mereka menggunakan isyarat harga untuk melicinkan permintaan.

Ini sebenarnya ekonomi infrastruktur yang bijak. AWS, Google Cloud, dan setiap penyedia awan utama telah lama melakukan ini dengan instance spot dan kapasiti ditempah. DeepSeek hanya penyedia API AI pertama yang mengaplikasikan logik yang sama pada inferens model bahasa.

Jangkakan pesaing lain mengikut. Jika DeepSeek membuktikan model ini berjaya, Kimi dan Qwen hampir pasti akan memperkenalkan tahap puncak/luar puncak mereka sendiri.

🎯 Apa yang Anda Patut Buat

  1. Jika anda sensitif harga: Jadualkan beban kerja berat (pemprosesan batch, penjanaan data latihan, analisis pukal) di luar waktu perniagaan Beijing (9:00–12:00, 14:00–18:00). Dompet anda akan berterima kasih.
  2. Jika anda perlu sentiasa dalam talian: Belanjakan untuk harga puncak, atau sediakan rantaian fallback — lencongkan trafik waktu puncak ke MiMo V2.5 atau Qwen3.7 Plus, luar puncak kembali ke DeepSeek.
  3. Jika anda dalam tahap percuma atau belanjawan rendah: V4 Flash pada kadar luar puncak hampir percuma. ¥1/M input (cache miss) bermaksud anda boleh memproses 1 juta token input dan 1 juta token output untuk lebih kurang ¥3 (41 sen). Itu satu novel penuh — masuk, dianalisis, dan keluar.
🔮 Ramalan: Harga lonjak DeepSeek V4 hanyalah burung murai dalam lombong arang. Menjelang Q4 2026, sekurang-kurangnya dua lagi penyedia AI China akan memperkenalkan penetapan harga berasaskan masa. Era "AI kadar rata tanpa had" sedang berakhir — dan itu sebenarnya baik untuk ekosistem. Ia bermaksud AI sedang menjadi infrastruktur sebenar, bukan sekadar demo kerugian.

⏳ Kesimpulan

DeepSeek V4 pada harga berganda masih API AI frontier paling murah di dunia. Pengumuman harga lonjak ini satu ciri, bukan pepijat — ia isyarat bahawa DeepSeek mempunyai permintaan yang cukup besar untuk memerlukan pengurusan kapasiti, dan harganya telus tentangnya.

Jika anda membina dengan API AI China (dan anda patut — jurang harga berbanding penyedia AS sudah tidak masuk akal), DeepSeek V4 Flash kekal sebagai pilihan lalai untuk apa-apa sahaja yang tak memerlukan input multimodal. Cuma jalankan kerja berat anda selepas makan malam.


Sumber: E-mel pengguna DeepSeek (29 Jun 2026), laporan Appinn, direktori harga DevTk.AI. Harga disemak pada 3 Julai 2026.