Tóm tắt: DeepSeek thông báo API V4 sẽ áp dụng định giá động theo khung giờ — giá nhân đôi trong khung giờ cao điểm ngày làm việc (9:00–12:00 và 14:00–18:00 giờ Bắc Kinh), còn thấp điểm thì giữ nguyên. V4 chính thức ra mắt vào giữa tháng 7 năm 2026. Ngay cả khi tính theo giá cao điểm, DeepSeek vẫn là API AI tiên tiến rẻ nhất thế giới, và chênh lệch không hề nhỏ.

⚡ Chuyện gì vừa xảy ra

Ngày 29 tháng 6, DeepSeek gửi hàng loạt email tới người dùng với tiêu đề "Kế hoạch phát hành DeepSeek V4 chính thức và điều chỉnh billing". Thay đổi lớn nhất là: định giá động theo khung giờ — điều chưa từng có ở các nhà cung cấp AI API lớn.

Trong khung giờ cao điểm ngày làm việc (9:00–12:00 và 14:00–18:00 giờ Bắc Kinh), toàn bộ giá API V4 sẽ nhân đôi. Ngoài khung giờ đó, giá giữ nguyên ở mức đã rẻ đến mức khó tin hiện tại.

Bạn cứ hiểu thế này: nó giống surcharge giờ cao điểm của Uber, nhưng áp cho AI token. Khi ai cũng đang code cùng lúc, bạn phải trả thêm phí; chuyển batch job chạy lúc 3 giờ sáng? Bạn được giảm giá.

📊 Bảng giá mới

DeepSeek V4 Pro

Hạng mục tính phíThấp điểm (¥/M token)Cao điểm (¥/M token)
Input (cache hit)¥0.025¥0.05
Input (cache miss)¥3.00¥6.00
Output¥6.00¥12.00

DeepSeek V4 Flash

Hạng mục tính phíThấp điểm (¥/M token)Cao điểm (¥/M token)
Input (cache hit)¥0.02¥0.04
Input (cache miss)¥1.00¥2.00
Output¥2.00¥4.00
⚡ Lưu ý: Ngay cả khi tính theo giá cao điểm, output của DeepSeek V4 Flash cũng chỉ có ¥4/M token, tương đương khoảng $0.56/M token. So sánh với GPT-5.5 là $30/M, Claude Opus 4.8 là $25/M. Tức là, ngay thời điểm đắt nhất, DeepSeek vẫn rẻ hơn mô hình flagship của OpenAI 45–50 lần.

📋 Chi phí thực tế

Chỉ nhìn đơn giá thì khó hình dung, nên hãy xem hóa đơn thật. 青小蛙 của Appinn chia sẻ mức dùng thực tế: chạy DeepSeek V4 Flash để tự động cập nhật một lịch giải World Cup — cào tỷ số, bàn thắng, dữ liệu trận đấu — liên tục suốt một tháng:

  • Ngày thường: khoảng ¥2 (khoảng $0.28)
  • Ngày chạy nặng (sửa bug, rerun task): ¥13 (khoảng $1.82)
  • Tổng cả tháng: ¥60 (khoảng $8.40)

Đúng vậy — một pipeline chạy tự động mỗi ngày trong suốt một tháng, tổng chi phí còn chẳng bằng một bữa trưa ở San Francisco.

🏆 So sánh với đối thủ

Dưới đây là giá output của các mô hình phổ biến (USD, mỗi triệu token):

Mô hìnhOutput $/MCửa sổ ngữ cảnh
DeepSeek V4 Flash (thấp điểm / cao điểm)$0.28 / $0.561,000,000
DeepSeek V4 Pro (thấp điểm / cao điểm)$0.87 / $1.741,000,000
Xiaomi MiMo V2.5$0.281,000,000
Xiaomi MiMo V2.5 Pro$0.871,000,000
MiniMax M3$1.201,000,000
GLM-5.1 (Zhipu)$4.40200,000
Kimi K2.6¥27 ≈ $3.78262,000
Qwen3.7 Plus¥8 ≈ $1.121,000,000
GPT-5.5 (OpenAI)$30.001,100,000
Claude Opus 4.8 (Anthropic)$25.001,000,000

Trong phân khúc "context 1 triệu + giá cực thấp", đối thủ gần nhất là Xiaomi MiMo V2.5 — output $0.28/M, ngang bằng giá thấp điểm của DeepSeek V4 Flash, nhưng không có surcharge giờ cao điểm. Nếu bạn nhạy cảm với chi phí và không muốn bận tâm tới khung giờ, MiMo có lẽ là lựa chọn an toàn hơn.

🤔 Tại sao DeepSeek làm vậy

Lý do rất đơn giản: quản lý dung lượng. Server của DeepSeek bị đánh ngập trong giờ hành chính Trung Quốc. Thay vì từ chối phục vụ (hoặc để chất lượng tụt do quá tải), họ dùng tín hiệu giá để làm phẳng nhu cầu.

Đây thực ra là kinh tế hạ tầng khá thông minh. AWS, Google Cloud và mọi nhà cung cấp cloud lớn đã làm chuyện này từ lâu với spot instance và reserved capacity. DeepSeek chỉ là nhà cung cấp AI API đầu tiên áp dụng tư duy đó cho inference mô hình ngôn ngữ.

Hãy chờ đợi những người đi theo. Nếu DeepSeek chứng minh được mô hình này hiệu quả, Kimi và Qwen gần như chắc chắn sẽ tung ra các gói giá cao điểm/thấp điểm riêng.

🎯 Bạn nên làm gì

  1. Nếu bạn nhạy cảm với giá: Đẩy các task nặng (xử lý batch, sinh dữ liệu training, phân tích quy mô lớn) ra ngoài giờ hành chính Bắc Kinh (9:00–12:00, 14:00–18:00). Ví của bạn sẽ biết ơn.
  2. Nếu cần online 7×24: Lên ngân sách theo giá cao điểm, hoặc thiết lập một chuỗi fallback — chuyển lưu lượng giờ cao điểm sang MiMo V2.5 hoặc Qwen3.7 Plus, rồi đổi lại DeepSeek lúc thấp điểm.
  3. Nếu bạn ở gói miễn phí hoặc ngân sách thấp: V4 Flash ở mức giá thấp điểm gần như là miễn phí. Input (cache miss) ¥1/M nghĩa là bạn xử lý 1 triệu token input cộng thêm 1 triệu token output với giá chỉ khoảng ¥3 (41 cent). Cả một cuốn tiểu thuyết dài, đưa vào, phân tích, rồi trả ra — chỉ ngần ấy tiền.
🔮 Dự đoán: Surcharge theo khung giờ của DeepSeek V4 chỉ là tín hiệu mở đầu. Trước quý 4 năm 2026, sẽ có ít nhất hai nhà cung cấp AI Trung Quốc khác áp dụng định giá theo khung giờ. Kỷ nguyên "AI dùng bao nhiêu cũng được, một giá chung" đang khép lại — và điều đó thực sự tốt. Nó chứng tỏ AI đang trở thành hạ tầng thật sự, chứ không còn là demo bán lỗ để câu khách.

⏳ Tổng kết

DeepSeek V4 dù giá nhân đôi vẫn là API AI tiên tiến rẻ nhất thế giới. Định giá theo khung giờ là một tính năng chứ không phải lỗi — nó cho thấy nhu cầu với DeepSeek đã lớn đến mức phải quản lý dung lượng, và họ nói thẳng điều đó trong bảng giá.

Nếu bạn đang dùng API AI Trung Quốc (và nói thật, bạn nên dùng — khoảng cách giá với các nhà cung cấp Mỹ đã quá lố tới mức vô lý), thì với bất kỳ tác vụ nào không cần input đa phương thức, DeepSeek V4 Flash vẫn là lựa chọn mặc định. Chỉ cần chạy các job nặng sau bữa tối thôi.


Nguồn: Email người dùng DeepSeek (29 tháng 6 năm 2026), bài viết của Appinn, danh bạ giá DevTk.AI. Giá kiểm tra ngày 3 tháng 7 năm 2026.