Tóm tắt: DeepSeek thông báo API V4 sẽ áp dụng định giá động theo khung giờ — giá nhân đôi trong khung giờ cao điểm ngày làm việc (9:00–12:00 và 14:00–18:00 giờ Bắc Kinh), còn thấp điểm thì giữ nguyên. V4 chính thức ra mắt vào giữa tháng 7 năm 2026. Ngay cả khi tính theo giá cao điểm, DeepSeek vẫn là API AI tiên tiến rẻ nhất thế giới, và chênh lệch không hề nhỏ.
⚡ Chuyện gì vừa xảy ra
Ngày 29 tháng 6, DeepSeek gửi hàng loạt email tới người dùng với tiêu đề "Kế hoạch phát hành DeepSeek V4 chính thức và điều chỉnh billing". Thay đổi lớn nhất là: định giá động theo khung giờ — điều chưa từng có ở các nhà cung cấp AI API lớn.
Trong khung giờ cao điểm ngày làm việc (9:00–12:00 và 14:00–18:00 giờ Bắc Kinh), toàn bộ giá API V4 sẽ nhân đôi. Ngoài khung giờ đó, giá giữ nguyên ở mức đã rẻ đến mức khó tin hiện tại.
Bạn cứ hiểu thế này: nó giống surcharge giờ cao điểm của Uber, nhưng áp cho AI token. Khi ai cũng đang code cùng lúc, bạn phải trả thêm phí; chuyển batch job chạy lúc 3 giờ sáng? Bạn được giảm giá.
📊 Bảng giá mới
DeepSeek V4 Pro
| Hạng mục tính phí | Thấp điểm (¥/M token) | Cao điểm (¥/M token) |
|---|---|---|
| Input (cache hit) | ¥0.025 | ¥0.05 |
| Input (cache miss) | ¥3.00 | ¥6.00 |
| Output | ¥6.00 | ¥12.00 |
DeepSeek V4 Flash
| Hạng mục tính phí | Thấp điểm (¥/M token) | Cao điểm (¥/M token) |
|---|---|---|
| Input (cache hit) | ¥0.02 | ¥0.04 |
| Input (cache miss) | ¥1.00 | ¥2.00 |
| Output | ¥2.00 | ¥4.00 |
📋 Chi phí thực tế
Chỉ nhìn đơn giá thì khó hình dung, nên hãy xem hóa đơn thật. 青小蛙 của Appinn chia sẻ mức dùng thực tế: chạy DeepSeek V4 Flash để tự động cập nhật một lịch giải World Cup — cào tỷ số, bàn thắng, dữ liệu trận đấu — liên tục suốt một tháng:
- Ngày thường: khoảng ¥2 (khoảng $0.28)
- Ngày chạy nặng (sửa bug, rerun task): ¥13 (khoảng $1.82)
- Tổng cả tháng: ¥60 (khoảng $8.40)
Đúng vậy — một pipeline chạy tự động mỗi ngày trong suốt một tháng, tổng chi phí còn chẳng bằng một bữa trưa ở San Francisco.
🏆 So sánh với đối thủ
Dưới đây là giá output của các mô hình phổ biến (USD, mỗi triệu token):
| Mô hình | Output $/M | Cửa sổ ngữ cảnh |
|---|---|---|
| DeepSeek V4 Flash (thấp điểm / cao điểm) | $0.28 / $0.56 | 1,000,000 |
| DeepSeek V4 Pro (thấp điểm / cao điểm) | $0.87 / $1.74 | 1,000,000 |
| Xiaomi MiMo V2.5 | $0.28 | 1,000,000 |
| Xiaomi MiMo V2.5 Pro | $0.87 | 1,000,000 |
| MiniMax M3 | $1.20 | 1,000,000 |
| GLM-5.1 (Zhipu) | $4.40 | 200,000 |
| Kimi K2.6 | ¥27 ≈ $3.78 | 262,000 |
| Qwen3.7 Plus | ¥8 ≈ $1.12 | 1,000,000 |
| GPT-5.5 (OpenAI) | $30.00 | 1,100,000 |
| Claude Opus 4.8 (Anthropic) | $25.00 | 1,000,000 |
Trong phân khúc "context 1 triệu + giá cực thấp", đối thủ gần nhất là Xiaomi MiMo V2.5 — output $0.28/M, ngang bằng giá thấp điểm của DeepSeek V4 Flash, nhưng không có surcharge giờ cao điểm. Nếu bạn nhạy cảm với chi phí và không muốn bận tâm tới khung giờ, MiMo có lẽ là lựa chọn an toàn hơn.
🤔 Tại sao DeepSeek làm vậy
Lý do rất đơn giản: quản lý dung lượng. Server của DeepSeek bị đánh ngập trong giờ hành chính Trung Quốc. Thay vì từ chối phục vụ (hoặc để chất lượng tụt do quá tải), họ dùng tín hiệu giá để làm phẳng nhu cầu.
Đây thực ra là kinh tế hạ tầng khá thông minh. AWS, Google Cloud và mọi nhà cung cấp cloud lớn đã làm chuyện này từ lâu với spot instance và reserved capacity. DeepSeek chỉ là nhà cung cấp AI API đầu tiên áp dụng tư duy đó cho inference mô hình ngôn ngữ.
Hãy chờ đợi những người đi theo. Nếu DeepSeek chứng minh được mô hình này hiệu quả, Kimi và Qwen gần như chắc chắn sẽ tung ra các gói giá cao điểm/thấp điểm riêng.
🎯 Bạn nên làm gì
- Nếu bạn nhạy cảm với giá: Đẩy các task nặng (xử lý batch, sinh dữ liệu training, phân tích quy mô lớn) ra ngoài giờ hành chính Bắc Kinh (9:00–12:00, 14:00–18:00). Ví của bạn sẽ biết ơn.
- Nếu cần online 7×24: Lên ngân sách theo giá cao điểm, hoặc thiết lập một chuỗi fallback — chuyển lưu lượng giờ cao điểm sang MiMo V2.5 hoặc Qwen3.7 Plus, rồi đổi lại DeepSeek lúc thấp điểm.
- Nếu bạn ở gói miễn phí hoặc ngân sách thấp: V4 Flash ở mức giá thấp điểm gần như là miễn phí. Input (cache miss) ¥1/M nghĩa là bạn xử lý 1 triệu token input cộng thêm 1 triệu token output với giá chỉ khoảng ¥3 (41 cent). Cả một cuốn tiểu thuyết dài, đưa vào, phân tích, rồi trả ra — chỉ ngần ấy tiền.
⏳ Tổng kết
DeepSeek V4 dù giá nhân đôi vẫn là API AI tiên tiến rẻ nhất thế giới. Định giá theo khung giờ là một tính năng chứ không phải lỗi — nó cho thấy nhu cầu với DeepSeek đã lớn đến mức phải quản lý dung lượng, và họ nói thẳng điều đó trong bảng giá.
Nếu bạn đang dùng API AI Trung Quốc (và nói thật, bạn nên dùng — khoảng cách giá với các nhà cung cấp Mỹ đã quá lố tới mức vô lý), thì với bất kỳ tác vụ nào không cần input đa phương thức, DeepSeek V4 Flash vẫn là lựa chọn mặc định. Chỉ cần chạy các job nặng sau bữa tối thôi.
Nguồn: Email người dùng DeepSeek (29 tháng 6 năm 2026), bài viết của Appinn, danh bạ giá DevTk.AI. Giá kiểm tra ngày 3 tháng 7 năm 2026.