So sánh Bảng giá API AI Trung Quốc 2026

Bảng giá API pay-as-you-go cho 20+ mô hình AI Trung Quốc — DeepSeek, Kimi, GLM, Qwen, MiniMax và hơn thế. So sánh chi phí input/output mỗi triệu token, cửa sổ ngữ cảnh và khả năng.
📅 Cập nhật liên tục · 2026🏷️ 10 nhà cung cấp · 20 mô hình📌 Cập nhật lần cuối: 4 tháng 7, 2026

So sánh Bảng giá API AI Trung Quốc 2026: Chi phí mỗi Triệu Token

Đang build với mô hình AI Trung Quốc qua API? Chúng tôi đã so sánh cạnh nhau 20+ mô hình từ 10 nhà cung cấp — gồm DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE và Spark. Tất cả giá tính mỗi triệu token (input/output), kèm cửa sổ ngữ cảnh và nhãn khả năng. Cập nhật tháng 7 2026.

22 mô hình
Mô hìnhNhà cung cấpInput/MOutput/MNgữ cảnhKhả năngGhi chú
DeepSeek V4 ProDeepSeek¥3.00Cache hit ¥0.025/M¥6.001M
TextFunction CallingStructured Output
CNYGiá gấp 2x vào khung giờ cao điểm 9–12 và 14–18 theo giờ Bắc Kinh; bản chính thức ra mắt giữa tháng 7
DeepSeek V4 FlashDeepSeek¥1.00Cache hit ¥0.02/M¥2.001M
TextFunction CallingStructured Output
CNYGiá gấp 2x vào khung giờ cao điểm 9–12 và 14–18 theo giờ Bắc Kinh
MiniMax M3MiniMax$0.30$1.201M
TextVisionVideoFunction Calling
USDModel multimodal chủ lực của MiniMax; hỗ trợ nhập văn bản, hình ảnh và video.
Kimi K3Kimi (Moonshot AI)¥20.00Cache hit ¥2.00/M¥100.001M
TextFunction CallingStructured Output
CNYModel chủ lực của Kimi dành cho lập trình dài hạn và công việc tri thức end-to-end. Luôn bật reasoning (reasoning_effort, hiện chỉ có mức 'max'). Hỗ trợ cache ngữ cảnh, tool_choice và nạp tool động. Lưu ý: web_search đang được nâng cấp — tạm thời không khuyến nghị.
Kimi K2.6Kimi (Moonshot AI)¥6.50¥27.00262K
TextVisionVideoFunction Calling
CNYModel multimodal của Kimi với hai chế độ thinking và non-thinking.
Kimi K2.5Kimi (Moonshot AI)¥4.00¥21.00262K
TextVisionVideoFunction Calling
CNYModel multimodal của Kimi; hỗ trợ nhập văn bản, hình ảnh và video.
Kimi K2.7 CodeKimi (Moonshot AI)¥6.50¥27.00262K
TextFunction Calling
CNYChỉ hoạt động ở chế độ thinking
GLM-5.1Zhipu AI (GLM)$1.40$4.40200K
TextFunction CallingStructured Output
USDModel văn bản của Zhipu, giá phân tầng theo độ dài ngữ cảnh.
GLM-5 TurboZhipu AI (GLM)$1.20$4.00200K
TextFunction CallingStructured Output
USDBiến thể GLM tối ưu chi phí, phù hợp khối lượng công việc văn bản thông lượng cao.
GLM-5V TurboZhipu AI (GLM)$1.20$4.00200K
TextVisionVideoFunction CallingStructured Output
USDBiến thể multimodal của GLM; hỗ trợ nhập văn bản, hình ảnh và video.
GLM-5.2Zhipu AI (GLM)¥8.00Cache hit ¥2.00/M¥28.001M
TextFunction CallingStructured Output
CNYModel chủ lực mới nhất. Lưu trữ cache miễn phí trong thời gian giới hạn.
Qwen3.7 MaxAlibaba Cloud (Qwen)¥12.00¥36.001M
TextVisionFunction CallingStructured Output
CNYModel Qwen3.7 chủ lực của Alibaba, ngữ cảnh 1M.
Qwen3.7 PlusAlibaba Cloud (Qwen)¥2.00¥8.001M
TextVisionFunction CallingStructured Output
CNYPhần ngữ cảnh vượt quá 256K được tính giá riêng
MiMo-V2.5-ProXiaomi (MiMo)$0.435$0.871M
TextFunction CallingStructured Output
USD (≈¥3.00 / ≈¥6.00)Mã nguồn mở MIT
MiMo-V2.5Xiaomi (MiMo)$0.14$0.281M
TextVisionVideoAudioFunction Calling
USD (≈¥1.00 / ≈¥2.00)Hỗ trợ văn bản, hình ảnh, video và âm thanh
Doubao-ProByteDance (Volcano Engine)¥1.00¥2.00128K
TextFunction Calling
CNYModel Doubao mục đích chung của ByteDance.
Doubao-LiteByteDance (Volcano Engine)¥0.30¥0.60128K
TextFunction Calling
CNYBiến thể Doubao nhẹ, siêu rẻ.
Hunyuan-LargeTencent Cloud (Hunyuan)¥4.00¥12.0032K
TextFunction Calling
CNYModel Hunyuan dung lượng lớn hơn của Tencent.
Hunyuan-StandardTencent Cloud (Hunyuan)¥0.50¥1.0032K
TextFunction Calling
CNYModel Hunyuan chuẩn, tối ưu chi phí.
ERNIE 4.5Baidu (Qianfan)¥8.00¥24.0032K
TextFunction Calling
CNYModel ERNIE chủ lực của Baidu.
ERNIE SpeedBaidu (Qianfan)¥0.12¥0.128K
TextFunction Calling
CNYBiến thể ERNIE siêu rẻ, độ trễ thấp.
Spark 4.0iFLYTEK (Spark)¥3.00¥9.00128K
TextFunction Calling
CNYModel Spark chủ lực của iFLYTEK.
Chú giải khả năng:Văn bảnThị giácVideoÂm thanhFunction CallingStructured Output

📝 Ghi chú Bảng giá

📌 Lưu ý Quan trọng
• Tất cả giá là mỗi triệu token (1M = 1.000.000 token) ở mức pay-as-you-go chính thức. Tiền tệ hiển thị theo nhà cung cấp: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash dùng định giá cao điểm/thấp điểm: trong giờ cao điểm (09:00–12:00 và 14:00–18:00, giờ Bắc Kinh), cả giá input và output ĐỨNG GẤP ĐÔI. Giờ thấp điểm giảm một nửa — lưu lượng khác múi giờ có thể tận dụng arbitrage. DeepSeek cũng hỗ trợ context caching: tiền tố prompt lặp lại được tính ở mức cache-hit thấp hơn nhiều (vd., V4 Pro cache hit ¥0.025/M vs. cache miss ¥3.00/M).
• Qwen3.7 Plus: giá input/output trên áp dụng cho 256K ngữ cảnh đầu. Sử dụng vượt 256K được tính riêng ở mức giá ngữ cảnh dài cao hơn.
• Giá chịu sự điều chỉnh của thông báo chính thức từ từng nền tảng. Một số nhà cung cấp có thêm giảm giá theo số lượng, gói tầng hoặc credit dùng thử. Luôn xác minh trước khi tích hợp.
🔥Chỉ nhìn giá là chưa đủ?Chúng tôi đã tính ngược hạn mức token thực của từng mô hình — xem bạn thực tế dùng được bao nhiêu.Xem so sánh hạn mức thực tế →