Paghahambing ng Presyo ng Chinese AI API 2026
Pay-as-you-go na presyo ng API para sa 20+ Chinese AI model — DeepSeek, Kimi, GLM, Qwen, MiniMax, at iba pa. Ihambing ang input/output na gastos kada milyong token, context window, at kakayahan.
Ihambing ang Presyo ng Chinese AI API 2026: Gastos kada Milyong Token
Gumagawa gamit ang Chinese AI model sa pamamagitan ng API? Magkatabi naming hinambing ang 20+ model mula sa 10 provider — kasama ang DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE, at Spark. Lahat ng presyo ay kada milyong token (input / output), may context window at capability tag. Updated July 2026.
| Model | Provider | Input /M | Output /M | Context | Kakayahan | Tala |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro↗ | DeepSeek | ¥3.00Cache hit ¥0.025/M | ¥6.00 | 1M | TextFunction CallingStructured Output | CNYDoble ang presyo sa peak hours (9–12 at 14–18, oras ng Beijing); magiging pangkalahatang available sa kalagitnaan ng Hulyo |
| DeepSeek V4 Flash↗ | DeepSeek | ¥1.00Cache hit ¥0.02/M | ¥2.00 | 1M | TextFunction CallingStructured Output | CNYDoble ang presyo sa peak hours (9–12 at 14–18, oras ng Beijing) |
| MiniMax M3↗ | MiniMax | $0.30 | $1.20 | 1M | TextVisionVideoFunction Calling | USDFlagship na multimodal model ng MiniMax; sinusuportahan ang text, image, at video input. |
| Kimi K3↗ | Kimi (Moonshot AI) | ¥20.00Cache hit ¥2.00/M | ¥100.00 | 1M | TextFunction CallingStructured Output | CNYFlagship model ng Kimi para sa long-horizon coding at end-to-end na knowledge work. Laging naka-on ang reasoning (reasoning_effort, kasalukuyang 'max' lang ang available). Sinusuportahan ang context caching, tool_choice, at dynamic tool loading. Paalala: ang web_search ay kasalukuyang ina-upgrade — hindi muna irerekomenda sa ngayon. |
| Kimi K2.6↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextVisionVideoFunction Calling | CNYMultimodal model ng Kimi na may thinking at non-thinking modes. |
| Kimi K2.5↗ | Kimi (Moonshot AI) | ¥4.00 | ¥21.00 | 262K | TextVisionVideoFunction Calling | CNYMultimodal model ng Kimi; sinusuportahan ang text, image, at video input. |
| Kimi K2.7 Code↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextFunction Calling | CNYReasoning mode lang |
| GLM-5.1↗ | Zhipu AI (GLM) | $1.40 | $4.40 | 200K | TextFunction CallingStructured Output | USDText model ng Zhipu na may tiered pricing ayon sa haba ng context. |
| GLM-5 Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextFunction CallingStructured Output | USDCost-optimized na variant ng GLM para sa high-throughput na text workloads. |
| GLM-5V Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextVisionVideoFunction CallingStructured Output | USDMultimodal na variant ng GLM; sinusuportahan ang text, image, at video input. |
| GLM-5.2↗ | Zhipu AI (GLM) | ¥8.00Cache hit ¥2.00/M | ¥28.00 | 1M | TextFunction CallingStructured Output | CNYPinakabagong flagship model. Libreng cache storage sa limited time. |
| Qwen3.7 Max↗ | Alibaba Cloud (Qwen) | ¥12.00 | ¥36.00 | 1M | TextVisionFunction CallingStructured Output | CNYTop-tier na model ng Qwen3.7 mula sa Alibaba na may 1M context. |
| Qwen3.7 Plus↗ | Alibaba Cloud (Qwen) | ¥2.00 | ¥8.00 | 1M | TextVisionFunction CallingStructured Output | CNYIba ang rate para sa context na lampas sa 256K |
| MiMo-V2.5-Pro↗ | Xiaomi (MiMo) | $0.435 | $0.87 | 1M | TextFunction CallingStructured Output | USD (≈¥3.00 / ≈¥6.00)MIT open-source |
| MiMo-V2.5↗ | Xiaomi (MiMo) | $0.14 | $0.28 | 1M | TextVisionVideoAudioFunction Calling | USD (≈¥1.00 / ≈¥2.00)Sinusuportahan ang text, image, video, at audio |
| Doubao-Pro↗ | ByteDance (Volcano Engine) | ¥1.00 | ¥2.00 | 128K | TextFunction Calling | CNYPangkalahatang-gamit na model ng Doubao mula sa ByteDance. |
| Doubao-Lite↗ | ByteDance (Volcano Engine) | ¥0.30 | ¥0.60 | 128K | TextFunction Calling | CNYMagaan at napakamurang variant ng Doubao. |
| Hunyuan-Large↗ | Tencent Cloud (Hunyuan) | ¥4.00 | ¥12.00 | 32K | TextFunction Calling | CNYMas malaki ang capacity na model ng Hunyuan mula sa Tencent. |
| Hunyuan-Standard↗ | Tencent Cloud (Hunyuan) | ¥0.50 | ¥1.00 | 32K | TextFunction Calling | CNYCost-effective na standard model ng Hunyuan. |
| ERNIE 4.5↗ | Baidu (Qianfan) | ¥8.00 | ¥24.00 | 32K | TextFunction Calling | CNYFlagship na model ng ERNIE mula sa Baidu. |
| ERNIE Speed↗ | Baidu (Qianfan) | ¥0.12 | ¥0.12 | 8K | TextFunction Calling | CNYNapakamura at mabilis na variant ng ERNIE. |
| Spark 4.0↗ | iFLYTEK (Spark) | ¥3.00 | ¥9.00 | 128K | TextFunction Calling | CNYFlagship na model ng Spark mula sa iFLYTEK. |
Legend ng kakayahan:TextVisionVideoAudioFunction CallingStructured Output
📝 Tala sa Presyo
📌 Mahalagang Paalala
• Lahat ng presyo ay kada milyong token (1M = 1,000,000 tokens) sa opisyal na pay-as-you-go rate. Ang pera ay ipinapakita ayon sa provider: ¥ = CNY (RMB), $ = USD.
• Gumagamit ang DeepSeek V4 Pro / V4 Flash ng peak/off-peak pricing: sa peak hours (09:00–12:00 at 14:00–18:00, Beijing time), parehong DOBLE ang presyo ng input at output. Ang off-peak hours ay kalahating presyo — maaaring mag-arbitrage dito ang cross-timezone traffic. Sinusuportahan din ng DeepSeek ang context caching: ang paulit-ulit na prompt prefix ay sinisingil sa mas mababang cache-hit rate (hal., V4 Pro cache hit ¥0.025/M kumpara sa cache miss ¥3.00/M).
• Qwen3.7 Plus: ang input/output na presyo sa itaas ay para sa unang 256K context. Ang paggamit na higit sa 256K ay ibang sinisingil sa mas mataas na long-context rate.
• Ang presyo ay nakadepende sa opisyal na anunsyo ng bawat platform. Nag-aalok ang ilang provider ng karagdagang volume discount, tier package, o libreng trial credit. Laging i-verify bago mag-integrate.
🔥Hindi sapat ang presyo lang?Na back-calculate namin ang real na token quota ng bawat model — tingnan kung gaano karami ang magagamit mo.Tingnan ang real na paghahambing ng quota →• Lahat ng presyo ay kada milyong token (1M = 1,000,000 tokens) sa opisyal na pay-as-you-go rate. Ang pera ay ipinapakita ayon sa provider: ¥ = CNY (RMB), $ = USD.
• Gumagamit ang DeepSeek V4 Pro / V4 Flash ng peak/off-peak pricing: sa peak hours (09:00–12:00 at 14:00–18:00, Beijing time), parehong DOBLE ang presyo ng input at output. Ang off-peak hours ay kalahating presyo — maaaring mag-arbitrage dito ang cross-timezone traffic. Sinusuportahan din ng DeepSeek ang context caching: ang paulit-ulit na prompt prefix ay sinisingil sa mas mababang cache-hit rate (hal., V4 Pro cache hit ¥0.025/M kumpara sa cache miss ¥3.00/M).
• Qwen3.7 Plus: ang input/output na presyo sa itaas ay para sa unang 256K context. Ang paggamit na higit sa 256K ay ibang sinisingil sa mas mataas na long-context rate.
• Ang presyo ay nakadepende sa opisyal na anunsyo ng bawat platform. Nag-aalok ang ilang provider ng karagdagang volume discount, tier package, o libreng trial credit. Laging i-verify bago mag-integrate.