Chinese AI API-prijzen vergeleken 2026
Pay-as-you-go API-prijzen voor 20+ Chinese AI-modellen — DeepSeek, Kimi, GLM, Qwen, MiniMax en meer. Vergelijk in-/uitvoerkosten per miljoen tokens, contextvensters en mogelijkheden.
Chinese AI API-prijzen vergeleken 2026: kosten per miljoen tokens
Bouwen met Chinese AI-modellen via de API? We hebben 20+ modellen van 10 aanbieders naast elkaar vergeleken — waaronder DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE en Spark. Alle prijzen zijn per miljoen tokens (invoer / uitvoer), met contextvensters en capability-tags. Bijgewerkt juli 2026.
| Model | Aanbieder | Invoer /M | Uitvoer /M | Context | Mogelijkheden | Opmerkingen |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro↗ | DeepSeek | ¥3.00Cache-hit ¥0.025/M | ¥6.00 | 1M | TextFunction CallingStructured Output | CNYTijdens de piekuren (09.00–12.00 en 14.00–18.00, Peking-tijd) geldt het dubbele tarief; algemene beschikbaarheid medio juli. |
| DeepSeek V4 Flash↗ | DeepSeek | ¥1.00Cache-hit ¥0.02/M | ¥2.00 | 1M | TextFunction CallingStructured Output | CNYTijdens de piekuren (09.00–12.00 en 14.00–18.00, Peking-tijd) geldt het dubbele tarief. |
| MiniMax M3↗ | MiniMax | $0.30 | $1.20 | 1M | TextVisionVideoFunction Calling | USDMultimodaal vlaggenschipmodel van MiniMax; ondersteunt tekst-, afbeeldings- en video-invoer. |
| Kimi K3↗ | Kimi (Moonshot AI) | ¥20.00Cache-hit ¥2.00/M | ¥100.00 | 1M | TextFunction CallingStructured Output | CNYVlaggenschipmodel van Kimi voor langlopende codeerklusjes en end-to-end kenniswerk. Altijd-aan-redeneren (reasoning_effort, momenteel alleen 'max'). Ondersteunt context-caching, tool_choice en dynamisch laden van tools. Let op: web_search wordt geüpgraded — voorlopig niet aanbevolen. |
| Kimi K2.6↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextVisionVideoFunction Calling | CNYMultimodaal model van Kimi met thinking- en non-thinking modi. |
| Kimi K2.5↗ | Kimi (Moonshot AI) | ¥4.00 | ¥21.00 | 262K | TextVisionVideoFunction Calling | CNYMultimodaal model van Kimi; ondersteunt tekst-, afbeeldings- en video-invoer. |
| Kimi K2.7 Code↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextFunction Calling | CNYUitsluitend reasoning-modus |
| GLM-5.1↗ | Zhipu AI (GLM) | $1.40 | $4.40 | 200K | TextFunction CallingStructured Output | USDTekstmodel van Zhipu met gelaagde prijsstelling op basis van contextlengte. |
| GLM-5 Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextFunction CallingStructured Output | USDKostengeoptimaliseerde GLM-variant voor tekstworkloads met hoge doorvoer. |
| GLM-5V Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextVisionVideoFunction CallingStructured Output | USDMultimodale GLM-variant; ondersteunt tekst-, afbeeldings- en video-invoer. |
| GLM-5.2↗ | Zhipu AI (GLM) | ¥8.00Cache-hit ¥2.00/M | ¥28.00 | 1M | TextFunction CallingStructured Output | CNYNieuwste vlaggenschipmodel. Cache-opslag tijdelijk gratis. |
| Qwen3.7 Max↗ | Alibaba Cloud (Qwen) | ¥12.00 | ¥36.00 | 1M | TextVisionFunction CallingStructured Output | CNYQwen3.7-topmodel van Alibaba met 1M context. |
| Qwen3.7 Plus↗ | Alibaba Cloud (Qwen) | ¥2.00 | ¥8.00 | 1M | TextVisionFunction CallingStructured Output | CNYContext boven 256K wordt tegen een apart tarief gefactureerd |
| MiMo-V2.5-Pro↗ | Xiaomi (MiMo) | $0.435 | $0.87 | 1M | TextFunction CallingStructured Output | USD (≈¥3.00 / ≈¥6.00)MIT open-source |
| MiMo-V2.5↗ | Xiaomi (MiMo) | $0.14 | $0.28 | 1M | TextVisionVideoAudioFunction Calling | USD (≈¥1.00 / ≈¥2.00)Ondersteunt tekst, afbeelding, video en audio |
| Doubao-Pro↗ | ByteDance (Volcano Engine) | ¥1.00 | ¥2.00 | 128K | TextFunction Calling | CNYHet algemene Doubao-model van ByteDance. |
| Doubao-Lite↗ | ByteDance (Volcano Engine) | ¥0.30 | ¥0.60 | 128K | TextFunction Calling | CNYLichtgewicht, extreem goedkope Doubao-variant. |
| Hunyuan-Large↗ | Tencent Cloud (Hunyuan) | ¥4.00 | ¥12.00 | 32K | TextFunction Calling | CNYHet Hunyuan-model met grotere capaciteit van Tencent. |
| Hunyuan-Standard↗ | Tencent Cloud (Hunyuan) | ¥0.50 | ¥1.00 | 32K | TextFunction Calling | CNYKostenefficiënt standaard Hunyuan-model. |
| ERNIE 4.5↗ | Baidu (Qianfan) | ¥8.00 | ¥24.00 | 32K | TextFunction Calling | CNYHet ERNIE-vlaggenschipmodel van Baidu. |
| ERNIE Speed↗ | Baidu (Qianfan) | ¥0.12 | ¥0.12 | 8K | TextFunction Calling | CNYExtreem goedkope, lage-latency ERNIE-variant. |
| Spark 4.0↗ | iFLYTEK (Spark) | ¥3.00 | ¥9.00 | 128K | TextFunction Calling | CNYHet Spark-vlaggenschipmodel van iFLYTEK. |
Mogelijkheden-legenda:TekstVisieVideoAudioFunction CallingGestructureerde uitvoer
📝 Prijstopmerkingen
📌 Belangrijke opmerkingen
• Alle prijzen zijn per miljoen tokens (1M = 1,000,000 tokens) tegen officiële pay-as-you-go-tarieven. Valuta wordt per aanbieder getoond: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash gebruikt piek/dal-prijzen: tijdens piekuren (09:00–12:00 en 14:00–18:00, Peking-tijd) verdubbelen zowel de invoer- als uitvoerprijs. Daluren zijn halve prijs — verkeer uit andere tijdzones kan dit arbitreren. DeepSeek ondersteunt ook context-caching: herhaalde prompt-prefixen worden gefactureerd tegen het veel lagere cache-hit-tarief (bijv. V4 Pro cache-hit ¥0.025/M vs. cache-miss ¥3.00/M).
• Qwen3.7 Plus: de bovenstaande invoer-/uitvoerprijzen gelden voor de eerste 256K context. Gebruik boven 256K wordt afzonderlijk gefactureerd tegen een hoger tarief voor lange-context.
• Prijzen zijn onderhevig aan de officiële aankondigingen van elk platform. Sommige aanbieders bieden extra volumekortingen, tier-pakketten of gratis proef-credits. Verifieer altijd vóór integratie.
🔥Is prijs alleen niet genoeg?We hebben de echte token-quota van elk model terug-berekend — zie hoeveel je echt kunt gebruiken.Bekijk de echte quota-vergelijking →• Alle prijzen zijn per miljoen tokens (1M = 1,000,000 tokens) tegen officiële pay-as-you-go-tarieven. Valuta wordt per aanbieder getoond: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash gebruikt piek/dal-prijzen: tijdens piekuren (09:00–12:00 en 14:00–18:00, Peking-tijd) verdubbelen zowel de invoer- als uitvoerprijs. Daluren zijn halve prijs — verkeer uit andere tijdzones kan dit arbitreren. DeepSeek ondersteunt ook context-caching: herhaalde prompt-prefixen worden gefactureerd tegen het veel lagere cache-hit-tarief (bijv. V4 Pro cache-hit ¥0.025/M vs. cache-miss ¥3.00/M).
• Qwen3.7 Plus: de bovenstaande invoer-/uitvoerprijzen gelden voor de eerste 256K context. Gebruik boven 256K wordt afzonderlijk gefactureerd tegen een hoger tarief voor lange-context.
• Prijzen zijn onderhevig aan de officiële aankondigingen van elk platform. Sommige aanbieders bieden extra volumekortingen, tier-pakketten of gratis proef-credits. Verifieer altijd vóór integratie.