Chinese AI API-prijzen vergeleken 2026

Pay-as-you-go API-prijzen voor 20+ Chinese AI-modellen — DeepSeek, Kimi, GLM, Qwen, MiniMax en meer. Vergelijk in-/uitvoerkosten per miljoen tokens, contextvensters en mogelijkheden.
📅 Doorlopend bijgewerkt · 2026🏷️ 10 aanbieders · 20 modellen📌 Laatste update: 4 juli 2026

Chinese AI API-prijzen vergeleken 2026: kosten per miljoen tokens

Bouwen met Chinese AI-modellen via de API? We hebben 20+ modellen van 10 aanbieders naast elkaar vergeleken — waaronder DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE en Spark. Alle prijzen zijn per miljoen tokens (invoer / uitvoer), met contextvensters en capability-tags. Bijgewerkt juli 2026.

22 modellen
ModelAanbiederInvoer /MUitvoer /MContextMogelijkhedenOpmerkingen
DeepSeek V4 ProDeepSeek¥3.00Cache-hit ¥0.025/M¥6.001M
TextFunction CallingStructured Output
CNYTijdens de piekuren (09.00–12.00 en 14.00–18.00, Peking-tijd) geldt het dubbele tarief; algemene beschikbaarheid medio juli.
DeepSeek V4 FlashDeepSeek¥1.00Cache-hit ¥0.02/M¥2.001M
TextFunction CallingStructured Output
CNYTijdens de piekuren (09.00–12.00 en 14.00–18.00, Peking-tijd) geldt het dubbele tarief.
MiniMax M3MiniMax$0.30$1.201M
TextVisionVideoFunction Calling
USDMultimodaal vlaggenschipmodel van MiniMax; ondersteunt tekst-, afbeeldings- en video-invoer.
Kimi K3Kimi (Moonshot AI)¥20.00Cache-hit ¥2.00/M¥100.001M
TextFunction CallingStructured Output
CNYVlaggenschipmodel van Kimi voor langlopende codeerklusjes en end-to-end kenniswerk. Altijd-aan-redeneren (reasoning_effort, momenteel alleen 'max'). Ondersteunt context-caching, tool_choice en dynamisch laden van tools. Let op: web_search wordt geüpgraded — voorlopig niet aanbevolen.
Kimi K2.6Kimi (Moonshot AI)¥6.50¥27.00262K
TextVisionVideoFunction Calling
CNYMultimodaal model van Kimi met thinking- en non-thinking modi.
Kimi K2.5Kimi (Moonshot AI)¥4.00¥21.00262K
TextVisionVideoFunction Calling
CNYMultimodaal model van Kimi; ondersteunt tekst-, afbeeldings- en video-invoer.
Kimi K2.7 CodeKimi (Moonshot AI)¥6.50¥27.00262K
TextFunction Calling
CNYUitsluitend reasoning-modus
GLM-5.1Zhipu AI (GLM)$1.40$4.40200K
TextFunction CallingStructured Output
USDTekstmodel van Zhipu met gelaagde prijsstelling op basis van contextlengte.
GLM-5 TurboZhipu AI (GLM)$1.20$4.00200K
TextFunction CallingStructured Output
USDKostengeoptimaliseerde GLM-variant voor tekstworkloads met hoge doorvoer.
GLM-5V TurboZhipu AI (GLM)$1.20$4.00200K
TextVisionVideoFunction CallingStructured Output
USDMultimodale GLM-variant; ondersteunt tekst-, afbeeldings- en video-invoer.
GLM-5.2Zhipu AI (GLM)¥8.00Cache-hit ¥2.00/M¥28.001M
TextFunction CallingStructured Output
CNYNieuwste vlaggenschipmodel. Cache-opslag tijdelijk gratis.
Qwen3.7 MaxAlibaba Cloud (Qwen)¥12.00¥36.001M
TextVisionFunction CallingStructured Output
CNYQwen3.7-topmodel van Alibaba met 1M context.
Qwen3.7 PlusAlibaba Cloud (Qwen)¥2.00¥8.001M
TextVisionFunction CallingStructured Output
CNYContext boven 256K wordt tegen een apart tarief gefactureerd
MiMo-V2.5-ProXiaomi (MiMo)$0.435$0.871M
TextFunction CallingStructured Output
USD (≈¥3.00 / ≈¥6.00)MIT open-source
MiMo-V2.5Xiaomi (MiMo)$0.14$0.281M
TextVisionVideoAudioFunction Calling
USD (≈¥1.00 / ≈¥2.00)Ondersteunt tekst, afbeelding, video en audio
Doubao-ProByteDance (Volcano Engine)¥1.00¥2.00128K
TextFunction Calling
CNYHet algemene Doubao-model van ByteDance.
Doubao-LiteByteDance (Volcano Engine)¥0.30¥0.60128K
TextFunction Calling
CNYLichtgewicht, extreem goedkope Doubao-variant.
Hunyuan-LargeTencent Cloud (Hunyuan)¥4.00¥12.0032K
TextFunction Calling
CNYHet Hunyuan-model met grotere capaciteit van Tencent.
Hunyuan-StandardTencent Cloud (Hunyuan)¥0.50¥1.0032K
TextFunction Calling
CNYKostenefficiënt standaard Hunyuan-model.
ERNIE 4.5Baidu (Qianfan)¥8.00¥24.0032K
TextFunction Calling
CNYHet ERNIE-vlaggenschipmodel van Baidu.
ERNIE SpeedBaidu (Qianfan)¥0.12¥0.128K
TextFunction Calling
CNYExtreem goedkope, lage-latency ERNIE-variant.
Spark 4.0iFLYTEK (Spark)¥3.00¥9.00128K
TextFunction Calling
CNYHet Spark-vlaggenschipmodel van iFLYTEK.
Mogelijkheden-legenda:TekstVisieVideoAudioFunction CallingGestructureerde uitvoer

📝 Prijstopmerkingen

📌 Belangrijke opmerkingen
• Alle prijzen zijn per miljoen tokens (1M = 1,000,000 tokens) tegen officiële pay-as-you-go-tarieven. Valuta wordt per aanbieder getoond: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash gebruikt piek/dal-prijzen: tijdens piekuren (09:00–12:00 en 14:00–18:00, Peking-tijd) verdubbelen zowel de invoer- als uitvoerprijs. Daluren zijn halve prijs — verkeer uit andere tijdzones kan dit arbitreren. DeepSeek ondersteunt ook context-caching: herhaalde prompt-prefixen worden gefactureerd tegen het veel lagere cache-hit-tarief (bijv. V4 Pro cache-hit ¥0.025/M vs. cache-miss ¥3.00/M).
• Qwen3.7 Plus: de bovenstaande invoer-/uitvoerprijzen gelden voor de eerste 256K context. Gebruik boven 256K wordt afzonderlijk gefactureerd tegen een hoger tarief voor lange-context.
• Prijzen zijn onderhevig aan de officiële aankondigingen van elk platform. Sommige aanbieders bieden extra volumekortingen, tier-pakketten of gratis proef-credits. Verifieer altijd vóór integratie.
🔥Is prijs alleen niet genoeg?We hebben de echte token-quota van elk model terug-berekend — zie hoeveel je echt kunt gebruiken.Bekijk de echte quota-vergelijking →