Kinesiske AI API-priser sammenlignet 2026

Betal-per-bruk API-prising for 20+ kinesiske AI-modeller — DeepSeek, Kimi, GLM, Qwen, MiniMax og flere. Sammenlign inn-/utgangskostnader per million tokens, kontekstvinduer og funksjoner.
📅 Kontinuerlig oppdatert · 2026🏷️ 10 leverandører · 20 modeller📌 Siste oppdatering: 4. juli 2026

Sammenlign kinesiske AI API-priser 2026: Kostnad per million tokens

Bygger du med kinesiske AI-modeller via API? Vi har sammenlignet 20+ modeller fra 10 leverandører side om side — inkludert DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE og Spark. Alle priser er per million tokens (inn-/utgang), med kontekstvinduer og funksjonsmerker. Oppdatert juli 2026.

22 modeller
ModellLeverandørInngang /MUtgang /MKontekstFunksjonerNotater
DeepSeek V4 ProDeepSeek¥3.00Cache-treff ¥0.025/M¥6.001M
TextFunction CallingStructured Output
CNYI toppperiodene (09–12 og 14–18, beijing-tid) dobles priset; generell tilgjengelighet i midten av juli.
DeepSeek V4 FlashDeepSeek¥1.00Cache-treff ¥0.02/M¥2.001M
TextFunction CallingStructured Output
CNYI toppperiodene (09–12 og 14–18, beijing-tid) dobles priset.
MiniMax M3MiniMax$0.30$1.201M
TextVisionVideoFunction Calling
USDMultimodalt flaggskip fra MiniMax; støtter tekst-, bilde- og videoinndata.
Kimi K3Kimi (Moonshot AI)¥20.00Cache-treff ¥2.00/M¥100.001M
TextFunction CallingStructured Output
CNYKimis flaggskipmodell for kodning over lang tid og ende-til-ende kunnskapsarbeid. Resonnering alltid aktivert (reasoning_effort, for øyeblikket kun «max»). Støtter kontekst-caching, tool_choice og dynamisk verktøylasting. Merk: web_search oppgraderes — anbefales ikke for øyeblikket.
Kimi K2.6Kimi (Moonshot AI)¥6.50¥27.00262K
TextVisionVideoFunction Calling
CNYMultimodal Kimi-modell med thinking- og non-thinking-modus.
Kimi K2.5Kimi (Moonshot AI)¥4.00¥21.00262K
TextVisionVideoFunction Calling
CNYMultimodal Kimi-modell; støtter tekst-, bilde- og videoinndata.
Kimi K2.7 CodeKimi (Moonshot AI)¥6.50¥27.00262K
TextFunction Calling
CNYKun resonneringsmodus
GLM-5.1Zhipu AI (GLM)$1.40$4.40200K
TextFunction CallingStructured Output
USDTekstmodell fra Zhipu med nivåbasert prising etter kontekstlengde.
GLM-5 TurboZhipu AI (GLM)$1.20$4.00200K
TextFunction CallingStructured Output
USDKostnadsoptimisert GLM-variant for tekstarbeidsbelastninger med høy gjennomstrømming.
GLM-5V TurboZhipu AI (GLM)$1.20$4.00200K
TextVisionVideoFunction CallingStructured Output
USDMultimodal GLM-variant; støtter tekst-, bilde- og videoinndata.
GLM-5.2Zhipu AI (GLM)¥8.00Cache-treff ¥2.00/M¥28.001M
TextFunction CallingStructured Output
CNYNyeste flaggskipmodell. Cache-lagring tidsbegrenset gratis.
Qwen3.7 MaxAlibaba Cloud (Qwen)¥12.00¥36.001M
TextVisionFunction CallingStructured Output
CNYAlibabas toppnivåmodell Qwen3.7 med 1M kontekst.
Qwen3.7 PlusAlibaba Cloud (Qwen)¥2.00¥8.001M
TextVisionFunction CallingStructured Output
CNYKontekst over 256K faktureres til egen sats
MiMo-V2.5-ProXiaomi (MiMo)$0.435$0.871M
TextFunction CallingStructured Output
USD (≈¥3.00 / ≈¥6.00)MIT-åpen kildekode
MiMo-V2.5Xiaomi (MiMo)$0.14$0.281M
TextVisionVideoAudioFunction Calling
USD (≈¥1.00 / ≈¥2.00)Støtter tekst, bilde, video og lyd
Doubao-ProByteDance (Volcano Engine)¥1.00¥2.00128K
TextFunction Calling
CNYByteDances generelle Doubao-modell.
Doubao-LiteByteDance (Volcano Engine)¥0.30¥0.60128K
TextFunction Calling
CNYLetto og ultrabilig Doubao-variant.
Hunyuan-LargeTencent Cloud (Hunyuan)¥4.00¥12.0032K
TextFunction Calling
CNYTencents Hunyuan-modell med høyere kapasitet.
Hunyuan-StandardTencent Cloud (Hunyuan)¥0.50¥1.0032K
TextFunction Calling
CNYKostnadseffektiv Hunyuan-standardmodell.
ERNIE 4.5Baidu (Qianfan)¥8.00¥24.0032K
TextFunction Calling
CNYBaidus flaggskipmodell ERNIE.
ERNIE SpeedBaidu (Qianfan)¥0.12¥0.128K
TextFunction Calling
CNYUltrabilig ERNIE-variant med lav latens.
Spark 4.0iFLYTEK (Spark)¥3.00¥9.00128K
TextFunction Calling
CNYiFLYTEKs flaggskipmodell Spark.
Funksjonsforklaring:TekstSynVideoLydFunksjonskallStrukturert utdata

📝 Prisnotater

📌 Viktige notater
• Alle priser er per million tokens (1M = 1 000 000 tokens) til offisielle betal-per-bruk-rater. Valuta vises per leverandør: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash bruker peak-/off-peak-prising: i peak-timer (09:00–12:00 og 14:00–18:00, Beijing-tid) dobler både inn- og utgangsprisen seg. Off-peak-timer er halv pris — trafikk på tvers av tidssoner kan arbitrasjere dette. DeepSeek støtter også kontekst-mellomlagring: gjentatte prompt-prefikser faktureres til den mye lavere cache-treff-raten (f.eks. V4 Pro cache-treff ¥0.025/M mot cache-bomber ¥3.00/M).
• Qwen3.7 Plus: inn-/utgangsprisene over gjelder for de første 256K kontekst. Bruk utover 256K faktureres separat til en høyere langkontekst-rate.
• Priser er underlagt hver plattforms offisielle kunngjøringer. Noen leverandører tilbyr ytterligere volumrabatter, nivåpakker eller gratis prøvekreditter. Verifiser alltid før integrasjon.
🔥Er ikke pris alene nok?Vi tilbakekalkulerte hver modells ekte token-kvote — se hvor mye du faktisk kan bruke.Se den ekte kvotesammenligningen →