Kinesiske AI API-priser sammenlignet 2026
Betal-per-bruk API-prising for 20+ kinesiske AI-modeller — DeepSeek, Kimi, GLM, Qwen, MiniMax og flere. Sammenlign inn-/utgangskostnader per million tokens, kontekstvinduer og funksjoner.
Sammenlign kinesiske AI API-priser 2026: Kostnad per million tokens
Bygger du med kinesiske AI-modeller via API? Vi har sammenlignet 20+ modeller fra 10 leverandører side om side — inkludert DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE og Spark. Alle priser er per million tokens (inn-/utgang), med kontekstvinduer og funksjonsmerker. Oppdatert juli 2026.
| Modell | Leverandør | Inngang /M | Utgang /M | Kontekst | Funksjoner | Notater |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro↗ | DeepSeek | ¥3.00Cache-treff ¥0.025/M | ¥6.00 | 1M | TextFunction CallingStructured Output | CNYI toppperiodene (09–12 og 14–18, beijing-tid) dobles priset; generell tilgjengelighet i midten av juli. |
| DeepSeek V4 Flash↗ | DeepSeek | ¥1.00Cache-treff ¥0.02/M | ¥2.00 | 1M | TextFunction CallingStructured Output | CNYI toppperiodene (09–12 og 14–18, beijing-tid) dobles priset. |
| MiniMax M3↗ | MiniMax | $0.30 | $1.20 | 1M | TextVisionVideoFunction Calling | USDMultimodalt flaggskip fra MiniMax; støtter tekst-, bilde- og videoinndata. |
| Kimi K3↗ | Kimi (Moonshot AI) | ¥20.00Cache-treff ¥2.00/M | ¥100.00 | 1M | TextFunction CallingStructured Output | CNYKimis flaggskipmodell for kodning over lang tid og ende-til-ende kunnskapsarbeid. Resonnering alltid aktivert (reasoning_effort, for øyeblikket kun «max»). Støtter kontekst-caching, tool_choice og dynamisk verktøylasting. Merk: web_search oppgraderes — anbefales ikke for øyeblikket. |
| Kimi K2.6↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextVisionVideoFunction Calling | CNYMultimodal Kimi-modell med thinking- og non-thinking-modus. |
| Kimi K2.5↗ | Kimi (Moonshot AI) | ¥4.00 | ¥21.00 | 262K | TextVisionVideoFunction Calling | CNYMultimodal Kimi-modell; støtter tekst-, bilde- og videoinndata. |
| Kimi K2.7 Code↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextFunction Calling | CNYKun resonneringsmodus |
| GLM-5.1↗ | Zhipu AI (GLM) | $1.40 | $4.40 | 200K | TextFunction CallingStructured Output | USDTekstmodell fra Zhipu med nivåbasert prising etter kontekstlengde. |
| GLM-5 Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextFunction CallingStructured Output | USDKostnadsoptimisert GLM-variant for tekstarbeidsbelastninger med høy gjennomstrømming. |
| GLM-5V Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextVisionVideoFunction CallingStructured Output | USDMultimodal GLM-variant; støtter tekst-, bilde- og videoinndata. |
| GLM-5.2↗ | Zhipu AI (GLM) | ¥8.00Cache-treff ¥2.00/M | ¥28.00 | 1M | TextFunction CallingStructured Output | CNYNyeste flaggskipmodell. Cache-lagring tidsbegrenset gratis. |
| Qwen3.7 Max↗ | Alibaba Cloud (Qwen) | ¥12.00 | ¥36.00 | 1M | TextVisionFunction CallingStructured Output | CNYAlibabas toppnivåmodell Qwen3.7 med 1M kontekst. |
| Qwen3.7 Plus↗ | Alibaba Cloud (Qwen) | ¥2.00 | ¥8.00 | 1M | TextVisionFunction CallingStructured Output | CNYKontekst over 256K faktureres til egen sats |
| MiMo-V2.5-Pro↗ | Xiaomi (MiMo) | $0.435 | $0.87 | 1M | TextFunction CallingStructured Output | USD (≈¥3.00 / ≈¥6.00)MIT-åpen kildekode |
| MiMo-V2.5↗ | Xiaomi (MiMo) | $0.14 | $0.28 | 1M | TextVisionVideoAudioFunction Calling | USD (≈¥1.00 / ≈¥2.00)Støtter tekst, bilde, video og lyd |
| Doubao-Pro↗ | ByteDance (Volcano Engine) | ¥1.00 | ¥2.00 | 128K | TextFunction Calling | CNYByteDances generelle Doubao-modell. |
| Doubao-Lite↗ | ByteDance (Volcano Engine) | ¥0.30 | ¥0.60 | 128K | TextFunction Calling | CNYLetto og ultrabilig Doubao-variant. |
| Hunyuan-Large↗ | Tencent Cloud (Hunyuan) | ¥4.00 | ¥12.00 | 32K | TextFunction Calling | CNYTencents Hunyuan-modell med høyere kapasitet. |
| Hunyuan-Standard↗ | Tencent Cloud (Hunyuan) | ¥0.50 | ¥1.00 | 32K | TextFunction Calling | CNYKostnadseffektiv Hunyuan-standardmodell. |
| ERNIE 4.5↗ | Baidu (Qianfan) | ¥8.00 | ¥24.00 | 32K | TextFunction Calling | CNYBaidus flaggskipmodell ERNIE. |
| ERNIE Speed↗ | Baidu (Qianfan) | ¥0.12 | ¥0.12 | 8K | TextFunction Calling | CNYUltrabilig ERNIE-variant med lav latens. |
| Spark 4.0↗ | iFLYTEK (Spark) | ¥3.00 | ¥9.00 | 128K | TextFunction Calling | CNYiFLYTEKs flaggskipmodell Spark. |
Funksjonsforklaring:TekstSynVideoLydFunksjonskallStrukturert utdata
📝 Prisnotater
📌 Viktige notater
• Alle priser er per million tokens (1M = 1 000 000 tokens) til offisielle betal-per-bruk-rater. Valuta vises per leverandør: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash bruker peak-/off-peak-prising: i peak-timer (09:00–12:00 og 14:00–18:00, Beijing-tid) dobler både inn- og utgangsprisen seg. Off-peak-timer er halv pris — trafikk på tvers av tidssoner kan arbitrasjere dette. DeepSeek støtter også kontekst-mellomlagring: gjentatte prompt-prefikser faktureres til den mye lavere cache-treff-raten (f.eks. V4 Pro cache-treff ¥0.025/M mot cache-bomber ¥3.00/M).
• Qwen3.7 Plus: inn-/utgangsprisene over gjelder for de første 256K kontekst. Bruk utover 256K faktureres separat til en høyere langkontekst-rate.
• Priser er underlagt hver plattforms offisielle kunngjøringer. Noen leverandører tilbyr ytterligere volumrabatter, nivåpakker eller gratis prøvekreditter. Verifiser alltid før integrasjon.
🔥Er ikke pris alene nok?Vi tilbakekalkulerte hver modells ekte token-kvote — se hvor mye du faktisk kan bruke.Se den ekte kvotesammenligningen →• Alle priser er per million tokens (1M = 1 000 000 tokens) til offisielle betal-per-bruk-rater. Valuta vises per leverandør: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash bruker peak-/off-peak-prising: i peak-timer (09:00–12:00 og 14:00–18:00, Beijing-tid) dobler både inn- og utgangsprisen seg. Off-peak-timer er halv pris — trafikk på tvers av tidssoner kan arbitrasjere dette. DeepSeek støtter også kontekst-mellomlagring: gjentatte prompt-prefikser faktureres til den mye lavere cache-treff-raten (f.eks. V4 Pro cache-treff ¥0.025/M mot cache-bomber ¥3.00/M).
• Qwen3.7 Plus: inn-/utgangsprisene over gjelder for de første 256K kontekst. Bruk utover 256K faktureres separat til en høyere langkontekst-rate.
• Priser er underlagt hver plattforms offisielle kunngjøringer. Noen leverandører tilbyr ytterligere volumrabatter, nivåpakker eller gratis prøvekreditter. Verifiser alltid før integrasjon.