Kinesiske AI API-priser sammenligning 2026
Pay-as-you-go API-priser for 20+ kinesiske AI-modeller — DeepSeek, Kimi, GLM, Qwen, MiniMax og flere. Sammenlign input/output-omkostninger per million tokens, kontekstvinduer og funktioner.
Sammenlign kinesiske AI API-priser 2026: Omkostning per million tokens
Bygger du med kinesiske AI-modeller via API? Vi har sammenlignet 20+ modeller fra 10 udbydere side om side — inklusive DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE og Spark. Alle priser er per million tokens (input / output) med kontekstvinduer og funktionstags. Opdateret juli 2026.
| Model | Udbyder | Input /M | Output /M | Kontekst | Funktioner | Noter |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro↗ | DeepSeek | ¥3.00Cache-hit ¥0.025/M | ¥6.00 | 1M | TextFunction CallingStructured Output | CNYDobbelt pris (2x) ved spidsbelastning i tidsrummene 9–12 og 14–18 Beijing-tid; generel tilgængelighed i midten af juli |
| DeepSeek V4 Flash↗ | DeepSeek | ¥1.00Cache-hit ¥0.02/M | ¥2.00 | 1M | TextFunction CallingStructured Output | CNYDobbelt pris (2x) ved spidsbelastning i tidsrummene 9–12 og 14–18 Beijing-tid |
| MiniMax M3↗ | MiniMax | $0.30 | $1.20 | 1M | TextVisionVideoFunction Calling | USDMiniMax' flagskibs-multimodel; understøtter tekst-, billed- og videoinput. |
| Kimi K3↗ | Kimi (Moonshot AI) | ¥20.00Cache-hit ¥2.00/M | ¥100.00 | 1M | TextFunction CallingStructured Output | CNYKimis flagskibsmodel til langsgående kodning og end-to-end videnarbejde. Reasoning altid aktiveret (reasoning_effort, i øjeblikket kun 'max'). Understøtter context caching, tool_choice og dynamisk tool loading. Bemærk: web_search er under opgradering — anbefales ikke lige nu. |
| Kimi K2.6↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextVisionVideoFunction Calling | CNYKimi-multimodel med thinking- og non-thinking-tilstande. |
| Kimi K2.5↗ | Kimi (Moonshot AI) | ¥4.00 | ¥21.00 | 262K | TextVisionVideoFunction Calling | CNYKimi-multimodel; understøtter tekst-, billed- og videoinput. |
| Kimi K2.7 Code↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextFunction Calling | CNYKun reasoning-tilstand |
| GLM-5.1↗ | Zhipu AI (GLM) | $1.40 | $4.40 | 200K | TextFunction CallingStructured Output | USDZhipu-tekstmodel med lagdelt prissætning efter kontekstlængde. |
| GLM-5 Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextFunction CallingStructured Output | USDOmkostningsoptimeret GLM-variant til tekstworkloads med høj gennemstrømning. |
| GLM-5V Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextVisionVideoFunction CallingStructured Output | USDMultimodal GLM-variant; understøtter tekst-, billed- og videoinput. |
| GLM-5.2↗ | Zhipu AI (GLM) | ¥8.00Cache-hit ¥2.00/M | ¥28.00 | 1M | TextFunction CallingStructured Output | CNYNyeste flagskibsmodel. Cache-lagring midlertidigt gratis. |
| Qwen3.7 Max↗ | Alibaba Cloud (Qwen) | ¥12.00 | ¥36.00 | 1M | TextVisionFunction CallingStructured Output | CNYAlibabas top-tier Qwen3.7-model med 1M kontekst. |
| Qwen3.7 Plus↗ | Alibaba Cloud (Qwen) | ¥2.00 | ¥8.00 | 1M | TextVisionFunction CallingStructured Output | CNYKontekst over 256K afregnes til separat sats |
| MiMo-V2.5-Pro↗ | Xiaomi (MiMo) | $0.435 | $0.87 | 1M | TextFunction CallingStructured Output | USD (≈¥3.00 / ≈¥6.00)MIT open source |
| MiMo-V2.5↗ | Xiaomi (MiMo) | $0.14 | $0.28 | 1M | TextVisionVideoAudioFunction Calling | USD (≈¥1.00 / ≈¥2.00)Understøtter tekst, billede, video og lyd |
| Doubao-Pro↗ | ByteDance (Volcano Engine) | ¥1.00 | ¥2.00 | 128K | TextFunction Calling | CNYByteDances generelle Doubao-model. |
| Doubao-Lite↗ | ByteDance (Volcano Engine) | ¥0.30 | ¥0.60 | 128K | TextFunction Calling | CNYLetvægts-Doubao-variant til ekstremt lav pris. |
| Hunyuan-Large↗ | Tencent Cloud (Hunyuan) | ¥4.00 | ¥12.00 | 32K | TextFunction Calling | CNYTencents Hunyuan-model med højere kapacitet. |
| Hunyuan-Standard↗ | Tencent Cloud (Hunyuan) | ¥0.50 | ¥1.00 | 32K | TextFunction Calling | CNYOmkostningseffektiv Hunyuan-standardmodel. |
| ERNIE 4.5↗ | Baidu (Qianfan) | ¥8.00 | ¥24.00 | 32K | TextFunction Calling | CNYBaidus flagskibs-ERNIE-model. |
| ERNIE Speed↗ | Baidu (Qianfan) | ¥0.12 | ¥0.12 | 8K | TextFunction Calling | CNYEkstremt billig ERNIE-variant med lav latens. |
| Spark 4.0↗ | iFLYTEK (Spark) | ¥3.00 | ¥9.00 | 128K | TextFunction Calling | CNYiFLYTEKs flagskibs-Spark-model. |
Funktionsforklaring:TekstSynVideoLydFunktionskaldStruktureret output
📝 Prisnoter
📌 Vigtige noter
• Alle priser er per million tokens (1M = 1.000.000 tokens) til officielle pay-as-you-go-rater. Valuta vises per udbyder: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash bruger peak/off-peak-priser: i peak-timer (09:00–12:00 og 14:00–18:00, Beijing-tid) dobbles både input- og outputpriser. Off-peak timer er halv pris — trafik på tværs af tidszoner kan arbitrere dette. DeepSeek understøtter også kontekstcaching: gentagne prompt-præfikser faktureres til den meget lavere cache-hit-rate (f.eks. V4 Pro cache-hit ¥0.025/M vs. cache-miss ¥3.00/M).
• Qwen3.7 Plus: input/output-priser ovenfor gælder for de første 256K kontekst. Forbrug ud over 256K faktureres separat til en højere lang-kontekst-rate.
• Priser er underlagt hver platforms officielle meddelelser. Nogle udbydere tilbyder yderligere volumen-rabatter, pakkeløsninger eller gratis prøvekredit. Verificer altid inden integration.
🔥Er pris alene ikke nok?Vi har tilbage-udregnet hver models ægte token-kvote — se hvor meget du faktisk kan bruge.Se den ægte kvotesammenligning →• Alle priser er per million tokens (1M = 1.000.000 tokens) til officielle pay-as-you-go-rater. Valuta vises per udbyder: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash bruger peak/off-peak-priser: i peak-timer (09:00–12:00 og 14:00–18:00, Beijing-tid) dobbles både input- og outputpriser. Off-peak timer er halv pris — trafik på tværs af tidszoner kan arbitrere dette. DeepSeek understøtter også kontekstcaching: gentagne prompt-præfikser faktureres til den meget lavere cache-hit-rate (f.eks. V4 Pro cache-hit ¥0.025/M vs. cache-miss ¥3.00/M).
• Qwen3.7 Plus: input/output-priser ovenfor gælder for de første 256K kontekst. Forbrug ud over 256K faktureres separat til en højere lang-kontekst-rate.
• Priser er underlagt hver platforms officielle meddelelser. Nogle udbydere tilbyder yderligere volumen-rabatter, pakkeløsninger eller gratis prøvekredit. Verificer altid inden integration.