Kinesiske AI API-priser sammenligning 2026

Pay-as-you-go API-priser for 20+ kinesiske AI-modeller — DeepSeek, Kimi, GLM, Qwen, MiniMax og flere. Sammenlign input/output-omkostninger per million tokens, kontekstvinduer og funktioner.
📅 Løbende opdateret · 2026🏷️ 10 udbydere · 20 modeller📌 Sidste opdatering: 4. juli 2026

Sammenlign kinesiske AI API-priser 2026: Omkostning per million tokens

Bygger du med kinesiske AI-modeller via API? Vi har sammenlignet 20+ modeller fra 10 udbydere side om side — inklusive DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE og Spark. Alle priser er per million tokens (input / output) med kontekstvinduer og funktionstags. Opdateret juli 2026.

22 modeller
ModelUdbyderInput /MOutput /MKontekstFunktionerNoter
DeepSeek V4 ProDeepSeek¥3.00Cache-hit ¥0.025/M¥6.001M
TextFunction CallingStructured Output
CNYDobbelt pris (2x) ved spidsbelastning i tidsrummene 9–12 og 14–18 Beijing-tid; generel tilgængelighed i midten af juli
DeepSeek V4 FlashDeepSeek¥1.00Cache-hit ¥0.02/M¥2.001M
TextFunction CallingStructured Output
CNYDobbelt pris (2x) ved spidsbelastning i tidsrummene 9–12 og 14–18 Beijing-tid
MiniMax M3MiniMax$0.30$1.201M
TextVisionVideoFunction Calling
USDMiniMax' flagskibs-multimodel; understøtter tekst-, billed- og videoinput.
Kimi K3Kimi (Moonshot AI)¥20.00Cache-hit ¥2.00/M¥100.001M
TextFunction CallingStructured Output
CNYKimis flagskibsmodel til langsgående kodning og end-to-end videnarbejde. Reasoning altid aktiveret (reasoning_effort, i øjeblikket kun 'max'). Understøtter context caching, tool_choice og dynamisk tool loading. Bemærk: web_search er under opgradering — anbefales ikke lige nu.
Kimi K2.6Kimi (Moonshot AI)¥6.50¥27.00262K
TextVisionVideoFunction Calling
CNYKimi-multimodel med thinking- og non-thinking-tilstande.
Kimi K2.5Kimi (Moonshot AI)¥4.00¥21.00262K
TextVisionVideoFunction Calling
CNYKimi-multimodel; understøtter tekst-, billed- og videoinput.
Kimi K2.7 CodeKimi (Moonshot AI)¥6.50¥27.00262K
TextFunction Calling
CNYKun reasoning-tilstand
GLM-5.1Zhipu AI (GLM)$1.40$4.40200K
TextFunction CallingStructured Output
USDZhipu-tekstmodel med lagdelt prissætning efter kontekstlængde.
GLM-5 TurboZhipu AI (GLM)$1.20$4.00200K
TextFunction CallingStructured Output
USDOmkostningsoptimeret GLM-variant til tekstworkloads med høj gennemstrømning.
GLM-5V TurboZhipu AI (GLM)$1.20$4.00200K
TextVisionVideoFunction CallingStructured Output
USDMultimodal GLM-variant; understøtter tekst-, billed- og videoinput.
GLM-5.2Zhipu AI (GLM)¥8.00Cache-hit ¥2.00/M¥28.001M
TextFunction CallingStructured Output
CNYNyeste flagskibsmodel. Cache-lagring midlertidigt gratis.
Qwen3.7 MaxAlibaba Cloud (Qwen)¥12.00¥36.001M
TextVisionFunction CallingStructured Output
CNYAlibabas top-tier Qwen3.7-model med 1M kontekst.
Qwen3.7 PlusAlibaba Cloud (Qwen)¥2.00¥8.001M
TextVisionFunction CallingStructured Output
CNYKontekst over 256K afregnes til separat sats
MiMo-V2.5-ProXiaomi (MiMo)$0.435$0.871M
TextFunction CallingStructured Output
USD (≈¥3.00 / ≈¥6.00)MIT open source
MiMo-V2.5Xiaomi (MiMo)$0.14$0.281M
TextVisionVideoAudioFunction Calling
USD (≈¥1.00 / ≈¥2.00)Understøtter tekst, billede, video og lyd
Doubao-ProByteDance (Volcano Engine)¥1.00¥2.00128K
TextFunction Calling
CNYByteDances generelle Doubao-model.
Doubao-LiteByteDance (Volcano Engine)¥0.30¥0.60128K
TextFunction Calling
CNYLetvægts-Doubao-variant til ekstremt lav pris.
Hunyuan-LargeTencent Cloud (Hunyuan)¥4.00¥12.0032K
TextFunction Calling
CNYTencents Hunyuan-model med højere kapacitet.
Hunyuan-StandardTencent Cloud (Hunyuan)¥0.50¥1.0032K
TextFunction Calling
CNYOmkostningseffektiv Hunyuan-standardmodel.
ERNIE 4.5Baidu (Qianfan)¥8.00¥24.0032K
TextFunction Calling
CNYBaidus flagskibs-ERNIE-model.
ERNIE SpeedBaidu (Qianfan)¥0.12¥0.128K
TextFunction Calling
CNYEkstremt billig ERNIE-variant med lav latens.
Spark 4.0iFLYTEK (Spark)¥3.00¥9.00128K
TextFunction Calling
CNYiFLYTEKs flagskibs-Spark-model.
Funktionsforklaring:TekstSynVideoLydFunktionskaldStruktureret output

📝 Prisnoter

📌 Vigtige noter
• Alle priser er per million tokens (1M = 1.000.000 tokens) til officielle pay-as-you-go-rater. Valuta vises per udbyder: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash bruger peak/off-peak-priser: i peak-timer (09:00–12:00 og 14:00–18:00, Beijing-tid) dobbles både input- og outputpriser. Off-peak timer er halv pris — trafik på tværs af tidszoner kan arbitrere dette. DeepSeek understøtter også kontekstcaching: gentagne prompt-præfikser faktureres til den meget lavere cache-hit-rate (f.eks. V4 Pro cache-hit ¥0.025/M vs. cache-miss ¥3.00/M).
• Qwen3.7 Plus: input/output-priser ovenfor gælder for de første 256K kontekst. Forbrug ud over 256K faktureres separat til en højere lang-kontekst-rate.
• Priser er underlagt hver platforms officielle meddelelser. Nogle udbydere tilbyder yderligere volumen-rabatter, pakkeløsninger eller gratis prøvekredit. Verificer altid inden integration.
🔥Er pris alene ikke nok?Vi har tilbage-udregnet hver models ægte token-kvote — se hvor meget du faktisk kan bruge.Se den ægte kvotesammenligning →