Kinesiska AI API-prisjämförelse 2026

Betalningsper-användning API-priser för 20+ kinesiska AI-modeller — DeepSeek, Kimi, GLM, Qwen, MiniMax och fler. Jämför in-/utmatningskostnader per miljon token, kontextfönster och funktioner.
📅 Kontinuerligt uppdaterad · 2026🏷️ 10 leverantörer · 20 modeller📌 Senaste uppdatering: 4 juli 2026

Jämför kinesiska AI API-priser 2026: Kostnad per miljon token

Bygger med kinesiska AI-modeller via API? Vi har jämfört 20+ modeller från 10 leverantörer sida vid sida — inklusive DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE och Spark. Alla priser är per miljon token (in / ut), med kontextfönster och funktionsetiketter. Uppdaterad juli 2026.

22 modeller
ModellLeverantörInmatning /MUtmatning /MKontextFunktionerNoteringar
DeepSeek V4 ProDeepSeek¥3.00Cache-träff ¥0.025/M¥6.001M
TextFunction CallingStructured Output
CNYUnder toppiderna (09.00–12.00 och 14.00–18.00, Peking-tid) fördubblas priset; allmän tillgänglighet i mitten av juli.
DeepSeek V4 FlashDeepSeek¥1.00Cache-träff ¥0.02/M¥2.001M
TextFunction CallingStructured Output
CNYUnder toppiderna (09.00–12.00 och 14.00–18.00, Peking-tid) fördubblas priset.
MiniMax M3MiniMax$0.30$1.201M
TextVisionVideoFunction Calling
USDMultimodalt flaggskepp från MiniMax; stöder text-, bild- och videoindata.
Kimi K3Kimi (Moonshot AI)¥20.00Cache-träff ¥2.00/M¥100.001M
TextFunction CallingStructured Output
CNYKimis flaggskepp för kodning över lång tid och end-to-end-kunskapsarbete. Reasoning alltid aktiverat (reasoning_effort, för närvarande endast 'max'). Stöder context caching, tool_choice och dynamisk verktygsinläsning. Obs: web_search håller på att uppgraderas — rekommenderas inte för närvarande.
Kimi K2.6Kimi (Moonshot AI)¥6.50¥27.00262K
TextVisionVideoFunction Calling
CNYMultimodal Kimi-modell med thinking- och non-thinking-lägen.
Kimi K2.5Kimi (Moonshot AI)¥4.00¥21.00262K
TextVisionVideoFunction Calling
CNYMultimodal Kimi-modell; stöder text-, bild- och videoindata.
Kimi K2.7 CodeKimi (Moonshot AI)¥6.50¥27.00262K
TextFunction Calling
CNYEndast reasoning-läge
GLM-5.1Zhipu AI (GLM)$1.40$4.40200K
TextFunction CallingStructured Output
USDTextmodell från Zhipu med nivåindelad prissättning utifrån kontextlängd.
GLM-5 TurboZhipu AI (GLM)$1.20$4.00200K
TextFunction CallingStructured Output
USDKostnadsoptimerad GLM-variant för textarbetsbelastningar med hög genomströmning.
GLM-5V TurboZhipu AI (GLM)$1.20$4.00200K
TextVisionVideoFunction CallingStructured Output
USDMultimodal GLM-variant; stöder text-, bild- och videoindata.
GLM-5.2Zhipu AI (GLM)¥8.00Cache-träff ¥2.00/M¥28.001M
TextFunction CallingStructured Output
CNYNyaste flaggskeppet. Cache-lagring tidsbegränsat gratis.
Qwen3.7 MaxAlibaba Cloud (Qwen)¥12.00¥36.001M
TextVisionFunction CallingStructured Output
CNYAlibabas toppnivåmodell Qwen3.7 med 1M kontext.
Qwen3.7 PlusAlibaba Cloud (Qwen)¥2.00¥8.001M
TextVisionFunction CallingStructured Output
CNYKontext över 256K faktureras till ett separat pris
MiMo-V2.5-ProXiaomi (MiMo)$0.435$0.871M
TextFunction CallingStructured Output
USD (≈¥3.00 / ≈¥6.00)MIT-öppen källkod
MiMo-V2.5Xiaomi (MiMo)$0.14$0.281M
TextVisionVideoAudioFunction Calling
USD (≈¥1.00 / ≈¥2.00)Stöder text, bild, video och ljud
Doubao-ProByteDance (Volcano Engine)¥1.00¥2.00128K
TextFunction Calling
CNYByteDances allmänna Doubao-modell.
Doubao-LiteByteDance (Volcano Engine)¥0.30¥0.60128K
TextFunction Calling
CNYLättviktig, extremt billig Doubao-variant.
Hunyuan-LargeTencent Cloud (Hunyuan)¥4.00¥12.0032K
TextFunction Calling
CNYTencents Hunyuan-modell med högre kapacitet.
Hunyuan-StandardTencent Cloud (Hunyuan)¥0.50¥1.0032K
TextFunction Calling
CNYKostnadseffektiv Hunyuan-standardmodell.
ERNIE 4.5Baidu (Qianfan)¥8.00¥24.0032K
TextFunction Calling
CNYBaidus flaggskeppsmodell ERNIE.
ERNIE SpeedBaidu (Qianfan)¥0.12¥0.128K
TextFunction Calling
CNYExtremt billig ERNIE-variant med låg latens.
Spark 4.0iFLYTEK (Spark)¥3.00¥9.00128K
TextFunction Calling
CNYiFLYTEKs flaggskeppsmodell Spark.
Funktionsförklaring:TextSynVideoLjudFunktionsanropStrukturerad utmatning

📝 Prisnoteringar

📌 Viktiga noteringar
• Alla priser är per miljon token (1M = 1 000 000 token) till officiella betalningsper-användning-satser. Valuta visas per leverantör: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash använder topp-/låglastpriser: under topplast (09:00–12:00 och 14:00–18:00, Peking-tid) dubblas både in- och utmatningspriserna. Låglasttider är halva priset — trafik över tidszoner kan arbitrage på detta. DeepSeek stöder också kontextcachelagring: upprepade prompt-prefix faktureras till den mycket lägre cache-träff-satsen (t.ex. V4 Pro cache-träff ¥0.025/M vs. cache-miss ¥3.00/M).
• Qwen3.7 Plus: in-/utmatningspriserna ovan gäller de första 256K kontext. Användning utöver 256K faktureras separat till en högre långkontext-sats.
• Priser är föremål för varje plattforms officiella tillkännagivanden. Vissa leverantörer erbjuder ytterligare volymrabatter, nivåpaket eller gratis testkrediter. Verifiera alltid före integration.
🔥Är priset ensamt inte tillräckligt?Vi har tillbakaberäknat varje modells verkliga tokenkvot — se hur mycket du faktiskt kan använda.Se den verkliga kvotjämförelsen →