Kinesiska AI API-prisjämförelse 2026
Betalningsper-användning API-priser för 20+ kinesiska AI-modeller — DeepSeek, Kimi, GLM, Qwen, MiniMax och fler. Jämför in-/utmatningskostnader per miljon token, kontextfönster och funktioner.
Jämför kinesiska AI API-priser 2026: Kostnad per miljon token
Bygger med kinesiska AI-modeller via API? Vi har jämfört 20+ modeller från 10 leverantörer sida vid sida — inklusive DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE och Spark. Alla priser är per miljon token (in / ut), med kontextfönster och funktionsetiketter. Uppdaterad juli 2026.
| Modell | Leverantör | Inmatning /M | Utmatning /M | Kontext | Funktioner | Noteringar |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro↗ | DeepSeek | ¥3.00Cache-träff ¥0.025/M | ¥6.00 | 1M | TextFunction CallingStructured Output | CNYUnder toppiderna (09.00–12.00 och 14.00–18.00, Peking-tid) fördubblas priset; allmän tillgänglighet i mitten av juli. |
| DeepSeek V4 Flash↗ | DeepSeek | ¥1.00Cache-träff ¥0.02/M | ¥2.00 | 1M | TextFunction CallingStructured Output | CNYUnder toppiderna (09.00–12.00 och 14.00–18.00, Peking-tid) fördubblas priset. |
| MiniMax M3↗ | MiniMax | $0.30 | $1.20 | 1M | TextVisionVideoFunction Calling | USDMultimodalt flaggskepp från MiniMax; stöder text-, bild- och videoindata. |
| Kimi K3↗ | Kimi (Moonshot AI) | ¥20.00Cache-träff ¥2.00/M | ¥100.00 | 1M | TextFunction CallingStructured Output | CNYKimis flaggskepp för kodning över lång tid och end-to-end-kunskapsarbete. Reasoning alltid aktiverat (reasoning_effort, för närvarande endast 'max'). Stöder context caching, tool_choice och dynamisk verktygsinläsning. Obs: web_search håller på att uppgraderas — rekommenderas inte för närvarande. |
| Kimi K2.6↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextVisionVideoFunction Calling | CNYMultimodal Kimi-modell med thinking- och non-thinking-lägen. |
| Kimi K2.5↗ | Kimi (Moonshot AI) | ¥4.00 | ¥21.00 | 262K | TextVisionVideoFunction Calling | CNYMultimodal Kimi-modell; stöder text-, bild- och videoindata. |
| Kimi K2.7 Code↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextFunction Calling | CNYEndast reasoning-läge |
| GLM-5.1↗ | Zhipu AI (GLM) | $1.40 | $4.40 | 200K | TextFunction CallingStructured Output | USDTextmodell från Zhipu med nivåindelad prissättning utifrån kontextlängd. |
| GLM-5 Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextFunction CallingStructured Output | USDKostnadsoptimerad GLM-variant för textarbetsbelastningar med hög genomströmning. |
| GLM-5V Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextVisionVideoFunction CallingStructured Output | USDMultimodal GLM-variant; stöder text-, bild- och videoindata. |
| GLM-5.2↗ | Zhipu AI (GLM) | ¥8.00Cache-träff ¥2.00/M | ¥28.00 | 1M | TextFunction CallingStructured Output | CNYNyaste flaggskeppet. Cache-lagring tidsbegränsat gratis. |
| Qwen3.7 Max↗ | Alibaba Cloud (Qwen) | ¥12.00 | ¥36.00 | 1M | TextVisionFunction CallingStructured Output | CNYAlibabas toppnivåmodell Qwen3.7 med 1M kontext. |
| Qwen3.7 Plus↗ | Alibaba Cloud (Qwen) | ¥2.00 | ¥8.00 | 1M | TextVisionFunction CallingStructured Output | CNYKontext över 256K faktureras till ett separat pris |
| MiMo-V2.5-Pro↗ | Xiaomi (MiMo) | $0.435 | $0.87 | 1M | TextFunction CallingStructured Output | USD (≈¥3.00 / ≈¥6.00)MIT-öppen källkod |
| MiMo-V2.5↗ | Xiaomi (MiMo) | $0.14 | $0.28 | 1M | TextVisionVideoAudioFunction Calling | USD (≈¥1.00 / ≈¥2.00)Stöder text, bild, video och ljud |
| Doubao-Pro↗ | ByteDance (Volcano Engine) | ¥1.00 | ¥2.00 | 128K | TextFunction Calling | CNYByteDances allmänna Doubao-modell. |
| Doubao-Lite↗ | ByteDance (Volcano Engine) | ¥0.30 | ¥0.60 | 128K | TextFunction Calling | CNYLättviktig, extremt billig Doubao-variant. |
| Hunyuan-Large↗ | Tencent Cloud (Hunyuan) | ¥4.00 | ¥12.00 | 32K | TextFunction Calling | CNYTencents Hunyuan-modell med högre kapacitet. |
| Hunyuan-Standard↗ | Tencent Cloud (Hunyuan) | ¥0.50 | ¥1.00 | 32K | TextFunction Calling | CNYKostnadseffektiv Hunyuan-standardmodell. |
| ERNIE 4.5↗ | Baidu (Qianfan) | ¥8.00 | ¥24.00 | 32K | TextFunction Calling | CNYBaidus flaggskeppsmodell ERNIE. |
| ERNIE Speed↗ | Baidu (Qianfan) | ¥0.12 | ¥0.12 | 8K | TextFunction Calling | CNYExtremt billig ERNIE-variant med låg latens. |
| Spark 4.0↗ | iFLYTEK (Spark) | ¥3.00 | ¥9.00 | 128K | TextFunction Calling | CNYiFLYTEKs flaggskeppsmodell Spark. |
Funktionsförklaring:TextSynVideoLjudFunktionsanropStrukturerad utmatning
📝 Prisnoteringar
📌 Viktiga noteringar
• Alla priser är per miljon token (1M = 1 000 000 token) till officiella betalningsper-användning-satser. Valuta visas per leverantör: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash använder topp-/låglastpriser: under topplast (09:00–12:00 och 14:00–18:00, Peking-tid) dubblas både in- och utmatningspriserna. Låglasttider är halva priset — trafik över tidszoner kan arbitrage på detta. DeepSeek stöder också kontextcachelagring: upprepade prompt-prefix faktureras till den mycket lägre cache-träff-satsen (t.ex. V4 Pro cache-träff ¥0.025/M vs. cache-miss ¥3.00/M).
• Qwen3.7 Plus: in-/utmatningspriserna ovan gäller de första 256K kontext. Användning utöver 256K faktureras separat till en högre långkontext-sats.
• Priser är föremål för varje plattforms officiella tillkännagivanden. Vissa leverantörer erbjuder ytterligare volymrabatter, nivåpaket eller gratis testkrediter. Verifiera alltid före integration.
🔥Är priset ensamt inte tillräckligt?Vi har tillbakaberäknat varje modells verkliga tokenkvot — se hur mycket du faktiskt kan använda.Se den verkliga kvotjämförelsen →• Alla priser är per miljon token (1M = 1 000 000 token) till officiella betalningsper-användning-satser. Valuta visas per leverantör: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash använder topp-/låglastpriser: under topplast (09:00–12:00 och 14:00–18:00, Peking-tid) dubblas både in- och utmatningspriserna. Låglasttider är halva priset — trafik över tidszoner kan arbitrage på detta. DeepSeek stöder också kontextcachelagring: upprepade prompt-prefix faktureras till den mycket lägre cache-träff-satsen (t.ex. V4 Pro cache-träff ¥0.025/M vs. cache-miss ¥3.00/M).
• Qwen3.7 Plus: in-/utmatningspriserna ovan gäller de första 256K kontext. Användning utöver 256K faktureras separat till en högre långkontext-sats.
• Priser är föremål för varje plattforms officiella tillkännagivanden. Vissa leverantörer erbjuder ytterligare volymrabatter, nivåpaket eller gratis testkrediter. Verifiera alltid före integration.