Porównanie cen API chińskiej AI 2026

Ceny API pay-as-you-go dla 20+ chińskich modeli AI — DeepSeek, Kimi, GLM, Qwen, MiniMax i więcej. Porównaj koszty wejścia/wyjścia na milion tokenów, okna kontekstu i możliwości.
📅 stale aktualizowane · 2026🏷️ 10 dostawców · 20 modeli📌 Ostatnia aktualizacja: 4 lipca 2026

Porównanie cen API chińskiej AI 2026: koszt na milion tokenów

Budujesz z chińskimi modelami AI przez API? Porównaliśmy ramię w ramię 20+ modeli od 10 dostawców — w tym DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE i Spark. Wszystkie ceny są za milion tokenów (wejście / wyjście), z oknami kontekstu i tagami możliwości. Aktualizacja lipiec 2026.

22 modeli
ModelDostawcaWejście /MWyjście /MKontekstMożliwościUwagi
DeepSeek V4 ProDeepSeek¥3.00Trafienie cache ¥0.025/M¥6.001M
TextFunction CallingStructured Output
CNYW godzinach szczytu (9–12 i 14–18 czasu pekińskiego) cena ulega podwojeniu; ogólna dostępność w połowie lipca.
DeepSeek V4 FlashDeepSeek¥1.00Trafienie cache ¥0.02/M¥2.001M
TextFunction CallingStructured Output
CNYW godzinach szczytu (9–12 i 14–18 czasu pekińskiego) cena ulega podwojeniu.
MiniMax M3MiniMax$0.30$1.201M
TextVisionVideoFunction Calling
USDMultimodalny model flagowy MiniMax; obsługuje wejście tekstowe, obrazowe i wideo.
Kimi K3Kimi (Moonshot AI)¥20.00Trafienie cache ¥2.00/M¥100.001M
TextFunction CallingStructured Output
CNYModel flagowy Kimi do długotrwałego kodowania i kompleksowej pracy z wiedzą. Rozumowanie zawsze włączone (reasoning_effort, obecnie wyłącznie 'max'). Obsługuje buforowanie kontekstu, tool_choice oraz dynamiczne ładowanie narzędzi. Uwaga: web_search jest w trakcie modernizacji — na razie nie jest zalecane.
Kimi K2.6Kimi (Moonshot AI)¥6.50¥27.00262K
TextVisionVideoFunction Calling
CNYMultimodalny model Kimi z trybami thinking i non-thinking.
Kimi K2.5Kimi (Moonshot AI)¥4.00¥21.00262K
TextVisionVideoFunction Calling
CNYMultimodalny model Kimi; obsługuje wejście tekstowe, obrazowe i wideo.
Kimi K2.7 CodeKimi (Moonshot AI)¥6.50¥27.00262K
TextFunction Calling
CNYWyłącznie tryb rozumowania
GLM-5.1Zhipu AI (GLM)$1.40$4.40200K
TextFunction CallingStructured Output
USDModel tekstowy Zhipu z cennikiem poziomowym uzależnionym od długości kontekstu.
GLM-5 TurboZhipu AI (GLM)$1.20$4.00200K
TextFunction CallingStructured Output
USDWariant GLM zoptymalizowany pod kątem kosztów do zadań tekstowych o wysokiej przepustowości.
GLM-5V TurboZhipu AI (GLM)$1.20$4.00200K
TextVisionVideoFunction CallingStructured Output
USDMultimodalny wariant GLM; obsługuje wejście tekstowe, obrazowe i wideo.
GLM-5.2Zhipu AI (GLM)¥8.00Trafienie cache ¥2.00/M¥28.001M
TextFunction CallingStructured Output
CNYNajnowszy model flagowy. Przechowywanie w cache czasowo bezpłatne.
Qwen3.7 MaxAlibaba Cloud (Qwen)¥12.00¥36.001M
TextVisionFunction CallingStructured Output
CNYTopowy model Qwen3.7 od Alibaba z kontekstem 1M.
Qwen3.7 PlusAlibaba Cloud (Qwen)¥2.00¥8.001M
TextVisionFunction CallingStructured Output
CNYKontekst powyżej 256K rozliczany w osobnej stawce
MiMo-V2.5-ProXiaomi (MiMo)$0.435$0.871M
TextFunction CallingStructured Output
USD (≈¥3.00 / ≈¥6.00)Open source na licencji MIT
MiMo-V2.5Xiaomi (MiMo)$0.14$0.281M
TextVisionVideoAudioFunction Calling
USD (≈¥1.00 / ≈¥2.00)Obsługuje tekst, obraz, wideo i dźwięk
Doubao-ProByteDance (Volcano Engine)¥1.00¥2.00128K
TextFunction Calling
CNYModel Doubao ogólnego przeznaczenia od ByteDance.
Doubao-LiteByteDance (Volcano Engine)¥0.30¥0.60128K
TextFunction Calling
CNYLekki, ultra-tani wariant Doubao.
Hunyuan-LargeTencent Cloud (Hunyuan)¥4.00¥12.0032K
TextFunction Calling
CNYModel Hunyuan o większej pojemności od Tencent.
Hunyuan-StandardTencent Cloud (Hunyuan)¥0.50¥1.0032K
TextFunction Calling
CNYEkonomiczny standardowy model Hunyuan.
ERNIE 4.5Baidu (Qianfan)¥8.00¥24.0032K
TextFunction Calling
CNYModel flagowy ERNIE od Baidu.
ERNIE SpeedBaidu (Qianfan)¥0.12¥0.128K
TextFunction Calling
CNYUltra-tani wariant ERNIE o niskich opóźnieniach.
Spark 4.0iFLYTEK (Spark)¥3.00¥9.00128K
TextFunction Calling
CNYModel flagowy Spark od iFLYTEK.
Legenda możliwości:TekstWizjaWideoAudioWywołania funkcjiWyjście strukturalne

📝 Uwagi do cennika

📌 Ważne uwagi
• Wszystkie ceny to oficjalne stawki pay-as-you-go za milion tokenów (1M = 1,000,000 tokenów). Waluta zależy od dostawcy: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash stosuje ceny szczyt/poza szczytem: w godzinach szczytu (09:00–12:00 i 14:00–18:00, czas pekiński) zarówno ceny wejścia, jak i wyjścia rosną DWUKROTNIE. Godziny poza szczytem są połową ceny — ruch między strefami czasowymi może to arbitrować. DeepSeek obsługuje też cache kontekstu: powtarzające się prefiksy promptu rozliczane są po znacznie niższej stawce trafienia cache (np. V4 Pro trafienie cache ¥0.025/M vs. pudło ¥3.00/M).
• Qwen3.7 Plus: powyższe ceny wejścia/wyjścia obowiązują dla pierwszych 256K kontekstu. Użycie powyżej 256K rozliczane jest osobno po wyższej stawce długiego kontekstu.
• Ceny podlegają oficjalnym ogłoszeniom każdej platformy. Niektórzy dostawcy oferują dodatkowe rabaty wolumenowe, pakietystopniowane lub darmowe kredyty próbne. Zawsze weryfikuj przed integracją.
🔥Sama cena to nie wszystko?Obliczyliśmy wstecz rzeczywiste limity tokenów każdego modelu — zobacz, ile faktycznie możesz wykorzystać.Zobacz porównanie rzeczywistych limitów →