Porównanie cen API chińskiej AI 2026
Ceny API pay-as-you-go dla 20+ chińskich modeli AI — DeepSeek, Kimi, GLM, Qwen, MiniMax i więcej. Porównaj koszty wejścia/wyjścia na milion tokenów, okna kontekstu i możliwości.
Porównanie cen API chińskiej AI 2026: koszt na milion tokenów
Budujesz z chińskimi modelami AI przez API? Porównaliśmy ramię w ramię 20+ modeli od 10 dostawców — w tym DeepSeek V4, Kimi K2.6, GLM-5.1, Qwen3.7, MiniMax M3, Doubao, Hunyuan, ERNIE i Spark. Wszystkie ceny są za milion tokenów (wejście / wyjście), z oknami kontekstu i tagami możliwości. Aktualizacja lipiec 2026.
| Model | Dostawca | Wejście /M | Wyjście /M | Kontekst | Możliwości | Uwagi |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro↗ | DeepSeek | ¥3.00Trafienie cache ¥0.025/M | ¥6.00 | 1M | TextFunction CallingStructured Output | CNYW godzinach szczytu (9–12 i 14–18 czasu pekińskiego) cena ulega podwojeniu; ogólna dostępność w połowie lipca. |
| DeepSeek V4 Flash↗ | DeepSeek | ¥1.00Trafienie cache ¥0.02/M | ¥2.00 | 1M | TextFunction CallingStructured Output | CNYW godzinach szczytu (9–12 i 14–18 czasu pekińskiego) cena ulega podwojeniu. |
| MiniMax M3↗ | MiniMax | $0.30 | $1.20 | 1M | TextVisionVideoFunction Calling | USDMultimodalny model flagowy MiniMax; obsługuje wejście tekstowe, obrazowe i wideo. |
| Kimi K3↗ | Kimi (Moonshot AI) | ¥20.00Trafienie cache ¥2.00/M | ¥100.00 | 1M | TextFunction CallingStructured Output | CNYModel flagowy Kimi do długotrwałego kodowania i kompleksowej pracy z wiedzą. Rozumowanie zawsze włączone (reasoning_effort, obecnie wyłącznie 'max'). Obsługuje buforowanie kontekstu, tool_choice oraz dynamiczne ładowanie narzędzi. Uwaga: web_search jest w trakcie modernizacji — na razie nie jest zalecane. |
| Kimi K2.6↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextVisionVideoFunction Calling | CNYMultimodalny model Kimi z trybami thinking i non-thinking. |
| Kimi K2.5↗ | Kimi (Moonshot AI) | ¥4.00 | ¥21.00 | 262K | TextVisionVideoFunction Calling | CNYMultimodalny model Kimi; obsługuje wejście tekstowe, obrazowe i wideo. |
| Kimi K2.7 Code↗ | Kimi (Moonshot AI) | ¥6.50 | ¥27.00 | 262K | TextFunction Calling | CNYWyłącznie tryb rozumowania |
| GLM-5.1↗ | Zhipu AI (GLM) | $1.40 | $4.40 | 200K | TextFunction CallingStructured Output | USDModel tekstowy Zhipu z cennikiem poziomowym uzależnionym od długości kontekstu. |
| GLM-5 Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextFunction CallingStructured Output | USDWariant GLM zoptymalizowany pod kątem kosztów do zadań tekstowych o wysokiej przepustowości. |
| GLM-5V Turbo↗ | Zhipu AI (GLM) | $1.20 | $4.00 | 200K | TextVisionVideoFunction CallingStructured Output | USDMultimodalny wariant GLM; obsługuje wejście tekstowe, obrazowe i wideo. |
| GLM-5.2↗ | Zhipu AI (GLM) | ¥8.00Trafienie cache ¥2.00/M | ¥28.00 | 1M | TextFunction CallingStructured Output | CNYNajnowszy model flagowy. Przechowywanie w cache czasowo bezpłatne. |
| Qwen3.7 Max↗ | Alibaba Cloud (Qwen) | ¥12.00 | ¥36.00 | 1M | TextVisionFunction CallingStructured Output | CNYTopowy model Qwen3.7 od Alibaba z kontekstem 1M. |
| Qwen3.7 Plus↗ | Alibaba Cloud (Qwen) | ¥2.00 | ¥8.00 | 1M | TextVisionFunction CallingStructured Output | CNYKontekst powyżej 256K rozliczany w osobnej stawce |
| MiMo-V2.5-Pro↗ | Xiaomi (MiMo) | $0.435 | $0.87 | 1M | TextFunction CallingStructured Output | USD (≈¥3.00 / ≈¥6.00)Open source na licencji MIT |
| MiMo-V2.5↗ | Xiaomi (MiMo) | $0.14 | $0.28 | 1M | TextVisionVideoAudioFunction Calling | USD (≈¥1.00 / ≈¥2.00)Obsługuje tekst, obraz, wideo i dźwięk |
| Doubao-Pro↗ | ByteDance (Volcano Engine) | ¥1.00 | ¥2.00 | 128K | TextFunction Calling | CNYModel Doubao ogólnego przeznaczenia od ByteDance. |
| Doubao-Lite↗ | ByteDance (Volcano Engine) | ¥0.30 | ¥0.60 | 128K | TextFunction Calling | CNYLekki, ultra-tani wariant Doubao. |
| Hunyuan-Large↗ | Tencent Cloud (Hunyuan) | ¥4.00 | ¥12.00 | 32K | TextFunction Calling | CNYModel Hunyuan o większej pojemności od Tencent. |
| Hunyuan-Standard↗ | Tencent Cloud (Hunyuan) | ¥0.50 | ¥1.00 | 32K | TextFunction Calling | CNYEkonomiczny standardowy model Hunyuan. |
| ERNIE 4.5↗ | Baidu (Qianfan) | ¥8.00 | ¥24.00 | 32K | TextFunction Calling | CNYModel flagowy ERNIE od Baidu. |
| ERNIE Speed↗ | Baidu (Qianfan) | ¥0.12 | ¥0.12 | 8K | TextFunction Calling | CNYUltra-tani wariant ERNIE o niskich opóźnieniach. |
| Spark 4.0↗ | iFLYTEK (Spark) | ¥3.00 | ¥9.00 | 128K | TextFunction Calling | CNYModel flagowy Spark od iFLYTEK. |
Legenda możliwości:TekstWizjaWideoAudioWywołania funkcjiWyjście strukturalne
📝 Uwagi do cennika
📌 Ważne uwagi
• Wszystkie ceny to oficjalne stawki pay-as-you-go za milion tokenów (1M = 1,000,000 tokenów). Waluta zależy od dostawcy: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash stosuje ceny szczyt/poza szczytem: w godzinach szczytu (09:00–12:00 i 14:00–18:00, czas pekiński) zarówno ceny wejścia, jak i wyjścia rosną DWUKROTNIE. Godziny poza szczytem są połową ceny — ruch między strefami czasowymi może to arbitrować. DeepSeek obsługuje też cache kontekstu: powtarzające się prefiksy promptu rozliczane są po znacznie niższej stawce trafienia cache (np. V4 Pro trafienie cache ¥0.025/M vs. pudło ¥3.00/M).
• Qwen3.7 Plus: powyższe ceny wejścia/wyjścia obowiązują dla pierwszych 256K kontekstu. Użycie powyżej 256K rozliczane jest osobno po wyższej stawce długiego kontekstu.
• Ceny podlegają oficjalnym ogłoszeniom każdej platformy. Niektórzy dostawcy oferują dodatkowe rabaty wolumenowe, pakietystopniowane lub darmowe kredyty próbne. Zawsze weryfikuj przed integracją.
🔥Sama cena to nie wszystko?Obliczyliśmy wstecz rzeczywiste limity tokenów każdego modelu — zobacz, ile faktycznie możesz wykorzystać.Zobacz porównanie rzeczywistych limitów →• Wszystkie ceny to oficjalne stawki pay-as-you-go za milion tokenów (1M = 1,000,000 tokenów). Waluta zależy od dostawcy: ¥ = CNY (RMB), $ = USD.
• DeepSeek V4 Pro / V4 Flash stosuje ceny szczyt/poza szczytem: w godzinach szczytu (09:00–12:00 i 14:00–18:00, czas pekiński) zarówno ceny wejścia, jak i wyjścia rosną DWUKROTNIE. Godziny poza szczytem są połową ceny — ruch między strefami czasowymi może to arbitrować. DeepSeek obsługuje też cache kontekstu: powtarzające się prefiksy promptu rozliczane są po znacznie niższej stawce trafienia cache (np. V4 Pro trafienie cache ¥0.025/M vs. pudło ¥3.00/M).
• Qwen3.7 Plus: powyższe ceny wejścia/wyjścia obowiązują dla pierwszych 256K kontekstu. Użycie powyżej 256K rozliczane jest osobno po wyższej stawce długiego kontekstu.
• Ceny podlegają oficjalnym ogłoszeniom każdej platformy. Niektórzy dostawcy oferują dodatkowe rabaty wolumenowe, pakietystopniowane lub darmowe kredyty próbne. Zawsze weryfikuj przed integracją.