Rzeczywiste porównanie limitów tokenów modeli AI

Rzeczywiste limity, obliczone wstecz od testów społeczności i przebiegów redakcji — nie oficjalne deklarowane capsy.

Nie ma jednego „najlepszego” planu — zależy to od Twojego rytmu pracy. Przy intensywnym użytkowaniu nocnym Alibaba Qwen 3.8 Max Token Plan (~1.5B tokenów/mies. za ¥39) nie ma sobie równych. Do programowania przez cały dzień Kimi K3 Allegretto (¥159/mies., ~950M tokenów) to stabilniejszy wybór.

Ostatnia weryfikacja:

Porównanie limitów ramię w ramię

ModelNajniższa /mcLimit miesięcznyTokeny / ¥Okno 5hZniżka nocnaNajlepsze doSzczegóły
Kimi K3 (Allegretto)Moonshot AI¥159~950M~6M~40MBrakProgramowanie całodniowe i agentySzczegóły →
Qwen 3.8 Max Token PlanAlibaba Cloud¥39~1.5B (nocą)~38M (nocą)700 credits / 5h80% rabatu (nocą)Sowy nocne, intensywne użytkowanieSzczegóły →
GLM 5.2Zhipu AI

Dane są obliczone wstecz na podstawie rzeczywistego użycia użytkowników społeczności, a nie oficjalnych stałych capów. Dostawcy mogą dynamicznie regulować limity. Kliknij nagłówek kolumny, by sortować.

Który plan pasuje do Ciebie?

Intensywne użytkowanie, ale głównie w nocy
Qwen 3.8 Max — 80% rabatu nocnego czyni go królem opłacalności.
Okazjonalne Q&A / lekkie użytkowanie
Zacznij za darmo — Qoder lub darmowy poziom Kimi. Ulepsz dopiero, gdy wyczerpiesz limity.

Jak szacujemy limit

Co oznacza „wsteczne wyliczenie puli”

Oficjalne strony rzadko publikują twardy limit tokenów. Wyliczamy go: Łączna pula ≈ zużyte tokeny ÷ wyświetlany procent użycia. Np. 15M tokenów przy 37.3% paska 5h oznacza ~40M dla tego okna. Krzyżujemy dane z pasków 5h, 7-dniowych i miesięcznych.

Dlaczego nie publikuje się oficjalnego stałego limitu

Limity są dynamiczne: zmieniają się wraz z wersją modelu, obciążeniem serwera i strategią biznesową. Opublikowanie konkretnej liczby staje się obietnicą i celem do nadużyć, dlatego dostawcy celowo utrzymują je w niejasności. Traktuj każdą liczbę tutaj jako migawkę, a nie umowę.

Jak wskaźnik trafień w cache zmienia rzeczywiste zużycie

W przepływach pracy związanych z programowaniem/agentami ten sam kontekst jest wysyłany w kółko. Jeden z użytkowników zanotował wskaźnik trafień w cache na poziomie 93.7% — co oznacza, że tylko ~6% danych wejściowych rozliczano w pełnej cenie. Pula, którą „czujesz”, jest więc znacznie większa, niż sugeruje surowa liczba tokenów.

Subskrypcja vs API pay-as-you-go

Subskrypcja wymienia elastyczność na stałą cenę w obrębie przesuwnych okien. API pay-as-you-go rozlicza każdy token, ale nigdy nie ogranicza Cię prędkością. Przy stabilnym, przewidywalnym użyciu wygrywa subskrypcja; przy skokowym użyciu lub gdy potrzebujesz współbieżności, wygrywa API.

Wnioski branżowe

Dlaczego chińskie modele promują subskrypcje zamiast czystego API

Subskrypcje gwarantują miesięczne przychody i zmniejszają tarcie rozliczeniowe dla konsumentów nieufnych wobec nieprzewidywalności płacenia-per-token. Pozwalają też dostawcom wygładzić popyt za pomocą okien puli zamiast nagłych skoków cen.

Logika harmonogramowania mocy obliczeniowej za zniżkami nocnymi

Klastry wnioskowania są nadmiarowo skalowane na dzienne szczyty i bezczynne w nocy. Duża zniżka nocna (0.2 折 w Qwen) po prostu wycenia tę bezczynną moc — nie kosztuje dostawcy prawie nic ekstra, a zapełnia inaczej zmarnowane GPU.

Skąd bierze się różnica między „ceną” a „odczuwaną wartością”

Trzy ukryte dźwignie decydują o tym, co faktycznie dostajesz: wskaźnik trafień w cache, stosunek wejścia/wyjścia w Twoim obciążeniu oraz zniżki zależne od pory dnia. Dwóch użytkowników na tym samym planie może zauważyć 50× różnicę w rzeczywistej przepustowości — dlatego właśnie liczymy wstecz zamiast ufać cennikowi.

Karty szybkie modeli

Kimi K3 (Allegretto)Najlepszy wybór do programowania na cały dzień

Najbardziej zrównoważony wybór dla codziennych programistów: ~950M tokenów/mies., okno ~40M na 5h i 20× pula Code. Dostępne przez całą dobę, bez nocnych haczyków.

Od /mc
¥159
Miesięcznie
~950M
Okno 5h
~40M
Zobacz pełny test →
Qwen 3.8 Max Token PlanNajlepsza opłacalność — w nocy

Bezkonkurencyjna opłacalność, JEŚLI uruchamiasz ciężkie zadania w nocy (22:00–08:00): ~1.5B tokenów/mies. za ¥39. W dzień Qwen spada do ~300M, a bez promocji do ~30M.

Od /mc
¥39
Miesięcznie
~1.5B (nocą)
Okno 5h
700 credits / 5h
Zobacz pełny test →

FAQ

Co jest bardziej opłacalne, Kimi K3 czy Qwen 3.8 Max?

To zależy od Twoich godzin. Qwen 3.8 Max jest znacznie tańszy na token, JEŚLI pracujesz w nocy (~38M tokenów/yuan wobec ~6M dla Kimi) — ale w dzień Qwen spada do ~300M tokenów/mies. Kimi K3 daje stabilne ~950M tokenów/mies. przez całą dobę, bez ograniczeń czasowych. Sowy nocne: Qwen. Codzienni programiści: Kimi.

Który chiński plan AI jest ogólnie najbardziej opłacalny?

Patrząc czysto na tokeny-per-yuan, Qwen 3.8 Max w nocy jest bezkonkurencyjny. Pod względem niezawodności i łańcucha narzędzi skupionego na programowaniu, Kimi K3 Allegretto to najsilniejszy uniwersalny zawodnik. Żeby coś wypróbować, zacznij od darmowej puli Qwen 3.8 Max w Qoder, zanim cokolwiek zapłacisz.

Co się dzieje, gdy osiągnę limit puli?

Zazwyczaj pojawia się komunikat o wyczerpaniu puli; czekasz, aż przesuwne okno się zwolni (okna 5h zwalniają godzinę po godzinie, okna 7-dniowe dzień po dniu), albo ulepszasz plan. Niektórzy dostawcy ograniczają jakość lub prędkość zamiast twardo blokować.

Co kończy się pierwsze — pula 5-godzinna czy miesięczna?

Przy intensywnych, skokowych sesjach (kodowanie przez agenta, duże refaktoryzacje) pasek 5-godzinny niemal zawsze stanowi wąskie gardło — możesz go wyczerpać na długo przed tym, zanim ruszy pasek miesięczny. Przy równomiernym, powolnym zużyciu to pasek miesięczny będziesz obserwować.

Czy są darmowe chińskie modele LLM, z których mogę korzystać?

Tak. Qoder oferuje darmowy poziom działający na Qwen 3.8 Max, a Kimi ma darmowy (ograniczony) poziom. To najlepszy sposób oceny Twojego rzeczywistego użycia, zanim zapłacisz za subskrypcję.

Powiązane lektury