Echte token-quota's van AI-modellen vergeleken

Echte quota, terug-berekend uit communitytests en runs van de redactie — geen officiële sticker-caps.

Er is geen enkel "beste" abonnement — het hangt af van je ritme. Voor intensief gebruik 's nachts is Alibaba's Qwen 3.8 Max Token Plan (~1.5B tokens/maand voor ¥39) ongeëvenaard. Voor coderen de hele dag is Kimi K3 Allegretto (¥159/mnd, ~950M tokens) de stabielere keuze.

Laatst geverifieerd:

Quota-vergelijking naast elkaar

ModelLaagste /mndMaandquotaTokens / ¥5u-vensterNachtkortingBeste voorDetails
Kimi K3 (Allegretto)Moonshot AI¥159~950M~6M~40MGeenCoderen de hele dag & agentsDetails →
Qwen 3.8 Max Token PlanAlibaba Cloud¥39~1.5B (nacht)~38M (nacht)700 credits / 5h80% korting (nacht)Nachtdieren met intensief gebruikDetails →
GLM 5.2Zhipu AI

Data is terug-berekend uit echt gebruik door community-gebruikers, geen officiële vaste caps. Aanbieders kunnen quota dynamisch aanpassen. Klik op een kolomkop om te sorteren.

Welk abonnement past bij jou?

Intensief gebruik, maar voornamelijk 's nachts
Qwen 3.8 Max — 80% korting 's nachts maakt het de waardekoning.
Gelegenheids-Q&A / licht gebruik
Begin gratis — Qoder of de gratis Kimi-laag. Upgrade pas wanneer je limieten raakt.

Hoe we de quota schatten

Wat "quota terugrekenen" betekent

Officiële pagina's publiceren zelden een harde tokenlimiet. We leiden deze af: Totale quota ≈ gebruikte tokens ÷ getoonde gebruikspercentage. Bijv. 15M tokens bij 37.3% van de 5u-balk betekent ~40M voor dat venster. We kruisverifiëren over de 5u-, 7-daagse en maandelijkse balken.

Waarom er geen officiële vaste limiet wordt gepubliceerd

Limieten zijn dynamisch: ze verschuiven met modelversie, serverbelasting en bedrijfsstrategie. Een gepubliceerd getal wordt een belofte en een doelwit voor misbruik, dus houden providers ze opzettelijk vaag. Beschouw elk getal hier als een momentopname, niet als een contract.

Hoe de cache-hitrate het werkelijke verbruik verandert

In codeer-/agentworkflows wordt dezelfde context steeds opnieuw verzonden. Eén gebruiker logde een 93.7% cache-hitrate — wat betekent dat slechts ~6% van de invoer tegen de volledige prijs werd gefactureerd. De quota die je "voelt" is dus veel groter dan het ruwe tokenaantal suggereert.

Abonnement vs pay-as-you-go API

Een abonnement ruilt flexibiliteit voor een vaste prijs binnen rollende vensters. Pay-as-you-go API factureert elke token, maar beperkt je nooit in snelheid. Bij stabiel en voorspelbaar gebruik winnen abonnementen; bij piekbelasting of wanneer je gelijktijdigheid nodig hebt, wint de API.

Branche-inzichten

Waarom Chinese modellen abonnementen boven pure API pushen

Abonnementen locken maandelijkse omzet en verminderen facturatiewrijving voor consumenten die de onvoorspelbaarheid van betalen-per-token wantrouwen. Ze laten providers ook de vraag gladstrijken met quotavensters in plaats van ruwe prijspieken.

De rekenscheduleringslogica achter nachtkortingen

Inferentieclusters zijn overvoorzien voor pieken overdag en liggen 's nachts stil. Een steile nachtkorting (Qwen's 0.2 折) prijst simpelweg de inactieve capaciteit — het kost de provider vrijwel niets extra en vult GPU's die anders verspild zouden zijn.

Waar de kloof tussen "prijs" en "gevoelde waarde" vandaan komt

Drie verborgen hefbomen bepalen wat je werkelijk krijgt: de cache-hitrate, de invoer/uitvoer-ratio van je werkbelasting en tijdsafhankelijke kortingen. Twee gebruikers op hetzelfde abonnement kunnen 50× verschillen in werkelijke doorvoer — precies daarom rekenen we terug in plaats van het etiket te vertrouwen.

Model-snelle kaarten

Kimi K3 (Allegretto)Beste keuze voor de hele dag

De meest gebalanceerde keuze voor dagelijkse codeurs: ~950M tokens/maand, een ~40M 5u-venster en 20× Code-quota. De hele dag beschikbaar, geen nachtelijke beperking.

Vanaf /mnd
¥159
Maandelijks
~950M
5u-venster
~40M
Lees de volledige test →
Qwen 3.8 Max Token PlanBeste waarde — 's nachts

Onverslaanbare waarde ALS je zware jobs 's nachts draait (22:00–08:00): ~1.5B tokens/maand voor ¥39. Overdag daalt dat naar ~300M, en zonder promotiekorting naar ~30M.

Vanaf /mnd
¥39
Maandelijks
~1.5B (nacht)
5u-venster
700 credits / 5h
Lees de volledige test →

FAQ

Welke biedt meer waarde, Kimi K3 of Qwen 3.8 Max?

Het hangt af van je uren. Qwen 3.8 Max is veel goedkoper per token ALS je 's nachts werkt (~38M tokens/yuan tegen ~6M voor Kimi) — maar overdag daalt Qwen naar ~300M tokens/maand. Kimi K3 geeft een stabiele ~950M tokens/maand de hele dag zonder tijdsbeperking. Nachtdieren: Qwen. Codeurs de hele dag: Kimi.

Welk Chinees AI-abonnement biedt over het algemeen de beste waarde?

Voor pure tokens-per-yuan is Qwen 3.8 Max 's nachts ongeëvenaard. Voor betrouwbaarheid en een op coderen gerichte toolchain is Kimi K3 Allegretto de sterkste alleskunner. Om dingen uit te proberen, begin met Qoder's gratis Qwen 3.8 Max-quota voordat je iets betaalt.

Wat gebeurt er wanneer ik de quotalimiet raak?

Meestal meldt een prompt dat de quota op is; je wacht tot het rollende venster vrijgeeft (5u-vensters geven uur per uur vrij, 7-daagse vensters dag per dag) of je upgrade. Sommige providers beperken de kwaliteit of snelheid in plaats van hard te blokkeren.

Welke raakt eerst op — de 5-uurs- of de maandelijkse quota?

Bij intensieve, piekerige sessies (agent-coderen, grote refactors) is de 5-uurs-balk vrijwel altijd de bottleneck — je kunt deze uitputten ruim voordat de maandelijkse balk beweegt. Bij een stabiele, druppelende gebruikspatroon is de maandelijkse balk waar je naar kijkt.

Zijn er gratis Chinese large models die ik kan gebruiken?

Ja. Qoder biedt een gratis laag met Qwen 3.8 Max, en Kimi heeft een gratis (beperkte) laag. Dit zijn de beste manieren om je werkelijke gebruik te meten voordat je voor een abonnement betaalt.

Lees ook