⚡ Eén zin eerst

Na de eerste twee stukken — dat over Meituan CatPaw, dat over Alibaba QoderWork — belandden er veel dm's in mijn inbox. Eén bericht bleef hangen. De strekking: al die tools zijn gratis, maar altijd mét een plafond — CatPaw 500 calls, QoderWork 2000 credits voor 30 dagen. Bestaat er een manier om de API van GLM-5.2 écht zonder limiet te gebruiken?

Mijn eerste reactie: dat is nogal een vraag. Rekenkracht voor een topmodel kost geld. Echt onbeperkt graan voor niets — dat bestaat niet.

Toch maar even gecheckt. Blijkt: jawel.

TL;DR · in één zin
Degene die dit aanbiedt is geen Chinese partij. Het is NVIDIA — ja, de GPU-maker, de duurste chipreus ter wereld. Op hun ontwikkelaarsplatform build.nvidia.com hangt een gratis GLM-5.2 API-endpoint, in OpenAI-compatibel formaat. Je prikt het rechtstreeks in Claude Code. Registreren kost vijf minuten, geen creditcard.

Mijn oordeel: dit is het deel van de "GLM-5.2 gratis-trilogie" dat je zélf wilt uitproberen — Meituan en Alibaba bouwen een productlaag, NVIDIA graaft helemaal door naar de infrastructuurlaag. Elke laag een stap dieper.

📰 Waar de gratis sleutel ligt: 77 van de 141 modellen op build.nvidia.com

NVIDIA draait een ontwikkelaarsplatform genaamd build.nvidia.com. Daarop staan 141 AI-modellen, waarvan er 77 een gratis API-endpoint hebben. Je leest het goed: 77 gratis modellen. DeepSeek-V4-Pro zit erin, Kimi-K2.6 zit erin, MiniMax-M2.7 zit erin, Qwen3.5 zit erin.

build.nvidia.com modelmarkt — 141 modellen, waarvan 77 met een gratis API-endpoint

GLM-5.2 zit er ook in. De badges luiden Free Endpoint plus Downloadable, de aanbieder is Z.ai (Zhipu), en het staat bovenaan de lijst met nieuwste modellen. Eén dag online, al 2 miljoen downloads.

GLM-5.2-modelkaart — Free Endpoint en Downloadable, aanbieder Z.ai (Zhipu)

Dit gratis API verschilt fundamenteel van de tools in de vorige twee stukken. CatPaw en QoderWork zijn afgewerkte producten: installeren, openen, gebruiken. Maar het model zit opgesloten in hun interface — je kunt het alleen via hún UI aanroepen. NVIDIA geeft je een kale API. OpenAI-compatibel. En je mag hem in elke tool prikken die dat formaat spreekt.

Elke tool. Inclusief Claude Code.

Iedereen die nu denkt: "API is ver weg, ik ben geen ontwikkelaar" — lees door. Er bestaat een grafisch hulpmiddeltje dat CC Switch heet; een paar klikken en de hele configuratie staat.

🧬 Drie parameters: base_url, api_key, model

Eerst de techniek. Open de GLM-5.2-pagina op het NVIDIA-platform en je ziet drie parameters:

GLM-5.2-modelpagina met de drie aanroepparameters: base_url, api_key en model

  • base_url: https://integrate.api.nvidia.com/v1 (in de praktijk mag je de afsluitende /v1 weglaten)
  • api_key: de nvapi--sleutel die we straks genereren
  • model: z-ai/glm-5.2

Als je ontwikkelaar bent, ben je hier klaar — met deze drie parameters zet je een OpenAI-compatibel call op; voorbeelden in Python, Node en Shell staan op de pagina zelf. Maar de meeste mensen zijn geen ontwikkelaar en willen niet met een terminal praten. Wat NVIDIA je geeft is een grondstof, geen eindproduct. Met je API Key in handen voed je Claude Code, of Cursor, of de AI-plugins van VS Code, of je eigen programma. De tool kies je zelf, het model is gratis, de compositie bepaal je zelf.

Dát is pas echte vrijheid. Straks eerst: hoe je de Key pakt. Daarna: hoe je hem in Claude Code hangt.

⚖️ De gratis drie broers — en de prijs die je betaalt

Zet de drie gratis kanalen naast elkaar en het verschil is direct zichtbaar:

KanaalGratis quotaRestrictiesModelvorm
CatPaw (Meituan)500 callsOp = formulier indienen voor reset, wachten op goedkeuringIngebakken in IDE
QoderWork (Alibaba)2000 credits30 dagen geldig, daarna vervallen (reacties: soms al in een paar dagen op)Ingebakken in desktop-app
NVIDIA NIMOnbeperkte Key~40 RPM, wachtrij in piekurenKale API, in elke tool

Het contrast is helder. CatPaw's 500 calls zijn op voordat je het doorhebt; daarna een formulier indienen en wachten op goedkeuring. QoderWork's 2000 credits vervallen na 30 dagen — in de reacties zeggen veel mensen dat ze de maand niet eens halen. NVIDIA geeft je een onbeperkte sleutel. Op de verificatiepagina staat letterlijk: Unlimited API requests without daily limits. Geen dagelijks plafond.

Toelichting op de gratis laag — Unlimited API requests without daily limits

Maar "onbeperkt" verdient een vraagteken — gratis betekent bijna altijd een verborgen grens. De gratis laag van NVIDIA heeft een bekend probleem: traag in piekuren. Niet alleen mijn ervaring; in buitenlandse communities hoor je hetzelfde. Tijdens drukke uren komen je requests in een wachtrij of krijg je direct een 429, en de reactietijd loopt op van een paar seconden naar een tiental of meer. Iemand op Threads verwoordt het rauw: Peak hours, you queue up and wait. Buiten de piek is het prima — 's nachts en in het weekend draait het lekker. Maar reken niet op stabiele hoogfrequente aanroepen op een werkdag overdag; dan word je teleurgesteld.

De snelheidslimiet zit rond 40 requests per minuut. Voor de individuele ontwikkelaar die code schrijft is dat ruim voldoende, maar voor geautomatiseerde batch-taken — bulk-documenten genereren, code-repo's analyseren — schiet deze snelheid lek.

Nog één ding eerlijk gezegd: GLM-5.2 is nog steeds geen Claude. Het mist Claude's systeem-prompts, mist de gesprekspersoonlijkheid, mist de stabiliteit bij lange redeneerketens. Zodra je het via CC Switch in Claude Code hebt gehangen, ziet de interface er identiek uit, maar de smaak van de antwoorden wijkt af. Sommige taken doet het beter dan je verwacht, andere slechter. Welke dat zijn, moet je zelf in echte projecten uitvinden; de benchmark van een ander vervangt niet je eigen gevoel.

🛠️ Vijf minuten tot je Key — en dan in Claude Code

Stap 1: je API Key in vijf minuten

Open build.nvidia.com en registreer. Heb je Google of GitHub? Direct inloggen, geen apart account. Na inloggen moet je je telefoonnummer verifiëren om een API Key te kunnen genereren — en nu komt het: het ondersteunt Chinese mobiele nummers. Location-menu openen, China kiezen, een +86-nummer invullen, op Send Code to Phone klikken. Je krijgt een zescijferige code op je telefoon, die vul je in, verificatie rond.

Registratiepagina — Location-menu op China, +86 Chinese mobiele nummers ondersteund

Zescijferige verificatiecode op de telefoon — Send Code to Phone voltooid

Veel mensen denken dat Chinese nummers niet werken. Helemaal geen probleem. Zelf getest, de SMS was er in enkele seconden.

Na de verificatie: rechtsboven je profiel, API Keys, Generate API Key. Geef je Key een naam — bijvoorbeeld freeapi — en NVIDIA genereert een string die met nvapi- begint. Let op: deze sleutel wordt slechts één keer getoond. Sluit je de pagina, dan is hij weg. Direct kopiëren en bewaren.

API Keys-pagina — Generate API Key genereert een nvapi- sleutel

Zie je de geldigheidsdatum — 5 juli 2027. Ik heb deze Key op één jaar gezet. Er is ook een optie "nooit verlopen", maar je weet niet wanneer NVIDIA de kraan dichtdraait, dus één jaar is veiliger. Het endpoint draait op NVIDIA's wereldwijde infrastructuur: geen regio-lock, geen VPN nodig. Ontwikkelaars in het buitenland (inclusief Japan) registreren met alleen een e-mailadres en kunnen direct aan de slag.

Stap 2: in Claude Code via CC Switch

Key binnen. Nu: hoe zet je hem in.

Als je ontwikkelaar bent, bouw je met de drie parameters een OpenAI-compatibel call. Voor ieder ander is er CC Switch — een grafisch tooltje dat de onderliggende model-aanbieder van Claude Code beheert. Open het en je ziet een lange lijst: tientallen aanbieders, SiliconFlow, OpenRouter, GitHub Copilot, Codex — en NVIDIA. Klik op de blauwe knop Nvidia en de aanvraag-URL wordt automatisch ingevuld; jij plakt alleen je API Key.

CC Switch-aanbiederslijst — de blauwe Nvidia-knop vult de aanvraag-URL automatisch in

CC Switch-configuratie — vier punten: API Key, aanvraag-URL, OpenAI Chat Completions-formaat en model-mapping

Vier configuratiepunten:

  1. API Key: plak je nvapi--sleutel.
  2. Aanvraag-URL: https://integrate.api.nvidia.com — CC Switch heeft deze al vooraf ingevuld.
  3. API-formaat: kies OpenAI Chat Completions (met routing aan) — iets anders en de formats matchen niet.
  4. Model-mapping (het belangrijkste): map Sonnet, Opus en Haiku allemaal naar z-ai/glm-5.2. Dan maakt het niet uit welke rol Claude Code aanroept, onder de motorkap draait altijd GLM-5.2.

Sla op, open Claude Code, typ /model. Waar eerst Sonnet 4.6 en Opus stonden, staat nu z-ai/glm-5.2. Kies "Custom Sonnet model", stuur een hi om te testen.

Claude Code — /model toont z-ai/glm-5.2 op de plek van Sonnet en Opus

Het werkt.

Wat je nu hebt: de volledige Claude Code-interface en het agent-workflow, maar met GLM-5.2 gratis van NVIDIA als motor. Multi-file edits, automatische uitvoering, contextbeheer, tool-calls — het staat er allemaal nog. Alleen de redeneermotor is gewisseld. Als je het niet vertelt, ziet niemand het — dezelfde logo's in je terminal, dezelfde interactie, hetzelfde /model-commando. Maar elke aanroep gaat via NVIDIA's GPU-cluster en pakt GLM-5.2 van Zhipu.

De rekening
Claude Code kost normaal minimaal het Max-pakket van $100 per maand, of API Usage Billing pay-as-you-go. Met NVIDIA's gratis API plus CC Switch krijg je dezelfde interface, hetzelfde workflow — en de onderliggende modelkosten zijn nul. Voor wie het Claude Code-workflow wil ervaren met een beperkt budget is dit een buitengewoon bruikbaar alternatief.

🌍 De economie achter gratis: drie lagen, één model

Na drie stukken gaat het me niet meer om GLM-5.2 alleen. Leg ze naast elkaar en je ziet een heldere drielagige structuur:

  • Laag 1, toepassingen — Meituan en Alibaba. Ze stoppen GLM-5.2 in hun eigen product (CatPaw is een IDE, QoderWork een desktop-buddy) en gebruiken het gratis model om eindgebruikers te winnen. Hoe goed het is, hangt voor een groot deel af van het product eromheen.
  • Laag 2, infrastructuur — NVIDIA. Ze zetten GLM-5.2 op hun eigen GPU-wolk en bieden het endpoint gratis aan, om ontwikkelaars met gratis rekenkracht te lokken.
  • Laag 3, het model — Zhipu zelf. Ze openen GLM-5.2 volledig (MIT-licentie) en laten iedereen het distribueren.

Drie lagen, drie bedrijfslogica's, drie compleet verschillende soorten gratis. Maar wat eronder stroomt, is hetzelfde.

Waarom doet NVIDIA dit? Het is geen modelbedrijf. Kijk naar hun business — ze verkopen GPU's. Een H200 of B200, de AI-chips, kost enkele tienduizenden dollars per stuk. Hun grootste klanten: bedrijven die rekenkracht voor grootschalige inferentie nodig hebben. Een gratis API lijkt NVIDIA geld toe te leggen op andermans modellen, maar het doet in feite één ding: ontwikkelaars laten bouwen, testen en prototypen op NVIDIA-infrastructuur. Zodra je project daar draait en je naar productie moet, is de natuurlijke volgende stap NVIDIA-GPU's kopen of hun betaalde inferentiedienst nemen.

De gratis API is het aas. GPU-verkoop en betaalde inferentiedienst zijn de haak. De logica is zo helder als glas.

Vroeger was dit ondenkbaar. Modellen waren gesloten: GPT-4 draaide alleen op het platform van OpenAI, Claude alleen op dat van Anthropic — wil je een model, dan moet je in hun ecosysteem. GLM-5.2 breekt die regel. Het is open source, MIT-licentie, iedereen mag het gebruiken. Dus bouwt Meituan er een IDE mee, Alibaba een kantoor-tool, en gebruikt NVIDIA het als gratis API-lokmiddel. Elk vecht met hetzelfde model om zijn eigen ingang bij de gebruiker, maar niemand bezit het.

Zhipu deed iets slims: het vecht niet met deze grote bedrijven om eindgebruikers. Het is de waterbron. Iedereen die wil irrigeren mag dat doen, het water is gratis. Maar zolang het water in ieders velden van mij komt, is deze rivier de infrastructuur — om eromheen te werken moet je je eigen put graven. Dát is de echte kracht van open source-modellen: niet het gratis op zich, maar dat het elke concurrent tot jouw distributiekanaal maakt. Hoe opener je bent, hoe onmisbaarder je wordt.

In 1911 werd Standard Oil door het Amerikaanse Hooggerechtshof als monopolist aangemerkt en gedwongen opgesplitst in 34 onafhankelijke bedrijven. Wall Street huilde; iedereen dacht dat Rockefeller er geweest was. De ironie: die 34 bedrijven werden elk reuzen in de oliesector — Exxon, Mobil, Chevron, Amoco, stuk voor stuk Fortune 500. Omdat Rockefeller aandelen in elk van de gesplitste bedrijven hield, verdubbelde zijn persoonlijke vermogen meerdere keren.

Iets uit elkaar halen en weggeven is soms geen verlies van controle. Het is hoe het uitgroeit tot infrastructuur waar niemand meer omheen kan.

📝 Tot slot

Zolang het aanbod loopt: ga naar build.nvidia.com en registreer. Het kost niets, is geregeld in vijf minuten, en CC Switch klikt de rest van de configuratie voor je uit.

De GLM-5.2 gratis-trilogie: Meituan en Alibaba bouwen de productlaag, NVIDIA graaft door naar de infrastructuurlaag. Elke laag een stap dieper. Welke laag jij wilt, kies zelf.


De stappen en screenshots in dit stuk zijn door de auteur zelf uitgevoerd (stand juli 2026); quota, snelheidslimieten en de looptijd van het aanbod kunnen op elk moment wijzigen — raadpleeg de officiële pagina op build.nvidia.com; de meningen zijn uitsluitend die van de auteur.