⚡ Det viktigaste först
För utvecklare är det här den enda meningen som räknar: det går att få obegränsad tillgång till GLM-5.2:s API — gratis, utan att binda ett kort. Inte 500 provanrop, inte 2 000 credits som rinner ut efter 30 dagar. En verklig, obegränsad nyckel.
Det här är tredje delen i en löpande serie — jag har redan skrivit om Meituans CatPaw och Alibabas QoderWork, och på sitt sätt delar alla tre ut GLM-5.2. Men leverantören den här gången skiljer sig: inte ett kinesiskt företag, utan NVIDIA — GPU-tillverkaren, världens mest värdefulla chippbolag. Och vad NVIDIA lägger på bordet är inte en provkvot, det är obegränsad gratis API-åtkomst.
NVIDIA har hängt upp en gratis API-endpoint för GLM-5.2 på sin utvecklarplattform
build.nvidia.com. OpenAI-kompatibelt format, går rakt in i Claude Code. Fem minuter att registrera sig, inget kort.Min bedömning: av "GLM-5.2 gratis-trilogin" är det här det inlägg som är mest värt att faktiskt göra — Meituan bygger produktnivån, Alibaba bygger produktnivån, NVIDIA går rakt på infrastruktursnivån. För varje lager sjunker de djupare.
📰 Var nyckeln sitter: 77 gratis modeller på build.nvidia.com
NVIDIA har en utvecklarplattform som heter build.nvidia.com. Den är värd för 141 AI-modeller, och 77 av dem har en gratis API-endpoint. Läs det igen. 77 gratis modeller. DeepSeek-V4-Pro ligger där, Kimi-K2.6 ligger där, MiniMax-M2.7 ligger där, Qwen3.5 ligger där.

GLM-5.2 ligger där också. Etiketten säger Free Endpoint och Downloadable, leverantören är Z.ai (Zhipu), och modellen toppar listan över senaste nytt. Efter en dag online: 2 miljoner nedladdningar.

Det som skiljer den här gratisendpointen från CatPaw och QoderWork är fundamentalt. CatPaw och QoderWork är färdiga produkter — du laddar ner, installerar, öppnar — men modellen är inbakad i produkten och du kan bara anropa den genom deras eget gränssnitt. NVIDIA ger dig rå API-passet, OpenAI-kompatibelt, och du kan stoppa in det i vilket verktyg som helst som talar det språket.
Vilket verktyg som helst. Inklusive Claude Code.
Vissa läsare stannar här och tänker: API är grejer för riktiga kodare, jag är inte den personen. Stanna. Läs vidare. Det finns ett grafiskt verktyg som heter CC Switch som gör hela konfigurationen med några få klick.
🧬 Tre parametrar: base_url, api_key, model
Låt oss först titta på det tekniska underlaget. Öppna GLM-5.2:s modellsida på NVIDIAs plattform, så ser du tre parametrar listade:

- base_url:
https://integrate.api.nvidia.com/v1(i praktiken går det lika bra att strunta i det där/v1på slutet) - api_key: den
nvapi--prefixade nyckeln vi genererar i nästa steg - model:
z-ai/glm-5.2
Om du är utvecklare slutar artikeln här — ta de här tre parametrarna och anropa ett OpenAI-kompatibelt API. Python-, Node- och shell-exempel finns på sidan. Men de flesta är inte utvecklare och vill inte mecka med kommandoraden. Och det är poängen: NVIDIA lämnar över råvaran, inte en färdig produkt. När du väl har nyckeln kan du plugga in den i Claude Code, i Cursor, i vilken VS Code AI-plugin som helst — eller i ett program du skrivit själv. Verktyget väljer du, modellen är gratis, kombinationen bestämmer du.
Det är den riktiga friheten. Nu: hur du skaffar nyckeln, och hur du pluggar in den i Claude Code.
⚖️ Tre gratisbröder & vad de kostar
Lägg de tre gratisvägarna brevid varandra så är skillnaden uppenbar:
| Kanal | Gratis kvot | Begränsning | Modellens form |
|---|---|---|---|
| CatPaw (Meituan) | 500 anrop | När de är slut: ansök om reset via formulär, vänta på godkännande | Inbakad i IDE |
| QoderWork (Alibaba) | 2 000 credits | 30 dagars giltighet, sedan bortfall (kommentatorer rapporterar att de tar slut på några dagar) | Inbakad i skrivbordsapp |
| NVIDIA NIM | Obegränsad nyckel | ~40 RPM, kö vid högtrafik | Rent API, plugga in var du vill |
Skillnaden talar för sig själv. CatPaws 500 anrop tar slut, och då får du skicka in ett formulär för att få mer — och vänta på godkännande. QoderWorks 2 000 credits löper ut efter 30 dagar, och i kommentarerna rapporterar många att de inte ens håller en månad. NVIDIA ger dig en obegränsad nyckel. På sidan står det Unlimited API requests without daily limits — ingen dagsgräns.

Men "obegränsat" förtjänar en parentes — gratis saker har nästan alltid en dold kostnad. NVIDIAs gratislager har ett välkänt problem: vid högtrafik är det långsamt. Inte bara min upplevelse — utvecklargemenskapen utomlands rapporterar samma sak: under rusningstid köar förfrågningarna, eller så får du direkt 429 och vägras anslutning, och svarstiden skjuter från några sekunder till över en minut. Någon på Threads sammanfattade det rakt: Peak hours, you queue up and wait — översatt: ställ dig i kö och vänta. Lågtrafik — natt, helger — fungerar finfint; men räkna inte med att den bär högfrekvent dagtidstrafik stabil under en arbetsvecka. Då blir du besviken.
Och en sak till, rakt ut: GLM-5.2 är inte Claude. Den har inte Claudes system-prompt, inte Claudes personlighet, inte Claudes stabilitet i långa resonemangskedjor. När du har pluggat in den via CC Switch ser Claude Code exakt likadant ut — men svaren smakar annorlunda. Vissa uppgifter löser den bättre än du väntat dig, vissa sämre. Vilka som är vilka måste du köra själv i riktiga projekt — någon annans benchmark ersätter inte din egen känsla.
🛠️ Fem minuter till nyckel + Claude Code
Steg 1: Skaffa API-nyckeln på fem minuter
Öppna build.nvidia.com och registrera dig. Har du Google- eller GitHub-konto loggar du in direkt med det, ingen separat registrering. Efter inloggning måste du verifiera ett telefonnummer innan du kan generera en API-nyckel — och nu kommer det viktiga: det stöder kinesiska mobilnummer. Dra upp Location-menyn, välj China, slå in ditt +86-nummer, klicka Send Code to Phone. En sexsiffrig kod dimper ner i telefonen, skriv in den, klar.


Det här är steget där de flesta ger upp i tron att kinesiska nummer inte fungerar. De gör det. Jag testade själv — SMS:et var framme på några sekunder.
När telefonnumret är verifierat går du in på profilmenyn uppe till höger, öppnar API Keys-sidan och klickar Generate API Key. Ge nyckeln ett namn — typ freeapi — så spottar systemet ur sig en sträng som börjar med nvapi-. Och här: den här nyckeln visas en enda gång. Stänger du sidan är den borta för alltid. Kopiera och spara direkt.

Lägg märke till giltigheten: 5 juli 2027. Jag satte den till ett år. Det finns ett alternativ för nycklar som aldrig löper ut också, men ingen vet när NVIDIA drar i bromsen på den här kampanjen, så ett år känns tryggare. Endpointen körs på NVIDIAs globala infrastruktur — inget regionslås, inget VPN — så utvecklare utomlands (inklusive Japan) registrerar sig med en e-postadress och är igång direkt.
Steg 2: Plugga in den i Claude Code via CC Switch
Nyckeln är hemma. Nu kommer det avgörande steget: få den att faktiskt göra nytta.
Om du är utvecklare tar du de tre parametrarna ovan och anropar API:et direkt. Men de flesta vill inte mecka kommandoraden — och det är precis här CC Switch kommer in. Det är ett grafiskt verktyg för att hantera vilken modellleverantör som sitter under huven på Claude Code. Öppna det så får du en tätt packad lista med leverantörer — SiliconFlow, OpenRouter, GitHub Copilot, Codex — och där sitter NVIDIA med. Du klickar på den blå Nvidia-knappen så fyller CC Switch i request-URL:en åt dig; allt du gör är att klistra in din API-nyckel.


Fyra saker att få rätt:
- API-nyckel: klistra in din
nvapi--nyckel. - Request-URL:
https://integrate.api.nvidia.com— CC Switch har redan fyllt i den åt dig. - API-format: måste vara OpenAI Chat Completions (med routing påslaget). Väljer du fel stämmer inte formatet.
- Modellmappning (den kritiska): mappa Sonnet, Opus och Haiku — alla tre — till
z-ai/glm-5.2. Då spelar det ingen roll vilken modellroll Claude Code anropar; under huven körs GLM-5.2.
Spara. Öppna Claude Code, skriv /model. I listan, där det brukade stå Sonnet 4.6 och Opus, står det nu z-ai/glm-5.2. Välj "Custom Sonnet model" och skriv hi för att testa.

Det funkar.
Vad du nu har är Claude Codes hela gränssnitt och hela agentarbetsflöde — men under huven kör NVIDIAs gratis GLM-5.2. Claude Codes fileredigering, automatisering, kontexthantering, verktygsanrop — allt finns kvar. Enda skillnaden är att inferensmotorn är utbytt. Säger du inget ser ingen skillnad från utsidan — terminalen visar Claude Codes logga, samma interaktion, samma /model-kommando. Men varje samtal rullar över NVIDIAs GPU-kluster och ropar på Zhipus GLM-5.2.
Ett vanligt Claude Code-abonnemang börjar på Max-planen till 100 dollar i månaden, eller så kör du API Usage Billing och betalar per anrop. Nu: samma gränssnitt, samma arbetsflöde, och 0 kronor i modellkostnad. För den som vill uppleva Claude Code-arbetsflödet men har en tunn plånbok är det här den mest praktiska ersättningen just nu.
🌍 Affären bakom gratis: tre lager, samma modell
Tre inlägg in i den här trilogin handlar det inte längre om GLM-5.2 som enskild modell. Lägg dem brevid varandra och ett tydligt trelagermönster träder fram:
- Lager ett — applikationsnivån: Meituan och Alibaba. De stoppar in GLM-5.2 i sina egna produkter (CatPaw som IDE, QoderWork som skrivbordskompis) och använder gratis modell för att locka slutanvändare. Hur bra modellen känns avgörs till stor del av hur bra själva produkten är.
- Lager två — infrastruktursnivån: NVIDIA. De lägger GLM-5.2 på sitt eget GPU-moln och ger bort en gratis API-endpoint för att locka utvecklare med gratis räknekraft.
- Lager tre — modellnivån: Zhipu själva. De släpper GLM-5.2 helt öppen (MIT-licens) och låter alla andra distribuera den.
Tre lager, tre affärslogiker, tre helt olika sorters gratis. Men det som flyter genom alla tre är samma modell.
Varför i all sin dar gör NVIDIA det här? De är ju inte ett modellbolag. Tänk på vad NVIDIA säljer — GPU. Deras H200 och B200, chip för AI, kostar tiotusentals dollar stycket. Deras största kunder är företag som behöver inferens i stor skala. Att ge bort ett gratis API ser ut som NVIDIA sponsrar andras modeller. I själva verket gör de en enda sak: lockar fler utvecklare att skriva kod, testa modeller och bygga prototyper på NVIDIA-infrastruktur. När ditt projekt väl rullar där och du ska skala upp till produktion är det naturligaste valet att köpa GPU:er från NVIDIA, eller använda NVIDIAs betalda inferenstjänst.
Tänk på hur otänkbart det här var för bara något år sedan. Tidigare modeller var låsta: GPT-4 fanns bara på OpenAI, Claude fanns bara på Anthropic — ville du använda en modell var du tvungen att kliva in i ägarens ekosystem. GLM-5.2 bryter den regeln. MIT-licens, öppna vikter, vem som helst kan ta den. Därför bygger Meituan en IDE på den, Alibaba bygger ett kontorsverktyg, NVIDIA bygger en gratis-endpoint för att dra trafik. Varje företag slåss om sin egen användaringång med samma modell — men ingen av dem äger den.
Zhipu har gjort en klok sak: de tävlar inte med de här jättarna om slutanvändarna. De är vattnet. Vem som helst får leda vattnet till sina åkrar, och det är gratis — men så länge alla åkrar vattnas med deras vatten blir floden infrastruktur, och för att komma runt den måste du borra en egen brunn. Det är den sanna kraften i öppen källkod: inte gratis i sig, utan att den förvandlar alla dina konkurrenter till dina distributionskanaler. Ju mer du öppnar upp, desto mer beroende blir de av dig.
1911 dömde USA:s högsta domstol Standard Oil för monopol och tvingade bolaget att splittras i 34 oberoende företag. Wall Street skrek blod, och alla trodde att Rockefeller var klar. Ironin blev den att de 34 företagen växte till varsin jätte — Exxon, Mobil, Chevron, Amoco — och Rockefeller, som höll ursprungliga aktier i alla, blev flera gånger rikare efter splittringen än före.
Att dela upp en sak och ge bort den är ibland inte att förlora kontrollen. Det är att låta den växa till infrastruktur som ingen kommer undan.
📝 Slutord
Passa på medan kampanjen lever — registrera dig på build.nvidia.com. Det kostar inget, tar fem minuter, och CC Switch sköter resten av konfigurationen åt dig.
GLM-5.2 gratis-trilogin i korthet: Meituan bygger produktnivån, Alibaba bygger produktnivån, NVIDIA bygger infrastruktursnivån — ett lager djupare för varje steg. Vilket lager du vill ha är ditt val.
Steg och skärmbilder i den här artikeln är testade av författaren (per juli 2026). Gratisnivåns omfattning, hastighetsgränser och kampanjens längd kan ändras när som helst — utgå alltid från build.nvidia.com:s officiella sida. Åsikterna är författarens egna.