⚡ Det viktige først

Etter at jeg sendte ut de to forrige innleggene — om Meituan CatPaw og om Alibaba QoderWork — datt det en god del meldinger i innboksen. Én av dem festet seg, med omtrent dette innholdet: disse verktøya er riktignok gratis, men alt har en kvote — CatPaw 500 kall, QoderWork 2000 poeng på 30 dager. Finnes det egentlig en måte å bruke GLM-5.2-API-et på uten en øvre grense?

Første reaksjon min var ærlig talt: det er litt freist spørsmål. Inferens for en frontlinjemodell koster regnekraft; ekte «ubegrenset gratis» finnes vel neppe.

Så sjekka jeg. Det gjør det.

TL;DR · på én setning
Selskapet som tilbyr denne kanalen er ikke kinesisk — det er NVIDIA, altså grafikkort-NVIDIA, verdens mest verdifulle brikkeselskap. På utviklerplattformen build.nvidia.com har de hengt opp et gratis API-endepunkt for GLM-5.2, i OpenAI-kompatibelt format, som du kan koble rett inn i Claude Code. Fem minutter å registrere seg, ingen binding av betalingskort.

Min vurdering: Dette er det innlegget i «GLM-5.2-gratis-trilogien» det er mest verdt å faktisk sette i gang med — Meituan bygger produktlaget, Alibaba bygger produktlaget, NVIDIA går rett på infrastrukturlaget. Hvert lag drar lenger ned mot bunnen.

📰 Hvor den gratis nøkkelen ligger: 77 av 141 modeller på build.nvidia.com

NVIDIA har en utviklerplattform som heter build.nvidia.com. Der er 141 AI-modeller hostet, og 77 av dem har gratis API-endepunkt. Du leste rett: 77 gratismodeller. DeepSeek-V4-Pro er der, Kimi-K2.6 er der, MiniMax-M2.7 er der, Qwen3.5 er der.

Modellmarkedet på build.nvidia.com — 77 av 141 modeller har gratis API-endepunkt

GLM-5.2 er også der. Etikettene sier Free Endpoint og Downloadable, leverandør er oppgitt som Z.ai (Zhipu), og den ligger øverst på listen over nyeste modeller. Én dag ute, og nedlastingen lå allerede på 2 millioner.

GLM-5.2-modellkortet — Free Endpoint og Downloadable, leverandør Z.ai (Zhipu)

Dette gratis-API-et skiller seg fra verktøya i de to forrige innleggene på et avgjørende punkt. CatPaw og QoderWork er ferdige produkter: du laster ned, installerer, åpner og bruker — men modellen er innkapslet i produktet, og du kan bare kalle på den gjennom grensesnittet deres. Hva NVIDIA gir deg er et rent API-endepunkt som følger OpenI-formatet. Du kan koble det inn i et hvert verktøy som forstår det formatet.

Et hvert verktøy. Inkludert Claude Code.

Jeg vet at noen lesere nå tenker at dette med API føles litt langt unna — «jeg er jo ikke utvikler, jeg». Vent. Lengre ned kommer et grafisk verktøy som heter CC Switch: noen museklikk, så er alt konfigurert for deg.

🧬 Tre parametere: base_url, api_key og model

Først det tekniske grunnlaget. Åpne modelsiden for GLM-5.2 på NVIDIAs plattform, så ser du tre nøkkelparametere listet opp:

GLM-5.2-modellsiden lister opp de tre parameterne base_url, api_key og model

  • base_url: https://integrate.api.nvidia.com/v1 (i praksis kan du droppe /v1 på slutten — testa)
  • api_key: den nvapi--nøkkelen du genererer i neste steg
  • model: z-ai/glm-5.2

Er du utvikler, er du egentlig ferdig her — ta med de tre parameterne og kall på API-et i OpenAI-kompatibelt format; Python-, Node- og Shell-eksempler står rett på siden. Men de fleste er ikke utviklere og orker ikke kommandolinja. Poget er at NVIDIA gir deg råmaterialet, ikke et ferdig produkt. Når du først har API-nøkkelen, kan du koble den til Claude Code, til Cursor, til et vilkårlig AI-tillegg i VS Code — eller til et program du har skrevet selv. Verktøyet velger du selv. Modellen er gratis. Hvordan du setter det sammen, er opp til deg.

Det er den virkelige frihetsgraden. Neste steg: hvordan hente selve nøkkelen, og hvordan koble den inn i Claude Code.

⚖️ De tre gratisbrødrene — og hva koster det egentlig

Sett de tre gratis-kanalene ved siden av hverandre, og forskjellene er umiddelbare:

KanalGratis kvoteBegrensningModellens form
CatPaw (Meituan)500 kallNår den er brukt opp: fyll ut skjema for å be om reset, vent på godkjenningInnebygd i en IDE
QoderWork (Alibaba)2000 poeng30 dager holdbarhet, deretter bortfaller (kommentarfeltet forteller at den kan være brukt opp på noen få dager)Innebygd i en skrivebordsapp
NVIDIA NIMUbegrenset nøkkelCa. 40 RPM, kø i rushtidenRent API — koble inn i det du vil

Kontrasten er tydelig. Når CatPaws 500 kall er brukt opp, må du fylle ut skjema og vente på godkjenning; QoderWork sine 2000 poeng forsvinner etter 30 dager, og i kommentarfeltet forteller folk at de sjelden kommer gjennom en hel måned. NVIDIA gir deg rett og slett en ubegrenset nøkkel. På valideringssiden står det Unlimited API requests without daily limits — ingen daglig øvre grense.

Beskrivelse av gratislaget — Unlimited API requests without daily limits, ingen daglig grense

Men la oss sette et spørsmålstegn ved ordet «ubegrenget» — gratis har som regel en skjult pris. NVIDIAs gratislag har ett velkjent problem: i rushtiden er det tregt. Det er ikke bare min erfaring; i internasjonale utviklermiljøer går rapportene på at forespørsler i travle perioder havner i kø eller rett og slett returnerer 429, og svartiden kan dra fra et par sekunder til over ti sekunder eller mer. Noen formulerte det nokså direkte på Threads: Peak hours, you queue up and wait — «i rushtida stiller du i kø og venter». Utenfor rushen er det god fart; nattestid og i helger jobber det faktisk ganske bra. Regner du med at det skal bære stabil, hyppig trafikk i arbeidstiden på hverdager, vil du nok bli skuffa.

Hastighetsgrensen ligger på ca. 40 forespørsler i minuttet. Til daglig kodearbeid for en enkelt utvikler holder det lett — men prøver du å kjøre automatiserte batchjobber (masse dokumentgenerering, analyse av store kodebaser), er det nettopp her flaskehalsen smeller.

Og én ting til, så det er sagt: GLM-5.2 er ikke Claude. Den har ikke Claudes systemprompt, ikke Claudes samtalespersonlighet, ikke stabiliteten Claude viser på komplekse, langvarige resonnementer. Når du har koblet den inn i Claude Code via CC Switch, ser grensesnittet helt likt ut — men tonen i svarene er en annen. På noen oppgaver er den bedre enn du tror; på andre dårligere. Hvilke scener den er sterk og svak i, må du teste med egne prosjekter. Ingen andres benchmark erstatter din egen opplevelse.

🛠️ Finn nøkkelen på 5 minutter — og koble den inn i Claude Code

Steg 1: Hent API-nøkkelen på fem minutter

Åpne build.nvidia.com og registrer en konto. Har du Google- eller GitHub-konto, kan du logge inn med én gang — ingen egen registrering. Etter innlogging må du verifisere telefonnummeret før du kan generere en API-nøkkel, og her er det verdt å løfte én ting fram: det går helt fint med kinesiske +86-nummer. I nedtrekksmenyen «Location» velger du China, fyller inn et +86-nummer, trykker Send Code to Phone, får en sekssifret kode på telefonen, taster den inn — og du er verificert.

Registreringssiden — i Location-nedtrekksmenyen velges China, og kinesiske +86-nummer støttes

Sekssifret kode mottatt på telefonen — Send Code to Phone verifisert

Mange tror at kinesiske nummer ikke fungerer her. Det stemmer ikke. Jeg testa selv — SMS-en kom på et par sekunder.

Når telefonen er verifisert, går du til profilen øverst til høyre, inn på API Keys-siden og trykker Generate API Key. Gi nøkkelen et navn, for eksempel freeapi, så genererer systemet en streng som starter med nvapi-. Advarsel: denne strengen vises bare én gang. Lukker du siden, er den borte for godt — kopier og lagre umiddelbart.

API Keys-siden — Generate API Key genererer en nvapi-nøkkel

Så selve utløpsdatoen: 5. juli 2027. Jeg satte gyldigheten på denne nøkkelen til ett år. Du kan også velge «aldri utløp», men det er usikkert når kampanjen eventuelt blir trukket tilbake, så ett år er det tryggeste valget. Endepunktet kjører på NVIDIAs globale infrastruktur — ingen regionlås, ingen VPN. Utviklere i utlandet (inkludert Japan) kan registrere seg med en e-postadresse og bruke det direkte.

Steg 2: Koble det inn i Claude Code via CC Switch

Nøkkelen har du. Neste spørsmål: hvordan faktisk bruke den.

Er du utvikler, kaller du på API-et med de tre parameterne fra før, i OpenAI-kompatibelt format. Men de fleste orker ikke kommandolinja — og da er CC Switch verktøyet. Det er en grafisk håndtering av modellleverandører, spesifikt bygget for å bytte ut den underliggende modellen i Claude Code. Åpner du det, får du en tett liste over leverandører — SiliconFlow, OpenRouter, GitHub Copilot, Codex og flere titalls til, NVIDIA inkludert. Trykk på den blå Nvidia-knappen, så foreslår den allerede forespørselsadressen. Det eneste du trenger å gjøre, er å lime inn din egen API-nøkkel.

Leverandørlisten i CC Switch — den blå Nvidia-knappen fyller inn forespørselsadressen automatisk

De fire konfigurasjonspunktene i CC Switch — API-nøkkel, forespørselsadresse, OpenAI Chat Completions-format, modellkartlegging

Konfigurasjonen koker ned til fire punkter:

  1. API-nøkkel: lim inn din nvapi--streng.
  2. Forespørselsadresse: https://integrate.api.nvidia.com — CC Switch har allerede fylt denne inn.
  3. API-format: må settes til OpenAI Chat Completions (med routing slått på) — uten dette stemmer ikke forespørselsformatet.
  4. Modellkartlegging (det viktigste punktet): kartlegg Sonnet, Opus og Haiku — alle tre — til z-ai/glm-5.2. Da uansett hvilken modellrolle Claude Code ber om, er det GLM-5.2 som faktisk kjører.

Lagre. Åpne Claude Code, skriv /model, og du vil se at de plassene som pleide å si Sonnet 4.6 og Opus nå sier z-ai/glm-5.2. Velg «Custom Sonnet model» og send et hi for å teste.

Claude Code med /model — Sonnet og Opus er nå byttet ut med z-ai/glm-5.2

Det funker.

Du har nå hele grensesnittet og hele agentarbeidsflyten i Claude Code intakt — men under panseret kjører GLM-5.2 gratis via NVIDIA. Claude Code sine evner for redigering på tvers av filer, automatisk kjøring, konteksthåndtering og verktøykall er alle intakte. Det er bare inferensmotoren som er byttet ut. Du sier ingenting, og ingen kan se det fra grensesnittet — terminalen viser Claudes logo, samme interaksjon, samme /model-kommando. Men hver eneste samtaleforespørsel går via NVIDIAs GPU-klynge, og hver eneste modell som kalles er Zhipu sin GLM-5.2.

Hva blir regnestykket?
Normal pris for Claude Code er minimum Max-abonnementet — 100 dollar i måneden — eller API Usage Billing etter forbruk. Med NVIDIAs gratis-API pluss CC Switch får du samme grensesnitt, samme arbeidsflyt, og den underliggende modellen koster null. For alle som vil prøve Claude Code-arbeidsflyten på stram budsjett, er dette et usedvanlig praktisk alternativ.

🌍 Forretningslogikken bak «gratis»: tre lag, samme modell

Nå som jeg har skrevet tre innlegg, handler det egentlig ikke lenger bare om modellen GLM-5.2. Sett de tre ved siden av hverandre, og et tydelig tresjikt møter deg:

  • Første lag — applikasjonslaget: Meituan og Alibaba. De bygger GLM-5.2 inn i egne produkter (CatPaw er en IDE, QoderWork en skrivebordsassistent) og bruker gratis-modellen til å trekke sluttkunder. Hvordan modellen oppleves, henger mye på hvor bra selve produktet er bygget.
  • Andre lag — infrastrukturlaget: NVIDIA. De legger GLM-5.2 på egen GPU-sky og gir bort et gratis API-endepunkt — gratis regnekraft for å trekke utviklere.
  • Tredje lag — modell-laget: Zhipu selv. De har åpnet GLM-5.2 fullt ut under MIT-lisensen og lar hvem som helst distribuere den.

Tre lag, tre forretningslogikker, tre helt ulike slags gratis. Men det som flyter i bunn er det samme.

Hvorfor i all verden gjør NVIDIA dette? De er ikke et modelselskap. Tenk over hva NVIDIAs virkelige forretning er: de selger GPU-er. Brikker som H200 og B200 koster titusenvis av dollar per stykk. De største kundene er selskaper som trenger massiv inferens-regnekraft. Et gratis API ser ut som NVIDIA subsidierer andres modellkjøringer. Det de egentlig gjør, er noe annet: la flere utviklere skrive kode, teste modeller og bygge prototyper på NVIDIAs infrastruktur. Når prosjektet ditt først er oppe og går på denne plattformen, og du skal gå til produksjon, er den mest naturlige veien videre å kjøpe GPU-er fra NVIDIA — eller bruke NVIDIAs betalte inferenstjeneste.

Gratis API er agn. GPU-salget og den betalte inferenstjenesten er fiskestanga. Så snart du tenker det gjennom, gir det selv.

Tenkt tilbake noen år hadde dette vært utenkelig. Før var modellene lukkede: GPT-4 fantes bare hos OpenAI, Claude bare hos Anthropic — ville du bruke en modell, måtte du inn i eierens økosystem. GLM-5.2 bryter den regelen. Den er åpen kildekode under MIT-lisensen; alle kan ta den i bruk. Så Meituan bygger en IDE på den, Alibaba en kontorassistent, og NVIDIA et gratis-API for å lede trafikk. Hver eneste av dem bruker samme modell til å kjempe om sin brukerinngang — men ingen av dem eier modellen.

Zhipu har gjort noe lurt: de konkurrerer ikke med gigantene om sluttkunder, de er vannkilden. Hvem som helst kan lede vannet dit de vil; vannet er gratis. Men så lenge alle vanner jordene sine med mitt vann, er den elva infrastruktur — vil du utenom, må du grave brønnen selv. Det er den virkelige krafta til åpen kildekode: ikke at den er gratis, men at den gjør alle konkurrentene dine til distribusjonskanaler. Jo mer åpen du er, jo mer avhengig blir alle av deg.

I 1911 ble Standard Oil dømt for monopol av amerikansk høyesterett og tvangssplittet i 34 uavhengige selskaper. Wall Street hylte, og alle trodde Rockefeller var ferdig. Ironisk nok ble disse 34 selskapene hver for seg til giganter i oljebransjen — Exxon, Mobil, Chevron, Amoco, alle på listen over verdens største selskaper. Siden Rockefeller beholdt grunnaksjene i samtlige selskaper etter oppdelingen, ble hans personlige formue flerdoblet sammenliknet med før splittelsen.

Å dele noe ut i mange biter er ikke alltid å miste kontroll. Noen ganger er det nettopp veien å gjøre det til infrastruktur ingen kommer seg utenom.

📝 Til slutt

Så lenge kampanjonen varer: gå til build.nvidia.com og registrer deg. Det koster ingenting, det tar fem minutter, og CC Switch fikser resten av konfigurasjonen for deg.

GLM-5.2-gratis-trilogien i korthet: Meituan bygger produktlaget, Alibaba bygger produktlaget, NVIDIA bygger infrastrukturlaget — hvert lag drar lenger ned mot bunnen. Hvilket lag du vil ha, velger du selv.


Trinna og skjermbildene i denne artikkelen er testa av forfatteren (per juli 2026). Gratislagets kvoter, hastighetsgrenser og kampanjevilkår kan når som helst endres — gjeldende informasjon finner du på build.nvidia.com. Vurderingene er forfatterens egne.