⚡ Najpierw konkret: od dziś Claude Code może biec na darmowym API
Dla deweloperów sprawa ma się tak: pełny interfejs Claude Code, pełen workflow agenta — edycja wielu plików, wywoływanie narzędzi, zarządzanie kontekstem — a model pod spodem nie kosztuje cię ani grosza za wywołanie. I ten klucz nie leży u Anthropic ani u chińskiego dostawcy. Leży u NVIDII. Tak, tej od kart graficznych. Na build.nvidia.com zawiesili darmowy endpoint GLM-5.2 — modelu Z.ai (Zhipu) — w formacie kompatybilnym z OpenAI, podłączalny bezpośrednio do Claude Code. Rejestracja w pięć minut, bez karty płatniczej.
I tu wraca pytanie, które spadło na mnie po poprzednich dwóch tekstach: CatPaw od Meituan daje 500 wywołań, QoderWork od Alibaba 2000 kredytów ważnych 30 dni — czy da się w ogóle dostać GLM-5.2 bez limitu?
Moja pierwsza reakcja brzmiała: trochę dużo żądasz. Wywołanie topowego modelu tyle kosztuje na samej mocy obliczeniowej, nie istnieje coś takiego jak nieograniczone darmowe API.
Poszukałem. Jest.
Dostawcą tego kanału nie jest chińska firma — to NVIDIA, najdroższa firma chipowa świata. Na swojej platformie
build.nvidia.com udostępniła darmowy endpoint GLM-5.2, w formacie kompatybilnym z OpenAI, podłączalny bezpośrednio do Claude Code. Rejestracja w pięć minut, bez karty.Moja ocena: to najbardziej warte wzięcia do ręki ogniwo „trylogii darmowego GLM-5.2" — Meituan robi warstwę produktową, Alibaba robi warstwę produktową, NVIDIA wchodzi prosto na warstwę infrastruktury. Każde ogniwo schodzi poziom głębiej.
📰 Gdzie leży darmowy klucz: 77 modeli za zero na build.nvidia.com
NVIDIA prowadzi platformę dla deweloperów build.nvidia.com, na której hostowanych jest 141 modeli AI — z czego 77 ma darmowy endpoint API. Czytasz dobrze: 77 darmowych modeli. DeepSeek-V4-Pro tam jest. Kimi-K2.6 tam jest. MiniMax-M2.7 tam jest. Qwen3.5 również tam jest.

GLM-5.2 też tam jest. Znaczniki mówią Free Endpoint i Downloadable, dostawcą jest Z.ai (Zhipu), model siedzi na pierwszym miejscu listy najnowszych. Po jednym dniu od premiery liczba pobrań przebiła 2 miliony.

Ten darmowy API różni się fundamentalnie od narzędzi z poprzednich dwóch tekstów. CatPaw i QoderWork to gotowe produkty — pobierasz, instalujesz, odpalasz, ale model jest zaszyty w środku i wzywasz go tylko z ich interfejsu. NVIDIA daje ci czysty endpoint API w formacie OpenAI — możesz go wpiąć w dowolne narzędzie, które ten format wspiera.
Dowolne narzędzie. W tym Claude Code.
Wiem, że część z was na tym miejscu myśli: API to dla mnie za wysoki próg, nie jestem programistą. Spokojnie, czytaj dalej. Jest graficzne narzędzie o nazwie CC Switch, które załatwia całą konfigurację w kilka kliknięć.
🧬 Trzy parametry: base_url, api_key, model
Najpierw techniczne podłoże. Na stronie modelu GLM-5.2 na platformie NVIDII zobaczysz trzy kluczowe parametry:

- base_url:
https://integrate.api.nvidia.com/v1(w praktyce to/v1na końcu można pominąć) - api_key: klucz generowany w następnym kroku, zaczynający się od
nvapi- - model:
z-ai/glm-5.2
Jeśli jesteś programistą, w tym miejscu tekst się dla ciebie kończy — bierzesz te trzy parametry i walisz do API w formacie OpenAI; przykłady w Pythonie, Node i shellu są na stronie. Ale większość ludzi nie chce grzebać w CLI. To, co dostajesz od NVIDII, to półprodukt, nie gotowiec. Mając API Key, możesz wejść w Claude Code, możesz wejść w Cursora, we wtyczki AI do VS Code, albo we własny program dowolnej postaci. Narzędzie wybierasz sam, model jest darmowy, sposób łączenia należy do ciebie.
To jest dopiero realna swoboda. Najpierw więc: jak zdobyć ten klucz. Potem: jak wpiąć go w Claude Code.
⚖️ Darmowa trójka i jej cena
Postawione obok siebie, trzy darmowe kanały różnią się drastycznie:
| Kanał | Darmowy limit | Ograniczenia | Forma modelu |
|---|---|---|---|
| CatPaw (Meituan) | 500 wywołań | Po wyczerpaniu formularz o reset i czekanie na akceptację | Zaszyty w IDE |
| QoderWork (Alibaba) | 2000 kredytów | Ważne 30 dni, potem przepada (w komentarzach czytelnicy przyznają, że schodzi w kilka dni) | Zaszyty w aplikacji desktopowej |
| NVIDIA NIM | Nieograniczony klucz | ok. 40 RPM, kolejki w szczycie | Czyste API, podłącz, do czego chcesz |
Różnica rzuca się w oczy: gdy 500 wywołań CatPaw się skończy, wysyłasz formularz i czekasz na akceptację; 2000 kredytów QoderWork przepada po 30 dniach, a w komentarzach wielu czytelników przyznaje, że miesiąca nie dają radę dociągnąć. NVIDIA wręcza ci klucz bez limitu — strona weryfikacji mówi wprost Unlimited API requests without daily limits, żadnego dziennego progu.

Oczywiście ze słowem „nieograniczony" trzeba ostrożnie — za wszystkim, co darmowe, zazwyczaj stoi ukryta cena. Darmowy tier NVIDII ma jeden dobrze znany problem: w godzinach szczytu jest wolno. To nie jest tylko moje wrażenie. Według relacji z zagranicznych społeczności deweloperskich, w szczycie żądania czekają w kolejce albo wprost zwracają błąd 429, a czas odpowiedzi rozciąga się z kilku sekund do kilkunastu albo i więcej. Ktoś na Threads ujął to wprost: Peak hours, you queue up and wait — „w szczycie stajesz w kolejce i czekasz". Poza szczytem jest nieźle; w nocy i w weekendy batchowe taski idą gładko. Ale jeśli liczysz, że w dzień pociągnie stabilnie pod dużym obciążeniem — prawdopodobnie się zawiedziesz.
I trzeba to powiedzieć na głos: GLM-5.2 to jednak nie Claude. Nie ma systemowego promptu Claude'a, nie ma jego osobowości w rozmowie, nie ma tej stabilności w długich łańcuchach rozumowania. Po podpięciu przez CC Switch do Claude Code interfejs wygląda identycznie, ale smak odpowiedzi jest inny. Jedne zadania wyjdą lepiej, niż zakładasz, inne gorzej. Które dokładnie — musisz samodzielnie przymierzyć na własnych projektach; cudze benchmarki nie zastąpią twojego własnego czucia.
🛠️ Pięć minut po klucz i wejście w Claude Code
Krok 1: klucz API w pięć minut
Odpal build.nvidia.com i załóż konto. Jeśli masz Google lub GitHuba, logujesz się o Auth, bez osobnej rejestracji. Po zalogowaniu musisz zweryfikować telefon, żeby dostać API Key — i tu jest punkt, który robi całą różnicę: przechodzi chiński numer +86. W polu Location wybierz China, wpisz numer z prefiksem +86, kliknij Send Code to Phone; na telefon przyjdzie sześciocyfrowy kod, wpisujesz go i gotowe.


Sporo osób zakłada, że chiński numer nie przejdzie. Przechodzi bez problemu. Sprawdzałem osobiście — SMS przyszedł w kilka sekund.
Po weryfikacji telefonu wejdź w menu konta w prawym górnym rogu, otwórz API Keys i kliknij Generate API Key. Nazwij go jakoś, np. freeapi, a system wygeneruje ciąg zaczynający się od nvapi-. Uwaga: ten klucz wyświetla się tylko raz. Zamkniesz stronę — już go nie zobaczysz, więc natychmiast skopiuj i zapisz w bezpiecznym miejscu.

Widzisz datę ważności? 5 lipca 2027. Dałem mojemu kluczowi rok. Dostępna jest też opcja „bez terminu ważności", tylko nie wiadomo, kiedy NVIDIA zablokuje całą akcję, więc bezpieczniej założyć sobie termin. Endpoint działa na globalnej infrastrukturze NVIDII — bez region-locka, bez VPN-a; deweloper za granicą, w tym w Japonii, zakłada konto na zwykłego maila i od razu ma dostęp.
Krok 2: wejście w Claude Code przez CC Switch
Klucz w kieszeni. Teraz najważniejsze — jak go realnie użyć.
Jeśli jesteś programistą, bierzesz trzy parametry z poprzedniego kroku i walisz do API w formacie OpenAI. Ale większość ludzi nie chce grzebać w CLI — i tu CC Switch bierze na siebie ciężar. To graficzne narzędzie do zarządzania dostawcami modeli, zbudowane specjalnie pod przełączanie silnika pod spodem Claude Code. Po otwarciu widzisz długą listę dostawców, kilkadziesiąt pozycji — SiliconFlow, OpenRouter, GitHub Copilot, Codex, no i NVIDIA. Klikasz niebieski przycisk Nvidia, adres żądania wypełnia się sam, zostaje ci wkleić własny API Key.


Cztery punkty konfiguracji:
- API Key: wklej swój klucz
nvapi-. - Adres żądania:
https://integrate.api.nvidia.com— to CC Switch uzupełnia za ciebie. - Format API: wybierz koniecznie OpenAI Chat Completions (z włączonym routingiem). Bez tego format żądań się nie dopasuje.
- Mapowanie modeli (najważniejsze): przypisz role Sonnet, Opus i Haiku do
z-ai/glm-5.2. Dzięki temu niezależnie od tego, z jakiej roli Claude Code wysyła żądanie, pod maską pracuje GLM-5.2.
Zapisz, odpal Claude Code i wpisz /model. Zobaczysz, że na pozycjach, gdzie wcześniej było Sonnet 4.6 i Opus, teraz widnieje z-ai/glm-5.2. Zaznacz „Custom Sonnet model" i wyślij hi w ramach testu.

Ścieżka działa.
Masz teraz pełny interfejs Claude Code i pełen workflow agenta — edycję wielu plików, automatyzację zadań, zarządzanie kontekstem, wywoływanie narzędzi — a pod maską pracuje GLM-5.2 z darmowego endpointu NVIDII. Wszystkie możliwości Claude Code wciąż są na miejscu, tylko silnik wnioskowania podmieniono na GLM-5.2. Z zewnątrz nikt niczego nie zauważy: terminal pokazuje to samo logo Claude Code, te same komendy, ten sam /model. Ale każde żądanie idzie przez klaster GPU NVIDII i trafia do GLM-5.2 od Zhipu.
Normalnie Claude Code wymaga co najmniej planu Max za 100 dolarów miesięcznie albo rozliczania przez API Usage Billing za rzeczywiste zużycie. Teraz, z darmowym API NVIDII plus CC Switch, ten sam interfejs i ten sam workflow kosztują cię zero za wywołania modelu. Dla każdego, kto chce dotknąć workflow Claude Code przy ograniczonym budżecie — bardzo praktyczna alternatywa.
🌍 Biznes za darmowym API: trzy warstwy, jeden model
Po trzech tekstach nie chcę już mówić tylko o GLM-5.2. Złożone razem, układają się w wyraźną strukturę trzech warstw:
- Warstwa pierwsza, aplikacyjna — Meituan i Alibaba. Wciskają GLM-5.2 we własne produkty (CatPaw jako IDE, QoderWork jako desktopowy pomocnik) i używają darmowego modelu do budowania bazy użytkowników końcowych. To, czy model realnie sprawdzi się w użyciu, zależy w dużej mierze od jakości samego produktu.
- Warstwa druga, infrastrukturalna — NVIDIA. Stawia GLM-5.2 na swoim GPU-cloudzie i oddaje darmowy endpoint API, kusząc deweloperów darmową mocą.
- Warstwa trzecia, modelowa — Zhipu. Udostępnia GLM-5.2 w pełni open-source (licencja MIT), pozwalając każdemu brać i dystrybuować.
Trzy warstwy, trzy logiki biznesowe, trzy zupełnie różne rodzaje darmowości. A pod spodem płynie ta sama rzecz.
Po co to w ogóle NVIDIA? Przecież to nie firma modelowa. Zastanów się, na czym polega jej biznes — NVIDIA sprzedaje GPU. Jej H200, B200 — pojedynczy układ idzie za kilkadziesiąt tysięcy dolarów. Największymi klientami są firmy potrzebujące mocy wnioskowania na dużą skalę. Darmowe API wygląda na to, że NVIDIA dorzuca własne pieniądze do cudzych wywołań modelu. W rzeczywistości robi jedną rzecz: ściąga deweloperów na swoją infrastrukturę do pisania kodu, testowania modeli, budowania prototypów. Gdy projekt wyrzeźbi się na tej platformie i przyjdzie czas na produkcję, najnaturalniejszym ruchem jest kupno GPU NVIDII albo skorzystanie z jej płatnej usługi wnioskowania.
Wcześniej było to nie do pomyślenia. Modele były zamknięte: GPT-4 tylko u OpenAI, Claude tylko u Anthropic — chciałeś użyć modelu, musiałeś wejść w czyjś ekosystem. GLM-5.2 łamie tę regułę — jest open-source, na licencji MIT, dostępny dla każdego. Dlatego Meituan robi z niego IDE, Alibaba narzędzie biurowe, NVIDIA darmowe API dla pozyskania ruchu. Każdy walczy o własny punkt wejścia u użytkownika, używając tego samego modelu — ale nikt go nie posiada.
Zhipu zrobił sprytną rzecz: nie walczy z gigantami o użytkownika końcowego. Robi wodę. Kto chce nawadniać pole — bierze za darmo. Ale skoro we wszystkich rowach płynie ta sama woda, rzeczka staje się infrastrukturą — chcesz ją obejść, musisz wykopać własną studnię. Na tym polega prawdziwa siła modelu open-source: nie w samej darmowości, lecz w tym, że każe wszystkim twoim konkurentom stać się twoim kanałem dystrybucji. Im większa otwartość, tym trudniej cię ominąć.
W 1911 r. Standard Oil zostało uznane przez Sąd Najwyższy USA za monopol i na mocy wyroku rozbite na 34 niezależne spółki. Wall Street wyła, wszyscy byli pewni, że Rockefeller skończy. Ironia polegała na tym, że te 34 spółki urosły potem do rangi gigantów branży naftowej — Exxon, Mobil, Chevron, Amoco, każde w Fortune 500. Rockefeller, który zachował pakiety udziałów we wszystkich kawałkach, miał na koncie kilka razy więcej niż przed podziałem.
Rozbrać coś na kawałki i rozdać to czasem nie jest utratą kontroli. To sposób, by stało się infrastrukturą, bez której nikt nie da rady żyć.
📝 Na koniec
Póki akcja trwa, załóż konto na build.nvidia.com. Nie kosztuje nic, załatwisz to w pięć minut, a CC Switch dokańcza za ciebie całą resztę konfiguracji.
Trylogia darmowego GLM-5.2 w pigułce: Meituan robi warstwę produktową, Alibaba robi warstwę produktową, NVIDIA robi warstwę infrastruktury — każde poziom głębiej. Wybierz tę warstwę, której potrzebujesz.
Wszystkie kroki i zrzuty ekranu pochodzą z własnego testu autora (stan na lipiec 2026); limity, tempo i termin ważności darmowego tieru mogą się zmienić — wiążąca jest strona build.nvidia.com; opinie są osobistymi ocenami autora.