โก Buod sa simula pa lang
Matapos kong i-publish ang dalawang naunang artikulo โ 'yung sa CatPaw ng Meituan at 'yung sa QoderWork ng Alibaba โ humaba ang DM ko sa inbox. Pero may isang mensahe na tumatak sa akin. Ganito ang gist: libre nga itong mga tools, pero puro may limitasyon โ 500 gamit ang CatPaw, 2000 credits sa loob ng 30 days ang QoderWork. May bang paraan talaga para mang-libre ng GLM-5.2 API nang walang hangganan?
Ang unang reaction ko: ang laki naman ng hinihingi. Top-tier model API 'yan โ kitang-kita ang compute cost, sino ba ang magbibigay ng tunay na walang hanggang libre?
Tapos hinanap ko. Mayroon nga.
Hindi Chinese company ang nag-o-offer nito โ NVIDIA. Oo, 'yung NVIDIA na gumagawa ng graphics card, pinakamalaking chip company sa mundo by market cap. May libreng GLM-5.2 API endpoint sila sa developer platform na
build.nvidia.com, OpenAI-compatible ang format, diretso mong mai-plug sa Claude Code. Limang minutong sign-up, walang credit card na kaakibat.Ang tingin ko: Ito ang pinakasulit subukan sa buong "libreng tatlo ng GLM-5.2" โ sa product layer naglaro ang Meituan, sa product layer din ang Alibaba, pero sa infrastructure layer bumagsak ang NVIDIA. Palalim nang palalim, isang hakbang bawat layer.
๐ฐ Nasaan ang susi: 77 modelo sa build.nvidia.com, libre
May developer platform ang NVIDIA na tinatawag na build.nvidia.com. Host dito ang 141 AI models, at 77 sa kanila ay may libreng API endpoint. Hindi ka nagbasa-mali โ 77 libreng modelo. Nandoon ang DeepSeek-V4-Pro, nandoon ang Kimi-K2.6, nandoon ang MiniMax-M2.7, nandoon din ang Qwen3.5.

Nandoon din ang GLM-5.2. Ang naka-tag: Free Endpoint at Downloadable, ang provider ay Z.ai (Zhipu), at ito ang numero uno sa listahan ng mga latest model. Isang araw pa lang itong live, umaabot na sa 2 million ang downloads.

May isang pinagkaiba itong libreng API sa dalawang naunang tool. Parehong tapos nang produkto ang CatPaw at QoderWork โ i-download, i-install, buksan, gamit ka na. Pero naka-lock ang modelo sa loob ng produkto, sa interface lang nila mo siya matawag. Ang ibinibigay ng NVIDIA ay purong API endpoint โ OpenAI-compatible ang format, pwede mong i-plug sa anumang tool na sumusuporta sa format na 'yan.
Kahit anong tool. Kasama ang Claude Code.
Alam ko, may nagbabasa nito na nagsasabi: "Ang layo naman ng API sa akin, hindi ako programmer." Huwag magmadali, basahin mo hanggang dulo. May graphical tool na tinatawag na CC Switch โ ilang klik lang, ayos na ang lahat ng configuration para sa'yo.
๐งฌ Tatlong parametro: base_url, api_key, model
Una, ang technical base. Buksan ang model page ng GLM-5.2 sa platform ng NVIDIA, makikita mo ang tatlong key na parametro:

- base_url:
https://integrate.api.nvidia.com/v1(sa actual testing, hindi na kailangang i-fill ang/v1sa dulo) - api_key: 'yung
nvapi-key na ire-generate mo sa susunod na hakbang - model:
z-ai/glm-5.2
Kung programmer ka, hanggang dito na 'yan โ kunin mo ang tatlong parametro, tumawag ka ng OpenAI-compatible API, Python, Node, Shell examples lahat nandoon sa page. Pero hindi naman lahat ay programmer, at hindi lahat ay gustong makipag-usap sa command line. Kaya ang ibinigay sa iyo ng NVIDIA ay hilaw na materyal, hindi yari nang produkto. Pagkatapos mong makuha ang API Key, pwede mong i-plug sa Claude Code, pwede sa Cursor, pwede sa mga AI plugin sa VS Code, pwede rin sa sarili mong program. Ikaw ang pipili ng tool, libre ang modelo, ikaw ang bahala sa combination.
Iyan ang tunay na kalayaan. Sunod: paano kunin ang susi, tapos paano i-plug sa Claude Code.
โ๏ธ Libreng tatlo & ang presyo ng libre
Magtabi-tabi natin ang tatlong libreng channel, kitang-kita ang pagkakaiba:
| Channel | Libreng quota | Limitasyon | Anyo ng modelo |
|---|---|---|---|
| CatPaw (Meituan) | 500 gamit | Pag ubos, mag-submit ng form para mag-reset, maghintay ng approval | Naka-lock sa loob ng IDE |
| QoderWork (Alibaba) | 2000 credits | 30 days valid, paglampas ay void (sa comments, ilang araw lang daw pwedeng maubos) | Naka-lock sa loob ng desktop app |
| NVIDIA NIM | Unlimited Key | Mga 40 RPM, pila sa peak hours | Purong API, i-plug sa kahit anong tool |
Kitang-kita: pag ubos ang 500 gamit ng CatPaw, kailangan mong mag-submit ng form para mag-reset at maghintay ng approval; 30 days lang ang valid ng 2000 credits ng QoderWork, paglampas ay void, at maraming nag-comment na hindi man lang ito umaabot ng isang buwan. Binigyan ka ng NVIDIA ng walang hanggang susi. Nakasulat sa page: Unlimited API requests without daily limits โ walang daily cap.

Siempre, may tanong doon sa salitang "unlimited" โ sa likod ng libre, palaging may hidden na limitasyon. May isang kilalang isyu ang free tier ng NVIDIA: mabagal sa peak hours. Hindi lang ito sa akin โ base sa feedback ng overseas developer community, kapag busy, nagpi-pila ang requests, o diretong 429 at hindi makonekta. Ang response time pwedeng humaba mula ilang segundo patungo sa labing-isang segundo o mas mahaba pa. May nagsabi sa Threads nang diretso: Peak hours, you queue up and wait โ sa Tagalog, "pila ka at maghintay." Okay naman ang experience outside peak โ madaling-araw at weekend, okay ang bilis; pero kung aasa ka na stable ito sa high-frequency na tawag sa araw ng weekday, malamang madismaya ka.
Isa pang kailangang linawin: hindi Claude ang GLM-5.2. Wala itong system prompt ng Claude, wala itong conversation persona ng Claude, wala itong stability ng Claude sa mahaba at kumplikadong reasoning task. Pag i-plug mo ito sa Claude Code via CC Switch, magmukhang pareho ang interface, pero iba ang lasa ng sagot. Sa ilang task, mas magaling kaysa sa inaasahan mo; sa iba, mas mahina. Kung saan ito mas malakas o mas mahina, kailangan mong mismo tumakbo ng ilang real na project para mahalata โ hindi pwedeng pumalit ang review ng iba sa sarili mong pakiramdam.
๐ ๏ธ Limang minuto para sa Key + i-plug sa Claude Code
Unang hakbang: kunin ang API Key sa limang minuto
Buksan ang build.nvidia.com, mag-sign up ng account. Kung may Google o GitHub account ka, direktang i-authorize, hindi na kailangan mag-sign up ng hiwalay. Pag-login, kailangan mong i-verify ang phone number bago ka makagawa ng API Key โ eto ang importante: sinusuportahan nito ang Chinese mainland number. Sa Location dropdown, piliin ang China, ilagay ang +86 na numero, i-click ang Send Code to Phone, makakatanggap ka ng six-digit na code sa phone, i-type mo, tapos ay verified.


Marami ang nag-aakala na hindi pwede ang Chinese number. Walang problema. Sinubukan ko mismo, ilang segundo lang dumating ang SMS.
Tapos ma-verify ang phone, hanapin ang personal center sa kanang-itaas, pumasok sa API Keys page, i-click ang Generate API Key. Bigyan ng pangalan ang key mo, halimbawa freeapi, at gagawa ang system ng string na nagsisimula sa nvapi-. Mag-ingat: isang beses lang ito ipapakita, kapag naisara ang page, wala ka na itong makikita โ kopyahin at itago agad.

Nakita mo ba ang expiry โ Hulyo 5, 2027. Isang taon ang itinakda kong validity ng key na ito. May option din na never-expire, pero hindi natin alam kung kailan ihihinto ang promotion na ito, kaya mas ligtas ang isang taon. Tumatakbo ang endpoint na ito sa global infrastructure ng NVIDIA โ walang region lock, hindi kailangan ng VPN, pwedeng direktang gamitin ng overseas developer (kasama ang Japan) na mag-sign up lang gamit ang email.
Pangalawang hakbang: i-plug sa Claude Code gamit ang CC Switch
Nasa kamay mo na ang Key. Susunod na mahalagang hakbang: paano ito gagamitin.
Kung programmer ka, kunin mo ang tatlong parametro kanina at tumawag ng OpenAI-compatible API. Pero hindi lahat ay gustong makipag-usap sa command line โ dito pumapasok ang CC Switch. Graphical na model provider management tool ito, ginawa para mag-switch ng underlying model ng Claude Code. Buksan mo ito, makikita mo ang siksik na listahan ng providers โ mga dosen-dosenang option, nandoon ang SiliconFlow, OpenRouter, GitHub Copilot, Codex, at siyempre, NVIDIA. I-click mo ang asul na button sa Nvidia, at pre-filled na niya ang request URL para sa'yo โ kailangan mo na lang i-paste ang sarili mong API Key.


Apat ang dapat tandaan sa configuration:
- API Key: ilagay ang
nvapi-key mo. - Request URL:
https://integrate.api.nvidia.comโ pre-filled na ito ng CC Switch. - API format: siguraduhing OpenAI Chat Completions (with routing enabled) ang napili โ kung hindi, hindi magmu-match ang format ng request.
- Model mapping (pinakamahalaga): i-map ang Sonnet, Opus, at Haiku โ lahat โ papunta sa
z-ai/glm-5.2. Sa ganitong paraan, anuman ang model role na gamitin ng Claude Code, GLM-5.2 ang actual na tumatakbo.
Pag-save, buksan ang Claude Code, i-type ang /model. Makikita mo na sa model list, ang dating nakasulat na Sonnet 4.6 at Opus ay ngayon z-ai/glm-5.2 na. Piliin ang "Custom Sonnet model," i-type ang hi para test.

Umaandar na.
Ang nasa kamay mo ngayon ay ang buong interface at agent workflow ng Claude Code, pero GLM-5.2 ng NVIDIA ang tumatakbo sa ilalim. Nandoon pa rin ang multi-file editing, automated execution, context management, at tool calling ng Claude Code โ nagbago lang ang inference engine sa GLM-5.2. Kahit hindi ka umamin, hindi makikita ng iba mula sa interface โ parehong Claude Code logo sa terminal, parehong interaction, parehong /model command. Pero bawat conversation request ay dadaan sa GPU cluster ng NVIDIA at magtatawag ng GLM-5.2 ng Zhipu.
Sa normal na paggamit ng Claude Code, hindi bababa sa Max plan na $100 kada buwan, o API Usage Billing na pay-per-use. Ngayon, gamit ang libreng API ng NVIDIA at CC Switch, parehong interface, parehong workflow โ pero zero ang cost ng underlying model call. Sa gustong makaranas ng Claude Code workflow pero may limitadong budget, praktikal na alternatibo ito.
๐ Ang negosyo sa likod ng libre: tatlong layer, iisang modelo
Tatlong artikulo na ang nalagay, at ang gusto kong pag-usapan ay hindi na lang GLM-5.2. Pag pinagsama ang tatlo, makikita mo ang malinaw na tatlong-layer na istraktura:
- Unang layer, application layer โ Meituan at Alibaba. Isiningit nila ang GLM-5.2 sa sarili nilang produkto (CatPaw = IDE, QoderWork = desktop buddy), gamit ang libreng modelo para hilahin ang end users. Maganda ba o hindi, nakadepende sa ganda ng produkto.
- Pangalawang layer, infrastructure layer โ NVIDIA. Inilagay nila ang GLM-5.2 sa GPU cloud nila, libreng API endpoint, gamit ang libreng compute para hilahin ang developers.
- Pangatlong layer, model layer โ Zhipu mismo. Buong-buo nilang ni-open source ang GLM-5.2 (MIT license), para ipamahagi ng lahat.
Tatlong layer, tatlong commercial logic, tatlong magkaibang klase ng libre. Pero parehong lumalagos sa ilalim.
Bakit ginagawa ito ng NVIDIA? Hindi naman sila model company. Isipin mo kung ano ang binebenta ng NVIDIA โ GPU. Ang H200 at B200 na AI chips, several thousand US dollars isang piraso. Ang pinakamalaking customer nila ay mga kumpanyang nangangailangan ng large-scale inference compute. Mukhang nagbabayad ang NVIDIA para magpatakbo ng modelo ng iba, pero ang totoong ginagawa nila: mas maraming developer na sumusulat ng code, nagte-test ng modelo, at nagbi-build ng prototype sa infrastructure nila. Kapag tumakbo na ang project mo sa platform at kailangan mo nang umakyat sa production, ang pinakanatural na pipiliin mo ay bilhin ang GPU ng NVIDIA, o gamitin ang paid inference service nila.
Noong una, hindi ito imaginable. Sarado ang mga modelo: GPT-4 sa OpenAI lang, Claude sa Anthropic lang โ kung gusto mong gamitin ang modelo ng sino, kailangan mong pumasok sa ecosystem nila. Sinira ng GLM-5.2 ang patakarang ito โ open source ito, MIT license, sino man ay pwedeng gumamit. Kaya nagamit ito ng Meituan para sa IDE, ng Alibaba para sa office tool, ng NVIDIA para sa free API na panghila. Bawat isa ay nag-aagawan sa user entry point gamit ang iisang modelo, pero walang may-ari ng modelong ito.
Ang ginawa ng Zhipu ay matalino: hindi sila nakikipag-agawan sa end user laban sa mga malalaking kumpanya โ ginawa nila ang pinagmumulan ng tubig. Sino man ang gusto manghila ng tubig para sa irigasyon, libre ang tubig. Pero basta sa bukirin ng lahat ay tubig mo ang dumadaloy, ang ilog na ito ay nagiging infrastructure โ kung ayaw mo sa kanya, kailangan mong maguknit ng sarili mong balon. Iyan ang tunay na kapangyarihan ng open source na modelo: hindi sa libre mismo, kundi sa ginagawa nitong lahat ng kakumpitensya mo ay nagiging distribution channel mo. Mas bukas ka, mas hindi ka mabitawan ng iba.
Noong 1911, hinatulan ng US Supreme Court na monopolyo ang Standard Oil, at sapilitang hinati sa 34 independiyenteng kumpanya. Nag-iyakan ang Wall Street, akala ng lahat ay tapos na si Rockefeller. Pero ironically, ang 34 na kumpanyang ito ay bawat isa lumaking giants ng oil industry โ Exxon, Mobil, Chevron, Amoco, lahat ay Fortune 500. Dahil hawak ni Rockefeller ang original shares ng lahat ng hinati na kumpanya, mas lumaki pa ang personal wealth niya nang ilang beses kaysa bago hatiin.
Ang paghati-hati at ipamigay ng isang bagay, minsan ay hindi pagkawala ng kontrol. Ito ang pagpapalago nito bilang infrastructure na hindi mabitawan ng kahit sino.
๐ Sa huli
Samantala, nandiyan pa ang promotion, pumunta ka sa build.nvidia.com at mag-sign up. Libre naman, limang minuto ayos na, tapos ay ayusin ng CC Switch ang natitirang configuration para sa'yo.
Ang "libreng tatlo ng GLM-5.2": product layer ang Meituan, product layer din ang Alibaba, infrastructure layer naman ang NVIDIA โ isang layer, isang layer, palalim nang palalim. Aling layer ang gusto mo, ikaw ang pumili.
Ang mga hakbang at screenshots sa artikulong ito ay sinubukan ko mismo (hanggang Hulyo 2026); ang libreng quota, rate limit, at promo validity ay maaaring magbago anumang oras โ ang opisyal na pahina ng build.nvidia.com ang basehan; ang opinyon sa artikulo ay sa akin lang.