โก Intinya dalam Satu Kalimat
Setelah dua tulisan terakhir terbit โ yang soal CatPaw Meituan dan QoderWork Alibaba โ DM yang masuk lumayan banyak. Tapi ada satu pesan yang nyangkut di kepala saya. Intinya begini: alat-alat itu memang gratis, tapi semua punya batas kuota. CatPaw 500 panggilan, QoderWork 2000 kredit yang harus habis dalam 30 hari. Apakah ada cara dapetin API GLM-5.2 gratis tanpa batas?
Jujur, reaksi pertama saya: permintaan ini agak berlebihan. API model kelas atas itu mahal โ komputasinya nyata di situ. Mana ada yang benar-benar gratis tanpa batas.
Tapi saya tetap cek sendiri. Ternyata ada.
Yang ngasih bukan perusahaan Tiongkok, melainkan NVIDIA โ ya, NVIDIA yang bikin kartu grafis itu, perusahaan semikonduktor dengan kapitalisasi pasar tertinggi di dunia. Mereka memasang satu endpoint API GLM-5.2 gratis di platform developer mereka,
build.nvidia.com. Formatnya kompatibel OpenAI, bisa langsung dicolok ke Claude Code. Daftar lima menit, tanpa kartu kredit.Penilaian saya: dari seluruh bagian "trilogi gratis GLM-5.2", inilah yang paling layak dicoba โ Meituan main di lapisan produk, Alibaba main di lapisan produk, NVIDIA langsung menusuk jauh ke lapisan infrastruktur. Satu lebih dalam dari sebelumnya.
๐ฐ Kunci Gratisnya Ada di Mana: 77 Model Gratis di build.nvidia.com
NVIDIA punya platform developer bernama build.nvidia.com. Di situ di-host 141 model AI, dan 77 di antaranya menyediakan endpoint API gratis. Bukan salah baca. 77 model gratis. DeepSeek-V4-Pro ada, Kimi-K2.6 ada, MiniMax-M2.7 ada, Qwen3.5 juga ada.

GLM-5.2 juga ada di situ. Labelnya Free Endpoint plus Downloadable, providernya Z.ai (Zhipu), dan duduk di posisi pertama daftar model terbaru. Baru satu hari di-list, unduhannya sudah menyentuh 2 juta.

Yang membedakan API gratis ini dengan dua alat di tulisan sebelumnya adalah hal yang mendasar. CatPaw dan QoderWork adalah produk jadi โ unduh, instal, buka, langsung jalan. Tapi modelnya dipendam di dalam produk; Anda cuma bisa memanggilnya dari antarmuka mereka. NVIDIA mengasih Anda antarmuka API mentah, kompatibel dengan format OpenAI, yang bisa Anda colok ke tool apa pun yang mendukung format itu.
Tool apa pun. Termasuk Claude Code.
Saya tahu sebagian dari Anda berpikir: "API itu bukan dunia saya, saya kan bukan programmer." Sabar dulu, lanjut baca. Ada satu tool visual namanya CC Switch โ beberapa klik saja, semua konfigurasi selesai.
๐งฌ Tiga Parameter: base_url, api_key, model
Mari bicara soal landasan teknisnya. Buka halaman model GLM-5.2 di platform NVIDIA, Anda akan melihat tiga parameter kunci tertera:

- base_url:
https://integrate.api.nvidia.com/v1(berdasarkan tes,/v1di akhir ini opsional) - api_key: kunci yang diawali
nvapi-, yang akan kita buat di langkah berikutnya - model:
z-ai/glm-5.2
Kalau Anda programmer, sampai sini sebenarnya beres โ ambil tiga parameter itu dan panggil API format OpenAI. Contoh kode Python, Node, Shell lengkap ada di halaman itu. Tapi kebanyakan orang bukan programmer, dan ogah repot dengan command line. Jadi yang NVIDIA kasih ke Anda adalah bahan baku, bukan produk jadi. Setelah dapat API Key, Anda bisa mencoloknya ke Claude Code, Cursor, macam-macam plugin AI VS Code, atau program bikinan Anda sendiri. Tool-nya Anda yang pilih, modelnya gratis, kombinasinya Anda yang putuskan.
Ini soal kebebasan yang sesungguhnya. Sekarang saya jelaskan dulu cara dapetin Key-nya, lalu cara mencolokkannya ke Claude Code.
โ๏ธ Tiga Saluran Gratis & Harga yang Harus Dibayar
Taruh ketiga saluran gratis berdampingan, bedanya langsung kelihatan:
| Saluran | Kuota Gratis | Batasan | Bentuk Model |
|---|---|---|---|
| CatPaw (Meituan) | 500 panggilan | Setelah habis, isi form reset lalu tunggu review | Dibungkus dalam IDE |
| QoderWork (Alibaba) | 2000 kredit | Berlaku 30 hari, hangus (laporan komunitas: bisa habis dalam beberapa hari) | Dibungkus dalam app desktop |
| NVIDIA NIM | Key tanpa batas | Sekitar 40 RPM, antri di jam puncak | API mentah, dicolok ke tool mana saja |
Dari tabel ini jelas kelihatan: 500 panggilan CatPaw setelah habis harus isi form reset lalu nunggu review; 2000 kredit QoderWork cuma berlaku 30 hari lalu hangus, dan banyak laporan di kolom komentar bilang tidak nahan sampai sebulan. NVIDIA langsung ngasih kunci tak terbatas. Di halaman verifikasi tertulis Unlimited API requests without daily limits โ nggak ada batas harian.

Tapi kata "tak terbatas" ini mesti diberi tanda tanya โ gratis biasanya selalu punya tang tersembunyi. Tier gratis NVIDIA punya satu masalah yang sudah jadi rahasia umum: lelet di jam puncak. Ini bukan cuma feeling saya. Berdasarkan laporan dari komunitas developer luar negeri, saat jam sibuk request akan antri atau langsung kena 429, dan waktu respons bisa membengkak dari beberapa detik jadi belasan detik bahkan lebih lama. Ada yang di Threads bilang begini: Peak hours, you queue up and wait โ diterjemahkan bebas: "antri, tunggu." Di luar jam puncak pengalamannya oke; dini hari dan akhir pekan lumayan ngebut buat ngampus tugas. Tapi kalau Anda berharap ini bakal stabil nahan beban tinggi di jam kerja hari kerja, besar kemungkinan kecewa.
Soal lain yang mesti jujur: GLM-5.2 pada akhirnya bukan Claude. Ia tak punya system prompt Claude, tak punya persona obrolan Claude, tak punya stabilitas penalaran rantai panjang yang jadi ciri khas Claude. Setelah Anda colok ke Claude Code via CC Switch, antarmukanya kelihatan sama persis, tapi rasa jawabannya beda. Beberapa tugas ia kerjakan lebih baik dari ekspektasi Anda, beberapa lainnya lebih buruk. Tugas mana yang lebih kuat dan mana yang lebih lemah โ itu mesti Anda coba sendiri di proyek nyata. Review orang lain tak akan menggantikan pengalaman tangan Anda sendiri.
๐ ๏ธ Lima Menit Bikin Key + Colok ke Claude Code
Langkah 1: Lima menit dapetin API Key
Buka build.nvidia.com dan daftar akun. Kalau Anda punya akun Google atau GitHub, tinggal login pakai itu โ nggak perlu daftar terpisah. Setelah login, Anda mesti verifikasi nomor HP sebelum bisa generate API Key. Inilah poin kuncinya: NVIDIA mendukung nomor HP Tiongkok daratan. Di menu dropdown Location pilih China, masukkan nomor yang diawali +86, klik Send Code to Phone, HP Anda bakal menerima kode enam digit, masukkan, verifikasi beres.


Banyak yang kira nomor Tiongkok tidak akan jalan. Padahal lancar. Saya tes sendiri, SMS-nya datang dalam hitungan detik.
Setelah nomor HP terverifikasi, masuk ke menu personal di kanan atas, buka halaman API Keys, klik Generate API Key. Kasih nama, misalnya freeapi, lalu sistem akan generate satu string yang diawali nvapi-. Catat: kunci ini cuma muncul sekali. Begitu halamannya ditutup, tidak akan kelihatan lagi โ langsung salin dan simpan baik-baik.

Coba perhatikan tanggal kedaluwarsa: 5 Juli 2027. Saya set masa berlaku Key-nya satu tahun. Ada juga opsi "no expiry" (tak pernah kedaluwarsa), tapi karena kita nggak tahu kapan NVIDIA bakal "narik karpet" dari program ini, setahun lebih aman. Endpoint ini jalan di infrastruktur global NVIDIA โ nggak ada region lock, nggak perlu VPN, developer luar negeri (termasuk Indonesia dan Jepang) cukup daftar dengan satu email dan langsung bisa dipakai.
Langkah 2: Colok ke Claude Code pakai CC Switch
Key sudah di tangan. Sekarang pertanyaan: gimana cara memakainya?
Kalau Anda programmer, ambil tiga parameter tadi dan panggil API format OpenAI. Tapi kebanyakan orang ogah repot dengan command line โ nah, di sinilah CC Switch masuk. Ini tool manajemen provider model berbasis GUI yang fungsinya switch model di balik Claude Code. Buka, Anda akan melihat daftar provider yang panjang โ puluhan opsi, SiliconFlow, OpenRouter, GitHub Copilot, Codex, semua ada, NVIDIA juga salah satunya. Klik tombol biru "Nvidia" di daftar itu, CC Switch bakal otomatis mengisi URL request untuk Anda. Anda tinggal tempel API Key sendiri.


Ada empat poin konfigurasi yang mesti diperhatikan:
- API Key: tempel kunci
nvapi-Anda. - URL request:
https://integrate.api.nvidia.comโ ini sudah diisi CC Switch otomatis. - Format API: mesti pilih OpenAI Chat Completions (dengan routing aktif). Kalau salah pilih, format request nggak akan cocok.
- Model mapping (paling penting): petakan Sonnet, Opus, dan Haiku ketiganya ke
z-ai/glm-5.2. Begini cara kerjanya โ peran model mana pun yang Claude Code pakai saat request, yang sebenarnya jalan di belakang layar tetap GLM-5.2.
Setelah disimpan, buka Claude Code, ketik /model. Anda akan melihat di daftar model, posisi yang tadinya Sonnet 4.6 dan Opus sekarang sudah berubah jadi z-ai/glm-5.2. Pilih "Custom Sonnet model", ketik hi untuk uji coba.

Jalan.
Yang Anda pegang sekarang adalah antarmuka penuh Claude Code plus workflow agent-nya, tapi di belakang layar yang jalan adalah GLM-5.2 gratisan NVIDIA. Kemampuan edit multi-file, eksekusi otomatis, manajemen konteks, pemanggilan tool โ semua masih ada, cuma mesin inferensinya ditukar jadi GLM-5.2. Kalau Anda nggak bilang, orang lain nggak bakal tahu dari antarmukanya โ logo Claude Code di terminal tetap sama, cara interaksi tetap sama, command /model tetap sama. Tapi tiap request obrolan itu lewat klaster GPU NVIDIA, dan model yang dipanggil adalah GLM-5.2 buatan Zhipu.
Pakai Claude Code secara normal, minimal Anda butuh paket Max $100 per bulan, atau API Usage Billing bayar sesuai pemakaian. Sekarang, dengan API gratis NVIDIA plus CC Switch, antarmuka sama, workflow sama, tapi biaya pemanggilan model di belakang layar adalah nol. Buat siapa pun yang ingin merasakan workflow Claude Code tapi budget-nya terbatas, ini alternatif yang lumayan solid.
๐ Logika Bisnis di Balik yang Gratis: Tiga Lapis, Satu Model
Tiga tulisan sudah terbit, dan yang mau saya bahas bukan cuma GLM-5.2 sebagai model. Kalau Anda taruh ketiganya berjajar, akan kelihatan satu struktur tiga lapis yang jelas:
- Lapisan pertama, aplikasi โ Meituan dan Alibaba. Mereka memasukkan GLM-5.2 ke dalam produknya (CatPaw sebagai IDE, QoderWork sebagai pendamping desktop), pakai model gratis untuk menarik pengguna akhir. Enak atau nggak, sangat tergantung kualitas produk itu sendiri.
- Lapisan kedua, infrastruktur โ NVIDIA. Mereka naruh GLM-5.2 di cloud GPU mereka, ngasih endpoint API gratis, pakai komputasi gratis untuk menarik developer.
- Lapisan ketiga, model โ Zhipu sendiri. Mereka membuka GLM-5.2 sepenuhnya (lisensi MIT), biar siapa saja bisa mendistribusikannya.
Tiga lapis, tiga logika bisnis, tiga jenis "gratis" yang benar-benar berbeda. Tapi yang mengalir di bawahnya cuma satu hal yang sama.
Kok NVIDIA mau melakukan ini? Mereka kan bukan perusahaan model. Coba pikirkan bisnis NVIDIA itu apa โ mereka jual GPU. Chip AI macam H200 dan B200, satu biji harganya puluhan ribu dolar. Pelanggan terbesar mereka adalah perusahaan-perusahaan yang butuh kapasitas inferensi masif. Soal "API gratis" ini, di permukaan kelihatan seperti NVIDIA merugi ngasih orang jalanin model, tapi sebetulnya mereka sedang melakukan satu hal: membuat lebih banyak developer menulis kode, menguji model, dan bikin prototipe di infrastruktur NVIDIA. Begitu proyek Anda jalan di platform itu, saat harus naik ke produksi, pilihan paling natural adalah beli GPU NVIDIA, atau pakai layanan inferensi berbayar NVIDIA.
Hal seperti ini dulu mustahil. Model dulu itu tertutup: GPT-4 cuma bisa dipakai di platform OpenAI, Claude cuma di platform Anthropic โ model siapa pun yang Anda mau pakai, Anda harus masuk ekosistemnya. Sekarang GLM-5.2 mematahkan aturan itu โ ia open source, lisensi MIT, siapa saja bisa pakai. Maka Meituan pakai dia buat IDE, Alibaba pakai dia buat tool kantor, NVIDIA pakai dia buat API gratis dan narik traffic. Tiap pihak berebut pintu masuk pengguna sendiri pakai model yang sama, tapi tidak satu pun dari mereka yang memiliki model ini.
Zhipu melakukan hal yang cerdik: mereka nggak ikut rebutan pengguna akhir dengan raksasa-raksasa itu. Mereka jadi sumber airnya. Siapa pun mau mengalirkan air untuk irigasi silakan, airnya gratis. Tapi selama air yang mengalir di sawah semua orang adalah air saya, sungai ini jadi infrastruktur โ kalau Anda mau menghindarinya, Anda harus sumur sendiri. Inilah daya sesungguhnya dari model open source: bukan pada gratisnya, tapi pada fakta bahwa semua kompetitor Anda berubah jadi saluran distribusi Anda. Makin Anda terbuka, makin mereka tak bisa lepas dari Anda.
Tahun 1911, Standard Oil divonis monopoli oleh Mahkamah Agung AS dan dipaksa pecah menjadi 34 perusahaan independen. Saat itu Wall Street menjerit; semua orang pikir Rockefeller selesai. Tapi ironisnya, 34 perusahaan itu masing-masing tumbuh jadi raksasa industri minyak โ Exxon, Mobil, Chevron, Amoco, semuanya masuk Fortune 500. Karena Rockefeller memegang saham awal di semua perusahaan hasil pecahan, kekayaan pribadinya malah berlipat ganda dibanding sebelum dipecah.
Memecah sesuatu dan membagikannya kadang bukan kehilangan kontrol. Kadang itu cara ia tumbuh jadi infrastruktur yang tak bisa dilepaskan siapa pun.
๐ Catatan Akhir
Selagi programnya masih jalan, mampir ke build.nvidia.com dan daftar. Lagian gratis, lima menit beres, CC Switch sudah mengurus sisanya untuk Anda.
Trilogi gratis GLM-5.2: Meituan di lapisan produk, Alibaba di lapisan produk, NVIDIA di lapisan infrastruktur โ satu lebih dalam dari sebelumnya. Lapisan mana yang Anda cari, pilih sendiri.
Setiap langkah operasional dan tangkapan layar di artikel ini sudah saya uji sendiri (per Juli 2026); kuota tier gratis, rate limit, dan masa berlaku program dapat berubah sewaktu-waktu โ yang berlaku adalah halaman resmi build.nvidia.com; pandangan di artikel ini murni milik penulis.