⚡ Intinya dalam satu ayat
Selepas dua artikel lepas — yang CatPaw Meituan, yang QoderWork Alibaba — peti mesej saya penuh dengan soalan. Tapi ada satu yang paling melekat, lebih kurang begini: alat-alat ini memang percuma, tapi semuanya ada had kuota, CatPaw 500 kali, QoderWork 2000 kredit untuk 30 hari, ada tak cara untuk dapatkan API GLM-5.2 secara percuma tanpa had?
Jujur, reaksi pertama saya: itu minta terlalu banyak. API model kelas atas, kos pengkomputan memang ada di situ, mana ada rezeki "percuma tanpa had" yang betul-betul jadi.
Lepas tu saya pergi semak sendiri. Ternyata ada.
Yang menawarkan saluran ini bukan syarikat China — ia NVIDIA, syarikat kad grafik tersebut, syarikat cip dengan nilai pasaran tertinggi di dunia. Ia letakkan satu titik akhir API GLM-5.2 percuma di platform pembangunnya
build.nvidia.com, format serasi OpenAI, boleh disambung terus ke Claude Code. Daftar lima minit, tak perlu kad kredit.Penilaian saya: inilah artikel paling berbaloi dicuba dalam "trilogi percuma GLM-5.2" — Meituan buat lapisan produk, Alibaba buat lapisan produk, NVIDIA terus masuk sampai ke lapisan infrastruktur. Satu lapisan demi satu lapisan, semakin mendalam ke bawah.
📰 Kunci percuma ada di mana: 77 model tak berharga di build.nvidia.com
NVIDIA ada satu platform pembangun bernama build.nvidia.com, yang menempatkan 141 model AI, dan 77 daripadanya menawarkan titik akhir API percuma. Tak silap baca, 77 model percuma. DeepSeek-V4-Pro ada di dalamnya, Kimi-K2.6 ada, MiniMax-M2.7 ada, Qwen3.5 pun ada.

GLM-5.2 juga ada di dalamnya. Tag pada kad ditulis Free Endpoint dan Downloadable, penyedianya Z.ai (Zhipu), duduk di tangga pertama senarai model terbaharu. Baru naik seminggu, muat turun dah pecah 2 juta.

API percuma ini ada satu perbezaan asas dengan dua alat dalam artikel lepas. CatPaw dan QoderWork kedua-duanya produk siap — muat turun, pasang, buka, terus boleh guna — tetapi modelnya terbungkus dalam produk, Anda hanya boleh memanggilnya dalam antara muka mereka. Yang NVIDIA beri ialah antara muka API yang tulen, serasi dengan format OpenAI, Anda boleh sambungkan ke apa-apa alat yang menyokong format itu.
Apa-apa alat. Termasuk Claude Code.
Saya tahu ada yang membaca sampai sini akan terasa: benda API ini terlalu jauh dari saya, saya bukan programmer. Jangan cepat-cepat. Baca lagi di bawah. Ada satu alat bergrafik bernama CC Switch, tolong Anda klik beberapa kali saja untuk siapkan semua konfigurasi.
🧬 Tiga parameter: base_url, api_key, model
Mari cerita asas teknikal dulu. Buka halaman model GLM-5.2 di platform NVIDIA, Anda akan nampak ia senaraikan tiga parameter utama:

- base_url:
https://integrate.api.nvidia.com/v1(dalam ujian sebenar kemudian,/v1ini tak perlu diisi) - api_key: iaitu kunci bermula
nvapi-yang akan dijana pada langkah seterusnya - model:
z-ai/glm-5.2
Kalau Anda seorang programmer, sampai sini sebenarnya dah selesai — bawa ketiga-tiga parameter ini untuk panggil API format serasi OpenAI, contoh Python, Node, Shell semuanya ada di halaman tersebut. Tetapi majoriti orang bukan programmer, dan tak nak pening dengan baris perintah. Jadi yang NVIDIA berikan ini ialah bahan mentah, bukan produk siap. Selepas dapat API Key, Anda boleh sambung ke Claude Code, boleh sambung ke Cursor, boleh sambung ke pelbagai plugin AI VS Code, malah boleh sambung ke apa-apa program yang Anda tulis sendiri. Alat Anda pilih sendiri, modelnya percuma, cara gabungan Anda yang tentukan.
Inilah kebebasan yang sebenar. Seterusnya mari cakap cara dapatkan Kunci ini dulu, lepas tu cara sambung masuk ke Claude Code.
⚖️ Tiga saluran percuma & harganya
Taruh tiga saluran percuma sekali untuk dibandingkan, bezanya jelas pada satu pandangan:
| Saluran | Kuota percuma | Had | Bentuk model |
|---|---|---|---|
| CatPaw (Meituan) | 500 kali | Habis kena hantar borang minta reset, tunggu semakan | Terbungkus dalam IDE |
| QoderWork (Alibaba) | 2000 kredit | Sah 30 hari, luput terus (ruang komen ada yang beritahu boleh habis dalam beberapa hari) | Terbungkus dalam aplikasi desktop |
| NVIDIA NIM | Kunci tanpa had | Lebih kurang 40 RPM, berbaris waktu puncak | API tulen, sambung ke alat apa sahaja |
Bandingkan terus-terang: kuota 500 kali CatPaw habis kena hantar borang minta reset, tunggu semakan; 2000 kredit QoderWork cuma sah 30 hari, luput terus, ramai pengguna di ruang komen beritahu memang tak cukup sampai habis bulan. NVIDIA terus beri Anda satu kunci tanpa had, halaman pengesahan ditulis Unlimited API requests without daily limits, tiada had permintaan harian.

Tapi memang perlu kena tanda tanya pada perkataan "tanpa had" ini — benda percuma selalunya ada had tersirat di sebaliknya. Peringkat percuma NVIDIA ada satu masalah yang semua orang tahu: perlahan waktu puncak. Ini bukan perasaan saya seorang; mengikut maklum balas komuniti pembangun luar negara, waktu sibuk permintaan akan berbaris menunggu, atau terus 429 tak boleh disambung, masa respons boleh meregang dari beberapa saat ke lebih sepuluh saat malah lebih lama lagi. Ada orang di Threads cakap terus-terang: "Peak hours, you queue up and wait", kalau diterjemah lebih kurung "waktu puncak, Anda berbaris dan tunggu". Waktu bukan puncak pengalaman masih elok, tengah malam dan hujung minggu jalankan tugas sebenarnya agak kencang; tapi kalau Anda harapkan ia stabil menanggung panggilan kerap waktu pejabat hari kerja, kemungkinan besar Anda akan kecewa.
Satu perkara lagi yang kena dijelaskan: GLM-5.2 akhirnya bukan Claude. Ia tak ada system prompt Claude, tak ada personaliti perbualan Claude, tak ada kestabilan GLM pada tugas penaakulan jangka panjang yang kompleks. Anda sambung masuk ke Claude Code menerusi CC Switch, antara muka nampak sama persis, tapi rasa jawapannya tak sama. Sesetengah tugas ia akan lebih baik dari jangkaan Anda, sesetengah lagi akan lebih teruk. Yang mana lebih kuat, yang mana lebih lemah, kena Anda jalankan sendiri beberapa projek sebenar untuk dinilaikan, ulasan orang lain tak boleh gantikan pengalaman tangan sendiri.
🛠️ Lima minit dapat Key + sambung ke Claude Code
Langkah pertama: dapatkan API Key dalam lima minit
Buka build.nvidia.com, daftar akaun. Kalau Anda ada akaun Google atau akaun GitHub, boleh log masuk terus dengan kebenaran, tak perlu daftar berasingan. Selepas log masuk, Anda kena sahkan nombor telefon baru boleh jana API Key — yang ini kena ambil perhatian: ia menyokong nombor telefon tanah besar China. Dalam menu tarik-turun Location pilih China, isi nombor bermula +86, klik Send Code to Phone, telefon akan terima satu kod pengesahan enam digit, masukkan, pengesahan lulus.


Langkah ini ramai orang sangka nombor telefon China tak boleh dipakai, sebenarnya langsung tak ada masalah. Saya uji sendiri, SMS sampai dalam beberapa saat.
Selepas sahkan nombor telefon, pergi ke pusat peribadi di penjuru kanan atas, masuk ke halaman pengurusan API Keys, klik Generate API Key. Beri nama untuk Key Anda, contohnya freeapi, sistem akan jana satu rentetan kunci bermula dengan nvapi-. Ambil perhatian, kunci ini hanya dipaparkan sekali, halaman dah tutup memang takkan nampak lagi, mesti terus disalin dan disimpan elok-elok.

Nampak tarikh sahnya? — 5 Julai 2027. Saya tetapkan tarikh sah Key ini setahun. Buat masa ini ada juga pilihan tak luput selamanya, cuma tak tahu bila kempen ini akan ditutup, jadi tetap setahun lebih selamat. Titik akhir ini berjalan di atas infrastruktur global NVIDIA, tiada kunci rantau, tak perlu VPN, pembangun luar negara (termasuk Jepun) daftar dengan satu e-mel terus boleh guna.
Langkah kedua: guna CC Switch untuk sambung ke Claude Code
Key dah dapat, sekarang langkah paling penting: macam mana nak guna Kunci ini.
Kalau Anda programmer, bawa ketiga-tiga parameter tadi untuk panggil API format serasi OpenAI sahaja. Tapi majoriti orang tak mau pening dengan baris perintah — inilah masanya CC Switch memainkan peranan. Ia satu alat bergrafik untuk mengurus penyedia model, khusus untuk tukar model asas Claude Code. Buka ia, Anda akan nampak satu senarai penyedia yang penuh sesak, puluhan pilihan, SiliconFlow, OpenRouter, GitHub Copilot, Codex semuanya ada, NVIDIA juga salah satu daripadanya. Dalam senarai itu klik butang biru Nvidia, ia tolong Anda isikan alamat permintaan, Anda hanya perlu menampal API Key sendiri.


Konfigurasi ada empat perkara penting:
- API Key: isi kunci
nvapi-Anda. - Alamat permintaan: isi
https://integrate.api.nvidia.com, yang ini CC Switch sudah tolong isi. - Format API: mesti pilih OpenAI Chat Completions (perlu aktifkan routing), tak pilih ini format permintaan tak akan sepadan.
- Pemetaan model (paling penting): petakan tiga peranan Sonnet, Opus, Haiku semuanya ke
z-ai/glm-5.2. Macam ini tak kira Claude Code hantar permintaan guna peranan model yang mana, yang sebenar berjalan semuanya GLM-5.2.
Selepas simpan, buka Claude Code, taip /model, Anda akan nampak dalam senarai model tempat yang asalnya tertulis Sonnet 4.6, Opus, sekarang semuanya bertukar jadi z-ai/glm-5.2. Pilih "Custom Sonnet model", taip hi untuk menguji.

Aliran dah berjalan.
Yang Anda ada sekarang ialah antara muka penuh Claude Code dan aliran kerja ejen, tetapi yang berjalan di bawah ialah GLM-5.2 percuma daripada NVIDIA. Kemampuan Claude Code — suntingan pelbagai fail, pelaksanaan automatik, pengurusan konteks, panggilan alat — semuanya masih ada, cuma enjin penaakulan ditukar jadi GLM-5.2. Kalau Anda tak beritahu, orang lain dari antara muka memang takkan nampak — terminal tetap papar logo Claude Code, cara interaksi sama, perintah /model sama. Tetapi setiap permintaan perbualan berjalan menerusi kluster GPU NVIDIA, dan yang dipanggil semuanya GLM-5.2 milik Zhipu.
Penggunaan Claude Code secara normal, minimum juga perlukan pelan Max 100 USD sebulan, atau ikut API Usage Billing membayar ikut guna. Sekarang Anda guna API percuma NVIDIA ditambah dengan CC Switch, antara muka sama, aliran kerja sama, kos panggilan model asas adalah sifar. Untuk sesiapa yang ingin alami aliran kerja Claude Code tapi bajetnya terhad, ini satu alternatif yang agak praktikal.
🌍 Perniagaan di sebalik percuma: tiga lapisan percuma, satu model yang sama
Tiga artikel ditulis, perkara yang saya nak bincang bukan lagi model GLM-5.2 semata-mata. Taruh ketiga-tiga sekali untuk dilihat, Anda akan jumpa satu struktur tiga lapisan yang jelas:
- Lapisan pertama, lapisan aplikasi — Meituan dan Alibaba. Mereka sumbat GLM-5.2 masuk ke produk sendiri (CatPaw ialah IDE, QoderWork ialah rakan desktop), guna model percuma untuk menarik pengguna akhir. Model bagus atau tak, sebahagian besarnya bergantung pada produk itu sendiri dibuat macam mana.
- Lapisan kedua, lapisan infrastruktur — NVIDIA. Ia letak GLM-5.2 di awan GPU sendiri, menawarkan titik akhir API percuma, guna kuasa pengkomputan percuma untuk menarik pembangun.
- Lapisan ketiga, lapisan model — Zhipu sendiri. Ia membuka GLM-5.2 sepenuhnya (lesen MIT), membenarkan semua orang datang mengedarkannya.
Tiga lapisan, tiga logik perniagaan, tiga jenis percuma yang berbeza sama sekali. Tetapi yang mengalir di bawah semua itu ialah benda yang sama.
Kenapa NVIDIA nak buat benda ini? Ia bukan syarikat model. Fikirkan apa perniagaan NVIDIA — ia menjual GPU. Cip AI H200, B200 ini, sekeping dah berpuluh-puluh ribu USD. Pelanggan terbesarnya ialah syarikat-syarikat yang perlukan kapasiti inferens berskala besar. Perkara API percuma ini, dari luar nampak macam NVIDIA menampung kos untuk tolong orang lain menjalankan model, sebenarnya ia sedang buat satu hal: memberi lebih ramai pembangun menulis kod, menguji model, membina prototaip di atas infrastruktur NVIDIA. Sekali projek Anda berjalan di platform ini, bila perlu naik ke persekitaran produksi, pilihan paling semula jadi adalah beli GPU NVIDIA, atau guna perkhidmatan inferens berbayar NVIDIA.
Dulu hal ini tak terfikir. Model-model lama tertutup: GPT-4 hanya boleh diguna di platform OpenAI, Claude hanya di platform Anthropic, Anda nak guna model siapa, mesti masuk ke ekosistemnya. Sekarang GLM-5.2 memecahkan peraturan ini — ia sumber terbuka, lesen MIT, sesiapa pun boleh ambil guna. Jadi Meituan ambil dia buat IDE, Alibaba ambil dia buat alat pejabat, NVIDIA ambil dia buat API percuma untuk menarik trafik. Setiap satu guna model yang sama untuk merebut pintu masuk pengguna masing-masing, tetapi tiada satu pun yang memiliki model ini.
Zhipu buat satu benda yang sangat bijak: ia tak berebut pengguna akhir dengan syarikat-syarikat besar ini, ia jadi sumber air. Sesiapa nak menarik air untuk menyiram tanaman, silakan, air memang percuma. Tetapi selagi air yang mengalir di tanah semua orang ialah air saya, sungai ini akan jadi infrastruktur — Anda nak elak, kena gali telaga sendiri. Inilah kuasa sebenar model sumber terbuka: bukan pada percuma itu sendiri, tetapi pada ia menjadikan semua pesaing Anda saluran edaran sendiri. Semakin Anda terbuka, semakin orang tak boleh melepaskan Anda.
Pada 1911, Standard Oil diputuskan monopoli oleh Mahkamah Agung Amerika Syarikat, dipaksa dipecahkan jadi 34 syarikat berasingan. Ketika itu Wall Street menjerit, semua orang sangka Rockefeller dah selesai. Tetapi yang ironi, 34 syarikat ini kemudiannya masing-masing membesar menjadi gergasi industri minyak — Exxon, Mobil, Chevron, Amoco, setiap satu syarikat Fortune 500. Rockefeller sebab memegang saham asal semua syarikat yang dipecahkan itu, kekayaan peribadinya sebaliknya berganda beberapa kali ganda berbanding sebelum dipecahkan.
Memecah-mecah satu benda dan memberikannya keluar, kadang-kadang bukan kehilangan kawalan. Tetapi membiarkannya membesar menjadi infrastruktur yang semua orang tak boleh lepaskan.
📝 Catatan terakhir
Sementara kempen masih ada, pergi ke build.nvidia.com daftar satu cuba. Lagipun tak berharga, lima minit siap, CC Switch tolong Anda klik semua konfigurasi yang selebihnya.
Trilogi percuma GLM-5.2 — Meituan buat lapisan produk, Alibaba buat lapisan produk, NVIDIA buat lapisan infrastruktur, satu lapisan lebih mendalam dari satu lapisan. Anda nak yang lapisan mana, pilih sendiri.
Langkah operasi dan tangkap layar halaman dalam artikel ini semuanya diuji sendiri oleh penulis (setakat Julai 2026); kuota peringkat percuma, had kadar dan tarikh sah kempen boleh berubah pada bila-bila masa, yang berkuat kuasa mengikut halaman rasmi build.nvidia.com; pandangan dalam artikel ini hanya mewakili penulis sendiri.