⚡ Önce cevabı vereyim

Önceki iki yazı — Meituan CatPaw ve Alibaba QoderWork — yayımlanınca gelen kutum doldu taştı. Ama bir mesaj takıldı aklıma, özetle şu: bu araçlar bedava tamam da, ikisinde de ölçülü bir tavan var — CatPaw 500 kullanım, QoderWork 30 günde 2000 kredi. GLM-5.2 API'sini limitsiz, beleşe kullanmanın bir yolu yok mu?

İlk içgüdüm "bu istek haddi aşar" oldu. Üst düzey bir modelin API çağrısının arkasında gerçek bir GPU faturası var; "sınırsız bedava" nadiren gerçek olur.

Sonra baktım. Var.

TL;DR · Tek cümleyle
Bunu sunan bir Çin şirketi değil — NVIDIA. Evet, ekran kartından o NVIDIA; dünyanın en değerli çip şirketi. Kendi geliştirici platformu build.nvidia.com üzerinde GLM-5.2 için bir ücretsiz API endpoint'i açmışlar; OpenAI uyumlu format, doğrudan Claude Code'a takılabilir. Kayıt beş dakika, kart bağlamaya gerek yok.

Benim yorumum: "GLM-5.2 ücretsiz üçlemesi"nin el atılması en kolay kısmı bu. Meituan ürün katmanında, Alibaba ürün katmanında oynuyor; NVIDIA ise doğrudan altyapı katmanında. Her katman bir öncekinden daha derine iniyor.

📰 Ücretsiz anahtar nerede: build.nvidia.com'da 77 model bedava

NVIDIA'nın build.nvidia.com adlı bir geliştirici platformu var; 141 AI modeli barındırıyor, bunların 77'si ücretsiz API endpoint'i sunuyor. Yanlış okumadın: 77 ücretsiz model. DeepSeek-V4-Pro orada, Kimi-K2.6 orada, MiniMax-M2.7 orada, Qwen3.5 de orada.

build.nvidia.com model pazarı: 141 modelin 77'si ücretsiz API endpoint'i sunuyor

GLM-5.2 de orada. Etiketinde Free Endpoint ve Downloadable yazıyor; sağlayıcı Z.ai (Zhipu), en yeni modeller listesinin zirvesinde. Yayına gireli 1 gün olmuş, indirme sayısı 2 milyona fırlamış.

GLM-5.2 model kartı: Free Endpoint + Downloadable etiketleri, sağlayıcı Z.ai (Zhipu)

Bu ücretsiz API, önceki iki yazıdaki araçlarla temelden farklı. CatPaw ve QoderWork hazır ürünler: indir, kur, aç, kullan — ama model ürünün içine gömülü, yalnızca kendi arayüzlerinden çağrılabiliyor. NVIDIA sana saf API veriyor; OpenAI formatıyla uyumlu, bu formatı destekleyen her araca takılabiliyor.

Her araç. Claude Code dahil.

Buraya kadar okuyan bazıları "API beni aşar, programcı değilim" diye düşünüyor olabilir. Dur, bekle. CC Switch adlı grafiksel bir araç, kalan tüm yapılandırmayı birkaç tıkla hallediyor.

🧬 Üç parametre: base_url, api_key, model

Teknik temelden başlayalım. GLM-5.2'nin NVIDIA platformundaki model sayfasını açtığında, üç kritik parametre listeleniyor:

GLM-5.2 model sayfası: base_url, api_key ve model olmak üzere üç bağlantı parametresi

  • base_url: https://integrate.api.nvidia.com/v1 (sonraki testlerde bu /v1'i yazmaya gerek olmadığını gördük)
  • api_key: bir sonraki adımda üreteceğin nvapi- önekli anahtar
  • model: z-ai/glm-5.2

Programcıysan iş burada bitiyor — bu üç parametreyle OpenAI uyumlu API'yi çağırırsın; Python, Node, Shell örnekleri sayfada duruyor. Ama çoğumuz programcı değil ve komut satırıyla uğraşmak istemiyor. NVIDIA sana hammadden veriyor, bitmiş ürünü değil. API Key'i cebine koyunca Claude Code'a, Cursor'a, VS Code'un AI eklentilerine, hatta kendin yazdığın herhangi bir programa bağlayabilirsin. Aracı sen seçersin, model bedava, kombinasyon sana kalmış.

Özgürlük tam olarak burada. Şimdi sıra: Key'i nasıl alacaksın, sonra Claude Code'a nasıl bağlayacaksın.

⚖️ Ücretsiz üçlü & bedelinin ne olduğu

Üç ücretsiz kanalı yan yana koyalım, fark kendi kendine ortaya çıkıyor:

KanalÜcretsiz kotaSınırModelin formu
CatPaw (Meituan)500 kullanımBitince form doldur, sıra bekleIDE'ye gömülü
QoderWork (Alibaba)2000 kredi30 gün geçerli, sonra yanar (yorumlarda birkaç günde bitenler var)Masaüstü uygulamaya gömülü
NVIDIA NIMSınırsız Key~40 RPM, yoğun saatlerde kuyrukSaf API, her araca bağlanır

Karşılaştırma net: CatPaw'ın 500 kullanımı bitince form doldurup onay bekliyorsun; QoderWork'ün 2000 kredisi 30 gün sonra eriyor, siliniyor — yorumlarda pek çok kişi bir ay dayanamadığını söylüyor. NVIDIA ise eline sınırsız bir anahtar sıkıştırıyor; doğrulama sayfasında birebir şunu yazıyor: Unlimited API requests without daily limits, yani günlük istek üst sınırı yok.

Ücretsiz katman açıklaması: Unlimited API requests without daily limits — günlük istek üst sınırı yok

Fakat "sınırsız" lafının yanına bir soru işareti koymak lazım — bedava şeylerin arkasında her zaman gizli bir sınır vardır. NVIDIA'nın ücretsiz katmanının bilinen bir sorunu var: yoğun saatlerde yavaş. Bu yalnız benim izlenimim değil; yurtdışı geliştirici topluluklarının geri bildirimleri aynı yönde — kalabalık saatlerde istekler kuyruğa giriyor ya da doğrudan 429 ile bağlanamıyor; yanıt süresi birkaç saniyeden onlarca saniyeye, hatta daha da uzağa uzayabiliyor. Threads'te biri çok net özetlemiş: Peak hours, you queue up and wait — "kuyruğa girip bekliyorsun". Yoğun olmayan saatlerde deneyim fena değil; gece yarısı ve hafta sonları iş oldukça hızlı yürüyor. Ama mesai saatlerinde, yüksek frekanslı çağrıları stabil karşılayacağını umuyorsan, büyük olasılıkla hayal kırıklığına uğrayacaksın.

Hız sınırı kabaca dakikada 40 istek (40 RPM) civarında. Bireysel bir geliştiricinin günlük kod yazması için yeterli; ama otomatik batch işleri — toplu belge üretimi, toplu repo analizi gibi — bu hızda tıkanır.

Şunu da net söyleyelim: GLM-5.2 sonuçta Claude değil. Claude'un sistem prompt'u yok onda, Claude'un konuşma kişiliği yok, uzun-halkalı karmaşık akıl yürütmede Claude'un o kararlılığı yok. CC Switch ile Claude Code'a bağladıktan sonra arayüz birebir aynı görünür; ama cevapların "tadı" farklı olur. Bazı işleri beklentinden iyi yapar, bazılarını beklentinden kötü. Hangi sahanda güçlü, hangisinde zayıf — kendi gerçek projelerinde koşup görmelisin; başkasının benchmark'ı senin kendi parmak hissini yerine koyamaz.

🛠️ Beş dakikada Key al + Claude Code'a bağlan

Adım 1: Beş dakikada API Key

build.nvidia.com'u aç, kayıt ol. Google veya GitHub hesabın varsa doğrudan yetkilendirip giriş yapabilirsin; ayrı kayıt şart değil. Giriş sonrası API Key üretebilmek için telefonunu doğrulaman gerekiyor — işte kritik nokta: Çin ana karası numarasını destekliyor. Location menüsünden China'yı seç, +86 önekli numaranı gir, Send Code to Phone'a bas; telefona altı haneli bir kod düşer, gir, doğrulansın.

Kayıt sayfasında Location olarak China seçili; +86 Çin ana karası numaraları kabul ediliyor

Telefona altı haneli doğrulama kodu geldi; Send Code to Phone adımı tamamlandı

Bu adımda birçok kişi Çin numarasının çalışmayacağını sanıyor; hiç sorun yok. Bizzat denedim, SMS birkaç saniyede geldi.

Telefonu doğruladıktan sonra sağ üstteki kullanıcı menüsünden API Keys sayfasına geç, Generate API Key'e tıkla. Key'e bir ad ver, mesela freeapi; sistem nvapi- önekli bir dize üretsin. Dikkat: bu anahtar yalnızca bir kez gösterilir — sayfayı kapatınca bir daha göremezsin. Hemen kopyala, güvenli bir yere kaydet.

API Keys sayfasında Generate API Key ile nvapi- önekli anahtar üretiliyor

Geçerlilik tarihine bak — 5 Temmuz 2027. Bu Key'e bir yıl ömür biçtim. Şu anda "hiç süresi dolmasın" seçeneği de var; ama kampanyanın ne zaman "fişini çekeceği" belli olmaz, o yüzden bir yıl daha garanti duruyor. Bu endpoint NVIDIA'ın küresel altyapısında koşuyor; bölge kilidi yok, VPN gerekmez — yurtdışı (Japonya dahil) bir geliştirici tek bir e-postayla kayıt olup kullanmaya başlayabilir.

Adım 2: CC Switch ile Claude Code'a bağlan

Anahtar elde. Şimdi kritik adım: bu Key'i nasıl kullanacaksın?

Programcıysan, üç parametreyle OpenAI uyumlu API'yi çağırırsın. Ama çoğu kişi komut satırıyla uğraşmak istemez — tam burada CC Switch devreye girer. Claude Code'un arka planda kullandığı modeli değiştirmeye yarayan grafiksel bir sağlayıcı yönetim aracı. Açtığında onlarca seçenekli bir sağlayıcı listesi karşılıyor: SiliconFlow, OpenRouter, GitHub Copilot, Codex hep orada, NVIDIA da aralarında. Listeden Nvidia adlı mavi düğmeye tıklarsan, istek adresini senin yerine önceden doldurur; geriye yalnızca API Key'ini yapıştırmak kalır.

CC Switch sağlayıcı listesinde Nvidia mavi düğmesi; tıklayınca istek adresi otomatik doluyor

CC Switch yapılandırmasının dört kritik noktası: API Key, istek adresi, OpenAI Chat Completions formatı, model eşleştirme

Yapılandırmada dört kritik nokta var:

  1. API Key: kendi nvapi- anahtarını gir.
  2. İstek adresi: https://integrate.api.nvidia.com — CC Switch bunu zaten senin için doldurdu.
  3. API formatı: mutlaka OpenAI Chat Completions (yönlendirme / routing açık) seç; bunu seçmezsen istek formatı uyuşmaz.
  4. Model eşleştirme (en kritik olan): Sonnet, Opus ve Haiku — üç rolün hepsini z-ai/glm-5.2'ye eşle. Böylece Claude Code hangi model rolüyle istek atarsa atsın, arka planda hep GLM-5.2 koşar.

Kaydet, ardından Claude Code'u aç ve /model yaz. Model listesinde eskiden Sonnet 4.6 ile Opus yazan yerlerin hepsinde artık z-ai/glm-5.2 okuyorsun. "Custom Sonnet model"i seç ve test için bir "hi" gönder.

Claude Code /model komutu: Sonnet ve Opus konumları artık z-ai/glm-5.2 olarak görünüyor

Kurulum tamam.

Artık elinde Claude Code'un tam arayüzü ve Agent iş akışı var; altta ise NVIDIA'nın bedava sunduğu GLM-5.2 koşuyor. Claude Code'un çok-dosyalı düzenleme, otomatik yürütme, bağlam yönetimi, araç çağrısı yetenekleri hep yerinde; yalnızca akıl yürütme motoru GLM-5.2 oldu. Söylemezsen, arayüzden anlamak imkânsız — terminalde aynı Claude Code logosu, aynı etkileşim, aynı /model komutu. Ama her sohbet isteği NVIDIA'nın GPU kümesinden geçiyor ve çağırdığı model Zhipu'nun GLM-5.2'si.

Hesabın kitabı
Claude Code'u normal yoldan kullanmak istesen, en az Max planı — ayda 100 dolar — ödemen ya da API Usage Billing ile kullanım başına ödemen gerekir. Şimdi NVIDIA'nın ücretsiz API'si ve CC Switch ile aynı arayüz, aynı iş akışı; alt katmandaki model çağrı maliyeti sıfır. Claude Code iş akışını denemek isteyen ama bütçesi kısıtlı bir geliştirici için ciddi bir alternatif.

🌍 Bedavanın arkasındaki iş: üç katman bedava, aynı model

Üç yazıdır kafamda dönen şey aslında tek bir modelin ötesine geçti. Üçünü yan yana koy; net bir üç-katmanlı yapı çıkıyor:

  • Birinci katman, uygulama katmanı — Meituan ve Alibaba. GLM-5.2'yi kendi ürünlerinin içine gömüyorlar (CatPaw bir IDE, QoderWork bir masaüstü yardımcısı); bedava modeliyle son kullanıcıyı topluyorlar. Modelin iyi-kötü olması büyük ölçüde ürünün kendisine bağlı.
  • İkinci katman, altyapı katmanı — NVIDIA. GLM-5.2'yi kendi GPU bulutuna koyuyor, ücretsiz API endpoint olarak dağıtıyor; bedava işlem gücüyle geliştiriciyi çekiyor.
  • Üçüncü katman, model katmanı — Zhipu'nun kendisi. GLM-5.2'yi tamamen açık kaynak yapıyor (MIT lisansı), herkesin dağıtmasına izin veriyor.

Üç katman, üç farklı iş mantığı, üç farklı bedava. Ama alttan akan tek bir şey.

NVIDIA neden bunu yapıyor? Model şirketi değil sonuçta. Şöyle düşün: NVIDIA'nın işi GPU satmak. H200, B200 gibi AI çipleri, bir tanesi birkaç on bin dolar. En büyük müşterisi, büyük çapta çıkarım (inference) işlem gücüne ihtiyaç duyan şirketler. Ücretsiz API, yüzeyde NVIDIA'nın başkalarının modelini koşturmak için para harcaması gibi duruyor; aslında tek bir şey yapıyor: daha fazla geliştiricinin NVIDIA altyapısında kod yazmasını, model test etmesini, prototip kurmasını sağlamak. Projen bir gün üretime çıkacak ve gerçek yüke ihtiyaç duyacak; o zaman en doğal seçim NVIDIA'nın GPU'sunu almak ya da ücretli çıkarım servisini kullanmak olur.

Bedava API yem. GPU satışı ve ücretli çıkarım servisi olta. Mantık bir kere oturunca çürümüyor.

Bu, eskiden düşünülemezdi. Eskiden modeller kapalıydı: GPT-4 yalnızca OpenAI'nin platformunda, Claude yalnızca Anthropic'in platformunda; birinin modelini kullanmak istiyorsan, o ekosisteme girmek zorundaydın. GLM-5.2 bu kuralı yıktı — açık kaynak, MIT lisansı, herkes kullanabilir. Bu yüzden Meituan onunla IDE yapıyor, Alibaba onunla ofis aracı, NVIDIA onunla ücretsiz API trafiği. Her biri aynı modeli kullanarak kendi kullanıcı giriş noktası için kapışıyor; ama hiçbiri bu modele sahip değil.

Zhipu akıllıca bir iş yaptı: büyük şirketlerle son kullanıcı için yarışmıyor; su kaynağı oluyor. Kim sulama yapmak isterse yapsın — su bedava. Ama herkesin tarlasında benim suyum aktığı sürece, bu ırmak bir altyapıdır; onu aşmak için kendi kuyunu kazman gerekir. Açık kaynak modelinin asıl gücü tam burada: bedava olmasında değil, tüm rakiplerini senin dağıtım kanalına çevirmesinde. Ne kadar açarsan, o kadar vazgeçilmez olursun.

1911'de Standard Oil, ABD Yüksek Mahkemesi tarafından tekel ilan edildi ve 34 bağımsız şirkete bölünmeye zorlandı. Wall Street çığlık attı; herkes Rockefeller'in bittiğini sandı. Ama trajikomik olan şu oldu: o 34 şirket tek tek petrol devlerine dönüştü — Exxon, Mobil, Chevron, Amoco; her biri Fortune 500'den biri. Bölünen tüm şirketlerin öz hisselerini elinde tuttuğu için Rockefeller'in kişisel serveti, bölünmeden öncekinin birkaç katına çıktı.

Bir şeyi parçalayıp dağıtmak, bazen kontrolü kaybetmek değildir. Onu herkesin artık vazgeçemeyeceği bir altyapıya dönüştürmektir.

📝 Son söz

Kampanya sürdüğü sürece, git build.nvidia.com'da bir kayıt ol. Zaten para yok; beş dakika, CC Switch geri kalanı için tıklamayı halleder.

GLM-5.2 ücretsiz üçlemesi: Meituan ürün katmanında, Alibaba ürün katmanında, NVIDIA altyapı katmanında — her katman bir öncekinden daha derine. Hangi katmanı istiyorsan, kendin seç.


Bu yazıdaki tüm adımlar ve ekran görüntüleri yazar tarafından bizzat test edilmiştir (Temmuz 2026 itibarıyla). Ücretsiz katmanın kotası, hız limitleri ve kampanya süresi her an değişebilir; yetkili kaynak build.nvidia.com resmî sayfasıdır. Yazıdaki görüşler yazarın kişisel görüşüdür.