⚡ El resumen en una frase
Lo que cambia para los desarrolladores es esto: ya existe una API de GLM-5.2 sin techo, sin tarjeta, sin VPN, con formato compatible OpenAI y abierta a cualquier herramienta. Y lo curioso no es que sea gratis — es quién la ofrece.
Las dos piezas anteriores —la de CatPaw de Meituan, la de QoderWork de Alibaba— soltaron una avalancha de mensajes privados. Pero hay uno que se me quedó grabado. Venía a decir, más o menos: estas herramientas están muy bien, pero todas traen techo; CatPaw corta a los 500 usos, QoderWork a 2000 créditos de 30 días. ¿No hay ninguna manera de usar la API de GLM-5.2 sin límite, gratis y a gusto?
Mi primer reflejo fue escéptico. Eso es pedir mucho. La inferencia de un modelo frontera cuesta compute real, y nadie regala compute sin garras.
Pues fui a mirar. Y existe.
Quien ofrece este canal no es una empresa china. Es NVIDIA —sí, la de las gráficas, la compañía de chips más valiosa del planeta. En su plataforma para desarrolladores
build.nvidia.com ha colgado un endpoint gratuito de GLM-5.2, compatible con OpenAI, que puedes enchufar directamente a Claude Code. Registro en cinco minutos, sin tarjeta.Mi tesis: esta es la pieza de la «trilogía GLM-5.2 gratis» que más merece la pena ejecutar. Meituan opera en la capa de producto, Alibaba opera en la capa de producto, y NVIDIA baja hasta la capa de infraestructura. Cada vez más cerca del metal.
📰 Dónde está la llave gratis: 77 modelos sin coste en build.nvidia.com
NVIDIA tiene una plataforma para desarrolladores que se llama build.nvidia.com. Aloja 141 modelos de IA, y de esos, 77 ofrecen un endpoint de API gratuito. No es un error de tipeo: 77 modelos gratis. DeepSeek-V4-Pro está ahí. Kimi-K2.6 está ahí. MiniMax-M2.7 está ahí. Qwen3.5 también.

GLM-5.2 también está ahí. Las etiquetas dicen Free Endpoint y Downloadable, el proveedor es Z.ai (Zhipu), y aparece el primero en la lista de novedades. Lleva un día publicado y ya acumula 2 millones de descargas.

Aquí hay una diferencia fundamental con las herramientas de las dos piezas anteriores. CatPaw y QoderWork son productos cerrados: descargas, instalas, abres y listo, pero el modelo vive encerrado dentro del producto —solo puedes invocarlo desde su propia interfaz. Lo que te entrega NVIDIA es la API en crudo. Respeta el formato de OpenAI, así que puedes enchufarla a cualquier herramienta que hable ese dialecto.
Cualquier herramienta. Incluida Claude Code.
Ya sé que alguno va a pensar: la API queda lejos, yo no soy programador. Aguanta un poco. Más abajo te presento una utilidad gráfica llamada CC Switch que con cuatro clics resuelve toda la configuración por ti.
🧬 Tres parámetros: base_url, api_key, model
Vamos con los cimientos técnicos. Abre la página del modelo GLM-5.2 en la plataforma de NVIDIA y verás tres parámetros de conexión clave:

- base_url:
https://integrate.api.nvidia.com/v1(en la práctica comprobé que el/v1del final es prescindible) - api_key: la clave
nvapi-que generarás en el siguiente paso - model:
z-ai/glm-5.2
Si programas, aquí ya habrías terminado: coges esos tres valores, llamas a la API con formato compatible OpenAI y a correr. La página trae ejemplos en Python, Node y Shell. Pero la mayoría no programa, ni quiere pelearse con la terminal. Lo que te da NVIDIA es la materia prima, no el producto acabado. Con la API Key en la mano puedes enchufarla a Claude Code, a Cursor, a cualquier plugin de IA para VS Code, o incluso a un programa que tú mismo hayas escrito. Tú eliges la herramienta, el modelo es gratis y la combinación la decides tú.
Esa es la libertad real. Ahora vamos a cómo se obtiene la llave y cómo se enchufa a Claude Code.
⚖️ Los tres hermanos gratis & el precio que pagas
Pongamos los tres canales gratis uno al lado de otro. Las diferencias saltan a la vista:
| Canal | Cuota gratuita | Limitaciones | Forma del modelo |
|---|---|---|---|
| CatPaw (Meituan) | 500 usos | Al agotarse, rellenas un formulario y esperas revisión | Encerrado en un IDE |
| QoderWork (Alibaba) | 2000 créditos | Caduca a los 30 días (los comentarios reportan que se acaba en unos días) | Encerrado en una app de escritorio |
| NVIDIA NIM | Key ilimitada | ~40 RPM, colas en horas punta | API pura, enchufable a cualquier herramienta |
Compáralos y el contraste es brutal. CatPaw te corta a los 500 usos; para volver a empezar tienes que enviar un formulario y esperar a que te lo aprueben. QoderWork te da 2000 créditos que caducan a los 30 días —los lectores nos cuentan que muchos no llegan a fin de mes sin quedarse tiesos. NVIDIA, en cambio, te lanza una llave sin techo. La página del free tier lo dice textual: Unlimited API requests without daily limits. Sin cupo diario.

Claro, «ilimitado» conviene leerlo con comillas. Lo gratis casi siempre esconde un impuesto oculto. Y el free tier de NVIDIA arrastra un problema ya proverbial: en horas punta va lento. No es solo mi impresión. Los foros internacionales de desarrolladores coinciden: en franjas ocupadas las peticiones se acumulan en cola o devuelven un error 429 sin más, y el tiempo de respuesta puede pasar de unos segundos a más de diez. Alguien lo resumió en Threads con franqueza brutal: Peak hours, you queue up and wait —«en horas punta, te pones a la cola y esperas». Fuera de punta el rendimiento es razonable; de madrugada y en fines de semana las tareas corren bastante bien. Pero si confías en que sostenga cargas altas en horario laboral de lunes a viernes, casi seguro te defrauda.
Y otra cosa que hay que decir clara: GLM-5.2 no es Claude. No tiene el prompt de sistema de Claude, ni su personalidad conversacional, ni esa estabilidad en razonamiento largo en la que Claude destaca. Cuando lo enchufas vía CC Switch a Claude Code, el aspecto es idéntico, pero el sabor de las respuestas cambia. Algunas tareas te sorprenderán para bien; otras te decepcionarán. Cuáles son sus puntos fuertes y cuáles los débiles tienes que comprobarlo tú con proyectos reales —el bench de otro no sustituye a tu propia experiencia.
🛠️ Key en cinco minutos + conexión a Claude Code
Primer paso: consigue tu API Key en cinco minutos
Abre build.nvidia.com y registra una cuenta. Si ya tienes Google o GitHub, puedes autorizar el login directamente, sin formulario. Tras entrar, te piden verificar un móvil para emitir la API Key —aquí viene lo importante: acepta números de China continental. En el menú desplegable de Location elige China, pon tu número con prefijo +86, pulsa Send Code to Phone, y en segundos recibirás un código de seis dígitos por SMS. Lo introduces y listo.


Mucha gente da por hecho que los números chinos no van a funcionar. Funcionan. Lo he probado yo mismo: el SMS llegó en cuestión de segundos.
Una vez verificado el móvil, abre el menú de tu cuenta en la esquina superior derecha, entra en la página de API Keys y pulsa Generate API Key. Ponle un nombre reconocible, por ejemplo freeapi. El sistema te escupe una cadena que empieza por nvapi-. Ojo: esa clave solo se muestra una vez. Cierras la página y desaparece para siempre. Cópiala y guárdala en el acto.

¿Ves la fecha de caducidad? 5 de julio de 2027. Yo le puse un año de validez. Existe también la opción de clave perpetua, pero como desconocemos cuándo retirarán la promoción, un año me parece más prudente. Este endpoint corre sobre la infraestructura global de NVIDIA: no tiene bloqueo regional, no necesitas VPN, y un desarrollador en cualquier parte del mundo (Japón incluido) puede registrarse con un correo y empezar a usarlo.
Segundo paso: conecta a Claude Code con CC Switch
Ya tienes la Key. Ahora viene el paso clave: cómo usarla.
Si programas, con los tres parámetros de antes puedes invocar la API en formato OpenAI y arreglado. Pero la mayoría no quiere pelearse con la terminal, y aquí brilla CC Switch. Es una utilidad gráfica para gestionar proveedores de modelo, pensada para cambiar el motor que mueve Claude Code. Al abrirla verás un catálogo denso de proveedores —SiliconFlow, OpenRouter, GitHub Copilot, Codex y NVIDIA, entre muchos otros. Pulsas el botón azul de Nvidia y te autorellena la URL de petición; solo te queda pegar tu API Key.


Cuatro puntos de configuración:
- API Key: pega tu secreto
nvapi-. - URL de petición:
https://integrate.api.nvidia.com. CC Switch ya la rellena por ti. - Formato de API: debe estar en OpenAI Chat Completions (con routing activado). Si no, el formato de petición no encaja.
- Mapeo de modelos (lo más importante): asigna Sonnet, Opus y Haiku a
z-ai/glm-5.2. Así, da igual el rol que invoque Claude Code: por debajo siempre ejecuta GLM-5.2.
Guarda. Abre Claude Code, escribe /model y comprueba que donde antes decía Sonnet 4.6 u Opus ahora aparece z-ai/glm-5.2. Selecciona «Custom Sonnet model» y manda un hi de prueba.

Funciona.
Lo que tienes delante es la interfaz completa de Claude Code y sus flujos de agente, pero el motor es el GLM-5.2 gratis de NVIDIA. La edición multifichero, la ejecución automatizada, la gestión de contexto y las llamadas a herramientas siguen ahí —solo cambia el motor de inferencia. Si no lo dices, nadie lo nota desde fuera: el terminal sigue mostrando el logo de Claude Code, los mismos comandos, el mismo /model. Pero cada petición de diálogo cae al cluster de GPUs de NVIDIA y responde con el GLM-5.2 de Zhipu.
Claude Code, en su uso normal, te cuesta como mínimo el plan Max a 100 dólares al mes, o bien pago por uso vía API Usage Billing. Con la API gratuita de NVIDIA más CC Switch, misma interfaz, mismo flujo de trabajo, el coste del modelo se va a cero. Para quien quiere probar el flujo de Claude Code con presupuesto ajustado, es un sustituto más que decente.
🌍 La lógica de negocio detrás del gratis: tres capas, un mismo modelo
Tres piezas después, lo que quiero contar ya no es solo GLM-5.2. Si pones las tres una al lado de la otra, aparece un patrón muy claro, en tres capas:
- Capa de aplicación — Meituan y Alibaba. Encajan GLM-5.2 dentro de un producto propio (CatPaw como IDE, QoderWork como compañero de escritorio) y usan el modelo gratis para captar usuarios finales. Lo bien que funciona depende, sobre todo, de cuánto acierte el producto.
- Capa de infraestructura — NVIDIA. Pone GLM-5.2 en su nube de GPUs y abre un endpoint gratuito para captar desarrolladores con compute gratis.
- Capa de modelo — Zhipu. Libera GLM-5.2 como open source puro (licencia MIT) para que cualquiera lo distribuya.
Tres capas, tres lógicas de negocio, tres clases completamente distintas de «gratis». Pero por todas circula el mismo modelo.
¿Por qué NVIDIA hace esto, si no es una empresa de modelos? Piénsalo un momento: el negocio de NVIDIA es vender GPUs. Sus chips H200 o B200 valen cada uno decenas de miles de dólares. Sus grandes clientes son las compañías que necesitan compute masivo de inferencia. Regalar una API parece tirar dinero para que otros corran modelos. En realidad hace otra cosa: atraer a más desarrolladores a escribir código, probar modelos y montar prototipos sobre su infraestructura. Cuando tu proyecto despega y necesitas pasar a producción, la opción natural es comprar GPUs de NVIDIA o contratar su servicio de inferencia de pago.
Hace unos años esto habría sido impensable. Los modelos eran cerrados: GPT-4 solo vivía en la plataforma de OpenAI, Claude solo en la de Anthropic; si querías usar uno, tenías que entrar en su ecosistema. GLM-5.2 rompe esa regla: es open source bajo MIT, cualquiera puede cogerlo. Por eso Meituan lo usa para su IDE, Alibaba para su herramienta de ofimática, y NVIDIA para atraer tráfico con una API gratis. Cada uno compite por su propia puerta de entrada, pero ninguno es dueño del modelo.
Zhipu ha jugado una carta lista: no compite con los gigantes por el usuario final, se dedica a ser la fuente de agua. Quien quiera regar su campo, que venga a buscarla. El agua es gratis, pero mientras el agua de todos pase por tu río, ese río se vuelve infraestructura —para esquivarlo tendrías que perforar tu propio pozo. Esa es la fuerza real del open source: no reside en que sea gratis, reside en que convierte a todos tus competidores en tus canales de distribución. Cuanto más abres, más indispensable te vuelves.
En 1911, el Tribunal Supremo de EE. UU. declaró a Standard Oil monopolio y la obligó a dividirse en 34 empresas independientes. Wall Street cantó el cataclismo: todos daban por muerto a Rockefeller. La ironía es que aquellas 34 compañías crecieron hasta convertirse en gigantes del petróleo —Exxon, Mobil, Chevron, Amoco—, todas en la lista Fortune 500. Rockefeller, al conservar acciones matriz de cada una, vio cómo su patrimonio se multiplicaba respecto al de antes del desmembramiento.
A veces despedazar algo y repartirlo no es perder el control. Es convertirlo en una infraestructura de la que ya nadie puede prescindir.
📝 Apunte final
Mientras la promoción siga abierta, date una vuelta por build.nvidia.com y regístrate. No cuesta nada, se resuelve en cinco minutos, y CC Switch completa el resto de la configuración con cuatro clics.
La trilogía GLM-5.2 gratis, en resumen: Meituan en la capa de producto, Alibaba en la capa de producto, NVIDIA en la capa de infraestructura. Cada una más profunda que la anterior. Qué capa te interesa, lo eliges tú.
Los pasos y capturas de este artículo están verificados por el autor a julio de 2026. Las cuotas, los límites de velocidad y la duración de la promoción del free tier pueden cambiar en cualquier momento; consulta siempre la página oficial de build.nvidia.com. Las opiniones son del autor.