¿Hay una API de GLM gratuita? 3 canales reales comparados (2026)

¿Hay una API de GLM gratuita? 3 canales reales comparados (2026)

Sí, existe una forma genuinamente gratuita de llamar a un modelo GLM a través de una API, pero lo “gratuito” se divide en tres ofertas diferentes según el canal que uses y a qué versión de GLM te refieras. La API propia de z.ai ofrece acceso gratuito permanente a dos modelos GLM más pequeños sin límite de tasa de expiración. OpenRouter ofrece acceso gratuito, con límite de tasa, específicamente a GLM-5.2. Y GLM-4.5-Air, la versión que la mayoría busca por nombre, no es gratuita en ningún lugar — es un modelo pago de bajo costo, y cualquier página que diga lo contrario está desactualizada.

Canal Forma gratuita Modelos cubiertos
API oficial de z.ai Nivel gratuito permanente, sin expiración GLM-4.7-Flash, GLM-4.5-Flash
OpenRouter etiqueta :free Nivel gratuito con límite de tasa (20 req/min, 50-1000 req/día) Solo GLM-5.2
chat.z.ai (chat del navegador, no API) Chat web gratuito, sin clave API GLM-5.2 (interfaz de chat, sin acceso programático)

Los tres canales gratuitos en detalle

API propia de z.ai: Dos modelos son realmente gratuitos

La página de precios oficial de z.ai lista GLM-4.7-Flash, GLM-4.6V-Flash y GLM-4.5-Flash a $0 para entrada, entrada en caché y salida — no es un descuento, no es una prueba, es simplemente gratuito. Cada otro modelo en la línea de z.ai, incluyendo GLM-4.5, GLM-4.5-Air, GLM-5.2 y GLM-5.3, tiene un precio estándar por token. (Verificado el 2026-08-25 a través de docs.z.ai/guides/overview/pricing.)

Este es el trato “gratuito” más limpio de esta lista porque no tiene límite de tasa por número de solicitudes y no requiere tarjeta de crédito. La desventaja es la elección del modelo: los modelos de nivel Flash intercambian algo de capacidad por costo, por lo que si tu carga de trabajo necesita específicamente la calidad de razonamiento de GLM-4.5-Air o el manejo de contexto largo de GLM-5.2, los modelos Flash gratuitos no son un sustituto — son un nivel diferente de modelo.

OpenRouter: Gratuito, pero solo para GLM-5.2 y con límite de tasa

OpenRouter ejecuta GLM-5.2 bajo un sufijo :free (z-ai/glm-5.2:free) a $0 por token tanto para entrada como para salida. Según la documentación de límites de tasa de OpenRouter, cualquier modelo que termine en :free está limitado a 20 solicitudes por minuto; el límite diario depende de cuánto hayas gastado en la plataforma de por vida — menos de $10 en créditos de por vida te da 50 solicitudes por día, y una recarga única de $10 (que nunca expira) lo eleva a 1,000 solicitudes por día. (Verificado el 2026-08-25 a través de openrouter.ai/docs/api-reference/limits y confirmado contra la lista de modelos en vivo en openrouter.ai/api/v1/models.)

GLM-4.5-Air no tiene un nivel gratuito en OpenRouter a partir de esta verificación — está listado allí como un modelo pago estándar. Si has visto una guía que hace referencia a glm-4.5-air:free, esa variante existió en algún momento pero no está en el catálogo actual de modelos de OpenRouter; trata cualquier tutorial que aún la mencione como obsoleto. GLM-5.2 es el modelo GLM que actualmente lleva la etiqueta :free en esta plataforma.

chat.z.ai: Gratuito, pero es una interfaz de chat, no una API

Z.ai también ofrece un chatbot gratuito en el navegador en chat.z.ai, que actualmente sirve GLM-5.2, sin necesidad de iniciar sesión ni clave API para comenzar a chatear. (Verificado el 2026-08-25: la etiqueta de título y la meta descripción de la página dicen “powered by GLM-5.2”.) Esto vale la pena saberlo si lo que realmente quieres es probar la calidad de salida de un modelo GLM antes de escribir código, pero no es acceso programático. No hay clave API, no hay formato de solicitud, no hay forma de llamarlo desde tu propia aplicación. Si tu objetivo es una integración de API, este canal no aplica; usa uno de los dos anteriores en su lugar.

Por qué GLM-4.5-Air no está en esta lista como “gratuito”

Si buscaste una API de GLM gratuita y llegaste aquí preguntándote específicamente sobre GLM-4.5-Air, la respuesta directa es: no es gratuita, ni en z.ai, ni en OpenRouter, ni en Novita AI. Precios actuales verificados:

Proveedor Entrada de GLM-4.5-Air (por 1M tokens) Salida de GLM-4.5-Air (por 1M tokens)
z.ai (oficial) $0.20 $1.10
Novita AI $0.13 $0.85

(Verificado el 2026-08-25 a través de docs.z.ai/guides/overview/pricing y api.novita.ai/openai/v1/models.)

GLM-4.5-Air es un modelo real con un costo real en cada plataforma que lo sirve — la “Air” en el nombre se refiere a una variante más pequeña y económica de GLM-4.5, no a una gratuita. Su posición real es: barato en comparación con los modelos estrella como GLM-5.2 o GLM-5.3, pero no de costo cero. Si necesitas específicamente GLM-4.5-Air, los canales gratuitos anteriores no te llevarán allí; estás eligiendo un proveedor basado en precio y confiabilidad, no buscando un nivel gratuito que no existe.

Novita AI aloja el mismo modelo GLM-4.5-Air a una tarifa por token más baja que la API propia de z.ai, con un endpoint compatible con OpenAI (sin trabajo adicional de SDK o integración específica del modelo si ya estás llamando a otros modelos a través del mismo cliente). Esto es adecuado para equipos que quieren GLM-4.5-Air en producción sin que un nivel gratuito con límite de tasa se interponga, no una afirmación de que sea gratuito.

Por separado, Novita AI ha tenido su propia oferta de GLM de costo cero antes — pero eso era GLM-4-9B-0414 y GLM-Z1-9B-0414, dos modelos más pequeños de 9B parámetros de una generación anterior de GLM, no la serie GLM-4.5+ que la gente busca hoy. Si encuentras esa página anterior de modelos gratuitos, ten en cuenta que es un par diferente de modelos con diferentes especificaciones, no un nivel gratuito para GLM-4.5-Air.

¿Cuál deberías usar realmente?

Si necesitas específicamente GLM-4.7-Flash o GLM-4.5-Flash y esos modelos se adaptan a tu tarea, la API propia de z.ai es la opción gratuita más simple — sin límite máximo de tasa, sin tarjeta de crédito. Si necesitas GLM-5.2 y puedes vivir con 50 solicitudes al día (o quieres gastar $10 una vez para obtener 1,000/día), el nivel gratuito de OpenRouter funciona y te da una única API que también cubre otros proveedores si quieres comparar modelos más tarde. Si necesitas GLM-4.5-Air, GLM-4.5, GLM-4.6 o cualquiera de los modelos estrella GLM-5.x, no hay ningún canal gratuito para esos — compara los precios por token entre proveedores en su lugar, ya que esa es la palanca real que controlas.

Preguntas frecuentes

¿Es GLM-4.5-Air gratuito en Novita AI?

No. Está a $0.13 por 1M de tokens de entrada y $0.85 por 1M de tokens de salida en Novita AI a partir de esta verificación, y $0.20/$1.10 en la API propia de z.ai. Ningún proveedor ofrece actualmente GLM-4.5-Air de forma gratuita; si has leído lo contrario, verifica la fecha de publicación de esa fuente, ya que los precios de GLM han cambiado entre versiones.

¿Es GLM-5.2 gratuito?

Es gratuito en OpenRouter bajo la etiqueta :free, sujeto a los límites de 20 solicitudes/minuto y 50 o 1,000 solicitudes/día descritos anteriormente. En la API propia de z.ai y en Novita AI, GLM-5.2 tiene un precio normal — el acceso gratuito es específico del programa de nivel gratuito de OpenRouter, no una publicación gratuita universal del modelo.

¿Cuál es la diferencia real entre los modelos Flash gratuitos de z.ai y el GLM-5.2 gratuito de OpenRouter?

Los modelos gratuitos de z.ai (GLM-4.7-Flash, GLM-4.5-Flash) no tienen límite de recuento de solicitudes y no expiran, pero son el nivel más pequeño y rápido en lugar del modelo estrella. El GLM-5.2 gratuito de OpenRouter te da el modelo más grande y capaz, pero te limita a un recuento diario de solicitudes. Elige según si tu limitación es la capacidad del modelo o el volumen de solicitudes.

¿Puedo obtener acceso a GLM-4.5-Air sin pagar por token?

Actualmente no, en ningún proveedor verificado aquí. Tus opciones son los precios oficiales de z.ai, la tarifa por token más baja de Novita AI para el mismo modelo, o descargar los pesos abiertos de GLM-4.5-Air y autoalojarlo en tu propia GPU, lo que elimina el costo por token pero lo reemplaza con un costo de infraestructura.

Artículos recomendados