Comparativa de APIs LLM gratuitas 2026: Límites reales, créditos y modelos a $0

Comparativa de APIs LLM gratuitas 2026: Límites reales, créditos y modelos a $0

La mayoría de los niveles “gratuitos” de API LLM no son acceso ilimitado; son un modelo con límite de tasa, una cuota diaria de solicitudes o un crédito por referido. Esta comparativa cubre seis proveedores, cada uno con un mecanismo de nivel gratuito verificado y una cantidad específica asociada, para que puedas ver exactamente qué compra “gratis” antes de construir sobre ello.

Comparativa rápida de APIs LLM gratuitas

Proveedor Tipo de nivel gratuito Límite concreto Cobertura de modelos
Novita AI Crédito por referido (ambas partes) $10 en crédito para cada uno, el referente y la nueva cuenta referida, por referido exitoso, hasta $500 en total Catálogo completo de API LLM serverless
OpenRouter Variantes de modelo gratuito con límite de tasa 20 solicitudes/minuto; 50 solicitudes/día sin créditos comprados, 1000 solicitudes/día con $10+ en créditos de por vida 17 de 414 modelos del catálogo tienen una variante :free
API de Google Gemini Tokens emblemáticos gratuitos; grounding requiere facturación $0 por token de entrada/salida/caché de contexto en Gemini 3.7 Flash sin facturación activada; Grounding con Búsqueda de Google no está disponible hasta que se active la facturación, luego limitado a 5000 solicitudes/mes Familia de modelos Gemini 3.x
Groq Nivel gratuito con límite de tasa, por modelo 30 solicitudes/minuto, 1000 solicitudes/día, 200 000 tokens/día en openai/gpt-oss-120b 13 modelos alojados en niveles de producción y vista previa
Cloudflare Workers AI Asignación diaria de cómputo 10 000 Neuronas/día sin costo en planes Workers Gratuito y de Pago 84 modelos alojados hasta el 2026-08-18 (el catálogo se actualiza continuamente)
Hugging Face Inference Providers Crédito mensual $0.10/mes para cuentas de nivel Gratuito Cientos de modelos en 18 proveedores de inferencia asociados

Conclusiones clave

  • Ningún proveedor en esta lista ofrece acceso ilimitado gratuito a API LLM. Cada nivel gratuito está limitado por una tasa de solicitud, un tope diario o un crédito en dólares.
  • Los niveles gratuitos basados en crédito (Novita AI, Hugging Face) no limitan las solicitudes por minuto; los niveles gratuitos con límite de tasa (OpenRouter, Groq) sí lo hacen, y el tope es específico del modelo.
  • Las variantes :free de OpenRouter existen para una minoría de su catálogo (17 de 414 modelos en el momento de esta verificación), no para todo el mercado.
  • El nivel gratuito de Google es específico del modelo y la función: el precio de los tokens en el modelo Flash emblemático actual es $0 sin facturación activada, pero el grounding de Búsqueda no forma parte de ese nivel sin facturación en absoluto; solo está disponible cuando activas la facturación, con su propio tope mensual independiente.
  • Los números de los niveles gratuitos cambian sin previo aviso. Cada cifra a continuación tiene una fuente y una fecha de verificación; vuelve a verificarla antes de construir una dependencia de producción en cualquiera de ellas.

Cómo comparamos estas APIs LLM gratuitas

La mayoría de las recopilaciones existentes de “API LLM gratuita” omiten cifras concretas, ignoran a Novita AI por completo o se quedan obsoletas entre actualizaciones. Esta comparativa utiliza tres comprobaciones para cada fila:

  1. Un mecanismo de nivel gratuito declarado. El acceso gratuito de cada proveedor se encuadra en una de tres formas: un crédito único de registro o referido, un modelo gratuito con límite de tasa, o una asignación diaria de cómputo/solicitudes.
  2. Un límite numérico verificado. Cada solicitud por minuto, solicitud por día, cantidad en dólares o tope de tokens se extrae de la documentación actual de precios o límites de tasa del propio proveedor, no de una publicación de blog de segunda mano.
  3. Estado actual en el momento de la verificación. Los términos de los niveles gratuitos cambian a menudo (el umbral de OpenRouter para límites diarios más altos, los precios gratuitos por modelo de Google y la asignación de Neuronas de Cloudflare han cambiado en ciclos anteriores), por lo que cada número a continuación tiene fecha.

Los proveedores se enumeran por el tamaño aproximado de su asignación gratuita diaria cuando se publica una, y los niveles basados en crédito (que no están limitados por el número de solicitudes) se colocan según su límite en dólares.

APIs LLM gratuitas comparadas en detalle

Cloudflare Workers AI: la mayor asignación diaria bruta

Workers AI de Cloudflare otorga a cada cuenta, incluido el plan gratuito Workers, una asignación diaria fija de Neuronas en lugar de un límite de solicitudes por modelo. En el momento de esta verificación, esa asignación era de 10 000 Neuronas por día sin costo, y el uso por encima de eso se facturaba a $0.011 por cada 1000 Neuronas en el plan de Pago. El costo de las Neuronas varía según el modelo, por lo que 10 000 Neuronas se traducen en un número diferente de solicitudes reales dependiendo del modelo al que llames.

Mejor para: equipos que ya trabajan con Cloudflare Workers y desean tener la inferencia integrada en la misma plataforma. Ten en cuenta: la asignación gratuita es en Neuronas, no en solicitudes, por lo que un modelo grande o de contexto largo consume la asignación más rápido que uno pequeño.

OpenRouter: el catálogo más amplio, la porción gratuita más estrecha

OpenRouter enruta a cientos de modelos de muchos proveedores, pero solo un subconjunto lleva el sufijo :free. En el momento de esta verificación, 17 de los 414 modelos del catálogo tenían una variante gratuita. Las variantes gratuitas están limitadas a 20 solicitudes por minuto; el límite diario depende de las compras de crédito de por vida de tu cuenta: 50 solicitudes por día si has comprado menos de $10 en créditos en total, aumentando a 1000 solicitudes por día una vez que hayas comprado al menos $10.

Para un ejemplo específico de una familia de modelos, consulta las opciones actuales de API GLM gratuita y los límites asociados a cada ruta.

Mejor para: probar un modelo de pesos abiertos específico que tenga una variante :free, sin comprometerse con un proveedor. Ten en cuenta: la porción gratuita es una pequeña fracción del catálogo, y el límite diario útil requiere una compra única de crédito de $10, no solo un registro.

Groq: la inferencia más rápida, el catálogo más pequeño

El nivel gratuito de Groq tiene un límite de tasa por modelo, no por cuenta. Para openai/gpt-oss-120b, los límites publicados son 30 solicitudes por minuto, 1000 solicitudes por día, 8000 tokens por minuto y 200 000 tokens por día. Otros modelos alojados en el nivel gratuito de Groq tienen sus propios límites separados.

Mejor para: prototipado de baja latencia donde la velocidad de inferencia de Groq importa más que la amplitud del modelo. Ten en cuenta: los límites se establecen por modelo, por lo que cambiar de modelo a mitad de proyecto puede implicar releer la tabla de límites.

API de Google Gemini: tokens emblemáticos gratuitos, límite de grounding reducido

Si aún no has configurado una, consulta cómo obtener una clave de API de Gemini en Google AI Studio antes de verificar los límites a continuación. El nivel gratuito de Gemini tiene un precio por modelo y por función, no como una asignación fija única. En el modelo emblemático actual Gemini 3.7 Flash, el precio de entrada, el precio de salida y el precio de caché de contexto se enumeran como gratuitos siempre que la facturación no esté activada en la cuenta. El grounding con Búsqueda de Google, una función adicional separada, no está disponible en absoluto con la facturación desactivada; solo se vuelve utilizable cuando activas la facturación, momento en el cual el nivel de pago incluye 5000 solicitudes de grounding gratuitas por mes compartidas en toda la familia de modelos Gemini 3.x, y luego se factura a $14 por cada 1000 solicitudes.

Mejor para: equipos que desean un costo de token $0 en un modelo emblemático actual y no necesitan grounding de Búsqueda sin activar la facturación. Ten en cuenta: el precio gratuito a nivel de token y el grounding de Búsqueda no son el mismo nivel: el grounding requiere que la facturación esté activada antes de que exista cualquier asignación de solicitudes, por lo que no puedes obtener respuestas fundamentadas en una cuenta pura sin facturación.

Hugging Face Inference Providers: el crédito más pequeño, la menor fricción

Cada cuenta de Hugging Face recibe un crédito mensual para Inference Providers, un mercado que enruta a backends de inferencia de terceros para modelos abiertos. Las cuentas de nivel Gratuito obtienen $0.10 por mes; las cuentas PRO obtienen $2.00 por mes, y las cuentas de Equipo o Empresa obtienen $2.00 por asiento.

Mejor para: llamadas únicas rápidas a un modelo abierto ya alojado a través del mercado de proveedores de Hugging Face. Ten en cuenta: $0.10 por mes cubren un pequeño número de llamadas en la mayoría de los modelos; se restablece mensualmente pero no se acumula ni se transfiere.

Novita AI: sin modelo gratuito con límite de tasa, pero un crédito por referido real

El catálogo de API LLM serverless de Novita AI tiene un precio por modelo, y ningún modelo actual en ese catálogo se ofrece a $0 por token. El mecanismo de nivel gratuito proviene en su lugar del programa de referidos de Novita: un referido exitoso otorga tanto al referente como a la nueva cuenta referida $10 en créditos de API LLM, hasta $500 en créditos totales para un solo referente. Ese crédito se aplica a todo el catálogo de modelos serverless de Novita, no a un solo modelo de nivel gratuito, por lo que no está limitado por solicitudes por minuto o por día como lo están los niveles gratuitos de OpenRouter o Groq.

Mejor para: desarrolladores que desean uso gratuito contra precios y disponibilidad de modelos de grado de producción, en lugar de un modelo de nivel gratuito separado y más limitado. Ten en cuenta: el crédito está vinculado a referidos, no es una concesión automática en cada nuevo registro, y es un límite de gasto en lugar de un modelo gratuito ilimitado; una vez gastado, se aplican los precios estándar por token. Siempre consulta la página de precios actual de Novita para conocer las tarifas en vivo antes de estimar hasta dónde llegará un crédito determinado.

Cómo elegir la API LLM gratuita adecuada

Empareja el mecanismo del nivel gratuito con lo que realmente estás haciendo:

  • Ejecutar muchas llamadas de prueba pequeñas contra un modelo abierto: un nivel gratuito con límite de tasa (variantes :free de OpenRouter o Groq) te proporciona un volumen real de solicitudes sin gastar nada, siempre que el modelo específico que necesites tenga una variante gratuita.
  • Prototipar contra un modelo de producción con el que podrías lanzar: un crédito por referido (Novita AI) te permite gastar en el mismo catálogo y precios que usarías en producción, en lugar de cambiar de modelo cuando salgas de un nivel gratuito.
  • Probar múltiples proveedores o modelos rápidamente: el crédito de Hugging Face Inference Providers es pequeño pero requiere la menor configuración si ya tienes una cuenta.
  • Necesitas respuestas fundamentadas en búsqueda, no solo llamadas a modelos en bruto: verifica específicamente el límite de grounding de Google. No está incluido en el nivel gratuito sin facturación en absoluto: debes activar la facturación antes de que cualquier solicitud de grounding cuente para un tope mensual (del nivel de pago).

Cualquiera que sea el nivel que elijas, lee la página de precios o límites de tasa actual del propio proveedor antes de construir; cada número anterior tiene una fecha de verificación, y los términos de los niveles gratuitos se encuentran entre las páginas que se revisan con más frecuencia en cualquier plataforma de inferencia.

Para quién no es esta comparativa

Ninguno de los niveles anteriores está diseñado para soportar tráfico de producción. Si tu aplicación ya necesita más de unos pocos miles de solicitudes por día de manera consistente, un SLA de soporte, o acceso a modelos frontera cerrados como GPT-5 o Claude, ninguno de los seis proveedores ofrece eso en un plan gratuito; estás buscando uso de pago independientemente de cuál elijas. Esta comparativa tampoco sustituye la lectura de los términos actuales del propio proveedor antes de lanzar: te dice cómo era cada nivel gratuito en la fecha de verificación, no cómo será cuando realmente necesites la capacidad.

Uso de créditos gratuitos en Novita AI

Para usar el crédito por referido de Novita AI:

  1. Crea una cuenta de Novita AI a través del enlace de referido de un amigo, o invita a un amigo usando tu propio enlace, para que ambas partes reciban el crédito de referido de $10.
  2. Genera una clave de API desde la consola de Novita AI.
  3. Llama a cualquier modelo del catálogo de API LLM serverless a través del punto final compatible con OpenAI en https://api.novita.ai/openai/v1/chat/completions, usando tu clave de API y un ID de modelo del catálogo actual.
  4. Comparte tu enlace de referido desde la página de referidos de Novita AI para agregar $10 en crédito por referido exitoso, hasta $500 en total.
curl https://api.novita.ai/openai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer <NOVITA_API_KEY>" \
  -d '{
    "model": "<MODEL_ID>",
    "messages": [{"role": "user", "content": "Hello"}],
    "max_tokens": 512
  }'

Consulta el catálogo de modelos de Novita AI para obtener los ID de modelo actuales y los precios por modelo antes de gastar crédito en un modelo específico.

Notas sobre precios, licencia y disponibilidad

Los términos de los niveles gratuitos en esta comparativa se verificaron el 2026-08-18 directamente en la documentación de precios o límites de tasa de cada proveedor. Los créditos de registro, los límites de referidos, los límites de tasa y las asignaciones diarias son el tipo de detalle que los proveedores cambian con actualizaciones normales de productos, no siempre con una entrada en el registro de cambios. Vuelve a verificar la página de origen de cualquier proveedor antes de confiar en un número específico para la planificación de producción, y trata cada cifra anterior como una instantánea, no como una garantía permanente.

Lista de verificación para desarrolladores

  • [ ] Confirma qué forma de nivel gratuito aplica (crédito de registro, crédito por referido, modelo gratuito con límite de tasa o asignación diaria de cómputo).
  • [ ] Confirma que el modelo que realmente necesitas está cubierto por ese nivel gratuito, no solo el proveedor en general.
  • [ ] Confirma el límite numérico específico (solicitudes/minuto, solicitudes/día, tokens/día o crédito en dólares) en la documentación actual del proveedor, no en este artículo, antes de lanzar cualquier cosa que dependa de él.
  • [ ] Confirma si el nivel gratuito requiere un umbral de crédito comprado antes de que se apliquen límites más altos (como hace OpenRouter).
  • [ ] Planifica qué sucede cuando se agota el nivel gratuito: ¿el precio simplemente se activa o la solicitud es rechazada?

Preguntas frecuentes

¿Existe una API LLM gratuita verdaderamente ilimitada?

No. Todos los proveedores comparados aquí limitan el uso gratuito mediante un límite de tasa, un tope diario o un crédito en dólares. Los proveedores comercializados como “gratuitos” describen un nivel limitado, no un acceso ilimitado.

¿Qué API LLM gratuita tiene el límite más alto de solicitudes por día?

Entre los niveles gratuitos con límite de tasa verificados aquí, OpenRouter y Groq publican un tope de 1000 solicitudes/día en sus respectivos modelos de nivel gratuito, una vez que se cumple el umbral de crédito de por vida de $10 de OpenRouter. La asignación de 10 000 Neuronas/día de Cloudflare Workers AI es un presupuesto de cómputo en lugar de un número fijo de solicitudes, por lo que no se traduce en un número de solicitudes comparable único.

¿Ofrece Novita AI un modelo LLM gratuito?

El catálogo actual de API LLM serverless de Novita AI no incluye un modelo con precio de $0 por token. Su mecanismo de nivel gratuito es un programa de referidos que otorga $10 en crédito tanto al referente como a la nueva cuenta referida por referido exitoso, hasta $500 en total, que se puede gastar en todo el catálogo serverless.

¿Los límites del nivel gratuito se aplican por clave de API o por cuenta?

Esto varía según el proveedor y está documentado en la página de límites de tasa de cada proveedor; Groq, por ejemplo, indica que sus límites se aplican a nivel de organización, no por clave de API individual. Consulta la documentación específica del proveedor para conocer la distinción entre cuenta y clave antes de asumir el comportamiento de agrupación de solicitudes.

Artículos recomendados