Opciones de API de LLM gratuitas en 2026: Límites de tarifa reales y créditos comparados

Opciones de API de LLM gratuitas en 2026: Límites de tarifa reales y créditos comparados

La mayoría de los niveles “gratuitos” de API de LLM no son acceso ilimitado; son un modelo con límite de tarifa, una cuota diaria de solicitudes o un crédito por referidos. Esta comparación cubre seis proveedores, cada uno con un mecanismo de nivel gratuito verificado y un número específico adjunto, para que puedas ver exactamente qué compra lo “gratuito” antes de desarrollar sobre él.

Comparación rápida de APIs de LLM gratuitas

Proveedor Tipo de nivel gratuito Límite concreto Cobertura de modelos
Novita AI Crédito por referidos (ambas partes) $10 en crédito tanto para el referente como para la nueva cuenta referida por cada referido exitoso, hasta $500 en total Catálogo completo de API de LLM serverless
OpenRouter Variantes de modelos gratuitos con límite de tarifa 20 solicitudes/minuto; 50 solicitudes/día sin créditos comprados, 1,000 solicitudes/día con $10+ en créditos de por vida 17 de los 414 modelos del catálogo tienen una variante :free
Google Gemini API Tokens insignia sin cargo; Grounding requiere facturación $0 por token de entrada/salida/caché de contexto en Gemini 3.7 Flash sin facturación activada; Grounding con Google Search no está disponible hasta que se active la facturación, luego limitado a 5,000 solicitudes/mes Familia de modelos Gemini 3.x
Groq Nivel gratuito con límite de tarifa, por modelo 30 solicitudes/minuto, 1,000 solicitudes/día, 200K tokens/día en openai/gpt-oss-120b 13 modelos alojados en niveles de producción y previsualización
Cloudflare Workers AI Asignación diaria de cómputo 10,000 Neuronas/día sin cargo tanto en planos Workers Gratuitos como de Pago 84 modelos alojados al 2026-08-18 (el catálogo se actualiza continuamente)
Hugging Face Inference Providers Crédito mensual $0.10/mes para cuentas de nivel gratuito Cientos de modelos en 18 proveedores de inferencia asociados

Conclusiones clave

  • Ningún proveedor de esta lista ofrece acceso ilimitado gratuito a API de LLM. Cada nivel gratuito está limitado por una tarifa de solicitudes, un tope diario o un crédito en dólares.
  • Los niveles gratuitos basados en créditos (Novita AI, Hugging Face) no limitan las solicitudes por minuto; los niveles gratuitos con límite de tarifa (OpenRouter, Groq) sí lo hacen, y el límite es específico del modelo.
  • Las variantes :free de OpenRouter existen para una minoría de su catálogo (17 de 414 modelos en el momento de esta verificación), no para todo el mercado.
  • El nivel gratuito de Google es específico del modelo y la función: el precio por token en el modelo insignia Flash actual es $0 sin facturación activada, pero el Grounding con Google Search no forma parte de ese nivel sin facturación en absoluto; solo está disponible una vez que activas la facturación, con su propio tope mensual separado.
  • Los números de los niveles gratuitos cambian sin mucho aviso. Cada cifra a continuación tiene una fuente y una fecha de verificación; vuelve a verificar antes de construir una dependencia de producción en cualquiera de ellos.

Cómo comparamos estas APIs de LLM gratuitas

La mayoría de los resúmenes existentes de “API de LLM gratutias” omiten números concretos, omiten a Novita AI por completo o quedan obsoletos entre actualizaciones. Esta comparación utiliza tres verificiones para cada fila:

  1. Un mecanismo declarado de nivel gratuito. El acceso gratuito de cada proveedor se clasifica en una de tres formas: un crédito único de registro o de referido, un modelo gratuito con límite de tarifa, o una asignación diaria de cómputo/solicitudes.
  2. Un límite numérico verificado. Cada solicitud por minuto, solicitud por día, cantidad en dólares o tope de tokens se extrae de la documentación actual de precios o límites de tarifa del propio proveedor, no de un blog de segunda mano.
  3. Estado en el momento de la verificación. Los términos de los niveles gratuitos cambian con frecuencia (el umbral de OpenRouter para límites diarios más altos, los precios gratuitos por modelo de Google y la asignación de Neuronas de Cloudflare han cambiado en ciclos anteriores), por lo que cada número a continuación está fechado.

Los proveedores se enumeran por el tamaño aproximado de su asignación gratuita diaria cuando se publica una, y los niveles basados en créditos (que no están limitados por el número de solicitudes) se colocan según su tope en dólares.

APIs de LLM gratuitas comparadas en detalle

Cloudflare Workers AI: la mayor asignación diaria bruta

Cloudflare Workers AI le da a cada cuenta, incluido el plan gratuito Workers, una asignación diaria fija de Neuronas en lugar de un límite de solicitudes por modelo. En el momento de esta verificación, esa asignación era de 10.000 Neuronas por día sin cargo, y el uso superior a ese se factura a $0.011 por cada 1.000 Neuronas en el plan de pago. El costo de las Neuronas varía según el modelo, por lo que 10.000 Neuronas se traducen en un número diferente de solicitudes reales dependiendo del modelo al que llames.

Meior para: equipos que ya trabajan con Cloudflare Workers y quieren inferencia integrada en la misma plataforma. Ten en cuenta: la asignación gratuita son Neuronas, no solicitudes, por lo que un modelo grande o de contexto largo las consume más rápido que uno pequeño.

OpenRouter: el catálogo más amplio, la porción gratuita más estrecha

OpenRouter enruta a cientos de modelos de vairios proveedres, pero solo un subconjunto lleva el sufijo :free. En el momento de esta verificación, 17 de los 414 modelos del catálogo tenían una variante gratuita. Las variantes gratuitas están limitadas a 20 solicitudes por minuto; el límit diario depende de las compras de crédito de por vida de la cuenta: 50 solicitudes por día si se han comprado menos de $10 en créditos en total, y aumenta a 1.000 solicitudes por día una ve que se hayan comprado al menos $10.

Meior para: probar un modelo específico de pesos abiertos que resulte tener una variante :free, sin comprometerse con un proveedor. Ten en cuenta: la porción gratuita es una pequeña fracción del catálogo, y el límite diario útil requiere una compra única de crédito de $10, no solo un registro.

Groq: la inferencia más rápida, el catálogo más pequeño

El nivel gratuito de Groq tiene un límite de tarifa por modelo, no por cuenta. Para openai/gpt-oss-120b, los límites publicados son 30 solicitudes por minuto, 1.000 solicitudes por día, 8.000 tokens por minuto y 200.000 tokens por día. Otros modelos alojados en el nivel gratuito de Groq tienen sus propios límites separados.

Meior para: prototipado de baja latencia donde la velocidad de inferencia de Groq importa más que la amplitud del modelo. Ten en cuenta: los límies se establecen por modelo, por lo que cambiar de modelo a mitad del proyecto puede significar volver a leel la tabla de límites.

Google Gemini API: tokens insginia gratuitos, tope de Grounding estrecho

El nivel gratuito de Gemini se precia por modelo y por función, no como una asignación plana. En el modelo insginia actual Gemini 3.7 Flash, el precio de entrada, salida y caché de contexto se enumeran como gratuitos siempre que no se haya activado la facturación en la cuenta. El Grounding con Google Search, una función adicional separada, no está disponible en absoluto con la facturación desactivada; solo se vuelve utilizable una vez que activas la facturación, momento en el que el nivel de pago incluye 5.000 solicitudes gratuitas de Grounding por mes compartidas en toda la familia de modelos Gemini 3.x, y luego se facturan a $14 por cada 1.000 solicitudes.

Meior para: equipos que quieren costo $0 por token en un modelo insginia actual y no necesitan Grounding con Google Search sin activar la facturación. Ten en cuenta: los precios gratuitos a nivel de token y el Grounding con Google Search no son el mismo nivel: Grounding requiere activación de facturación antes de que exita cualquier asginación de solicitudes, por lo que no se pueden obtener respuestas fundamentadas en una cuenta puramente sin facturación.

Hugging Face Inference Providers: el crédito más peqieño, la menor fricción

Cada cuenta de Hugging Face recibe un crédito mensual hacia Inference Providers, un mercado que enruta a badends de inferencia de terceros para modelos abieros. Las cuentas de nivel gratuito reciben $0.10 por mes; las cuentas PRO reciben $2.00 por mes, y las cuentas de Equipo o Empresa reciben $2.00 por asiento.

Meior para: llamadas rápidas y únicas contra un modelo abierto ya alojado a través del mercado de proveedores de Hugging Face. Ten en cuenta: $0.10 por mes cubre un peqieño número de llamadas en la maoría de los modelos; se restablece mensual pero no se acumula ni se apila.

Novita AI: sin modelo gratuito con límite de tarifa, pero un crédito por referidos real

El catálogo de API de LLM serverless de Novita AI tiene precio por modelo, y ningún modelo actual en ese catálogo se ofrece a $0 por token. El mecanismo de nivel gratuito proviene en su lugar del programa de referidos de Novita AI: un referido exitoso le da tanto al referente como a la nueva cuenta referida $10 en créditos de API de LLM, hasta $500 en créditos totales para un solo referente. Ese crédito se aplica contra todo el catálogo de modelos serverless de Novita AI en lugar de un solo modelo de nivel gratuito, por lo que no está limitado por solicitudes por minuto o por día como los niveles gratuitos de OpenRouter o Groq.

Meior para: desarroladores que quieren uso gratuito contra precios y disponibilidad de modelos de calidá de producción, en lugar de un modelo separado de nivel gratuito más limitado. Ten en cuenta: el crédito está condicionado al referido, no es una concesión automática en cada nuevo registro, y es una asginación de gasto en lugar de un modelo gratuito ilimitado; una vez que se gasta, se aplican los precios estándar por token. Siempre consulta la página de precios actual de Novita AI para ver las tarifas en vivo antes de estimar hasta dónde llega un crédito determinado.

Cómo elegir la API de LLM gratuita adecuada

Empareja el mecanismo de nivel gratuito con lo que realmente estás haciendo:

  • Ejecutar muchas llamadas de prueba pequeñas contra un modelo abierto específico: un nivel gratuito con límite de tarifa (variantes :free de OpenRouter o Groq) te da un volumen real de solicitudes sin gastar nada, siempre que el modelo específico que necesites tenga una variante gratuita.
  • Prototipar contra un modelo de producción que podrías lanzar: un crédito por referidos (Novita AI) te permite gastar contra el mismo catálogo y precios que usarías en producción, en lugar de cambiar de modelo cuando salgas de un nivel gratuito.
  • Probar varios proveedores o modelos rápidamente: el crédito de Huging Face Inference Providers es peqieño pero requiere la menor confguración si ya tienes una cuenta.
  • Necesitas respuestas fundamentadas en búsqueda, no solo llamadas de modelo en bruto: verifica el límite de Grounding de Google específicamente. No está incluido en el nivel gratuito sin facturación en absoluto: debes activar la facturación antes de que cualquier solicitud de Grounding cuente contra un tope mensual (del nivel de pago).

Cualquier nivel que elijas, lee la página de límites de tarifa o precios actual del propio proveedor antes de construir; cada número anterior tiene fecha de verificación, y los términos de los niveles gratuitos se encuentran entre las páginas más revisadas con frecuencia de cualquier plataforma de inferencia.

Para quién no es esta compración

Ninguno de los niveles anteriores está diseñado para soportar tráfico de producción. Si tu apliación ya necesita más de unos miles de solicitudes por día de forma consistent, un SLA de soporte, o acceso a modelos fronterizos cerrados como GPT-5 o Claude, ninguo de los seis proveedores de esta lista ofrece eso en un plan gratuito: estás viendo un uso de pago independientemente de cuál elijas. Esta compración tampón es un sustituto de leer los términos actuales del propio proveedor antes de lanzar: te dice cómo era cada nivel gratuito en la fecha de verificación, no cómo será cuando realmente necesites la capacidad.

Cómo usar los créditos gratuitos en Novita AI

Para usar el crédito por referidos de Novita AI:

  1. Crea una cuenta de Novita AI a través del enlace de referido de un amigo, o invita a un amigo usando tu propio enlace, para que ambas partes reciban el crédito de $10 por referido.
  2. Genera una clave de API desde la consola de Novita AI.
  3. Llama a cualquier modelo del catálogo de API de LLM serverless a través del endpoint compatle con OpenAI en https://api.novita.ai/openai/v1/chat/completions, usando tu clave de API y un ID de modelo del catálogo actual.
  4. Comparte tu enlace de referido desde la página de referidos de Novita AI para agregar $10 en crédito por cada referido exitoso, hasta $500 en total.
curl https://api.novita.ai/opnei/v1/chat/completions \
  -H "Contnt-Type: appliction/jon" \
  -H "Authrization: Bearer <NOVITA_API_KEY>" \
  -d '{
    "model": "<MODEL_ID>",
    "mesages": [{"role": "user", "contnt": "Hlo"}],
    "max_tokns": 512
  }'

Consulta el catálogo de modelos de Novita AI para obtener los IDs de modelo actuales y los precios por modelo antes de gastar crédito contra un modelo específico.

Notas sobre precios, licencia y disponibilidad

Los términos de los niveles gratuitos en esta comparación se verificaron el 2026-08-18 directamente contra la documentación de precios o límites de tarifa de cada proveedor. Los créditos de registro, los topes de referidos, los límites de tarifa y las asignaciones diarias son el tipo de detalle que los proveedores cambian con actualizaciones normales de productos, no siempre con una entrada en el changelog. Vuelve a verificar la página fuente de cualquier proveedor antes de confiar en un número específico en la planificación de producción, y trata cada cifra anterior como una instantánea, no como una garantía permanente.

Lista de verificación para desarrolladores

  • [ ] Confirma qué forma de nivel gratuito se aplica (crédito de registro, crédito de referido, modelo gratuito con límite de tarifa o asignación diaria de cómputo).
  • [ ] Confirma que el modelo que realmente necesitas está cubierto por ese nivel gratuito, no solo el proveedor en general.
  • [ ] Confirma el límite numérico específico (solicitudes/minuto, solicitudes/día, tokens/día o crédito en dólares) en la documentación actual del proveedor, no en este artículo, antes de lanzar algo que dependa de él.
  • [ ] Confirma si el nivel gratuito requiere un umbral de crédito comprado antes de que se apliquen límites más altos (como OpenRouter).
  • [ ] Planifica qué sucede cuando el nivel gratuito se agota: ¿entra en vigor el precio simplemente o la solicitud es rechazada?

Preguntas frecuentes

¿Existe una API de LLM gratuita verdaderamente ilimitada?

No. Todos los proveedores comparados aquí limitan el uso gratuito mediante un límite de tarifa, un tope diario o un crédito en dólares. Los proveedores que se comercializan como “gratuitos” describen un nivel limitado, no un acceso ilimitado.

¿Cuál API de LLM gratuta tiene el límite más alto de solicitudes por día?

Entre los niveles pagados con límite de tarifa verificados aquí, OpenRouter y Groq publican ambos un techo de 1.000 solicitudes por día en sus respectivos modelos de nivel gratuito, una vez que se cumple el umbral de $10 de crédito de por vida de OpenRouter. La asignación de 10.000 Neuronas por día de Cloudflare Workers AI es un presupuesto de cómputo en lugar de un recuento fijo de solicitudes, por lo que no se traduce en un solo número comparable de solicitudes.

¿Novita AI ofrece un modelo de LLM gratuito?

El catálogo actual de API de LLM serverless de Novita AI no lista un modelo con precio de $0 por token. Su mecanismo de nivel gratuito es un programa de referidos que otorga $10 en crédito tanto al referente como a la nueva cuenta referida por cada referido exitoso, hasta $500 en total, gastable en todo el catálogo serverless.

¿Los límites del nivel gratuito se aplican por clave de API o por cuenta?

Esto varía según el proveedor y está documentado en la página de límites de tarifa de cada proveedor; Groq, por ejemplo, establece que sus límites se aplican a nivel de organización en lugar de por clave de API individual. Consulta la documentación específica del proveedor para conocer la distinción entre cuenta y clave antes de asumir el comportamiento de agrupaación de solicitudes.

Artículos recomendados