Comparação de APIs LLM Gratuitas 2026: Limites Reais, Créditos e Modelos a $0

Comparação de APIs LLM Gratuitas 2026: Limites Reais, Créditos e Modelos a $0

A maioria dos planos “gratuitos” de APIs LLM não oferece acesso ilimitado; são um modelo com limite de taxa, uma cota diária de requisições ou um crédito por indicação. Esta comparação abrange seis provedores, cada um com um mecanismo gratuito verificado e um número específico associado, para que você veja exatamente o que o “gratuito” oferece antes de desenvolver com base nele.

Comparação rápida de APIs LLM gratuitas

Provedor Tipo de plano gratuito Limite concreto Cobertura de modelos
Novita AI Crédito por indicação (ambos os lados) US$ 10 em crédito para cada indicador e cada nova conta indicada por indicação bem-sucedida, até US$ 500 no total Catálogo completo da API LLM serverless
OpenRouter Variantes de modelo gratuito com limite de taxa 20 requisições/minuto; 50 requisições/dia sem créditos comprados, 1.000 requisições/dia com créditos vitalícios de US$ 10+ 17 dos 414 modelos do catálogo possuem uma variante :free
API Google Gemini Tokens principais gratuitos; fundamentação (grounding) requer faturamento US$ 0 por token de entrada/saída/caching de contexto no Gemini 3.7 Flash sem faturamento ativado; Fundamentação com Google Search não está disponível até que o faturamento seja ativado, então limitado a 5.000 requisições/mês Família de modelos Gemini 3.x
Groq Plano gratuito com limite de taxa, por modelo 30 requisições/minuto, 1.000 requisições/dia, 200.000 tokens/dia no openai/gpt-oss-120b 13 modelos hospedados entre tiers de produção e pré-visualização
Cloudflare Workers AI Cota diária de computação 10.000 Neurons/dia sem custo nos planos Workers Gratuito e Pago 84 modelos hospedados em 2026-08-18 (catálogo atualizado continuamente)
Hugging Face Inference Providers Crédito mensal US$ 0,10/mês para contas no nível Gratuito Centenas de modelos em 18 provedores de inferência parceiros

Principais conclusões

  • Nenhum provedor nesta lista oferece acesso ilimitado e gratuito a uma API LLM. Todo plano gratuito é limitado por uma taxa de requisições, um teto diário ou um crédito em dólares.
  • Planos gratuitos baseados em crédito (Novita AI, Hugging Face) não limitam requisições por minuto; planos gratuitos com limite de taxa (OpenRouter, Groq) limitam, e o limite é específico para cada modelo.
  • As variantes :free do OpenRouter existem para uma minoria de seu catálogo (17 dos 414 modelos no momento da verificação), não para todo o marketplace.
  • O plano gratuito do Google é específico por modelo e funcionalidade: o preço dos tokens no modelo Flash principal atual é US$ 0 sem faturamento ativado, mas a fundamentação com Search não faz parte desse nível sem faturamento — ela só fica disponível quando você ativa o faturamento, com seu próprio teto mensal separado.
  • Os números dos planos gratuitos mudam sem muito aviso. Cada valor abaixo tem uma fonte e uma data de verificação; reverifique antes de criar uma dependência de produção em qualquer um deles.

Como comparamos essas APIs LLM gratuitas

A maioria dos resumos existentes de “API LLM gratuita” ou ignora números concretos, skipa a Novita AI por completo, ou fica desatualizada entre atualizações. Esta comparação usa três verifcações para cada linha:

  1. Um mecanismo de plano gratuito declarado. O acesso gratuito de cada provedor se enquadra em uma de três formas: um crédito de cadastro ou indicação único, um modelo gratuito com limite de taxa ou uma permissão diária de computação/requisições.
  2. Um limite numérico verifcado. Cada requisição por minuto, requisição por dia, valor em dólar ou teto de token é extraído da própria documentação atual de preços ou limites de taxa do provedor, não de um post de blog de segunda mão.
  3. Status ativo no momento da verifcação. Os termos dos planos gratuitos mudam com freqiência (o limite do OpenRouter para tetos diários mais altos, os preços gratuitos por modelo do Google e a alocação de Neurons do Cloudflare já mudaram em íclos anteriores), portanto cada número abaixo tem data.

Os provedores são listados aproximadamente pelo tamanho de sua permissão gratuita diária, quando publicada, com os tiers baseados em crédito (que não são limitados por contagem de requisições) colocados em seu teto em dólar.

APIs LLM gratuitas comparadas em detlhe

Cloudflare Workers AI: maior permissão diária bruta

O Workers AI do Cloudflare dá a toda conta, incluindo o plano gratuito Workers, uma alocação diária fixa de Neurons em vez de um limite de requisição por modelo. No momento da verifcação, essa alocação era de 10.000 Neurons por dia sem custo, com uso acima disso cobrado a US$ 0,011 por 1.000 Neurons no plano Pago. O custo do Neuron varia por modelo, então 10.000 Neurons se tradiz em um número diferente de requisições reais dependendo do modelo chamado.

Melhor para: equipes que já usam Cloudflare Workers e querem inferência integrada na mesma plataforma. Cuidado com: a permissão gratuita é em Neurons, não em requisições, então um modelo grande ou de contexto longo a consome mais rapidamente que um pequeno.

OpenRouter: catálogo mais amplo, fatia gratuita estreita

O OpenRouter roteia para centenas de modelos de muitos provedores, mas apenas um subconjunto carrega um sufijo :free. No momento da verificação, 17 dos 414 modelos do catálogo tinham uma variante gratuta. As variantes gratutas são limitadas a 20 requisições por minuto; o teto diário depende das compras totais de crédito vitalícios da sua conta: 50 requisições por dia se você comprou menos de US$ 10 em créditos totais, subindo para 1.000 requisições por dia assim que você comprar pelo menos US$ 10.

Para um exemplo espeífico de família de modelos, veja as opções atuais de API GLM gratuita e os limites atados a cada rota.

Melhor para: testar um modelo específico de pesos abertos que por acaso tenha uma variante :free, sem se comprometer com um provedor. Cuidado com: a fatia gratuita é uma pequena fração do catálogo, e o teto diário útil requer uma compra única de US$ 10 em crédito, não apenas um cadastro.

O plano gratuito do Groq tem limite de taxa por modelo, não por conta. Para openai/gpt-oss-120b, os limites publicados são 30 requisições/minuto, 1.000 requisições/dia, 8.000 tokens/minuto e 200.000 tokens/dia. Outros modelos hospedados no plano gratuito do Groq carregam seus própios limites separados.

Melhor para: prototipação de baixa latência onde a velociade de inferência do Groq importa mais que a amplitude do modelo. Cuidado com: os limites são defnidos por modelo, então mudar de modelo no meio do projeto pode signifcar reler a tabela de limites.

API Google Gemini: tokens principais gratuitos, teto estreito de fundamentação

Se você ainla não configorou uma, veja como obter uma chave da api Gemini no Google AI Studo antes de verifcar os limites abaixo. O plano gratuito do Gemini é precifcado por modelo e por funcionalidade, não como uma permissão única. No modelo principal atual Gemini 3.7 Flash, o preço de entrada, o preço de saída e o preço de cache de contexto são todos listados como gratuitos, desde que o faturamento não esteja ativado na conta. A fundamentação com Google Search, um recurso complementar separado, não está dispnível com o faturamento desativado; ela só se torna usável quando você ativa o faturamento, momento em que o nível pago inclui 5.000 requisições gratuitas de fundamentação por mês, compartilhadas em toda a família de modelos Gemini 3.x, e então cobradas a US$ 14 por 1.000 requisições.

Melhor para: equipes que querem custo de token $0 em um modelo principal atual e não precisam de fundamentação com Search sem ativar o faturamento. Cuidado com: o preço gratuito no nível de token e a fundamentação com Search não são o mesmo nível — a fundamentação requer que o faturamento seja ativado antes que qualquer permissão de requisição exista, então você não pode obter respostas fundamentadas em uma conta puramente sem faturamento.

Hugging Face Inference Providers: menor crédito, menor atrito

Toda conta do Hugging Face recebe um crédito mensal para o Inference Providers, um mercado que roteia para backends de inferência de terceiros para modelos abertos. Contas no nível Gratuito recebem US$ 0,10 por mês; contas PRO recebem US$ 2,00 por mês, e contas de Equipe ou Empresa recebem US$ 2,00 por assento.

Melhor para: chamadas únicas rápdas contra um modelo abeto já hospedado através do mercado de provedores do Huging Face. Cuidado com: US$ 0,10 por mês cobré um pequeno número de chamadas na maoria dos modelos; é reiniciado mensalmente, mas não acumula nem empilha.

Novita AI: nenhum modelo gratuito com limite de taxa, mas um crédito de indicação real

O catálogo de API LLM serverless da Novita AI é precificado por modelo, e nenhum modelo atual nesse catálogo é ofrecido a US$ 0 por token. O mecanismo de plano gratuito vem do programa de indicação da Novita: uma indicação bem-sucedida dá tanro ao indicador quanto à nova conta indicada US$ 10 em créditos de API LLM, até US$ 500 em créditos totais para um único indicador. Esse crédito se aplica a todo o catálogo de modelos serverless da Novita, e não a um único modelo gratuito, portano não é limitado por requisições por minuto ou por dia como os planos gratuitos do OpenRouter ou Groq.

Melhor para: desenvolvedores que querem uso gratuito contra preços de modelos de nível de produção e disponibilidade, em vez de um modelo de plano gratuito separado e mais limitado. Cuidado com: o crédito é ativado por indicação, não uma concessão automática em todo novo cadastro, e é uma permissão de gasto, não um modelo gratuito ilimitado; uma vez gasto, os preços padrão por token se aplicam. Sempre verifique a página de preços atuais da Novita AI para taxas em tempo real antes de estimar até onde um deteminado crédito irá.

Como escolher a API LLM gratuita certa

Correspondeo o mecanismo do plano gratuito ao que você está realmente fazendo:

  • Executando muitas chamadas de teste pequenas contra um modelo aberto: um plano gratuito com limite de taxa (variantes :free do OpenRouter ou Groq) lhe dá volume real de requisições sem gastar nada, desde que o modelo espeífico que você precisa tenha uma variante gratuta.
  • Prototipando contra um modelo de produção com o qual você pode lançar: um crédito de indicação (Novita AI) perite que você gaste contra o mesmo catálogo e preços que usaria em produção, em vez de trocar de modelo ao sair de um plano gratuito.
  • Testando vários provedores ou modelos rápdamente: o crédito do Huging Face Inference Providers é pequeno, mas exige a menoor configoração se você já tem uma conta.
  • Você precisa de respostas fundamentadas em busca, não apenas chamadas brutas de modelo: verifique especificamente o teto de fundamentação do Google. Ele não está incluso no plano gratuito sem faturamento — você deve ativar o faturamento antes que qualquer requisição de fundamentação conte contra um teto mensal (do nível pago).

Qualer nível que você escolher, leia a própria página atul de limites de taxa ou preços do provedor antes de criar; todo número acima tem uma data de verificação, e os termos dos planos gratuitos estão entre as páginas mais frequentemente revisadas em qualquer pltaforma de inferência.

Para quem esta comparação não é

Nenhum dos níveis acima é construído para suportar tráfego de produção. Se o seu aplicativo já precise de mais de algumas milhares de requisições por dia de forma consistente, um SLA de suporte ou acesso a modelos de fronteira fechados como GPT-5 ou Claude, nenhum dos seis provedores aqui oferece isso em um plano gratuito — você está olhando para uso pago, independentemente de qual escolher. Esta comparação também não substitui a leitura dos próprios termos atuais de um provedor antes do lançamento: ela informa como era cada plano gratuito na data de verificação, não como será quando você realmente precisar da capacidade.

Usando créditos gratuitos na Novita AI

Para usar o crédito de indicação da Novita AI:

  1. Crie uma conta Novita AI através do link de indicação de um amigo, ou convide um amigo usando seu próprio link, para que ambos os lados recebam o crédito de indicação de US$ 10.
  2. Gere uma chave de API no console da Novita AI.
  3. Chame qualquer modelo no catálogo da API LLM serverless através do endpoint compatível com OpenAI em https://api.novita.ai/openai/v1/chat/completions, usando sua chave de API e um ID de modelo do catálogo atual.
  4. Compartilhe seu link de indicação da página de indicação da Novita AI para adicionar US$ 10 em crédito por indicação bem-sucedida, até US$ 500 no total.
curl https://api.novita.ai/openai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer <NOVITA_API_KEY>" \
  -d '{
    "model": "<MODEL_ID>",
    "messages": [{"role": "user", "content": "Hello"}],
    "max_tokens": 512
  }'

Verifique o catálogo de modelos da Novita AI para obter IDs de modelos atuais e preços por modelo antes de gastar crédito contra um modelo específico.

Notas sobre preços, licenças e disponibilidade

Os termos dos planos gratuitos nesta comparação foram verificados em 2026-08-18 diretamente na documentação de preços ou limites de taxa de cada provedor. Créditos de cadastro, limites de indicação, limites de taxa e permissões diárias são o tipo de detalhe que os provedores alteram com atualizações normais de produto, nem sempre com uma entrada no changelog. Re-verifique a página de origem de qualquer provedor antes de confiar em um número específico no planejamento de produção, e trate cada valor acima como uma captura de tela, não uma garantia permanente.

Lista de verificação para desenvolvedores

  • [ ] Confirme qual forma de plano gratuito se aplica (crédito de cadastro, crédito de indicação, modelo gratuito com limite de taxa ou permissão diária de computação).
  • [ ] Confirme se o modelo que você realmente precisa está coberto por esse plano gratuito, não apenas o provedor em geral.
  • [ ] Confirme o limite numérico específico (requisições/minuto, requisições/dia, tokens/dia ou crédito em dólar) na documentação atual do provedor, não neste artigo, antes de enviar qualquer coisa que dependa dele.
  • [ ] Confirme se o plano gratuito requer um limite de crédito comprado antes que limites mais altos se apliquem (como o OpenRouter faz).
  • [ ] Planeje o que acontece quando o plano gratuito acabar: o preço simplesmente entra em vigor, ou a requisição é rejeitada?

FAQ

Existe uma API LLM gratuita verdadeiramente ilimitada?

Não. Todo provedor comparado aqui limita o uso gratuito por um limite de taxa, um teto diário ou um crédito em dólar. Provedores comercializados como “gratuitos” estão descrevendo um nível limitado, não acesso ilimitado.

Qual API LLM gratuita tem o maior limite de requisições por dia?

Entre os planos gratuitos com limite de taxa verificados aqui, OpenRouter e Groq ambos publcam um teto de 1.000 requisições/dia em seus respectvos modelos de plano gratuito, uma vez que o limite de crédito vitalícis de US$ 10 do OpenRouter é atigido. A permissão de 10.000 Neurons/dia do Cloudflare Workers AI é um orçamento de computação, não uma contagem fxa de requisições, portano não se traduz em um único número comparável de requisições.

A Novita AI oferece um modelo LLM gratuito?

O catálogo atual de API LLM serverless da Novita AI não lista um modelo precifcado a US$ 0 por token. Seu mecanismo de plano gratuito é um programa de indicação que dá US$ 10 em crédito tanto ao indicador quanto à nova conta indicada por indicação bem-sucedida, até US$ 500 no total, gastável em todo o catálogo serverless.

Os limites do plano gratuito se aplicam por chave de API ou por conta?

Isso varia de provedor para provedor e está documentado na própria página de limites de taxa de cada provedor; o Groq, por exemplo, afirma que seus limites se aplicam no nível da organização, não por chave de API individual. Verifique a documentação específica do provedor para a distinção entre conta e chave antes de assumir o comportamento de pooling de requisições.

Artigos recomendados