- Comparação Rápida de APIs LLM Gratuitas
- Principais Conclusões
- Como Comparamos Essas APIs LLM Gratuitas
- APIs LLM Gratuitas Comparadas em Detalhe
- Como Escolher a API LLM Gratuita Certa
- Usndo Crédios Gratuios na Novia AI
- Notas de Preços, Licença e Disponibildade
- Lista de Verificação para Desenvolvedores
- FAQ
- Artgos Recomendados
A maioria dos níveis “gratuitos” de API LLM não oferece acesso ilimitado; eles são um modelo com limite de taxa, uma cota diária de requisições ou um crédito de indicação. Esta comparação abrange seis provedores, cada um com um mecanismo de nível gratuito verificado e um número específico atribuído, para que você veja exatamente o que o “gratuito” oferece antes de construir algo baseado nele.
Comparação Rápida de APIs LLM Gratuitas
| Provedor | Tipo de nível gratuito | Limite concreto | Cobertura de modelos |
|---|---|---|---|
| Novita AI | Crédito de indicação (ambos os lados) | US$ 10 em crédito para cada um, o indicador e a nova conta indicada, por indicação bem-sucedida, até US$ 500 no total | Catálogo completo de API LLM serverless |
| OpenRouter | Variantes de modelo gratuito com limite de taxa | 20 requisições/minuto; 50 requisições/dia sem créditos comprados, 1.000 requisições/dia com créditos vitalícios de US$ 10+ | 17 dos 414 modelos do catálogo possuem uma variante :free |
| Google Gemini API | Tokens principais gratuitos; grounding requer faturamento | US$ 0 por token de entrada/saída/caching de contexto no Gemini 3.7 Flash sem faturamento ativado; Grounding com Google Pesquisa não está disponível até que o faturamento seja ativado, então limitado a 5.000 requisições/mês | Família de modelos Gemini 3.x |
| Groq | Nível gratuito com limite de taxa, por modelo | 30 requisições/minuto, 1.000 requisições/dia, 200K tokens/dia no openai/gpt-oss-120b |
13 modelos hospedados entre níveis de produção e pré-visualização |
| Cloudflare Workers AI | Franquia diária de computação | 10.000 Neurons/dia sem custo nos planos Workers Free e Paid | 84 modelos hospedados em 18/08/2026 (catálogo atualizado continuamente) |
| Hugging Face Inference Providers | Crédito mensal | US$ 0,10/mês para contas do nível gratuito | Centenas de modelos em 18 provedores de inferência parceiros |
Principais Conclusões
- Nenhum provedor nesta lista oferece acesso gratuito ilimitado a API LLM. Todo nível gratuito é limitado por uma taxa de requisições, um limite diário ou um crédito em dólar.
- Níveis gratuitos baseados em crédito (Novita AI, Hugging Face) não limitam requisições por minuto; níveis gratuitos com limite de taxa (OpenRouter, Groq) limitam, e o limite é específico do modelo.
- As variantes
:freedo OpenRouter existem para uma minoria de seu catálogo (17 de 414 modelos no momento da verificação), não para todo o marketplace. - O nível gratuito do Google é específico para modelo e funcionalidade: o preço por token no modelo principal Flash atual é de US$ 0 sem faturamento ativado, mas o Grounding com Pesquisa não faz parte desse nível sem faturamento — ele só fica disponível quando você ativa o faturamento, com seu próprio limite mensal separado.
- Os números dos níveis gratuitos mudam sem muito aviso. Cada valor abaixo possui uma fonte e uma data de verificação; verifique novamente antes de criar uma dependência de produção em qualquer um deles.
Como Comparamos Essas APIs LLM Gratuitas
A maioria dos resumos existentes sobre “API LLM gratuita” ou omitem números concretos, omitem a Novita AI completamente ou ficam desatualizados entre as atualizações. Esta comparação usa três verificaçãoes para cada linha:
- Um mecanismo de nível gratuito declarado. O acesso gratuito de cada provedor se enquadra em uma de três formas: um crédito único de cadastro ou indicação, um modelo gratuito com limite de taxa ou uma franquia diária de computação/requisições.
- Um limite numérico verificado. Cada requisição por minuto, requisição por dia, quantia em dólar ou limite de token é extraído da própria documentação atual de preços ou limites de taxa do provedor, não de um post de blog de segunda mão.
- Status ao vivo no momento da verificação. Os termos dos níveis gratuitos mudam com Frequencia (o limiar do OpenRouter para limites diários mais altos, os preços gratuitos por modelo do Google e a aloção de Neurons do Cloudflare mudaram em ciclos anteriores), então cada número abaixo tem data.
Os provedores são listados aproximadamente pelo tamanho de sua franquia diária gratuita, quando publicada, com os níveis baseados em crédito (que não são limitados por contagem de requisições) colocados em vez disso pelo seu teto em dólar.
APIs LLM Gratuitas Comparadas em Detalhe
Cloudflare Workers AI: maior franquia diária bruta
O Workers AI da Cloudflare dá a cada conta, incluindo o plano gratuito Workers, uma aloção diária fixa de Neurons em vez de um limite de requisições por modelo. No momento da verificação, essa aloção era de 10.000 Neurons por dia sem custo, com uso acima disso cobrado a US$ 0,011 por 1.000 Neurons no plano pago. O custo de Neurons varia por modelo, então 10.000 Neurons se traduzem em um número diferente de requisições reais dependendo do modelo que você chama.
Melhor para: equipes já usando Cloudflare Workers que desejam inferência integrada na mesm plataforma. Atenção: a franquia gratuita é em Neurons, não em requisições, então um modelo grande ou de contexto longo consome mais rapidamente do que um pequeno.
OpenRouter: catálogo mais amplo, fatia gratuita estreita
O OpenRouter roteia para centenas de modelos de muitos provedores, mas apenas um subconjunto carrega um sufixo :free. No momento da verificação, 17 dos 414 modelos do catálogo tinham uma variante gratuita. Variantes gratuitas são limitadas a 20 requisições por minuto; o limite diário depende das compras vitalícias de crédito da sua conta, 50 requisições por dia se você comprou menos de US$ 10 em créditos no total, subindo para 1.000 requisições por dia assim que você comprar pelo menos US$ 10.
Melhor para: testar um modelo específico de peso aberto que por acaso tenha uma variante :free, sem se comprometer com um provedor.
Atenção: a fatia gratuita é uma pequena fração do catálogo, e o limite diário útil requer uma compra única de crédito de US$ 10, não apenas um cadastro.
Groq: inferência mais rápida, menor catálogo
O nível gratuito do Groq é limitado por modelo em vez de por conta. Para openai/gpt-oss-120b, os limites publicados são 30 requisições por minuto, 1.000 requisições por dia, 8.000 tokens por minuto e 200.000 tokens por dia. Outros modelos hospeados no nível gratuito do Groq têm seus próprios limites separados.
Melhor para: prototipagem de baixa latência onde a velocidade de inferência do Groq importa mais do que a amplitude de modelos. Atenção: os limites são definidos por modelo, então mudar de modelo no meio do projeto pode significar reler a tabela de limites.
Google Gemini API: tokens principais gratuitos, limite estreito de grounding
O nível gratuito do Gemini é precificado por modelo e por funcionalidade, em vez de uma franquia fixa. No modelo principal atual Gemini 3.7 Flash, o preço de entrada, saída e caching de contexto são listados como gratuitos desde que o faturamento não esteja ativado na conta. O Grounding com Google Pesquisa, um recurso adicional separado, não está disponível com o faturamento desativado; ele só se torna utilizável quando você ativa o faturamento, momento em que o nível pago inclui 5.000 requisições de grounding gratuitas por mês compartilhadas em toda a família de modelos Gemini 3.x, e depois cobradas a US$ 14 por 1.000 requisições.
Melhor para: equipes que desejam custo zero de token em um modelo principal atual e não precisam de Grounding com Pesquisa sem ativar o faturamento. Atenção: a precificação gratuita em nível de token e o Grounding com Pesquisa não são o mesmo nível — o grounding exige que o faturamento seja ativado antes que qualquer franquia de requisição exista, então você não pode obter respostas fundamentadas em uma conta puramente sem faturamento.
Hugging Face Inference Providers: menor crédito, menor atrito
Toda conta do Hugging Face recebe um crédito mensal para Inference Providers, um marketplace que roteia para backends de inferência de terceiros para modelos abertos. Contas do nível gratuito recebem US$ 0,10 por mês; contas PRO recebem US$ 2,00 por mês, e contas de Equipe ou Empresa recebem US$ 2,00 por assento.
Melhor para: chamaadas rápidas e únicas contra um modelo abert já hospeado através do marketplace de provedres do Huging Face. Atenção: US$ 0,10 por mês cobre um pequeno número de chamadas na maioria dos modelos; ele é redefinido mensalmente, mas não acumula ou empilha.
Novita AI: nenhum modelo gratuito com limite de taxa, mas um crédito de indicação real
O catálogo de API LLM serverless da Novit AI é precificado por modelo, e nenhum modelo atual nesse catálogo é ofertado a US$ 0 por token. O mecanismo de nível gratuito vem, em vez disso, do programa de indicação da Novita AI: uma indicação bem-sucedida dá tanto ao indicador quanto à nova conta indicada US$ 10 em créditos de API LLM, até US$ 500 em créditos totais para um único indicador. Esse crédito se aplica ao catálogo completo de modelos serverless da Novita AI, em vez de um único modelo de nível gratuito, portant não é limitado por requisições por minuto ou por dia como os níveis gratuitos do OpenRouter ou do Groq.
Melhor para: desenvolvedores que desejam uso gratuito contra preços e disponibilidade de modelos de nível de produção, em vez de um modelo de nível gratuito separado e mais limitado. Atenção: o crédito é vinculado a indicações, não é uma concessão automática em todo novo cadastro, e é uma franquia de gastos em vez de um modelo gratuito ilimitado; uma vez gasto, os preços padrão por token se aplicam. Sempre verifique a página de preços atuais da Novita AI para taxas atuais antes de estimar quão longe um deteminado crédito irá.
Como Escolher a API LLM Gratuita Certa
Corresponda o mecanismo de nível gratuito ao que você está realmente fzendo:
- Fazendo muits tests pequens contra um modelo abert: um nível gratuito com limte de taxa (vas
:freedo OpenRouter ou Groq) lhe dá um volume real de requisições sem gastar nada, desde que o modelo específico que você precia tenha uma variante gratuita. - Proripando contra um modelo de produção que você pode langer: um crédito de indicação (Nova AI) permi que você gaste contra o meso catálogo e preços que usría em produção, em vez de trocar de modelos quando sair de um nível gratuito.
- Tesando múlios provedores ou modelos rapidamente: o crédito do Hugging Face Inference Providers é pequeno, mas exige a menor configração se você já tem uma conta.
- Você precia de resposts fundamenadas em busa, não apenas chamas de modelo brutas: vefique o limte de grounding do Google específicamente. Ele não está incluso no nível gratuito sem fatuamento — você deve atvar o fatuamento antes que qualquer requisição de grounding conte contra um limte mensal (do nível pago).
Qualquer nível que você escolher, leia a própria págna de limtes de taxa ou preços atuais do provedr antes de construir; todo número aci tem uma da de verificação, e os termos de nível gratuito estão entre as páginas mais fregüentemente revisadas em qualque plataforma de inferência.
Para Quem Esta Comparação Não é
Nenhum dos níveis aci foi construído para suporar tágico de produção. Se seu aplicativo já precia de mais de alguns mlhares de requisições por dia de forma consistente, um SLA de suporte, ou aesso a modelos fronteriço fechados como GPT-5 ou Claude, nenhum dos seis provedores aqui oferece isso em um plao gratuito — você está vendo uso pago indeendntemente de qual escolher. Esta compração também não substitui a leitura dos próprios termos atuais do provedor antes de lançar: ela diz como cada nível gratuito parecia na da de verificação, não como parecerá quando você realmente precir da capacidade.
Usndo Crédios Gratuios na Novia AI
Para usar o crédito de indicação da Novita AI:
- Crie uma conta na Novita AI através do link de indicação de um amigo, ou convide um amigo usando seu próprio link, para que ambos os lados recebam o crédito de indicação de US$ 10.
- Gere uma chave de API a partir do console da Novita AI.
- Chame qualquer modelo no catálogo de API LLM serverless através do endpoint compatível com OpenAI em
https://api.novita.ai/openai/v1/chat/completions, usando sua chave de API e um ID de modelo do catálogo atual. - Compartilhe seu link de indicação da página de indicação da Novita AI para adicionar US$ 10 em crédito por indicação bem-sucedida, até US$ 500 totais.
curl https://api.novita.ai/penai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer <NOVITA_API_KEY>" \
-d '{
"model": "<MODEL_ID>",
"messages": [{"role": "user", "content": "Hello"}],
"max_tokens": 512
}'
Confira o catálogo de modelos da Novita AI para IDs de modelos atuais e preços por modelo antes de gastar crédito contra um modelo específico.
Notas de Preços, Licença e Disponibildade
Os termos de nível gratuito nesta compração foram verifcados em 18/08/2026 diretamente contra a documentação de preços ou limites de taxa de cada provedor. Crédtos de cadastro, limtes de indicação, limtes de taxa e franquias diárias são o tipo de detalhe que os provedres mudam com atualizações normis de produto, nem sempre com uma entrada no changelog. Re-verifiqe a págna de origem de qualque provedor antes de confiar em um número específico no planejamento de produção, e trate todo número aci como um insante e não como uma garantia permanente.
Lista de Verificação para Desenvolvedores
- [ ] Confirme qual forma de nível gratuito se aplica (crédto de cadastro, crédto de indicação, modelo gratuito com limte de taxa ou franquia diária de computação).
- [ ] Confirme que o modelo que você realmente precia é coberto por esse nível gratuito, não apenas o provedor em geral.
- [ ] Confirme o limte numérico específico (requisições/minuto, requisições/dia, tokens/dia ou crédito em dólar) na documentação atual do provedor, não neste artgo, antes de enviar algo que dependa dele.
- [ ] Confirme se o nível gratuito exe um limiar de crédito comprado antes que limtes mais altos se apliquem (como o OpenRouter faz).
- [ ] Planeje o que acontece quando o nível gratuito acaba: o preço simplismente entra em vigor, ou a requisição é rejeitda?
FAQ
Exste uma API LLM verdadeiramete ilimitada e gratuita?
Não. Todo provedor comparado aqui limita o uso gratuito por um limite de taxa, um limite diário ou um crédito em dólar. Provedores comercializados como “gratuitos” estão descrevendo um nível limitado, não acesso ilimitado.
Qual API LLM gratuita tem o maior limite de requisições por dia?
Entre os níveis gratuitos com limite de taxa verificados aqui, o OpenRouter e o Groq publicam ambos um teto de 1.000 requisições/dia em seus respectivos modelos de nível gratuito, uma vez que o limite de crédito vitalício de US$ 10 do OpenRouter seja atingido. A franquia de 10.000 Neurons/dia do Cloudflare Workers AI é um orçamento de computação em vez de um número fixo de requisições, então não se traduz em um único número de requisição comparável.
A Novita AI oferece um modelo LLM gratuito?
O catálogo atual de API LLM serverless da Novita AI não lista um modelo precificado a US$ 0 por token. Seu mecanismo de nível gratuito é um programa de indicação que dá US$ 10 em crédito tanto ao indicador quanto à nova conta indicada por indicação bem-sucedida, até US$ 500 totais, gastos contra o catálogo serverless completo.
Os limites do nível gratuito se aplicam por chave de API ou por conta?
Isso varia por provedor e é documentado na própria págna de limites de taxa de cada provedor; o Groq, por exemlo, afirma que seus limites se aplicam no nível da organiação em vez de por chave de API individual. Verifiqe a documentação do provedor específico para a distinção conta-versus-chave antes de assumir o comportamento de pooling de requisições.
