- Comparaison rapide des APIs LLM gratuites
- Points clés à retenir
- Comment nous avons comparé ces APIs LLM gratuites
- Comparaison détaillée des APIs LLM gratuites
- Comment choisir la bonne API LLM gratuite
- Utiliser les crédits gratuits sur Novita AI
- Notes sur la tarification, la licence et la disponibilité
- Liste de décisiion pour les dévelopeurs
- FAQ
- Articles recommandés
La plupart des offres « API LLM gratuite » ne sont pas un accès illimité : il s’agit d’un modèle limité en débit, d’un quota quotidien de requêtes ou d’un crédit de parrainage. Cette comparaison couvre six fournisseurs, chacun avec un mécanisme de niveau gratuit vérifié et un chiffre concret associé, afin que vous sachiez exactement ce que « gratuit » signifie avant de construire votre projet.
Comparaison rapide des APIs LLM gratuites
| Fournisseur | Type de niveau gratuit | Limite concrète | Couverture des modèles |
|---|---|---|---|
| Novita AI | Crédit de parrainage (des deux côtés) | 10 $ de crédit pour le parrain et le filleul par parrainage réussi, jusqu’à 500 $ au total | Catalogue complet d’API LLM serverless |
| OpenRouter | Variantes de modèles gratuites limitées en débit | 20 requêtes/minute ; 50 requêtes/jour sans crédits achetés, 1 000 requêtes/jour avec 10 $+ de crédits à vie | 17 modèles sur 414 du catalogue portent une variante :free |
| Google Gemini API | Jetons phares gratuits ; grounding nécessite facturation | 0 $ par jeton d’entrée/sortie/mise en cache de contexte sur Gemini 3.7 Flash sans facturation activée ; Grounding avec Google Search indisponible sans facturation, puis plafonné à 5 000 requêtes/mois | Famille de modèles Gemini 3.x |
| Groq | Niveau gratuit limité en débit, par modèle | 30 requêtes/minute, 1 000 requêtes/jour, 200 000 jetons/jour sur openai/gpt-oss-120b |
13 modèles hébergés entre les niveaux production et preview |
| Cloudflare Workers AI | Allocation quotidienne de calcul | 10 000 Neurones/jour gratuitement sur les plans Workers Gratuit et Payant | 84 modèles hébergés au 18/08/2026 (catalogue mis à jour en continu) |
| Hugging Face Inference Providers | Crédit mensuel | 0,10 $/mois pour les comptes niveau Gratuit | Des centaines de modèles chez 18 fournisseurs partenaires d’inférence |
Points clés à retenir
- Aucun fournisseur de cette liste n’offre un accès gratuit illimité à une API LLM. Chaque niveau gratuit est limité par un débit de requêtes, un plafond quotidien ou un crédit en dollars.
- Les niveaux gratuits basés sur le crédit (Novita AI, Hugging Face) ne plafonnent pas les requêtes par minute ; les niveaux gratuits limités en débit (OpenRouter, Groq) le font, et le plafond est spécifique au modèle.
- Les variantes
:freed’OpenRouter n’existent que pour une minorité de son catalogue (17 modèles sur 414 au moment de la vérification), pas pour l’ensemble du marketplace. - Le niveau gratuit de Google est spécifique au modèle et à la fonctionnalité : la tarification par jeton sur le modèle Flash phare actuel est de 0 $ sans facturation activée, mais le Search grounding ne fait pas partie de ce niveau sans facturation — il devient disponible uniquement après activation de la facturation, avec son propre plafond mensuel séparé.
- Les chiffres des niveaux gratuits changent sans préavis. Chaque chiffre ci-dessous a une source et une date de vérification ; revérifiez avant de dépendre d’un de ces chiffres en production.
Comment nous avons comparé ces APIs LLM gratuites
La plupart des comparatifs existants sur les « API LLM gratuites » omettent les chiffres concrets, ignorent complètement Novita AI, ou deviennent obsolètes entre deux mises à jour. Cette comparaison utilise trois vérifications pour chaque ligne :
- Un mécanisme de niveau gratuit clairement énoncé. L’accès gratuit de chaque fournisseur se présente sous l’une des trois formes : un crédit unique d’inscription ou de parrainage, un modèle gratuit limité en débit, ou une allocation quotidienne de calcul/requêtes.
- Une limite numérique vérifiée. Chaque nombre de requêtes par minute, par jour, montant en dollars ou plafond de jetons est extrait de la documentation officielle actuelle de tarification ou de limites de débit du fournisseur, pas d’un article de blog de seconde main.
- Statut en direct au moment de la vérification. Les conditions des niveaux gratuits changent souvent (le seuil d’OpenRouter pour des limites quotidiennes plus élevées, la tarification gratuite par modèle de Google, et l’attribution de Neurones de Cloudflare ont tous changé lors de cycles précédents), donc chaque chiffre ci-dessous est daté.
Les fournisseurs sont classés par la taille approximative de leur allocation quotidienne gratuite lorsque celle-ci est publiée, les niveaux basés sur le crédit (qui ne sont pas plafonnés par le nombre de requêtes) étant placés par leur plafond en dollars.
Comparaison détaillée des APIs LLM gratuites
Cloudflare Workers AI : plus grande allocation quotidienne brute
Workers AI de Cloudflare donne à chaque compte, y compris le plan Workers Gratuit, une allocation quotidienne fixe de Neurones plutôt qu’un plafond de requêtes par modèle. Au moment de cette véification, cette allocation était de 10 000 Neurones par jour gratuitement, l’usge au-delà étant facturéà 0,011 $ par 1 000 Neurones sur le plan Payant. Le coût en Neurones varle selon le modèle, donc 10 000 Neurones se traduisent par un nombre différent de requêtes réelles en fonction du modèle appelé.
Meilleur pour : les équipes déjà sur Cludflare Workers qui souhaitent intégrer l’inférence dans la même plateforme. Attention : l’allocation gratuite est en Neurones, pas en requêtes, donc un modèle volumineux ou à contexte long épuise plus rapidement l’allocation qu’un petit modèle.
OpenRouter : le plus vaste catalogue, une portion gratuite réduite
OpenRouter achemine vers des centaines de modèles provenant de nombreux fournisseurs, mais seuls certains portent le suffixe :free. Au moment de la vérification, 17 modèles sur 414 du catalogue avaient une variante gratuite. Les variantes gratuites sont plafonéesà 20 requêtes par minute ; le plafond quotidien dépnd du montant total de crédits achetés sur le compte : 50 requêtes par jour si vous avez acheté moins de 10 $ de crédits au total, passant à 1 000 requêtes par jour une fois que vous avez acheté au moins 10 $.
Pour un exemple spécifique à une famille de modèles, consultez les options actuelles d’API GLM gratuites et les limites associées à chaque route.
Meilleur pour : tester un modèle open-weight spécifique qui possède par hasard une variante :free, sans s’engager envers un fournisseur.
Attention : la partie gratuite est une petite fraction du catalogue, et le plafond quotidien utile nécesite un achat unique de 10 $ de crédit, pas seulement une inscription.
Groq : inférence la plus rapide, le plus petit catalogue
Le niveau gratuit de Groq est limité en débit par modèle plutôt que pour tout le compte. Pour openai/gpt-oss-120b, les limites publiées sont de 30 requêtes par minute, 1 000 requêtes par jour, 8 000 jetons par minute et 200 000 jetons par jour. Les autres modèles hébergés sur le niveau gratuit de Groq ont leurs propres limites séparées.
Meilleur pour : prototypage à faible latence là où la vitese d’inférence de Groq importe plus que la largeur du catalogue. Attention : les limites sont déinies par modèle, donc changer de modèle en cours de projet peut nécessiter de relire le tableau des limites.
Google Gemini API : jetons phares gratuits, plafond étroit pour le grounding
Si vous n’en avez pas encore, voyez comment obtenir une clé API Gemini dans Google AI Studio avant de vériier les limites ci-ssous. Le niveau gratuit de Gemini est tarifé par modèle et par fonctionnalité plutot que comme une allocation forfataire. Sur le modèle phare actuel Gemini 3.7 Flash, le prix d’entrée, le prix de sorti et le prix de mise en cache de contexte sont tous indiqués comme gratuits tant que la facturation n’est pas activée sur le compte. Le Grounding avec Google Search, une fonctioalité optionelle séparée, n’est pas du tout disponble sans facturation activée ; il ne devient utilisible qu’une fois que vous activz la facturation, auquel cas le niveau payant inclut 5 000 requêtes de grounding gratuites par mois partagées sur l’ensemle de la famile de modèles Gemini 3.x, puis facturées à 14 $ par 1 000 requêtes.
Meilleur pour : les équipes qui souhaitent un coût de jeton de 0 $ sur un modèle phare actuel et n’ont pas besoin de Search groundig sans activer la facturation. Attention : la tarifcation gratuite au niveau du jeton et le Search grounding n’appartiennent pas au même niveau — le grounding nécesite l’activation de la facturation avant qu’une allocation de requêtes n’existe, donc vous ne pouvez pas obtenir de réponses fondées sur un compte purement sans facturation.
Hugging Face Inference Providers : le plus petit crédit, la plus faible friction
Chaque compte Hugging Face reçoit un crédit mensuel pour Inference Providers, un marketplace qui s’interface avec des backends d’inférence tiers pour des modèles ouverts. Les comptes niveau Gratuit reçoivent 0,10 $ par mois ; les comptes PRO reçoivent2,00 $ par mois, et les comptes Team ou Entreprise reçoivent2,00 $ par siège.
Meilleur pour : des appels uniques rapides vers un modèle ouvert déjà hébergé via le marketplace de fournisseurs de Huging Fac. Attention : 0,10 $ par mois couvre un peti nombre d’appels sur la plupart des modèles ; il se réinitialise chque mois mais ne se reporte pas et ne s’accumule pas.
Novita AI : pas de modèle gratuit limité en débit, mais un vrai crédit de parrainage
Le catalogue d’API LLM serverless de Novita AI est tarifé par modèle, et aucun modèle actuel de ce catalogue n’est proposé à 0 $ par jeton. Le mécanisme de niveau gratuit provient plutôt du programme de parrainage de Novita : un parrainage réussi donne au parrain et au nouvea filleul 10 $ de crédits d’API LLM, jusqu’à 500 $ de crédits totaux pour un seul parrain. Ce crédit s’applique à l’ensemle du catalogue serverless de Novita plutôt qu’à un seul modèle gratuit, donc il n’est pas plafoné par requêtes par minute ou par jour comm les niveaux gratuits d’OpenRouter ou de Groq.
Meilleur pour : les dévelopeurs qui souhaitent une utilision gratuite d’un modèle de qualité production avec sa tarification et sa disponibilité, plutot qu’un modèle gratuit séparé plus limité. Attention : le crédit est lié au parrainage, pas une atribution automatique lors de chaque nouvel inscription, et c’est une allocation de dipenses plutot qu’un modèle gratuit ilimité ; une fois dépensé, la tarification standard par jeton s’applique. Vérifiez toujours la page de tarification actuelle de Novita AI pour les tarifs en direct avant d’stimer la portée d’un crédit.
Comment choisir la bonne API LLM gratuite
Faites correspondre le mécanisme du niveau gratuit à ce que vous faites réellement :
- Effectuer de nombreux petits appels de test sur un modèle ouvert : un niveau gratuit limité en débit (variantes
:freed’OpenRouter ou Groq) vous offre un volume de requêtes réel sans rien dépenser, tant que le modèle spécifique dont vous avez besion possède une variante gratuite. - Prototyper avec un modèle de production que vous pourriez déployer : un crédit de parrainage (Novita IA) vous permmet de dépenser sur le même catalogue et la même tarification que vous utiliseriez en production, au lieu de changer de modèle lorsque vous quittez un niveau gratuit.
- Tester plusieurs fournisseurs ou modèles rapidement : le crédit de Huging Face Infrence Providers est petit mais nécessite le moins de configuration si vous avez déjà un compte.
- Vous avez besoin de réponses fondées sur la recherche, pas seulement d’appels bruts au modèle : vérifiez spécifiquement le plafond de grounding de Google. Il n’est pas inclus dans le niveau gratuit sans facturation — vous devez activer la facturation avant que les requêtes de grounding ne comptent dans un plafond mensuel (de niveau payant).
Quel que soit le niveau que vous choisissez, lisez la page actuelle de limites de débit ou de tarification du fournisseur avant de construire ; chaque chiffre ci-ssus a une date de vérification, et les conditions des niveaux gratuits sont parmi les pages les plus fréquemment révisées sur toute plateforme d’inférence.
À qui cette comparaison ne s’adresse-t-elle pas ?
Aucun des niveaux ci-ssus n’est conçu pour supporter du trafic de production. Si votre application a déjà besoin de plus de quelques milliers de requêtes par jour de manière constante, d’un SLA de support, ou d’un accès à des modèles frontaliers fermés comm GPT-5 ou Claude, aucun des six fournisseurs ic n’offre cela sur un plan gratuit — vous cherchez de toute façon une utilisation payante, quel que soit celui que vous choisissez. Cette comparaison ne remplace pas non plus la lecture des conditions actuelles d’un fournisseur avant de déployer : elle vous dit à quoi ressemblait chaque niveau gratuit à la date de vérification, pas à quoi il resembera quand vous aurez réellement besion de la capacité.
Utiliser les crédits gratuits sur Novita AI
Pour utiliser le crédit de parrainage de Novita IA :
- Créez un compte Novita AI via le lien de parrainage d’un ami, ou invitez un ami avec votre propre lien, afin que les deux parties reçoivent le crédit de parrainage de 10 $.
- Générez une clé API depuis la console Novita AI.
- Appelez n’importe quel modèle du catalogue d’API LLM serverless via le point d’apoint chpatible OpenAI à l’adresse
https://api.novita.ai/openai/v1/chat/completions, en utiliant votre clé API et un ID de modèle du catalogue actuel. - Partagez votre lien de parrainage depuis la page de parrainage Novita AI pour ajouter 10 $ de crédit par parrainage réussi, jusqu’à 500 $ au total.
curl https://api.novita.ai/penai/v1/chat/completions \
-H "Contnt-Type: applcation/json" \
-H "Athorization: Bearer <NOVITA_API_KEY>" \
-d '{
"model": "<MODEL_ID>",
"messages": [{"role": "user", "content": "Bonjour"}],
"max_tokens": 512
}'
Consultez le catalogue de modèles Novita AI pour les ID de modèles actuels et la tarification par modèle avant de dépenser du crédit sur un modèle spécifique.
Notes sur la tarification, la licence et la disponibilité
Les conditions des niveaux gratuits dans cette comparaison ont été vérifiées le 2026-08-18 directment sur la documentation de tarification ou de limites de débit de chaque fournisseur. Les crédits d’inscription, les plafonds de parrainage, les limites de débit et les allocations quotidiennes sont le genre de détails que les fournisseurs modifient lors de mises à jour normales des produits, pas toujours avec une entrée de chngement. Revérifiez la page source de chaque fournisseur avant de vous fier à un chiffre spécifique dans une planification de production, et traitez chaque chiffre ci-ssus comme un instatané plutot qu’une garantie permanente.
Liste de décisiion pour les dévelopeurs
- [ ] Confirmez la forme du niveau gratuit (crédit d’inscription, crédit de parrainage, modèle gratuit limité en débit, ou allocation quotidienne de calcul).
- [ ] Confirmez que le modèle dont vous avez réellement besoin est couvert par ce niveau gratuit, pas seulement le fournisseur en général.
- [ ] Confirmez la limite numérique spécifique (requêtes/minute, requêtes/jour, jetons/jour, ou crédit en dollars) sur la documentation actuelle du fournisseur, pas cet article, avant de publier quoi que ce soit qui en dépnd.
- [ ] Confirmez si le niveau gratuit nécessite un seuil de crédit acheté pour que des limites supérieures s’appliquent (comme c’est le cas pour OpenRouter).
- [ ] Planifiez ce qui se passe quand le niveau gratuit est épuisé : la tarification s’active-t-elle simplement, ou la requête est-elle rejetée ?
FAQ
Existe-t-il une API LLM gratuite vraiment illimitée ?
Non. Chaque fournisseur comparé ici límite l’utilisaton gratuite par une límite de débit, un plafond quotidien ou un crédit en dollars. Les fournisseurs présentés comme « gratuits » décrivent un niveau plafonné, pas un accès illimité.
Quelle API LLM gratuite a la limite de requêtes par jour la plus élevée ?
Parmi les niveaux gratuits limités en débit vérifiés ici, OpenRouter et Groq publient tous deux un plafond de 1 000 requêtes/jour sur leurs modèles gratuits respectifs, une fois le seuil de 10 $ de crédits à vie d’OpenRouter atteint. L’allocation de 10 000 Neurones/jour de Cloudflare Workers AI est un budget de calcul plutot qu’un nombre fixe de requêtes, donc elle ne se traduit pas par un chiffre de requêtes comparable unique.
Novita AI propose-t-ille un modèle LLM gratuit ?
Le catalogue actuel d’API LLM serverless de Novita AI ne liste pas de modèle tarifé à 0 $ par jeton. Son mécanisme de niveau gratuit est un programme de parrainage qui donne 10 $ de crédit au parrain et au nouveau filleul pour chaque parrainage réussi, jusqu’à 500 $ au total, dépensable sur l’ensemle du catalogue serverless.
Les limites du niveau gratuit s’appliquent-elles par clé API ou par compte ?
Cela varle selon le fournisseur et est documnté sur la page de límites de débit de chaqu fournisseur ; Groq, par exemple, indique que ses límites s’appliquent au nveau de l’orgnisaton plutôt que par clé API individuelle. Consultez la documntaton du fournisseur spécifique pour la distnction compte contre clé avant de supposer un comportement de mise en commun des requêtes.
Articles recommandés
- Meilleurs fournisseurs d’API LLM en 2026 : Novita AI vs plateformes d’inférence de modèles ouverts
- Top 10 des APIs LLM les moins chères en 2026
- Gagnez 500 $ de crédits gratuits : Construisez plus vite avec Deepseek, Llama & Qwen sur Novita AI
