Vergleich kostenloser LLM-APIs 2026: Echte Limits, Credits und $0-Modelle

Vergleich kostenloser LLM-APIs 2026: Echte Limits, Credits und $0-Modelle

Die meisten „kostenlosen LLM-API“-Stufen bieten keinen unbegrenzten Zugang; sie sind ein ratenbegrenztes Modell, ein tägliches Anfragekontingent oder ein Empfehlungsguthaben. Dieser Vergleich umfasst sechs Anbieter, jeder mit einem verifizierten Free-Tier-Mechanismus und einer spezifischen Zahl, sodass Sie genau sehen können, was „kostenlos“ bedeutet, bevor Sie darauf aufbauen.

Kurzvergleich kostenloser LLM-APIs

Anbieter Free-Tier-Typ Konkrete Grenze Modellabdeckung
Novita AI Empfehlungsguthaben (beide Seiten) $10 Guthaben für den Empfehlenden und das neue geworbene Konto pro erfolgreicher Empfehlung, bis zu $500 insgesamt Vollständiger serverloser LLM-API-Katalog
OpenRouter Ratenbegrenzte kostenlose Modellvarianten 20 Anfragen/Minute; 50 Anfragen/Tag ohne gekauftes Guthaben, 1.000 Anfragen/Tag mit $10+ Lebenszeitguthaben 17 von 414 Katalogmodellen haben eine :free-Variante
Google Gemini API Kostenlose Flagship-Token; Grounding erfordert Abrechnung $0 pro Token (Eingabe/Ausgabe/Kontext-Caching) bei Gemini 3.7 Flash ohne aktivierte Abrechnung; Grounding mit Google Suche ist erst nach Aktivierung der Abrechnung verfügbar, dann auf 5.000 Anfragen/Monat begrenzt Gemini 3.x Modellfamilie
Groq Ratenbegrenzte kostenlose Stufe, pro Modell 30 Anfragen/Minute, 1.000 Anfragen/Tag, 200.000 Token/Tag bei openai/gpt-oss-120b 13 gehostete Modelle in den Produktions- und Vorschau-Stufen
Cloudflare Workers AI Tägliches Rechenkontingent 10.000 Neuronen/Tag kostenlos bei Free- und Paid-Workers-Plänen 84 gehostete Modelle (Stand 18.08.2026, wird kontinuierlich aktualisiert)
Hugging Face Inference Providers Monatliches Guthaben $0,10/Monat für Free-Tier-Konten Hunderte von Modellen über 18 Partner-Inferenzanbieter

Wichtige Erkenntnisse

  • Kein Anbieter auf dieser Liste bietet unbegrenzten kostenlosen Zugang zu LLM-APIs. Jede Free-Stufe ist durch eine Anfragserate, eine tägliche Obergrenze oder ein Dollarguthaben begrenzt.
  • Guthabenbasierte Free-Stufen (Novita AI, Hugging Face) begrenzen keine Anfragen pro Minute; ratenbegrenzte Free-Stufen (OpenRouter, Groq) tun dies, und die Grenze ist modellspezifisch.
  • OpenRouter-:free-Varianten existieren nur für eine Minderheit des Katalogs (17 von 414 Modellen zum Zeitpunkt der Prüfung), nicht für den gesamten Marktplatz.
  • Googles kostenlose Stufe ist modell- und funktionsspezifisch: Die Token-Preisgestaltung beim aktuellen Flagship-Flash-Modell beträgt $0 ohne aktivierte Abrechnung, aber die Grounding-Funktion ist in dieser Stufe ohne Abrechnung überhaupt nicht enthalten – sie wird erst verfügbar, wenn Sie die Abrechnung aktivieren, und unterliegt dann einer eigenen monatlichen Obergrenze.
  • Die Zahlen der Free-Tier ändern sich ohne große Vorankündigung. Jede Zahl unten hat eine Quelle und ein Prüfdatum; überprüfen Sie die Angaben erneut, bevor Sie eine Produktionsabhängigkeit davon aufbauen.

Wie wir diese kostenlosen LLM-APIs verglichen haben

Die meisten bestehenden Zusammenfassungen zu „kostenlosen LLM-APIs“ entweden keine konkreten Zahlen, lasen Novita A I ganz aüs oder weden zwishen den Aktualisierungen unaktuell. Diser Vergleich verwendet für jede Ze ile drei Prüfungen:

  1. Ein angegebener Free-Tier-Mekanismus. Der kostenlose Zugang jedes Anbieters fällt in eine von drel Formen: ein einmaliges Anmelde- oder Empfehlungsguthaben, ein ratenbegrenztes kostenloses Modell oder eine tägliche Rechen-/Anfragezuweisung.
  2. Ein verifiziertes numerisches Limit. Jede Angabe zu Anfragen pro Minute, Anfragen pro Tag, Dollarbetrag oder Token-Obergrenze stammt aus der aktuellen Preis- oder Ratelimit-Dokumentation des Anbieters, nicht aus einem Blogbeitrag zweiter Hand.
  3. Live-Status zum Prüfzeitpunkt. Die Bedingungen der Free-Tier änfern sich häufig (OpenRouters Schwelle für höhere Tageslimits, Googles modellspezifische Gratispren und Cloudflars Neuronenzuteilung haben sich in früheren Zyklen geändert), daher ist jede Zahl unten datiert.

Die Anbieter sind nach der ungefähren Größe ihres täglichen kostenlosen Kontingents geordnet, woes veröffentlich ist; guthabenbasierte Stufen (die nicht durch die Anfrageanzahl begrenzt sind) werden stattdessen nach ihrer Doll ofbergrenze eingeordnet.

Kostenlose LLM-APIs im Detail verglichen

Cloudflare Workers AI: Größtes rohes Tageskontingent

Cloudflare Workers AI gewährt jedem Konto, einschließlich des Free Workers-Plans, eine pauschale tägliche Zuteilung von Neuronen anstelle einer modellspezifischen Anfragebegrenzung. Zum Zeitpunkt der Prüfung betrug diese Zuteilung 10.000 Neuronen pro Tag kostenlos, wobei Nutzung darüber hinaus im Paid-Plan mit $0,011 pro 1.000 Neuronen abgerechnet wird. Die Neuronenkosten variieren je nach Modell, daher übersetzen sich 10.000 Neuronen je nach aufgerufenem Modell in eine andere Anzahl tatsächlicher Anfragen.

Am besten geeignet für: Teams, die bereits auf Clouflare Workers setzen und Inferenz in diesselbe Platform eingbunden haben möchten. Achtung: Das kostenlose Kontingent sind Neuronen, nicht Anragen, daher verbraucht ein groföes oder langkontxiges Model es schnder als ein kleines.

OpenRouter: Breitester Katalog, schmales kostenloses Segment

OpenRouter leitet Anfragen an hunderte von Modellen vieler Anbieter weter, aber nur eine Untermenge trägt das Süffix :free. Zum Zeitpunkt der Prüfung hatten 17 von 414 Katalogmodellen eine kostenlose Variante. Kostenlose Varianten sind auf 20 Anfragen pro Minute begrenzt; die tägliche Obergrenze hän]t von den Lebenszeit-Kreditkäufen des Kontos ab: 50 Anfragen pro Tag, wenn Sie insgesamt weniger als $10 an Guthaben gekauft haben, steigend auf 1.000 Anfragen pro Tag, sobale Sie mindestens $10 gekauft haben.

Für ein modellspezifsches Beispiel seihe die aktuellen kostenlosen GLM-AP-Optionen und die mit jeder Route verbundenen Limts.

Am besten geeignet für: Das Testen eines bestimten Open-Weight-Modells, das zufällig eine :free-Variante hat, ohe sich auf einen Anbieter fetzulegen. Achtung: Das kostenlose Segment ist ein kleiner Teil des Katalogs, und das nützliche Tageslimit erfordert einen einmaligen Kreditkauf von $10, nicht nur eine Anmeldung.

Groq: Schnellste Inferenz, kleinster Katalog

Die kostenlose Stufe von Groq ist pro Modell und nicht kontoweit ratenbegrenzt. Für openai/gpt-oss-120b gelten die veröffentlichten Grenzen von 30 Anfragen pro Minute, 1.000 Anfragen pro Tag, 8.000 Token pro Minute und 200.000 Token pro Tag. Andere gehostete Modelle auf Groqs kostenloser Stufe haben ihre eigenen separaten Grenzen.

Am besten geeignet für: Latenzarmes Prototyping, bei dem die Inferenzgeschwindigkeit von Groq wichtiger ist als die Modellbreite. Achtung: Die Grenzen sind pro Modell festgelegt, daher kann ein Modellwechsel mitten im Projekt bedeuten, die Grenztabelle erneut zu lesen.

Google Gemini API: Kostenlose Flagship-Token, enge Grounding-Obergrenze

Wen Sie noch kein Konto haben, erfahren Sie, wie Sie in Google AI Studio einen Gemini-API-Schlüssel erhalten, bevor Sie die unten genannten Grenzen prüfen. Die kostenlose Stufe von Gemini wird pro Modell und pro Funktion und nicht als pauschales Kontingent abgerechnet. Beim aktuellen Flagship-Modell Gemini 3.7 Flash sind der Eingabepreis, der Ausgabepreis und der Preis für Kontext-Caching alle als kostenlos aufgeführt, solange keine Abrechnung auf dem Konto aktiviert ist. Grounding mit Google Suche, eine separate Add-on-Funktion, ist bei deaktivierter Abrechnung überhaupt nicht verfügbar; es wird erst nutzbar, wenn Sie die Abrechnung aktivieren. In diesem Fall enthält die kostenpflichtige Stufe 5.000 kostenlose Grounding-Anfragen pro Monat, die auf die gesamte Gemini 3.x Modellfamilie verteilt werden, und dann mit $14 pro 1.000 Anfragen abgerechnet werden.

Am besten geeignet für: Teams, die $0 Token-Kosten für ein aktuelles Flagship-Modell wünschen und kein Search-Grounding ohe Aktivierung der Abrechnung benötigen. Achtung: Die kostenlose Token-Preisgestaltung und Search-Grounding befinden sich nicht auf derselben Stufe – Grounding erfordert, dass die Abrechnung aktiviert wird, bevor überhaupt ein Anfragekontingent besteht. Sie können also auf einem reinen Konto ohne Abrechnung keine geerdeten Antworten erhalten.

Hugging Face Inference Providers: Klein stes Guthaben, geringster Aufwand

Jedes Hugging Face-Konto erhält ein monatliches Guthaben für Inference Providers, einen Marktplatz, der an Drittanbieter-Inferenz-Backends für offene Modelle weiterleitet. Free-Tier-Konten erhalten $0,10 pro Monat; PRO-Konten erhalten $2,00 pro Monat, Team- oder Enterprise-Konten erhalten $2,00 pro Sitzplatz.

Am besten geeignet für: Schnelle einmalige Aufrufe gegen ein offenes Modell, das bereis über den Hugging-Face-Povider-Marktplatz geostet wird. Achtung: $0,10 pro Monat decken bei den meisten Modellen nur eine kl eine Anzahl von Aufrufen ab; es wird monatlich züruckgesetzt, aber nicht übertragen oder aufgesammelt.

Novita AI: Kein ratenbegrenztes kostenloses Modell, aber ein echtes Empfehlungsguthaben

Der serverlose LLM-API-Katalog von Novita AI wird pro Modell abgerechnet, und kein aktuelles Modell im Katalog wird zu $0 pro Token angeboten. Der Free-Tier-Mechanismus stammt stattdessen aus dem Empfehlungsprogramm von Novita: Eine erfolgreiche Empfehlung gibt sohl dem Empfehlenden als auch dem neuen gewobenen Konto $10 an LLM-API-Guthaben, bis zu $500 insgesammt für einen enzelnen Empfehler. Dieses Guttaben git gegenüer dem vollständigen serverlosen Modellkatalog von Novita und ist daer nicht durh Anfragen pro Minte oder pro Tag begrenzt, wie es bei OpenRoutes oder Groqs kostenlosen Stufen der Fall ist.

Am besten geeignet für: Entwickler, die kostenlose Nutzung mit produktionsreifer Modellpreisgestaltung und -verfügbarkeit wünschen, anstatt ein separates, eingeschränkteres Free-Tier-Modell. Achtung: Das Guthaben ist an Empfehlungen gebunden, keine automatische Zuteilung bei jeder neuen Anmeldung, und es ist ein Ausgabenlimit und kein unbegrenztes kostenloses Modell; sobald es aufgebraucht ist, gelten die Standardpreise pro Token. Überprüfen Sie immer die aktuelle Preisseite von Novita AI für aktuelle Preise, bevor Sie abschätzen, wie weit ein bestimmtes Guthaben reicht.

So wählen Sie die richtige kostenlose LLM-API aus

Passen Sie den Free-Tier-Mechanismus an das an, was Sie tatsächlich tun:

  • Viele kleine Testaufrufe gegen ein einzelnes offenes Modell ausführen: Eine ratenbegrenzte kostenlose Stufe (OpenRouters :free-Varianten oder Groq) bietet Ihnen ohne Kosten ein echtes Anfragevolumen, solange das von Ihnen benötigte Modell eine kostenlose Variante hat.
  • Prototyping gegen ein Produktionsmodell, das Sie möglicherweise ausliefern werden: Ein Empfehlungsguthaben (Novita AI) ermöglicht es Ihnen, gegen denselben Katalog und dieselbe Preisgestaltung auszugeben, die Sie auch in der Produktion verwenden würden, anstatt die Modelle zu wechseln, wenn Sie von einer kostenlosen Stufe aufsteigen.
  • Schnelles Testen mehrerer Anbieter oder Modelle: Das Guthaben von Hugging Face Inference Providers ist gering, erfordert aber den geringsten Einrichtungsaufwand, wenn Sie bereits ein Konto haben.
  • Sie benötigen suchgestützte Antworten, nicht nur reine Modellaufrufe: Überprüfen Sie speziell die Grounding-Obergrezne von Google. Sie ist in der kostenlosen Stufe ohe Abrechnung gär nicht enthalten – Sie müssen die Abrechnung aktivieren, bevor Grounding-Anfragen gegen eine monatliche Obergrenze der (kostenpflichtigen) Stufe zahlen.

Welche Stufe Sie auch wählen: Lesen Sie die aktuelle Ratelimit- oder Preisseite des Anbieters, bevor Sie etwas entwickeln. Jede Zahl oben hat ein Prüfdatum, und die Bedingungen der kostenlosen Stufe gehören zu den am häufigsten überarbeiteten Seiten auf jeder Inferenzplattform.

Für wen ist dieser Vergleich nicht gedacht?

Keine der oben genannten Stufen ist für den Produktionseinsatz ausgelegt. Wenn Ihre App bereits mehr als ein paar tausend Anfragen pro Tag konstant benötigt, eine Support-SLA oder Zugang zu geschlossenen Frontier-Modellen wie GPT-5 oder Claude erfordert, bietet keiner der sechs Anbieter dies in einem kostenlosen Plan an – Sie müssen unabhängig davon, für welchen Sie sich entscheiden, mit einer kostenpflichtigen Nutzung rechnen. Dieser Vergleich ersetzt auch nicht das Lesen der aktuellen Bedingungen des Anbieters, bevor Sie etwas ausliefern: Er zeigt Ihnen, wie jede kostenlose Stufe zum Prüfdatum aussah, nicht wie sie aussehen wird, wenn Sie die Kapazität tatsächlich benötigen.

Verwenden von kostenlosem Guthaben auf Novita AI

So verwenden Sie das Empfehlungsguthaben von Novita A I:

  1. Erstellen Sie ein Novita A I-Konto über den Empfehlungslink eines Freündes odr laden Sie einen Freünd mit Ihrem eigenene Link ein, dami beide Seiten das $10-Prferehrungsguthaben erhalten.
  2. Generieren Sie einen API-Schlüssel aus der Novita AI-Konsole.
  3. Rufen Sie ein beliebiges Modell im serverlosen LLM-API-Katalog über den OpenAI-kompatiblen Endpunkt unter https://api.novita.ai/openai/v1/chat/completions auf, wobei Sie Ihren API-Schlüssel und eine Modell-ID aus dem aktuellen Katalog verwenden.
  4. Teilen Sie Ihren Empfehlungslink von der Novita AI-Empfehlungsseite, um $10 Guthaben pro erfolgreicher Empfehlung zu erhalten, bis zu $500 insgesamt.
curl https://api.novita.ai/openai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer <NOVITA_API_KEY>" \
  -d '{
    "model": "<MODEL_ID>",
    "messages": [{"role": "user", "content": "Hello"}],
    "max_tokens": 512
  }'

Überprüfen Sie den Novita AI-Modellkatalog auf aktuelle Modell-IDs und modellspezifische Preise, bevor Sie Guthaben gegen ein bestimmtes Modell ausgeben.

Hinweise zu Preisen, Lizenz und Verfügbarkeit

Die Bedingungen der kostenlosen Stufe in diesem Vergleich wurden am 18.08.2026 direkt anhand der Preis- oder Ratelimit-Dokumentation des jeweiligen Anbieters überprüft. Anmeldeguthaben, Empfehlungsobergrenzen, Ratenlimits und Tageskontingente sind Details, die Anbieter im Rahmen normaler Produktaktualisierungen ändern, nicht immer mit einem Changelog-Eintrag. Überprüfen Sie die Quellseite für jeden Anbieter erneut, bevor Sie sich bei der Produktionsplanung auf eine bestimmte Zahl verlassen, und betrachten Sie jede Zahl oben als eine Momentaufnahme und nicht als dauerhafte Garantie.

Entscheidungscheckliste für Entwickler

  • [ ] Bestätigen Sie, welche Free-Tier-Form zutrifft (Anmeldeguthaben, Empfehlungsguthaben, ratenbegrenztes kostenloses Modell oder tägliches Rechenkontingent).
  • [ ] Bestätigen Sie, dass das von Ihnen tatsächlich benötigte Modell von dieser kostenlosen Stufe abgedeckt wird, nicht nur der Anbieter im Allgemeinen.
  • [ ] Bestätigen Sie das spezifische numerische Limit (Anfragen/Minute, Anfragen/Tag, Token/Tag oder Dollarguthaben) in der aktuellen Dokumentation des Anbieters, nicht in diesem Artikel, bevor Sie etwas ausliefern, das davon abhängt.
  • [ ] Bestätigen Sie, ob die kostenlose Stufe eine gekaufte Kreditschwelle erfordert, bevor höhere Limits gelten (wie bei OpenRouter).
  • [ ] Planen Sie, was passiert, wenn die kostenlose Stufe aufgebraucht ist: Wird einfach abgerechnet oder wird die Anfrage abgelehnt?

FAQ

Gibt es eine wirklich unbegrenzte kostenlose LLM-API?

Nein. Jeder hier verglichene Anbieter begrenzt die kostenlose Nutzung durch ein Ratenlimit, eine tägliche Obergrenze oder ein Dollarguthaben. Anbieter, die als „kostenlos“ vermarktet werden, beschreiben eine gedeckelte Stufe, keinen unbegrenzten Zugang.

Welche kostenlose LLM-API hat das höchste Anfragen-pro-Tag-Limit?

Unter den hier überprüften ratenbegrenzten kostenlosen Stufen geben sowohl OpenRouter als auch Groq eine Obergrenze von 1.000 Anfragen pro Tag für ihre jeweiligen kostenlosen Modelle an, sobald OpenRouters Schwelle von $10 Lebenszeitguthaben erreicht ist. Das Kontingent von Cloudflare Workers AI von 10.000 Neuronen pro Tag ist ein Rechenbudget und keine feste Anfrageanzahl, daher lässt es sich nicht in eine einzelne vergleichbare Anfragenzahl übersetzen.

Bietet Novita AI ein kostenloses LLM-Modell an?

Der aktuelle serverlose LLM-AP-Katalog von Novita AI führt kein Modell, das zu $0 pro Token bepreist ist. Sein Free-Tier-Mechanismus ist ein Empehlungsprogramm, das sowel dem Empehlenden als auch dem neuen gewobenen Konto $10 Guthaben pro erfolgreicher Empehlung git, bis zu $500 ingesamt, ausgebenbar gegen den vollständigen serverlosen Katalog.

Gelten die Limits der kostenlosen Stufe pro API-Schlüssel oder pro Konto?

Dies variiert je nach Anbieter und ist auf der jeweiligen Ratelimit-Seite des Anbieters dokumetiert; Groq gibt zum Beispil an, dass seine Limits auf Organis ationinebene und nicht pro individuellem API-Schlüssel gelen. Überprüfen Sie die spezifische Dokumentation des Anbieters auf die Unterscheidung zwischen Konto und Schlüssel, bevor Sie ein Pooling-Verhalten von Anfragen annehmen.

Empfohlene Artikel