Claude bietet zwei separate Preispfade: API-Token-Preise für Entwickler, die Modelle programmatisch aufrufen, und Abonnementpläne für die Nutzung von Claude über claude.ai. Diese werden unabhängig voneinander abgerechnet und dienen unterschiedlichen Anwendungsfällen – eine Verwechslung führt zu schlechten Budgetentscheidungen. Dieser Leitfaden behandelt die genauen Tarife für beide Pfade, was jeder Plan freischaltet und wo die wahren Kostenmultiplikatoren liegen, einschließlich Claude Code und agentischer Nutzung.
Kurzübersicht Preistabelle
| Pfad | Option | Preis |
|---|---|---|
| API | Claude Haiku 4.5 | 1,00 $ / 5,00 $ pro MTok (Eingabe/Ausgabe) |
| API | Claude Sonnet 5 | 2,00 $ / 10,00 $ pro MTok (Eingabe/Ausgabe) |
| API | Claude Opus 5 | 5,00 $ / 25,00 $ pro MTok (Eingabe/Ausgabe) |
| Abonnement | Free | 0 $/Monat |
| Abonnement | Pro | 20 $/Monat (~17 $/Monat jährlich) |
| Abonnement | Max 5x | 100 $/Monat |
| Abonnement | Max 20x | 200 $/Monat |
| Abonnement | Team Standard | 25 $/Sitzplatz/Monat |
| Abonnement | Team Premium | 125 $/Sitzplatz/Monat |
| Abonnement | Enterprise | Individuell |
Claude Abonnementpläne
Anthropic bietet fünf Stufen für den Zugriff auf Claude über claude.ai. Jeder Plan setzt ein Nutzungslimit für die Chat-Oberfläche und Claude Code – der API-Zugriff wird separat abgerechnet.
| Plan | Monatlicher Preis | Jährlich (pro Monat) | Für wen geeignet |
|---|---|---|---|
| Free | 0 $ | 0 $ | Leichte private Nutzung |
| Pro | 20 $ | ~17 $ | Regelmäßige Nutzer, Entwickler |
| Max 5x | 100 $ | — | Intensive tägliche Nutzer |
| Max 20x | 200 $ | — | Power-User, agentische Workflows |
| Team Standard | 25 $/Sitzplatz | ~20 $/Sitzplatz | Kleine bis mittlere Teams |
| Team Premium | 125 $/Sitzplatz | ~100 $/Sitzplatz | Entwicklungsteams mit Claude Code |
| Enterprise | Individuell | Individuell | Große Organisationen, Compliance-Anforderungen |
Free
Der Free-Plan bietet eingeschränkten Zugriff auf Claude über die Weboberfläche, ohne Claude Code und ohne API-Zugriff. Geeignet für gelegentliche Nutzung; keine ernsthafte Option für Entwicklung oder tägliche Produktivitätsarbeit.
Pro (20 $/Monat)
Pro bietet 5x mehr Nutzung als Free und schaltet Zugriff auf alle aktuellen Modellstufen frei – Haiku 4.5, Sonnet 5 und Opus 5. Claude Code ist enthalten. Der Jahrestarif von 17 $/Monat macht es zum kosteneffektivsten Einstiegspunkt für einzelne Entwickler oder alle, die Claude als primäres Werkzeug nutzen.
Max-Pläne (100–200 $/Monat)
Die Max-Stufen existieren, weil Claude Code und erweiterte agentische Sitzungen die Nutzungskontingente schnell verbrauchen – etwa 5 bis 20 Mal schneller als Konversations-Chat. Wenn Sie bei Codierungsaufgaben regelmäßig die Pro-Limits erreichen, deckt Max 5x (100 $) das 5-fache der Pro-Nutzung ab. Max 20x (200 $) ist für Entwickler, die den ganzen Tag über mehrstufige Agenten oder lange Codiersitzungen ausführen.
Team-Pläne (25–125 $/Sitzplatz/Monat)
Team Standard eignet sich für Organisationen, die einen gemeinsamen Arbeitsbereich, Administrationskontrollen und standardmäßigen Modellzugriff ohne Claude Code-Anforderungen wünschen. Team Premium fügt Claude Code-Zugriff für Entwicklungsteams hinzu und ist das praktische Äquivalent auf Teamebene zu einem Max-Plan. Möglicherweise gelten Mindestsitzplatzanzahlen – prüfen Sie die aktuelle Anthropic-Preisseite.
Enterprise
Enterprise-Preise sind individuell und beinhalten in der Regel dedizierten Support, erweiterte Sicherheits- und Compliance-Funktionen (SSO, Audit-Logs) sowie ausgehandelte Tarifobergrenzen. Die Basistarife beginnen normalerweise bei etwa 20 $/Sitzplatz plus API-Nutzung, aber die tatsächlichen Bedingungen hängen von Vertragsgröße und Anforderungen ab.
Claude API-Preise nach Modell
Der API-Zugriff ist nutzungsabhängig und wird pro Million Token (MTok) abgerechnet. Eingabe- und Ausgabetoken werden getrennt berechnet. Stand August 2026 sind die aktiven Modellstufen:
| Modell | Eingabe ($/MTok) | Ausgabe ($/MTok) | Kontextfenster | Maximale Ausgabe |
|---|---|---|---|---|
| Claude Opus 5 | 5,00 $ | 25,00 $ | 1M Token | 128K Token |
| Claude Sonnet 5 | 2,00 $ | 10,00 $ | 1M Token | 128K Token |
| Claude Haiku 4.5 | 1,00 $ | 5,00 $ | 200K Token | 64K Token |
Ein durchgängiges Muster: Ausgabetoken kosten auf jeder Stufe das 5-fache des Eingabepreises. Dieses Verhältnis ist für die Kostenschätzung wichtig – ein Workflow, der lange Ausgaben generiert, wird den Großteil seines Token-Budgets für die Ausgabe aufwenden.
Praktische Schätzungen pro Aufruf für eine typische Aufgabe (4.000 Eingabetoken + 500 Ausgabetoken):
- Haiku 4.5: ~0,0065 $
- Sonnet 5: ~0,013 $
- Opus 5: ~0,0325 $
Hochgerechnet auf 100.000 Aufrufe pro Monat beträgt der Unterschied zwischen Haiku und Opus etwa 650 $ gegenüber 3.250 $ – bei identischem Aufgabenvolumen.
Claude Code Abonnementkosten
Claude Code, Anthropics terminalbasiertes Codierungs-Agent, ist in Pro und höher enthalten – es gibt keine eigenständige kostenlose Stufe dafür. Was zwischen den Plänen variiert, ist die Nutzungstiefe:
- Pro (20 $/Monat): Claude Code-Zugriff enthalten, aber komplexe Multi-File- oder langfristige Aufgaben können das Nutzungslimit schnell erschöpfen.
- Max 5x (100 $/Monat): 5x die Nutzung von Pro, geeignet für aktive tägliche Codiersitzungen.
- Max 20x (200 $/Monat): Für Entwickler, die Claude Code als primären IDE-Assistenten während des gesamten Arbeitstages nutzen.
- Team Premium (125 $/Sitzplatz/Monat): Claude Code für Teams mit gemeinsamem Arbeitsbereich und Administrationskontrollen.
Eine Klarstellung ist wichtig: Das Abonnement steuert, wie viel Sie Claude Code über die Oberfläche nutzen können. Wenn Sie Ihren eigenen Codierungs-Agenten auf Basis der Anthropic-API erstellen, sind diese Kosten separat und werden pro Token abgerechnet.
Wie sich API-Token-Kosten summieren
Die Token-Mathematik wird schnell unübersichtlich, insbesondere bei kontextintensiven Aufgaben.
Kontext ist wichtiger als die Fertiglänge. Wenn Sie pro Aufruf 100.000 Token Kontext übergeben und nur 2.000 Token zurückerhalten, geben Sie allein für die Opus 5-Eingabe 0,50 $ pro Aufruf aus. Entwickler, die Dokument-Q&A, Code-Review oder Langkontext-Zusammenfassungstools erstellen, müssen die Eingabekosten als primäre Variable betrachten, nicht die Ausgabe.
Agentische Schleifen multiplizieren Token. Eine einzelne Claude Code-Sitzung, die eine Codebasis liest, Dateien überarbeitet und Verifizierungsschritte ausführt, kann 50.000–200.000 Token im gesamten Gespräch generieren. Planen Sie entsprechend.
Die Modellwahl ist der größte Kostenhebel. Bevor Sie eine Arbeitslast Opus 5 zuweisen, testen Sie, ob Haiku 4.5 oder Sonnet 5 eine akzeptable Qualität erreicht. Viele Klassifikations-, Extraktions- und Zusammenfassungsaufgaben laufen auf Haiku bei 80 % niedrigeren Kosten pro Token einwandfrei.
Batch- und Caching-Rabatte
Anthropic bietet zwei strukturierte Wege zur Kostenreduzierung:
Prompt Caching
Für wiederholten Kontext (System-Prompts, Referenzdokumente, Codebasis-Schnappschüsse) vermeidet Prompt Caching die erneute Berechnung des vollen Eingabepreises für gecachte Token. Die Cache-Leseraten sind deutlich niedriger – etwa 90 % Einsparungen beim gecachten Teil für häufig wiederverwendete Prompts. Cache-Schreibvorgänge haben einen kleinen Aufpreis; die Wirtschaftlichkeit ist gegeben, wenn derselbe Kontextblock über viele Aufrufe hinweg verwendet wird.
Batch API
Die Batch-API verarbeitet Anfragen asynchron und liefert Ergebnisse innerhalb von 24 Stunden. Aktueller Rabatt: 50 % auf sowohl Eingabe- als auch Ausgabetoken bei unterstützten Modellen. Dies ist eine direkte Lösung für Evaluierungs-Pipelines, Masseninhaltserstellung, nächtliche Datenverarbeitung und alle Arbeitslasten, bei denen keine Echtzeitlatenz erforderlich ist.
Kombination beider Ansätze: Eine Dokumentanalyse-Pipeline, die einen großen System-Prompt wiederverwendet und Anfragen in Batches verarbeitet, kann die effektiven Token-Kosten im Vergleich zu synchronen, nicht gecachten Aufrufen um 70–80 % senken.
Den richtigen Plan oder die richtige Modellstufe wählen
Einige Entscheidungsregeln, die tatsächlich Bestand haben:
Wenn Sie Claude ein paar Mal pro Woche für Chat und leichte Codierung nutzen: Pro für 20 $/Monat ist in der Regel ausreichend. Der Jahrestarif bringt es auf ~17 $/Monat.
Wenn Claude Code Ihre primäre Codierungsumgebung ist: Beginnen Sie mit Max 5x (100 $/Monat). Wechseln Sie zuerst zu Pro und beobachten Sie, ob Sie innerhalb einer Woche an Grenzen stoßen – wenn ja, upgraden Sie.
Wenn Sie ein API-basiertes Produkt entwickeln: Zahlen Sie kein Abonnement als Ersatz für API-Kosten. Diese sind getrennt. Kaufen Sie Credits, nutzen Sie die Batch-API für nicht-echtzeitnahe Jobs und wählen Sie das günstigste Modell, das die Qualitätsschwelle für Ihre spezifische Aufgabe erfüllt.
Für Teams: Team Standard deckt die meisten Kollaborationsanforderungen ab. Team Premium ist nur sinnvoll, wenn Ingenieure Claude Code in voller Nutzungstiefe benötigen – der Jahrestarif von 100 $/Sitzplatz entspricht in etwa einem individuellen Max 5x-Plan.
Für Unternehmen: Verhandeln Sie über das Volumen, nicht über die Stufe. Der angegebene Preis pro Sitzplatz ist ein Ausgangspunkt, keine Obergrenze.
Verwendung der Novita AI LLM API als Kostenalternative
Für Entwickler, die mit Open-Source-Modellen arbeiten oder kostenintensive Arbeitslasten betreiben, bietet die Novita AI LLM API einen OpenAI-kompatiblen Endpunkt für Modelle wie Llama, Qwen, DeepSeek und GLM zu deutlich niedrigeren Token-Kosten. Die Eingabepreise beginnen bei 0,02 $/Millionen Token für kleinere Modelle, und leistungsfähige mittelgroße Modelle wie die Qwen3- und DeepSeek V3-Serie liegen unter 0,50 $/Millionen Token für die Eingabe.
Dies ist in der Praxis für Claude Code-Nutzer relevant: Mehrere Open-Source-Modelle können über die API-Kompatibilitätsschicht als Claude Code-Backends verwendet werden, wodurch die Token-Kosten pro Sitzung erheblich gesenkt werden. Beispielsweise läuft GLM-5 für 1,00 $/3,20 $ pro Million Token auf Novita AI – ein Bruchteil des Opus 5-Tarifs – und wurde speziell für agentische Codierungs-Workflows getestet. Eine Anleitung zur Einrichtung finden Sie unter Wie man GLM-5 in Claude Code verwendet.
Für Teams, die mehrstufige Agenten betreiben, bietet die Novita Agent Sandbox verwaltete Ausführungsumgebungen für Browserautomatisierung, Codeausführung und Dateioperationen – die Infrastrukturebene, die allein durch API-Aufrufe nicht abgedeckt wird. Informationen zu den Preisen für die Agent-Sandbox-Infrastruktur finden Sie unter KI-Agent-Sandbox-Preismodelle.
Wenn die Budgetoptimierung das Hauptziel ist, finden Sie unter Top 10 günstigste LLM-APIs im Jahr 2026 einen vergleichenden Überblick über die Anbieter.
FAQ
Wie viel kostet Claude pro Monat?
Claude kostet 0 $ (Free), 20 $ (Pro), 100 $ (Max 5x) oder 200 $ (Max 20x) pro Monat für Einzelpläne. Teampläne beginnen bei 25 $/Sitzplatz (Standard) oder 125 $/Sitzplatz (Premium). Enterprise-Preise sind individuell.
Wie hoch sind die API-Preise von Claude?
Stand August 2026: Haiku 4.5 für 1 $/5 $ pro Million Token (Eingabe/Ausgabe), Sonnet 5 für 2 $/10 $ und Opus 5 für 5 $/25 $. Alle Tarife sind nutzungsabhängig ohne monatliches Minimum.
Wie viel kostet Claude Pro?
20 $/Monat bei monatlicher Abrechnung oder etwa 17 $/Monat bei einem Jahresplan.
Wie hoch ist der Preis für Claude Max?
Max 5x kostet 100 $/Monat und Max 20x kostet 200 $/Monat. Beides sind Einzelpläne für intensive Claude-Nutzung einschließlich Claude Code. Derzeit ist für Max-Stufen keine jährliche Abrechnungsoption aufgeführt.
Wie viel kostet Claude Code?
Claude Code ist in Pro (20 $/Monat) und höher enthalten. Es gibt keine kostenlose Stufe. Team Premium (125 $/Sitzplatz/Monat) ist die empfohlene Stufe für Entwicklungsteams, die vollen Claude Code-Zugriff benötigen.
Wie hoch sind die Preise für Anthropic Claude Opus in der API?
Claude Opus 5 kostet 5,00 $/MTok Eingabe und 25,00 $/MTok Ausgabe. Prompt Caching- und Batch-API-Rabatte sind anwendbar.
Wie hoch sind die Preise für Claude Sonnet?
Claude Sonnet 5 kostet 2,00 $/MTok Eingabe und 10,00 $/MTok Ausgabe.
Bietet Anthropic Mengenrabatte?
Ja, über zwei Mechanismen: die Batch-API (50 % Rabatt auf Eingabe und Ausgabe für asynchrone Verarbeitung) und Prompt Caching (bis zu 90 % Einsparungen bei wiederholten Kontextblöcken). Enterprise-Verträge können auch ausgehandelte Tarifobergrenzen enthalten.
Wie hoch sind die Anthropic-API-Kosten im großen Maßstab?
Bei 10 Millionen Aufrufen pro Monat mit 4K Eingabe + 500 Ausgabe-Token pro Aufruf: Haiku 4.5 summiert sich auf ~65.000 $/Monat vor Rabatten; Sonnet 5 ~130.000 $; Opus 5 ~325.000 $. Batch-API-Rabatte halbieren diese Kosten für Nicht-Echtzeit-Arbeitslasten etwa.
