DeepSeek V4 Pro 0813 ist die Produktionsversion von DeepSeek V4 Pro auf Novita AI. Novita listet die Modell-ID jetzt als deepseek/deepseek-v4-pro-0813 mit 1,048,576 Kontext-Tokens, maximal 393,216 Ausgabe-Tokens und OpenAI-kompatiblem Zugriff über https://api.novita.ai/openai. Die Modellseite zeigt außerdem Serverless-Bereitstellung, Function Calling, strukturierte Ausgaben und Reasoning-Unterstützung.
Was sich in DeepSeek V4 Pro 0813 geändert hat
Diese Version ist nicht nur eine Umbenennung. Das Changelog von DeepSeek markiert die V4-Familie als offiziell veröffentlicht am 13. August 2026 und gibt an, dass Preisänderungen am 16. August 2026 UTC in Kraft treten. Die Hugging-Face-Modellkarte für DeepSeek-V4-Pro-0813 identifiziert es ebenfalls als offizielles Release und listet die Lizenz als MIT.
Die wichtigsten Release-Punkte sind:
| Feld | Wert |
|---|---|
| Modell-ID | deepseek/deepseek-v4-pro-0813 |
| Release-Status | GA / offizielles Release |
| Kontextfenster | 1,048,576 Tokens |
| Maximale Ausgabe | 393,216 Tokens |
| Eingabe | Text |
| Ausgabe | Text |
| Lizenz | MIT |
DSpark-Decoding-Update für DeepSeek V4 Pro 0813
Die offizielle Modellkarte besagt, dass 0813 das offizielle Release von DeepSeek V4 Pro ist und dass es der Preview-Struktur ein spekulatives DSpark-Decoding-Modul hinzufügt. Einfach ausgedrückt bedeutet das, dass der Serving-Pfad darauf ausgelegt ist, die Ausgabe konsistent zu halten und gleichzeitig die Decodierungseffizienz zu verbessern. Für Teams, die DeepSeek V4 Pro bereits für agentisches Coding oder Long-Context-Reasoning nutzen, ist der wichtige Punkt einfach: Dies ist die Version, die für den Produktionseinsatz gedacht ist – nicht der frühere Preview-Leitfaden.

Wenn Sie den Implementierungsaspekt näher betrachten möchten, orientieren Sie sich am DeepSeek-V4-Pro-Long-Context-Leitfaden für das Request-Shaping und am DeepSeek-V4-Pro-vs-Flash-Leitfaden für Routing-Entscheidungen.
Aktuelle Preise auf Novita AI
Zum Zeitpunkt dieser Prüfung zeigt die Modellseite von Novita:
| Feld | Wert |
|---|---|
| Eingabepreis | $1.32 / M Tokens |
| Cache-Lesepreis | $0.35 / M Tokens |
| Ausgabepreis | $3.96 / M Tokens |
| Endpoint-Familie | chat/completions, responses, anthropic |
Das sind die Preise, die Sie jetzt für Planung und Rollout-Prüfungen auf Novita AI verwenden sollten. Die älteren Preise aus der Preview-Ära, die in den früheren DeepSeek-V4-Pro-Artikeln genannt wurden, sollten nicht mehr verwendet werden.
Schnellstart
from openai import OpenAI
client = OpenAI(
api_key="YOUR_NOVITA_API_KEY",
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-pro-0813",
messages=[
{"role": "user", "content": "Summarize the key GA changes in DeepSeek V4 Pro 0813."}
],
temperature=0.2,
)
print(response.choices[0].message.content)
Wann Sie es verwenden sollten
Verwenden Sie DeepSeek V4 Pro 0813, wenn Sie das aktuelle GA-Modell auf Novita AI für Coding, Planung und Long-Context-Arbeiten benötigen. Wenn Sie noch zwischen Pro und Flash entscheiden, beginnen Sie mit Flash für den Basisverkehr und reservieren Sie Pro 0813 für anspruchsvollere Prompts.
FAQ
Ist DeepSeek V4 Pro 0813 dasselbe wie das frühere Preview-Release?
Nein. 0813 ist das GA-Release auf Novita AI, und die früheren Leitlinien aus der Preview-Ära sollten nicht als aktuelle Preise oder Release-Status behandelt werden.
Wie lautet die Modell-ID auf Novita AI?
deepseek/deepseek-v4-pro-0813.
Wo sollte ich beginnen, wenn ich eine Routing-Anleitung benötige?
Verwenden Sie Flash für den Basisverkehr und Pro 0813 für anspruchsvollere Prompts, Long-Context-Arbeiten und Aufgaben mit höheren Fehlerkosten.
Überprüfte Quellen:
