Qwen3.8 2.4T A95B ist ein Open-Weight-Modell von Qwen3.8, das ausschließlich Text verarbeitet und über die serverlose API von Novita AI verfügbar ist. Es richtet sich an Entwickler, die Long-Context-Coding, Recherche, komplexes Reasoning oder agentische Workflows benötigen und dabei eine Open-Weight-Serving-Option behalten möchten. Novita listet die Modell-ID als qwen/qwen3.8-2.4t-a95b mit einem Kontextfenster von 1.000.000 Token, maximal 131.072 Ausgabe-Token und Preisen von 2 $ pro 1 Million Eingabe-Token, 0,25 $ pro 1 Million Cache-Read-Token und 6 $ pro 1 Million Ausgabe-Token.
Die wichtigsten Erkenntnisse
- Qwen3.8 2.4T A95B ist ein Open-Weight-Sparse-MoE-Modell mit insgesamt 2.4T Parametern und 95B aktiven Parametern.
- Novita stellt es als serverloses Modell mit Text-Eingabe bereit und unterstützt Function Calling, strukturierte Ausgaben und Reasoning.
- Novita listet ein Kontextfenster von 1.000.000 Token und eine maximale Ausgabe von 131.072 Token.
- Das Modell ist besser für Teams geeignet, die Open-Weight-Portabilität und Text-First-Workflows schätzen, als für Arbeitslasten, die Vision-Eingaben oder eine schlüsselfertige verwaltete Produktebene erfordern.
Qwen3.8 2.4T A95B – Spezifikationen und Preise
| Feld | Wert bei Novita |
|---|---|
| Anzeigename | Qwen3.8 2.4T A95B |
| Modell-ID | qwen/qwen3.8-2.4t-a95b |
| Modelltyp | Open-Weight-Sparse-MoE |
| Gesamtparameter | 2.4T |
| Aktive Parameter | 95B |
| Kontextfenster | 1,000,000 Token |
| Max. Ausgabe-Token | 131,072 |
| Eingabe-Modalität | Text |
| Ausgabe-Modalität | Text |
| Endpunkte | chat/completions, responses |
| Funktionen | Serverless, Function Calling, strukturierte Ausgaben, Reasoning |
| Eingabepreis | $2 / 1M Token |
| Cache-Read-Preis | $0.25 / 1M Token |
| Ausgabepreis | $6 / 1M Token |
| Angezeigte Tarifstufe | T1: 30 RPM / 50,000,000 TPM |
| Prüfdatum | 2. September 2026 |
Preise und Limits können sich ändern. Prüfen Sie die Novita-AI-Modellseite und die Preisseite von Novita AI, bevor Sie sich auf Produktionskosten festlegen.
Was Qwen3.8 2.4T A95B kann
Qwen3.8 2.4T A95B wurde für Text-First-Arbeitslasten entwickelt, die von einem großen Kontextfenster und einer starken Reasoning-Kapazität profitieren. Die Open-Weight-Positionierung gibt Teams außerdem die Möglichkeit, das Modell anhand der eigenen Serving- und Deployment-Anforderungen zu evaluieren, statt einen verwalteten Endpunkt als einzige Option zu betrachten.
Das Modell eignet sich für Code-Reviews auf Repository-Ebene, Recherchen über mehrere Dokumente, komplexes Text-Reasoning, strukturierte Generierung sowie Agenten-Loops, die Tool-Spuren oder Zwischenzustände behalten. Die Qwen-Modellkarte dokumentiert die Modellgewichte und Konfigurationsdateien und listet Kompatibilität mit Serving-Stacks wie vLLM und SGLang auf.
Wann Qwen3.8 2.4T A95B gut geeignet ist
Wählen Sie dieses Modell, wenn Sie Folgendes benötigen:
- Open-Weight-Portabilität und Kontrolle über die Serving-Ebene
- Long-Context-Coding, Code-Review oder Repository-Analyse
- Textbasierte Recherche und Reasoning über mehrere Dokumente
- Agentische Workflows mit Function Calling, strukturierten Ausgaben oder Reasoning
- Einen gehosteten Novita-Endpunkt für die Evaluierung, bevor Sie umfangreichere Infrastrukturarbeiten durchführen
Die Open-Weight-Eigenschaft ist wichtig, wenn Ihr Team später selbst hosten, die Serving-Infrastruktur wechseln oder ein konsistentes Modell-Artefakt über Umgebungen hinweg beibehalten möchte. Für das verwaltete Qwen3.8-Max-Modell auf Novita AI und den produktbezogenen Zugriffspfad finden Sie weitere Informationen unter Qwen3.8-Max auf Novita AI.
Wann Qwen3.8 2.4T A95B nicht die beste Standardwahl ist
Dieses Modell ist nicht die beste Standardwahl für Bild- oder Vision-Eingaben, da Novita als Eingabe-Modalität Text angibt. Es kann außerdem für kurze Klassifizierungen, einfache Extraktionen oder Prompts mit hohem Volumen überdimensioniert sein, wenn ein kleineres Modell die Qualitätsanforderungen zu geringeren Kosten erfüllt.
Wählen Sie stattdessen den verwalteten Qwen3.8-Max-Weg, wenn Sie dessen zusätzliche Produktebene benötigen, einschließlich Vision-Eingaben oder eines stärker schlüsselfertigen verwalteten Workflows. Wenn Sie hauptsächlich wissen möchten, wie Sie Ihre erste Anfrage senden, nutzen Sie den Qwen3.8-Max-API-Schnellstart statt dieser Einführungs- und Entscheidungsseite.
API-Zugriff auf Qwen3.8 2.4T A95B bei Novita AI
Die Novita-Modellseite listet die API-Modell-ID als qwen/qwen3.8-2.4t-a95b und unterstützt die Endpunktfamilien chat/completions und responses. Der OpenAI-kompatible API-Endpunkt von Novita lautet https://api.novita.ai/openai.
Dieser Abschnitt enthält bewusst nur Zugriffsinformationen. Er enthält keine vollständige Anleitung für die erste Anfrage, keine vollständigen Anfrageparameter und keine Schritte zur Fehlerbehebung; diese gehören in einen 4.4-Quick-Start- oder Feature-Guide.
FAQ
Wie lautet die Novita-Modell-ID?
Verwenden Sie qwen/qwen3.8-2.4t-a95b.
Ist Qwen3.8 2.4T A95B ein Open-Weight-Modell?
Ja. Die Qwen-Modellkarte stellt die Modellgewichte und Konfigurationsdateien für das nachtrainierte Modell bereit. Open-Weight-Verfügbarkeit bedeutet nicht, dass jedes Deployment dasselbe Hardware-, Serving- oder Leistungsprofil hat.
Welche Kontext- und Ausgabelimits listet Novita?
Novita listet ein Kontextfenster von 1.000.000 Token und eine maximale Ausgabe von 131.072 Token.
Was kostet es auf Novita AI?
Novita listet, geprüft am 2. September 2026, einen Preis von 2 $ pro 1 Million Eingabe-Token, 0,25 $ pro 1 Million Cache-Read-Token und 6 $ pro 1 Million Ausgabe-Token.
Ist das dasselbe wie Qwen3.8-Max?
Es ist das Open-Weight-Modell Qwen3.8 2.4T A95B, während Qwen3.8-Max ein separater, verwalteter Service ist. Vergleichen Sie die geprüften Funktionen und Zugriffsvoraussetzungen für Ihre Arbeitslast, bevor Sie sich zwischen beiden entscheiden.
Quellen
- Novita-Modellseite: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (geprüft am 2. September 2026)
- Preisseite von Novita AI: https://novita.ai/pricing (geprüft am 2. September 2026)
- Qwen-Modellkarte: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (geprüft am 2. September 2026)
- Qwen3.8-Max-Einführungsleitfaden: /qwen3-8-max-on-novita-ai-launch-pricing/
- Qwen3.8-Max-Schnellstart: /qwen3-8-max-api-quick-start/
