Qwen3.8 2.4T A95B ist ein Open-Weight-Modell der Qwen3.8-Familie, das ausschließlich Text verarbeitet und über die serverlose API von Novita AI verfügbar ist. Es richtet sich an Entwickler, die Langkontext-Codierung, Forschung, komplexes Reasoning oder agentische Workflows benötigen und dabei eine Open-Weight-Serving-Option nutzen möchten. Novita listet die Modell-ID als qwen/qwen3.8-2.4t-a95b, ein Kontextfenster von 1.000.000 Token, maximal 131.072 Ausgabe-Token und Preise von 2 $ pro 1 Mio. Input-Token, 0,25 $ pro 1 Mio. Cache-Read-Token sowie 6 $ pro 1 Mio. Output-Token.
Wichtige Erkenntnisse
- Qwen3.8 2.4T A95B ist ein Open-Weight Sparse-MoE-Modell mit 2,4B Gesamtparametern und 95B aktiven Parametern.
- Novita stellt es als reines Textmodell mit Function Calling, strukturierten Ausgaben und Reasoning-Unterstützung bereit.
- Novita gibt ein Kontextfenster von 1.000.000 Token und eine maximale Ausgabe von 131.072 Token an.
- Das Modell eignet sich besser für Teams, die Wert auf Open-Weight-Portabilität und Text-zentrierte Workflows legen, als für Aufgaben, die Bildeingabe oder eine schlüsselfertige, verwaltete Produktebene erfordern.
Qwen3.8 2.4T A95B – Spezifikationen und Preise
| Feld | Novita-Wert |
|---|---|
| Anzeigename | Qwen3.8 2.4T A95B |
| Modell-ID | qwen/qwen3.8-2.4t-a95b |
| Modelltyp | Open-Weight Sparse MoE |
| Gesamtparameter | 2,4B |
| Aktive Parameter | 95B |
| Kontextfenster | 1.000.000 Token |
| Max. Ausgabe-Token | 131.072 |
| Eingabemodalität | Text |
| Ausgabemodalität | Text |
| Endpunkte | chat/completions, responses |
| Funktionen | Serverlos, Function Calling, strukturierte Ausgaben, Reasoning |
| Eingabepreis | 2 $ / 1 Mio. Token |
| Cache-Read-Preis | 0,25 $ / 1 Mio. Token |
| Ausgabepreis | 6 $ / 1 Mio. Token |
| Angezeigte Tarifstufe | T1: 30 RPM / 50.000.000 TPM |
| Stand der Daten | 2. September 2026 |
Preise und Limits können sich ändern. Überprüfen Sie vor einer produktionsrelevanten Kostenentscheidung die Novita AI Modellseite und die Novita AI Preisseite.
Was Qwen3.8 2.4T A95B kann
Qwen3.8 2.4T A95B ist für Text-zentrierte Workloads konzipiert, die von einem großen Kontextfenster und starker Reasoning-Fähigkeit profitieren. Seine Open-Weight-Ausrichtung gibt Teams zudem die Möglichkeit, das Modell im Hinblick auf ihre eigenen Serving- und Bereitstellungsanforderungen zu evaluieren, anstatt einen verwalteten Endpunkt als einzige Option zu betrachten.
Das Modell eignet sich für Repository-weite Code-Reviews, Multi-Dokumenten-Recherche, komplexes Text-Reasoning, strukturierte Generierung sowie Agent-Loops, die Tool-Spuren oder Zwischenzustände speichern. Die Qwen-Modellkarte dokumentiert die Modellgewichte und Konfigurationsdateien und listet Kompatibilität mit Serving-Stacks wie vLLM und SGLang auf.
Wann Qwen3.8 2.4T A95B eine gute Wahl ist
Wählen Sie dieses Modell, wenn Sie Folgendes benötigen:
- Open-Weight-Portabilität und Kontrolle über die Serving-Ebene
- Langkontext-Codierung, Code-Reviews oder Repository-Analysen
- Reine Textforschung und Multi-Dokumenten-Reasoning
- Agentische Workflows mit Function Calling, strukturierten Ausgaben oder Reasoning
- Einen gehosteten Novita-Endpunkt zur Evaluierung vor tiefergehender Infrastrukturarbeit
Die Open-Weight-Unterscheidung ist wichtig, wenn Ihr Team später selbst hosten, die Serving-Infrastruktur wechseln oder ein konsistentes Modellartefakt über verschiedene Umgebungen hinweg beibehalten möchte. Informationen zum verwalteten Qwen3.8-Max-Modell auf Novita AI und seinem produktnahen Zugangspfad finden Sie unter Qwen3.8-Max auf Novita AI.
Wann Qwen3.8 2.4T A95B nicht die beste Standardwahl ist
Dieses Modell ist nicht die beste Standardwahl für Bild- oder Vision-Eingaben, da Novita die Eingabemodalität als Text angibt. Es kann auch mehr sein, als Sie für kurze Klassifikationen, einfache Extraktionen oder Prompts mit hohem Volumen benötigen, bei denen ein kleineres Modell die Qualitätsanforderungen zu geringeren Kosten erfüllen würde.
Wählen Sie stattdessen den verwalteten Qwen3.8-Max-Pfad, wenn Sie die zusätzliche Produktebene benötigen, einschließlich Vision-Eingabe oder eines stärker schlüsselfertigen, verwalteten Workflows. Wenn Ihre Hauptfrage darin besteht, wie Sie die erste Anfrage senden, verwenden Sie den Qwen3.8-Max API Schnellstart anstelle dieser Start- und Entscheidungsseite.
Qwen3.8 2.4T A95B API-Zugang auf Novita AI
Die Novita-Modellseite listet die API-Modell-ID als qwen/qwen3.8-2.4t-a95b und unterstützt die Endpunktfamilien chat/completions und responses. Der OpenAI-kompatible API-Einstiegspunkt von Novita lautet https://api.novita.ai/openai.
Dieser Abschnitt enthält bewusst nur Zugangsinformationen. Er enthält keine Erstanfrage-Anleitung, vollständige Anforderungsparameter oder Schritte zur Fehlerbehebung; diese gehören in einen 4.4 Schnellstart- oder Funktionsleitfaden.
FAQ
Wie lautet die Novita-Modell-ID?
Verwenden Sie qwen/qwen3.8-2.4t-a95b.
Ist Qwen3.8 2.4T A95B ein Open-Weight-Modell?
Ja. Die Qwen-Modellkarte stellt die Modellgewichte und Konfigurationsdateien für das nachtrainierte Modell bereit. Die Verfügbarkeit offener Gewichte bedeutet nicht, dass jede Bereitstellung dasselbe Hardware-, Serving- oder Leistungsprofil aufweist.
Welche Kontext- und Ausgabelimits gibt Novita an?
Novita gibt ein Kontextfenster von 1.000.000 Token und eine maximale Ausgabe von 131.072 Token an.
Was kostet es auf Novita AI?
Novita listet zum Stand 2. September 2026 Preise von 2 $ pro 1 Mio. Input-Token, 0,25 $ pro 1 Mio. Cache-Read-Token und 6 $ pro 1 Mio. Output-Token.
Ist dies das Gleiche wie Qwen3.8-Max?
Es handelt sich um das Open-Weight-Modell Qwen3.8 2.4T A95B, während Qwen3.8-Max der separate verwaltete Dienstpfad ist. Vergleichen Sie die verifizierten Fähigkeiten und Zugriffsanforderungen für Ihren Workload, bevor Sie eine Wahl treffen.
Quellen
- Novita Modellseite: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (geprüft am 02.09.2026)
- Novita Preisseite: https://novita.ai/pricing (geprüft am 02.09.2026)
- Qwen Modellkarte: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (geprüft am 02.09.2026)
- Qwen3.8-Max Startleitfaden: /qwen3-8-max-on-novita-ai-launch-pricing/
- Qwen3.8-Max Schnellstart: /qwen3-8-max-api-quick-start/
