Qwen3.8 2.4T A95B auf Novita AI: 1 Mio. Kontext, offene Gewichte und 2 $/M Input

Qwen3.8 2.4T A95B auf Novita AI: 1 Mio. Kontext, offene Gewichte und 2 $/M Input

Qwen3.8 2.4T A95B ist ein Open-Weight-Modell der Qwen3.8-Familie, das ausschließlich Text verarbeitet und über die serverlose API von Novita AI verfügbar ist. Es richtet sich an Entwickler, die Langkontext-Codierung, Forschung, komplexes Reasoning oder agentische Workflows benötigen und dabei eine Open-Weight-Serving-Option nutzen möchten. Novita listet die Modell-ID als qwen/qwen3.8-2.4t-a95b, ein Kontextfenster von 1.000.000 Token, maximal 131.072 Ausgabe-Token und Preise von 2 $ pro 1 Mio. Input-Token, 0,25 $ pro 1 Mio. Cache-Read-Token sowie 6 $ pro 1 Mio. Output-Token.

Wichtige Erkenntnisse

  • Qwen3.8 2.4T A95B ist ein Open-Weight Sparse-MoE-Modell mit 2,4B Gesamtparametern und 95B aktiven Parametern.
  • Novita stellt es als reines Textmodell mit Function Calling, strukturierten Ausgaben und Reasoning-Unterstützung bereit.
  • Novita gibt ein Kontextfenster von 1.000.000 Token und eine maximale Ausgabe von 131.072 Token an.
  • Das Modell eignet sich besser für Teams, die Wert auf Open-Weight-Portabilität und Text-zentrierte Workflows legen, als für Aufgaben, die Bildeingabe oder eine schlüsselfertige, verwaltete Produktebene erfordern.

Qwen3.8 2.4T A95B – Spezifikationen und Preise

Feld Novita-Wert
Anzeigename Qwen3.8 2.4T A95B
Modell-ID qwen/qwen3.8-2.4t-a95b
Modelltyp Open-Weight Sparse MoE
Gesamtparameter 2,4B
Aktive Parameter 95B
Kontextfenster 1.000.000 Token
Max. Ausgabe-Token 131.072
Eingabemodalität Text
Ausgabemodalität Text
Endpunkte chat/completions, responses
Funktionen Serverlos, Function Calling, strukturierte Ausgaben, Reasoning
Eingabepreis 2 $ / 1 Mio. Token
Cache-Read-Preis 0,25 $ / 1 Mio. Token
Ausgabepreis 6 $ / 1 Mio. Token
Angezeigte Tarifstufe T1: 30 RPM / 50.000.000 TPM
Stand der Daten 2. September 2026

Preise und Limits können sich ändern. Überprüfen Sie vor einer produktionsrelevanten Kostenentscheidung die Novita AI Modellseite und die Novita AI Preisseite.

Was Qwen3.8 2.4T A95B kann

Qwen3.8 2.4T A95B ist für Text-zentrierte Workloads konzipiert, die von einem großen Kontextfenster und starker Reasoning-Fähigkeit profitieren. Seine Open-Weight-Ausrichtung gibt Teams zudem die Möglichkeit, das Modell im Hinblick auf ihre eigenen Serving- und Bereitstellungsanforderungen zu evaluieren, anstatt einen verwalteten Endpunkt als einzige Option zu betrachten.

Das Modell eignet sich für Repository-weite Code-Reviews, Multi-Dokumenten-Recherche, komplexes Text-Reasoning, strukturierte Generierung sowie Agent-Loops, die Tool-Spuren oder Zwischenzustände speichern. Die Qwen-Modellkarte dokumentiert die Modellgewichte und Konfigurationsdateien und listet Kompatibilität mit Serving-Stacks wie vLLM und SGLang auf.

Wann Qwen3.8 2.4T A95B eine gute Wahl ist

Wählen Sie dieses Modell, wenn Sie Folgendes benötigen:

  • Open-Weight-Portabilität und Kontrolle über die Serving-Ebene
  • Langkontext-Codierung, Code-Reviews oder Repository-Analysen
  • Reine Textforschung und Multi-Dokumenten-Reasoning
  • Agentische Workflows mit Function Calling, strukturierten Ausgaben oder Reasoning
  • Einen gehosteten Novita-Endpunkt zur Evaluierung vor tiefergehender Infrastrukturarbeit

Die Open-Weight-Unterscheidung ist wichtig, wenn Ihr Team später selbst hosten, die Serving-Infrastruktur wechseln oder ein konsistentes Modellartefakt über verschiedene Umgebungen hinweg beibehalten möchte. Informationen zum verwalteten Qwen3.8-Max-Modell auf Novita AI und seinem produktnahen Zugangspfad finden Sie unter Qwen3.8-Max auf Novita AI.

Wann Qwen3.8 2.4T A95B nicht die beste Standardwahl ist

Dieses Modell ist nicht die beste Standardwahl für Bild- oder Vision-Eingaben, da Novita die Eingabemodalität als Text angibt. Es kann auch mehr sein, als Sie für kurze Klassifikationen, einfache Extraktionen oder Prompts mit hohem Volumen benötigen, bei denen ein kleineres Modell die Qualitätsanforderungen zu geringeren Kosten erfüllen würde.

Wählen Sie stattdessen den verwalteten Qwen3.8-Max-Pfad, wenn Sie die zusätzliche Produktebene benötigen, einschließlich Vision-Eingabe oder eines stärker schlüsselfertigen, verwalteten Workflows. Wenn Ihre Hauptfrage darin besteht, wie Sie die erste Anfrage senden, verwenden Sie den Qwen3.8-Max API Schnellstart anstelle dieser Start- und Entscheidungsseite.

Qwen3.8 2.4T A95B API-Zugang auf Novita AI

Die Novita-Modellseite listet die API-Modell-ID als qwen/qwen3.8-2.4t-a95b und unterstützt die Endpunktfamilien chat/completions und responses. Der OpenAI-kompatible API-Einstiegspunkt von Novita lautet https://api.novita.ai/openai.

Dieser Abschnitt enthält bewusst nur Zugangsinformationen. Er enthält keine Erstanfrage-Anleitung, vollständige Anforderungsparameter oder Schritte zur Fehlerbehebung; diese gehören in einen 4.4 Schnellstart- oder Funktionsleitfaden.

FAQ

Wie lautet die Novita-Modell-ID?

Verwenden Sie qwen/qwen3.8-2.4t-a95b.

Ist Qwen3.8 2.4T A95B ein Open-Weight-Modell?

Ja. Die Qwen-Modellkarte stellt die Modellgewichte und Konfigurationsdateien für das nachtrainierte Modell bereit. Die Verfügbarkeit offener Gewichte bedeutet nicht, dass jede Bereitstellung dasselbe Hardware-, Serving- oder Leistungsprofil aufweist.

Welche Kontext- und Ausgabelimits gibt Novita an?

Novita gibt ein Kontextfenster von 1.000.000 Token und eine maximale Ausgabe von 131.072 Token an.

Was kostet es auf Novita AI?

Novita listet zum Stand 2. September 2026 Preise von 2 $ pro 1 Mio. Input-Token, 0,25 $ pro 1 Mio. Cache-Read-Token und 6 $ pro 1 Mio. Output-Token.

Ist dies das Gleiche wie Qwen3.8-Max?

Es handelt sich um das Open-Weight-Modell Qwen3.8 2.4T A95B, während Qwen3.8-Max der separate verwaltete Dienstpfad ist. Vergleichen Sie die verifizierten Fähigkeiten und Zugriffsanforderungen für Ihren Workload, bevor Sie eine Wahl treffen.

Quellen

Empfohlene Artikel