Qwen3.8 2.4T A95B auf Novita AI: Open-Weight-API mit 1M Kontext

Qwen3.8 2.4T A95B auf Novita AI: Open-Weight-API mit 1M Kontext

Qwen3.8 2.4T A95B ist ein Open-Weight-Modell von Qwen3.8, das ausschließlich Text verarbeitet und über die serverlose API von Novita AI verfügbar ist. Es richtet sich an Entwickler, die lange Kontexte für Coding, Recherche, komplexes Reasoning oder agentische Workflows benötigen und gleichzeitig eine Open-Weight-Serving-Option nutzen möchten. Novita listet die Modell-ID als qwen/qwen3.8-2.4t-a95b, ein 1.000.000-Token-Kontextfenster, maximal 131.072 Ausgabetoken und Preise von $2 pro 1M Input-Token, $0,25 pro 1M Cache-Read-Token und $6 pro 1M Output-Token.

Die wichtigsten Erkenntnisse

  • Qwen3.8 2.4T A95B ist ein Open-Weight-Modell mit spärlichem MoE, 2,4T Gesamtparametern und 95B aktiven Parametern.
  • Novita stellt es als reines Textmodell (serverlos) mit Funktionsaufruf, strukturierten Ausgaben und Reasoning-Unterstützung bereit.
  • Novita gibt ein Kontextfenster von 1.000.000 Token und eine maximale Ausgabe von 131.072 Token an.
  • Das Modell eignet sich besser für Teams, die Wert auf Open-Weight-Portabilität und Text-First-Workflows legen, als für Workloads, die Bildeingabe oder eine vollständig verwaltete Produktebene erfordern.

Qwen3.8 2.4T A95B Spezifikationen und Preise

Feld Novita-Wert
Anzeigename Qwen3.8 2.4T A95B
Modell-ID qwen/qwen3.8-2.4t-a95b
Modelltyp Open-Weight, spärliches MoE
Gesamtparameter 2,4T
Aktive Parameter 95B
Kontextfenster 1.000.000 Token
Maximale Ausgabetoken 131.072
Eingabemodalität Text
Ausgabemodalität Text
Endpunkte chat/completions, responses
Funktionen Serverlos, Funktionsaufruf, strukturierte Ausgaben, Reasoning
Eingabepreis $2 / 1M Token
Cache-Read-Preis $0,25 / 1M Token
Ausgabepreis $6 / 1M Token
Angezeigte Stufe T1: 30 RPM / 50.000.000 TPM
Datum der Überprüfung 2. September 2026

Preise und Limits können sich ändern. Überprüfe die Novita AI Modellseite und die Novita AI Preisseite, bevor du eine Produktionskostenentscheidung triffst.

Was Qwen3.8 2.4T A95B kann

Qwen3.8 2.4T A95B ist für Text-First-Workloads konzipiert, die von einem großen Kontextfenster und einer starken Reasoning-Fähigkeit profitieren. Seine Open-Weight-Positionierung gibt Teams außerdem die Möglichkeit, das Modell im Hinblick auf ihre eigenen Serving- und Bereitstellungsanforderungen zu evaluieren, anstatt einen verwalteten Endpunkt als einzige Option zu betrachten.

Das Modell eignet sich für Code-Reviews auf Repository-Ebene, Multi-Dokumenten-Recherche, komplexes Text-Reasoning, strukturierte Generierung und Agenten-Schleifen, die Tool-Traces oder Zwischenzustände speichern. Die Qwen-Modellkarte dokumentiert die Modellgewichte und Konfigurationsdateien und listet die Kompatibilität mit Serving-Stacks wie vLLM und SGLang auf.

Wann Qwen3.8 2.4T A95B die richtige Wahl ist

Wähle dieses Modell, wenn du Folgendes benötigst:

  • Open-Weight-Portabilität und Kontrolle über die Serving-Ebene
  • Lange Kontexte für Coding, Code-Reviews oder Repository-Analysen
  • Textbasierte Recherche und Multi-Dokumenten-Reasoning
  • Agentische Workflows mit Funktionsaufruf, strukturierten Ausgaben oder Reasoning
  • Einen gehosteten Novita-Endpunkt zur Evaluierung vor tiefergehenden Infrastrukturarbeiten

Die Open-Weight-Unterscheidung ist wichtig, wenn dein Team später selbst hosten, die Serving-Infrastruktur ändern oder ein konsistentes Modell-Artefakt über verschiedene Umgebungen hinweg verwenden möchte. Informationen zum verwalteten Qwen3.8-Max-Modell auf Novita AI und seinem produktbezogenen Zugang findest du unter Qwen3.8-Max auf Novita AI.

Wann Qwen3.8 2.4T A95B nicht die beste Standardlösung ist

Dieses Modell ist nicht die beste Standardlösung für Bild- oder Vision-Eingaben, da Novita seine Eingabemodalität als Text angibt. Es könnte auch mehr sein, als du für kurze Klassifikationen, einfache Extraktionen oder große Mengen an Prompts benötigst – hier würde ein kleineres Modell die Qualitätsanforderungen zu geringeren Kosten erfüllen.

Wähle stattdessen den verwalteten Qwen3.8-Max-Pfad, wenn du dessen zusätzliche Produktebene benötigst, einschließlich Vision-Eingabe oder eines stärker vorgefertigten, verwalteten Workflows. Falls deine Hauptfrage lautet, wie du die erste Anfrage sendest, verwende den Qwen3.8-Max API-Schnellstart anstelle dieser Einführungs- und Entscheidungsseite.

Qwen3.8 2.4T A95B API-Zugang auf Novita AI

Die Novita-Modellseite listet die API-Modell-ID als qwen/qwen3.8-2.4t-a95b und unterstützt die Endpunktfamilien chat/completions und responses. Der OpenAI-kompatible API-Einstiegspunkt von Novita ist https://api.novita.ai/openai.

Dieser Abschnitt enthält bewusst nur Zugangsinformationen. Er enthält keine Erstanfrage-Anleitung, vollständige Request-Parameter oder Schritte zur Fehlerbehebung; diese gehören in einen 4.4-Schnellstart oder eine Feature-Anleitung.

FAQ

Wie lautet die Novita-Modell-ID?

Verwende qwen/qwen3.8-2.4t-a95b.

Ist Qwen3.8 2.4T A95B Open-Weight?

Ja. Die Qwen-Modellkarte stellt die Modellgewichte und Konfigurationsdateien für das nachtrainierte Modell bereit. Die Verfügbarkeit als Open-Weight bedeutet nicht, dass jede Bereitstellung das gleiche Hardware-, Serving- oder Leistungsprofil aufweist.

Welche Kontext- und Ausgabelimits gibt Novita an?

Novita gibt ein Kontextfenster von 1.000.000 Token und eine maximale Ausgabe von 131.072 Token an.

Was kostet es auf Novita AI?

Novita listet $2 pro 1M Input-Token, $0,25 pro 1M Cache-Read-Token und $6 pro 1M Output-Token – Stand der Überprüfung am 2. September 2026.

Ist das dasselbe wie Qwen3.8-Max?

Es handelt sich um das Open-Weight-Modell Qwen3.8 2.4T A95B, während Qwen3.8-Max der separate, verwaltete Service-Pfad ist. Vergleiche die verifizierten Fähigkeiten und Zugriffsanforderungen für deinen Workload, bevor du dich zwischen ihnen entscheidest.

Quellen

Empfohlene Artikel