Qwen3.8 2.4T A95B sur Novita AI : API open-weight avec contexte 1M

Qwen3.8 2.4T A95B sur Novita AI : API open-weight avec contexte 1M

Qwen3.8 2.4T A95B est un modèle Qwen3.8 open-weight, texte uniquement, disponible via l’API serverless de Novita AI. Il est conçu pour les développeurs ayant besoin de codage long-contexte, de recherche, de raisonnement complexe ou de workflows agentiques, tout en conservant une option de service open-weight. Novita liste l’ID du modèle comme qwen/qwen3.8-2.4t-a95b, une fenêtre de contexte de 1 000 000 de tokens, un maximum de 131 072 tokens de sortie, et une tarification de 2 $ par million de tokens d’entrée, 0,25 $ par million de tokens de cache lus, et 6 $ par million de tokens de sortie.

Points clés

  • Qwen3.8 2.4T A95B est un modèle MoE sparse open-weight avec 2,4T paramètres totaux et 95B paramètres actifs.
  • Novita l’expose comme un modèle serverless texte uniquement avec appel de fonctions, sorties structurées et prise en charge du raisonnement.
  • Novita liste une fenêtre de contexte de 1 000 000 de tokens et un maximum de 131 072 tokens de sortie.
  • Le modèle est mieux adapté aux équipes qui valorisent la portabilité open-weight et les workflows axés sur le texte qu’aux charges de travail nécessitant une entrée visuelle ou une couche produit gérée clé en main.

Spécifications et tarification de Qwen3.8 2.4T A95B

Champ Valeur Novita
Nom d’affichage Qwen3.8 2.4T A95B
ID du modèle qwen/qwen3.8-2.4t-a95b
Type de modèle MoE sparse open-weight
Paramètres totaux 2,4T
Paramètres actifs 95B
Fenêtre de contexte 1 000 000 tokens
Tokens de sortie max 131 072
Modalité d’entrée Texte
Modalité de sortie Texte
Endpoints chat/completions, responses
Fonctionnalités Serverless, appel de fonctions, sorties structurées, raisonnement
Prix d’entrée 2 $ / 1M tokens
Prix de lecture du cache 0,25 $ / 1M tokens
Prix de sortie 6 $ / 1M tokens
Niveau de débit affiché T1 : 30 RPM / 50 000 000 TPM
Date de vérification 2 septembre 2026

Les prix et les limites peuvent changer. Confirmez la page du modèle Novita AI et la page de tarification Novita AI avant de prendre un engagement de coût en production.

Ce que Qwen3.8 2.4T A95B peut faire

Qwen3.8 2.4T A95B est conçu pour les charges de travail axées sur le texte qui bénéficient d’une grande fenêtre de contexte et d’une forte capacité de raisonnement. Son positionnement open-weight donne également aux équipes la possibilité d’évaluer le modèle par rapport à leurs propres exigences de service et de déploiement, plutôt que de considérer un endpoint géré comme la seule option.

Le modèle est adapté à la revue de code à l’échelle d’un dépôt, à la recherche multi-documents, au raisonnement textuel complexe, à la génération structurée et aux boucles agentiques qui conservent les traces d’outils ou l’état intermédiaire. La fiche technique du modèle Qwen documente les poids du modèle et les fichiers de configuration et liste la compatibilité avec des piles de service telles que vLLM et SGLang.

Quand Qwen3.8 2.4T A95B est un bon choix

Choisissez ce modèle lorsque vous avez besoin :

  • de portabilité open-weight et de contrôle sur la couche de service
  • de codage long-contexte, de revue de code ou d’analyse de dépôt
  • de recherche textuelle et de raisonnement multi-documents
  • de workflows agentiques utilisant l’appel de fonctions, les sorties structurées ou le raisonnement
  • d’un endpoint Novita hébergé pour une évaluation avant un travail d’infrastructure plus approfondi

La distinction open-weight est importante lorsque votre équipe peut ultérieurement auto-héberger, changer d’infrastructure de service ou conserver un artefact de modèle cohérent entre les environnements. Pour le modèle Qwen3.8-Max géré sur Novita AI et sa voie d’accès au niveau produit, consultez Qwen3.8-Max sur Novita AI.

Quand Qwen3.8 2.4T A95B n’est pas le meilleur choix par défaut

Ce modèle n’est pas le meilleur choix par défaut pour les entrées d’image ou de vision, car Novita liste sa modalité d’entrée comme texte. Il peut également être plus que ce dont vous avez besoin pour la classification courte, l’extraction légère ou les prompts à volume élevé où un modèle plus petit répondrait à l’exigence de qualité à moindre coût.

Choisissez plutôt la voie Qwen3.8-Max gérée lorsque vous avez besoin de sa couche produit supplémentaire, y compris l’entrée visuelle ou un workflow géré plus clé en main. Si votre question principale est comment envoyer la première requête, utilisez le Guide de démarrage rapide de l’API Qwen3.8-Max plutôt que cette page de lancement et de décision.

Accès à l’API Qwen3.8 2.4T A95B sur Novita AI

La page du modèle de Novita liste l’ID d’API du modèle comme qwen/qwen3.8-2.4t-a95b et prend en charge les familles d’endpoints chat/completions et responses. Le point d’entrée de l’API compatible OpenAI de Novita est https://api.novita.ai/openai.

Cette section fournit intentionnellement uniquement des informations d’accès. Elle n’inclut pas de procédure pas à pas pour une première requête, de paramètres de requête complets ni d’étapes de dépannage ; ceux-ci appartiennent à un guide de démarrage rapide 4.4 ou à un guide de fonctionnalités.

FAQ

Quel est l’ID du modèle Novita ?

Utilisez qwen/qwen3.8-2.4t-a95b.

Qwen3.8 2.4T A95B est-il open-weight ?

Oui. La fiche technique du modèle Qwen fournit les poids du modèle et les fichiers de configuration pour le modèle post-entraîné. La disponibilité open-weight ne signifie pas que chaque déploiement a le même profil matériel, de service ou de performance.

Quelles sont les limites de contexte et de sortie listées par Novita ?

Novita liste une fenêtre de contexte de 1 000 000 de tokens et un maximum de 131 072 tokens de sortie.

Combien cela coûte-t-il sur Novita AI ?

Novita liste 2 $ par million de tokens d’entrée, 0,25 $ par million de tokens de cache lus et 6 $ par million de tokens de sortie, vérifié le 2 septembre 2026.

Est-ce la même chose que Qwen3.8-Max ?

Il s’agit du modèle open-weight Qwen3.8 2.4T A95B, tandis que Qwen3.8-Max est la voie de service gérée distincte. Comparez les capacités vérifiées et les exigences d’accès pour votre charge de travail avant de choisir entre eux.

Sources

Articles recommandés