Le modèle Qwen3.8 2.4T A95B est un modèle Qwen3.8 open-weight, textuel uniquement, disponible via l’API serverless de Novita AI. Il s’adresse aux développeurs qui ont besoin de contextes longs pour le codage, la recherche, le raisonnement complexe ou les workflows agentiques, tout en conservant une option de service open-weight. Novita répertorie l’ID du modèle sous la forme qwen/qwen3.8-2.4t-a95b, une fenêtre de contexte de 1 000 000 de jetons, un maximum de 131 072 jetons en sortie, et une tarification de 2 $ par million de jetons en entrée, 0,25 $ par million de jetons en lecture cache et 6 $ par million de jetons en sortie.
Points clés
- Qwen3.8 2.4T A95B est un modèle MoE sparse open-weight avec 2,4 T de paramètres au total et 95 B de paramètres actifs.
- Novita l’expose comme un modèle serverless textuel avec fonction calling, sorties structurées et prise en charge du raisonnement.
- Novita indique une fenêtre de contexte de 1 000 000 de jetons et un maximum de 131 072 jetons en sortie.
- Ce modèle convient mieux aux équipes qui privilégient la portabilité open-weight et les workflows orientés texte qu’aux charges de travail nécessitant une entrée vision ou une couche produit managée clé en main.
Spécifications et tarification de Qwen3.8 2.4T A95B
| Champ | Valeur Novita |
|---|---|
| Nom affiché | Qwen3.8 2.4T A95B |
| ID du modèle | qwen/qwen3.8-2.4t-a95b |
| Type de modèle | MoE sparse open-weight |
| Paramètres totaux | 2,4 T |
| Paramètres actifs | 95 B |
| Fenêtre de contexte | 1 000 000 de jetons |
| Jetons de sortie max | 131 072 |
| Modalité d’entrée | Texte |
| Modalité de sortie | Texte |
| Endpoints | chat/completions, responses |
| Fonctionnalités | Serverless, function calling, sorties structurées, raisonnement |
| Prix d’entrée | 2 $ / 1M jetons |
| Prix de lecture cache | 0,25 $ / 1M jetons |
| Prix de sortie | 6 $ / 1M jetons |
| Niveau de débit affiché | T1 : 30 RPM / 50,000,000 TPM |
| Date de vérification | 2 septembre 2026 |
Les tarifs et les limites peuvent évoluer. Confirmez la page modèle Novita AI et la page tarifaire Novita AI avant de prendre un engagement de coût en production.
Ce que Qwen3.8 2.4T A95B peut faire
Qwen3.8 2.4T A95B est conçu pour les charges de travail textuelles qui bénéficient d’une grande fenêtre de contexte et de solides capacités de raisonnement. Son positionnement open-weight offre aussi aux équipes la possibilité d’évaluer le modèle par rapport à leurs propres exigences de service et de déploiement, plutôt que de considérer un endpoint managé comme la seule option.
Le modèle convient à la revue de code à l’échelle d’un dépôt, à la recherche multi-documents, au raisonnement textuel complexe, à la génération structurée et aux boucles agentiques qui conservent les traces d’outils ou l’état intermédiaire. La fiche modèle Qwen documente les poids et les fichiers de configuration du modèle et liste la compatibilité avec des piles de service comme vLLM et SGLang.
Quand Qwen3.8 2.4T A95B est un bon choix
Choisissez ce modèle lorsque vous avez besoin :
- d’une portabilité open-weight et du contrôle de la couche de service ;
- de codage long contexte, de revue de code ou d’analyse de dépôt ;
- de recherche textuelle et de raisonnement multi-documents ;
- de workflows agentiques utilisant le function calling, les sorties structurées ou le raisonnement ;
- d’un endpoint Novita hébergé pour évaluer avant d’approfondir le travail d’infrastructure.
La distinction open-weight compte lorsque votre équipe peut ensuite auto-héberger, changer d’infrastructure de service ou conserver le même artefact de modèle dans tous les environnements. Pour le modèle managé Qwen3.8-Max sur Novita AI et son chemin d’accès au niveau produit, voir Qwen3.8-Max sur Novita AI.
Quand Qwen3.8 2.4T A95B n’est pas le meilleur choix par défaut
Ce modèle n’est pas le meilleur choix par défaut pour les entrées image ou vision, car Novita répertorie sa modalité d’entrée comme texte. Il peut aussi être plus que nécessaire pour la classification courte, l’extraction légère ou les volumes élevés de prompts lorsqu’un modèle plus petit suffirait sur le plan qualitatif, à moindre coût.
Choisissez plutôt le parcours managé Qwen3.8-Max lorsque vous avez besoin de sa couche produit supplémentaire, notamment l’entrée vision ou un workflow managé plus clé en main. Si votre question principale est l’envoi de la première requête, utilisez le Démarrage rapide de l’API Qwen3.8-Max plutôt que cette page d’annonce et de décision.
Accès API Qwen3.8 2.4T A95B sur Novita AI
La page modèle de Novita répertorie l’ID API qwen/qwen3.8-2.4t-a95b et prend en charge les familles d’endpoints chat/completions et responses. Le point d’entrée API compatible OpenAI de Novita est https://api.novita.ai/openai.
Cette section fournit intentionnellement uniquement des informations d’accès. Elle n’inclut pas de procédure pas à pas pour la première requête, les paramètres de requête complets ni les étapes de dépannage ; ceux-ci relèvent d’un guide de démarrage rapide 4.4 ou d’un guide de fonctionnalités.
FAQ
Quel est l’ID du modèle Novita ?
Utilisez qwen/qwen3.8-2.4t-a95b.
Qwen3.8 2.4T A95B est-il open-weight ?
Oui. La fiche modèle Qwen fournit les poids et les fichiers de configuration du modèle post-entraîné. La disponibilité open-weight ne signifie pas que chaque déploiement présente le même profil matériel, de service ou de performance.
Quelles limites de contexte et de sortie Novita indique-t-elle ?
Novita indique une fenêtre de contexte de 1 000 000 de jetons et un maximum de 131 072 jetons en sortie.
Quel est son coût sur Novita AI ?
Novita affiche un prix de 2 $ par million de jetons en entrée, 0,25 $ par million de jetons en lecture cache et 6 $ par million de jetons en sortie, vérifié le 2 septembre 2026.
Est-ce identique à Qwen3.8-Max ?
Non, il s’agit du modèle open-weight Qwen3.8 2.4T A95B, tandis que Qwen3.8-Max est le parcours de service managé distinct. Comparez les capacités vérifiées et les exigences d’accès pour votre charge de travail avant de choisir entre ces deux options.
Sources
- Page modèle Novita : https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (vérifié le 02/09/2026)
- Page tarifaire Novita : https://novita.ai/pricing (vérifié le 02/09/2026)
- Fiche modèle Qwen : https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (vérifié le 02/09/2026)
- Guide de lancement de Qwen3.8-Max : /qwen3-8-max-on-novita-ai-launch-pricing/
- Démarrage rapide de Qwen3.8-Max : /qwen3-8-max-api-quick-start/
