O Qwen3.8 2.4T A95B é um modelo Qwen3.8 de pesos abertos, apenas texto, disponível através da API serverless da Novita AI. Ele é voltado para desenvolvedores que precisam de tarefas de codificação com contexto longo, pesquisa, raciocínio complexo ou fluxos de trabalho agentes, mantendo uma opção de serviço com pesos abertos. A Novita lista o ID do modelo como qwen/qwen3.8-2.4t-a95b, uma janela de contexto de 1.000.000 de tokens, máximo de 131.072 tokens de saída e preços de $2 por 1M de tokens de entrada, $0,25 por 1M de tokens de leitura de cache e $6 por 1M de tokens de saída.
Principais Conclusões
- O Qwen3.8 2.4T A95B é um modelo MoE esparso de pesos abertos com 2,4T de parâmetros totais e 95B de parâmetros ativos.
- A Novita o expõe como um modelo serverless apenas texto, com suporte a chamada de funções, saídas estruturadas e raciocínio.
- A Novita lista uma janela de contexto e 1.000.000 tokens e máximo de 131.072 tokens de saida.
- O modelo é masi adeuqado para equipes que valorizam portabilidade com pesos abertos e fluxos de trabalho de texto do que para cargas de trabalho que exijem entrada de visão ou uma camada de produto gerenciado chave-na-mão.
Especificações e Preços do Qwen3.8 2.4T A95B
| Campo | Valor da Novita |
|---|---|
| Nome de exibição | Qwen3.8 2.4T A95B |
| ID do modelo | qwen/qwen3.8-2.4t-a95b |
| Tipo de modelo | MoE esparso com pesos abertos |
| Parâmetros totais | 2,4T |
| Parâmetros ativos | 95B |
| Janela de contexto | 1.000.000 de tokens |
| Máximo de tokens de saída | 131.072 |
| Modalidade de entrada | Texto |
| Modalidade de saída | Texto |
| Endpontos | chat/completions, responses |
| Recrusos | Serverless, chamada de funçõe, saídas estrutudaredas, raciocínio |
| Preço de entrada | $2 / 1M tokens |
| Preço de leitura de cache | $0,25 / 1M tokns |
| Preço de saída | $6 / 1M tokens |
| Nível de taxa exibido | T1: 30 RPM / 50.000.000 TPM |
| Data verificada | 2 de setembro de 2026 |
Os preços e limites podem udar. Conirme a página de modelo da Novita AI e a página de preços da Novita AI antes de assuir um compromisso de custo de produção.
O que o Qwen3.8 2.4T A95B Pode Fazer
O Qwen3.8 2.4T A95B é projétado para cargas de trabalho focadas em texto que se beneficiam de uma grande janela de contexto e forte capacidade de raciocínio. Sua posição de pesos abertos também dá às equipes um caminho para avaliar o modelo em relação às suas próprias exigências de serviço e implantação, ao invés de tratar um endpoint gerenciado como a única opção.
O modelo é adequado para revisão de código em escala de repositório, pesquisa com múltiplos documentos, raciocínio textual complexo, geração estrutrada e loops agentes que reêm rastros de ferramentas ou estado intermedário. O cartão do modelo Qwen documeta os pesos do modelo e arquivos de configração e lista com patibilidade com pihas de servço como vLLM e SGLang.
Quando o Qwen3.8 2.4T A95B é uma Boa Escolha
Escolha este modelo quando precisar de:
- portabilidade de pesos abertos e controle sobre a camada de serviço
- codificação com contexto longo, revisão de código ou análise de repositório
- pesquisa apenas com texto e raciocínio com múltilos documentos
- fluxos de trabao agentes usando chamada de funções, saídas estruturadas ou raciocínio
- um endpoint da Novita para avaliação antes de um trablho de infraestrutra mai aprofundado
A distinção de pesos abertos é importante quando sua equip pode, posteriormente, hospear sozinha o modelo, mudar a infraestrutura de serviço ou manter um artefato de modelo consistente em diferentes ambientes. Para o modelo Qwen3.8-Max gerenciado na Novita AI e sua via de acesso ao nível do produto, veja Qwen3.8-Max na Novita AI.
Quando o Qwen3.8 2.4T A95B Não é a Melhor Opção Padrão
Este modelo não é a melhor escolha padrão emr entrada de imagem ou visão, porque a Novita lista sua modaldade de entrada como texto. Também pode ser mais do que você precisa para classificação curta, extração leve ou prompts de alto volume, onde um modelo menor atenderia ao requisito de qualidade a um custo menor.
Escolha o caminho do Qwen3.8-Max gerenciado quando precisar de sua camada adicional de produto, incluindo entrada de visão ou um fluxo de trabalho gerenciado mais chave-na-mão. Se sua principal dúvida é como enviar a primeira requisição, use o Guia de Início Rápido da API Qwen3.8-Max em vez desta página de lançamento e decisão.
Acesso à API Qwen3.8 2.4T A95B na Novita AI
A página do modelo da Novita lista o ID da API como qwen/qwen3.8-2.4t-a95b e suporta as famílias de endpoints chat/completions e responses. O ponto de entrada da API compatível com OpenAI da Novita é https://api.novita.ai/openai.
Esta seção fornece intencionalmente apenas informações de acesso. Ela não inclui um passo a passo para a primeira requisição, parâmetros completos da requisição ou etapas de solução de problemas; esses itens pertencem a um guia de início rápido ou de funcionalidades da seção 4.4.
FAQ
Qual é o ID do modelo na Novita?
Use qwen/qwen3.8-2.4t-a95b.
O Qwen3.8 2.4T A95B tem pesos abertos?
Sim. O cartão do modelo Qwen fornece os pesos e arquivos de configuração para o modelo pós-treinado. A disponibilidade de pesos abertos não significa que toda implantação tenha o mesmo hardware, serviço ou perfil de desempenho.
Quais são os limites de contexto e saída listados pela Novita?
A Novita lista uma janela de contexto de 1.000.000 de tokens e um máximo de 131.072 tokens de saída.
Quanto custa na Novita AI?
A Novita lista $2 por 1M de tokens de entrada, $0,25 por 1M de tokens de leitura de cache e $6 por 1M de tokens de saída, conforme verificado em 2 de setembro de 2026.
Isso é o mesmo que Qwen3.8-Max?
É o modelo Qwen3.8 2.4T A95B de pesos abertos, enquanto o Qwen3.8-Max é a via de serviço gerenciado separada. Compare as capacidades verificadas e os requisitos de acesso para sua carga de trabalho antes de escolher entre eles.
Fontes
- Página do modelo na Novita: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (verificado em 2026-09-02)
- Página de preços da Novita: https://novita.ai/pricing (verificado em 2026-09-02)
- Cartão do modelo Qwen: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (verificado em 2026-09-02)
- Guia de lançamento do Qwen3.8-Max: /qwen3-8-max-on-novita-ai-launch-pricing/
- Guia de início rápido do Qwen3.8-Max: /qwen3-8-max-api-quick-start/
