Qwen3.8 2.4T A95B na Novita AI: Acesso e Preços do Modelo Open-Weight

Qwen3.8 2.4T A95B na Novita AI: Acesso e Preços do Modelo Open-Weight

O Qwen3.8 2.4T A95B é um modelo Qwen3.8 de pesos abertos, apenas texto, disponível através da API serverless da Novita AI. Ele é voltado para desenvolvedores que precisam de tarefas de codificação com contexto longo, pesquisa, raciocínio complexo ou fluxos de trabalho agentes, mantendo uma opção de serviço com pesos abertos. A Novita lista o ID do modelo como qwen/qwen3.8-2.4t-a95b, uma janela de contexto de 1.000.000 de tokens, máximo de 131.072 tokens de saída e preços de $2 por 1M de tokens de entrada, $0,25 por 1M de tokens de leitura de cache e $6 por 1M de tokens de saída.

Principais Conclusões

  • O Qwen3.8 2.4T A95B é um modelo MoE esparso de pesos abertos com 2,4T de parâmetros totais e 95B de parâmetros ativos.
  • A Novita o expõe como um modelo serverless apenas texto, com suporte a chamada de funções, saídas estruturadas e raciocínio.
  • A Novita lista uma janela de contexto e 1.000.000 tokens e máximo de 131.072 tokens de saida.
  • O modelo é masi adeuqado para equipes que valorizam portabilidade com pesos abertos e fluxos de trabalho de texto do que para cargas de trabalho que exijem entrada de visão ou uma camada de produto gerenciado chave-na-mão.

Especificações e Preços do Qwen3.8 2.4T A95B

Campo Valor da Novita
Nome de exibição Qwen3.8 2.4T A95B
ID do modelo qwen/qwen3.8-2.4t-a95b
Tipo de modelo MoE esparso com pesos abertos
Parâmetros totais 2,4T
Parâmetros ativos 95B
Janela de contexto 1.000.000 de tokens
Máximo de tokens de saída 131.072
Modalidade de entrada Texto
Modalidade de saída Texto
Endpontos chat/completions, responses
Recrusos Serverless, chamada de funçõe, saídas estrutudaredas, raciocínio
Preço de entrada $2 / 1M tokens
Preço de leitura de cache $0,25 / 1M tokns
Preço de saída $6 / 1M tokens
Nível de taxa exibido T1: 30 RPM / 50.000.000 TPM
Data verificada 2 de setembro de 2026

Os preços e limites podem udar. Conirme a página de modelo da Novita AI e a página de preços da Novita AI antes de assuir um compromisso de custo de produção.

O que o Qwen3.8 2.4T A95B Pode Fazer

O Qwen3.8 2.4T A95B é projétado para cargas de trabalho focadas em texto que se beneficiam de uma grande janela de contexto e forte capacidade de raciocínio. Sua posição de pesos abertos também dá às equipes um caminho para avaliar o modelo em relação às suas próprias exigências de serviço e implantação, ao invés de tratar um endpoint gerenciado como a única opção.

O modelo é adequado para revisão de código em escala de repositório, pesquisa com múltiplos documentos, raciocínio textual complexo, geração estrutrada e loops agentes que reêm rastros de ferramentas ou estado intermedário. O cartão do modelo Qwen documeta os pesos do modelo e arquivos de configração e lista com patibilidade com pihas de servço como vLLM e SGLang.

Quando o Qwen3.8 2.4T A95B é uma Boa Escolha

Escolha este modelo quando precisar de:

  • portabilidade de pesos abertos e controle sobre a camada de serviço
  • codificação com contexto longo, revisão de código ou análise de repositório
  • pesquisa apenas com texto e raciocínio com múltilos documentos
  • fluxos de trabao agentes usando chamada de funções, saídas estruturadas ou raciocínio
  • um endpoint da Novita para avaliação antes de um trablho de infraestrutra mai aprofundado

A distinção de pesos abertos é importante quando sua equip pode, posteriormente, hospear sozinha o modelo, mudar a infraestrutura de serviço ou manter um artefato de modelo consistente em diferentes ambientes. Para o modelo Qwen3.8-Max gerenciado na Novita AI e sua via de acesso ao nível do produto, veja Qwen3.8-Max na Novita AI.

Quando o Qwen3.8 2.4T A95B Não é a Melhor Opção Padrão

Este modelo não é a melhor escolha padrão emr entrada de imagem ou visão, porque a Novita lista sua modaldade de entrada como texto. Também pode ser mais do que você precisa para classificação curta, extração leve ou prompts de alto volume, onde um modelo menor atenderia ao requisito de qualidade a um custo menor.

Escolha o caminho do Qwen3.8-Max gerenciado quando precisar de sua camada adicional de produto, incluindo entrada de visão ou um fluxo de trabalho gerenciado mais chave-na-mão. Se sua principal dúvida é como enviar a primeira requisição, use o Guia de Início Rápido da API Qwen3.8-Max em vez desta página de lançamento e decisão.

Acesso à API Qwen3.8 2.4T A95B na Novita AI

A página do modelo da Novita lista o ID da API como qwen/qwen3.8-2.4t-a95b e suporta as famílias de endpoints chat/completions e responses. O ponto de entrada da API compatível com OpenAI da Novita é https://api.novita.ai/openai.

Esta seção fornece intencionalmente apenas informações de acesso. Ela não inclui um passo a passo para a primeira requisição, parâmetros completos da requisição ou etapas de solução de problemas; esses itens pertencem a um guia de início rápido ou de funcionalidades da seção 4.4.

FAQ

Qual é o ID do modelo na Novita?

Use qwen/qwen3.8-2.4t-a95b.

O Qwen3.8 2.4T A95B tem pesos abertos?

Sim. O cartão do modelo Qwen fornece os pesos e arquivos de configuração para o modelo pós-treinado. A disponibilidade de pesos abertos não significa que toda implantação tenha o mesmo hardware, serviço ou perfil de desempenho.

Quais são os limites de contexto e saída listados pela Novita?

A Novita lista uma janela de contexto de 1.000.000 de tokens e um máximo de 131.072 tokens de saída.

Quanto custa na Novita AI?

A Novita lista $2 por 1M de tokens de entrada, $0,25 por 1M de tokens de leitura de cache e $6 por 1M de tokens de saída, conforme verificado em 2 de setembro de 2026.

Isso é o mesmo que Qwen3.8-Max?

É o modelo Qwen3.8 2.4T A95B de pesos abertos, enquanto o Qwen3.8-Max é a via de serviço gerenciado separada. Compare as capacidades verificadas e os requisitos de acesso para sua carga de trabalho antes de escolher entre eles.

Fontes

Artigos Recomendados