Qwen3.8 2.4T A95B na Novita AI: API de Contexto de 1M com Pesos Abertos

Qwen3.8 2.4T A95B na Novita AI: API de Contexto de 1M com Pesos Abertos

O Qwen3.8 2.4T A95B é um modelo Qwen3.8 com pesos abertos, apenas texto, disponível através da API serverless da Novita AI. Ele é voltado para desenvolvedores que precisam de contexto longo para codificação, pesquisa, raciocínio complexo ou fluxos agentivos, mantendo uma opção de serviço com pesos abertos. A Novita lista o ID do modelo como qwen/qwen3.8-2.4t-a95b, uma janela de contexto de 1.000.000 de tokens, máximo de 131.072 tokens de saída e preços de $2 por 1M de tokens de entrada, $0,25 por 1M de tokens de leitura de cache e $6 por 1M de tokens de saída.

Principais Conclusões

  • O Qwen3.8 2.4T A95B é um modelo MoE esparso de pesos abertos com 2,4T de parâmetros totais e 95B de parâmetros ativos.
  • A Novita o expõe como um modelo serverless apenas texto com suporte a chamada de função, saídas estruturadas e raciocínio.
  • A Novita lista uma janela de contexto de 1.000.000 de tokens e um máximo de 131.072 tokens de saída.
  • O modelo é mais adequado para equipes que valorizam portabilidade de pesos abertos e fluxos de trabalho focados em texto do que para cargas de trabalho que exigem entrada visual ou uma camada de produto gerenciada pronta para uso.

Especificações e Preços do Qwen3.8 2.4T A95B

Campo Valor Novita
Nome de exibição Qwen3.8 2.4T A95B
ID do modelo qwen/qwen3.8-2.4t-a95b
Tipo de modelo MoE esparso de pesos abertos
Parâmetros totais 2,4T
Parâmetros ativos 95B
Janela de contexto 1.000.000 de tokens
Máx. tokens de saída 131.072
Modalidade de entrada Texto
Modalidade de saída Texto
Endpoints chat/completions, responses
Recursos Serverless, chamada de função, saídas estruturadas, raciocínio
Preço de entrada $2 / 1M tokens
Preço de leitura de cache $0,25 / 1M tokens
Preço de saída $6 / 1M tokens
Nível de taxa mostrado T1: 30 RPM / 50.000.000 TPM
Data de verificação 2 de setembro de 2026

Preços e limites podem mudar. Confirme a página do modelo na Novita AI e a página de preços da Novita AI antes de assumir um compromisso de custo em produção.

O Que o Qwen3.8 2.4T A95B Pode Fazer

O Qwen3.8 2.4T A95B é projetado para cargas de trabalho focadas em texto que se beneficiam de uma grande janela de contexto e forte capacidade de raciocínio. Sua posição de pesos abertos também oferece às equipes um caminho para avaliar o modelo em relação às suas próprias necessidades de serviço e implantação, em vez de tratar um endpoint gerenciado como a única opção.

O modelo é adequado para revisão de código em escala de repositório, pesquisa com múltiplos documentos, raciocínio textual complexo, geração estruturada e loops agentivos que retêm rastros de ferramentas ou estado intermediário. A ficha técnica (model card) do Qwen documenta os pesos do modelo e os arquivos de configuração, listando compatibilidade com stacks de serviço como vLLM e SGLang.

Quando o Qwen3.8 2.4T A95B é uma Boa Escolha

Escolha este modelo quando precisar de:

  • portabilidade de pesos abertos e controle sobre a camada de serviço
  • codificação com contexto longo, revisão de código ou análise de repositório
  • pesquisa apenas texto e raciocínio com múltiplos documentos
  • fluxos agentivos usando chamada de função, saídas estuturadas ou raciocínio
  • um endpoint hospedado da Novita para avaliação antes de um trabalho de infraestrutura mais profundo

A distinção de pesos abertos é importante quando sua equipe pode posteriormente auto-hospedar, mudar a infraestrutura de serviço ou manter um artefato de modelo consistente em diferentes ambientes. Para o modelo gerenciado Qwen3.8-Max na Novita AI e seu caminho de acesso a nível de produto, veja Qwen3.8-Max na Novita AI.

Quando o Qwen3.8 2.4T A95B Não é a Melhor Opção Padrão

Este modelo não é a melhor opção padrão para entrada de imagem ou visão, pois a Novita lista sua modalidade de entrada como texto. Ele também pode ser mais do que o necessário para classificação curta, extração leve ou prompts de alto volume, onde um modelo menor atenderia ao requisito de qualidade a um custo menor.

Escolha o caminho gerenciado do Qwen3.8-Max quando precisar de sua camada de produto adicional, incluindo entrada de visão ou um fluxo de trabalho gerenciado mais pronto para uso. Se sua principal dúvida é como enviar a primeira requisição, use o Início Rápido da API Qwen3.8-Max em vez desta página de lançamento e decisão.

Acesso à API do Qwen3.8 2.4T A95B na Novita AI

A página do modelo da Novita lista o ID da API como qwen/qwen3.8-2.4t-a95b e suporta as famílias de endpoints chat/completions e responses. O ponto de entrada da API compatível com OpenAI da Novita é https://api.novita.ai/openai.

Esta seção fornece intencionalmente apenas informações de acesso. Não inclui um passo a passo da primeira requisição, parâmetros completos de requisição ou etapas de solução de problemas; esses itens pertencem a um guia de início rápido ou de funcionalidades.

FAQ

Qual é o ID do modelo na Novita?

Use qwen/qwen3.8-2.4t-a95b.

O Qwen3.8 2.4T A95B tem pesos abertos?

Sim. A ficha técnica do Qwen fornece os pesos do modelo e os arquivos de configuração para o modelo pós-treinado. A disponibilidade de pesos abertos não significa que toda implantação terá o mesmo hardware, perfil de serviço ou desempenho.

Quais limites de contexto e saída a Novita lista?

A Novita lista uma janela de contexto de 1.000.000 de tokens e um máximo de 131.072 tokens de saída.

Quanto custa na Novita AI?

A Novita lista $2 por 1M de tokens de entrada, $0,25 por 1M de tokens de leitura de cache e $6 por 1M de tokens de saída, conforme verificado em 2 de setembro de 2026.

É o mesmo que Qwen3.8-Max?

É o modelo de pesos abertos Qwen3.8 2.4T A95B, enquanto Qwen3.8-Max é o caminho separado do serviço gerenciado. Compare as capacidades verificadas e os requisitos de acesso para sua carga de trabalho antes de escolher entre eles.

Fontes

Artigos Recomendados