Qwen3.8 2.4T A95B é um modelo Qwen3.8 de pesos abertos e somente texto, disponível através da API serverless da Novita AI. Ele é voltado para desenvolvedores que precisam de codificação com contexto longo, pesquisa, raciocínio complexo ou fluxos de trabalho agentivos, mantendo uma opção de servidor com pesos abertos. A Novita lista o ID do modelo como qwen/qwen3.8-2.4t-a95b, uma janela de contexto de 1.000.000 de tokens, máximo de 131.072 tokens de saída e preços de US$ 2 por 1M de tokens de entrada, US$ 0,25 por 1M de tokens de leitura de cache e US$ 6 por 1M de tokens de saída.
Principais Conclusões
- Qwen3.8 2.4T A95B é um modelo MoE esparso de pesos abertos com 2,4T de parâmetros totais e 95B de parâmetros ativos.
- A Novita o expõe como um modelo serverless somente texto, com suporte a chamada de funções, saídas estruturadas e raciocínio.
- A Novita lista uma janela de contexto de 1.000.000 de tokens e um máximo de 131.072 tokens de saída.
- O modelo é mais adequado para equipes que valorizam a portabilidade de pesos abertos e fluxos de trabalho focados em texto do que para cargas de trabalho que exigem entrada de visão ou uma camada de produto gerenciada pronta para uso.
Especificações e Preços do Qwen3.8 2.4T A95B
| Campo | Valor Novita |
|---|---|
| Nome de exibição | Qwen3.8 2.4T A95B |
| ID do modelo | qwen/qwen3.8-2.4t-a95b |
| Tipo de modelo | MoE esparso de pesos abertos |
| Parâmetros totais | 2,4T |
| Parâmetros ativos | 95B |
| Janela de contexto | 1.000.000 tokens |
| Máx. tokens de saída | 131.072 |
| Modalidade de entrada | Texto |
| Modalidade de saída | Texto |
| Endpoints | chat/completions, responses |
| Recursos | Serverless, chamada de funções, saídas estruturadas, raciocínio |
| Preço de entrada | US$ 2 / 1M tokens |
| Preço de leitura de cache | US$ 0,25 / 1M tokens |
| Preço de saída | US$ 6 / 1M tokens |
| Nível de taxa exibido | T1: 30 RPM / 50.000.000 TPM |
| Data verificada | 2 de setembro de 2026 |
Preços e limites podem mudar. Confirme a página do modelo na Novita AI e a página de preços da Novita AI antes de assumir um compromisso de custo em produção.
O Que o Qwen3.8 2.4T A95B Pode Fazer
O Qwen3.8 2.4T A95B foi projetado para cargas de trabalho focadas em texto que se beneficiam de uma grande janela de contexto e forte capacidade de raciocínio. Sua posição de pesos abertos também oferece às equipes um caminho para avaliar o modelo em relação aos seus próprios requisitos de servidor e implantação, em vez de tratar um endpoint gerenciado como a única opção.
O modelo é adequado para revisão de código em escala de repositório, pesquisa com múltiplos documentos, raciocínio textual complexo, geração estruturada e loops agentivos que retêm rastros de ferramentas ou estado intermediário. O cartão do modelo Qwen documenta os pesos e arquivos de configuração e lista compatibilidade com stacks de servidor como vLLM e SGLang.
Quando o Qwen3.8 2.4T A95B é uma Boa Escolha
Escolha este modelo quando precisar de:
- portabilidade de pesos abertos e controle sobre a camada de servidor
- codificação com contexto longo, revisão de código ou análise de repositório
- pesquisa somente texto e raciocínio com múltiplos documentos
- fluxos de trabalho agentivos usando chamada de funções, saídas estruturadas ou raciocínio
- um endpoint hospedado pela Novita para avaliação antes de um trabalho de infraestrutura mais profundo
A distinção de pesos abertos é importante quando sua equipe pode posteriormente auto-hospedar, alterar a infraestrutura de servidor ou manter um artefato de modelo consistente entre ambientes. Para o modelo Qwen3.8-Max gerenciado na Novita AI e seu caminho de acesso em nível de produto, consulte Qwen3.8-Max na Novita AI.
Quando o Qwen3.8 2.4T A95B Não é a Melhor Opção Padrão
Este modelo não é a melhor opção padrão para entrada de imagem ou visão, pois a Novita lista sua modalidade de entrada como texto. Ele também pode ser mais do que você precisa para classificação curta, extração leve ou prompts de alto volume, onde um modelo menor atenderia ao requisito de qualidade com custo menor.
Escolha o caminho gerenciado Qwen3.8-Max quando precisar de sua camada de produto adicional, incluindo entrada de visão ou um fluxo de trabalho gerenciado mais pronto para uso. Se sua principal dúvida é como enviar a primeira solicitação, use o Início Rápido da API Qwen3.8-Max em vez desta página de lançamento e decisão.
Acesso à API Qwen3.8 2.4T A95B na Novita AI
A página do modelo na Novita lista o ID do modelo da API como qwen/qwen3.8-2.4t-a95b e suporta as famílias de endpoints chat/completions e responses. O ponto de entrada da API compatível com OpenAI da Novita é https://api.novita.ai/openai.
Esta seção fornece intencionalmente apenas informações de acesso. Ela não inclui um passo a passo da primeira solicitação, parâmetros completos da solicitação ou etapas de solução de problemas; esses conteúdos pertencem a um guia de início rápido ou guia de recursos 4.4.
FAQ
Qual é o ID do modelo na Novita?
Use qwen/qwen3.8-2.4t-a95b.
O Qwen3.8 2.4T A95B tem pesos abertos?
Sim. O cartão do modelo Qwen fornece os pesos e arquivos de configuração para o modelo pós-treinado. A disponibilidade de pesos abertos não significa que toda implantação tenha o mesmo perfil de hardware, servidor ou desempenho.
Quais limites de contexto e saída a Novita lista?
A Novita lista uma janela de contexto de 1.000.000 de tokens e um máximo de 131.072 tokens de saída.
Quanto custa na Novita AI?
A Novita lista US$ 2 por 1M de tokens de entrada, US$ 0,25 por 1M de tokens de leitura de cache e US$ 6 por 1M de tokens de saída, conforme verificado em 2 de setembro de 2026.
Isso é o mesmo que Qwen3.8-Max?
É o modelo Qwen3.8 2.4T A95B de pesos abertos, enquanto o Qwen3.8-Max é o caminho de serviço gerenciado separado. Compare as capacidades verificadas e os requisitos de acesso para sua carga de trabalho antes de escolher entre eles.
Fontes
- Página do modelo Novita: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (verificada em 2026-09-02)
- Página de preços Novita: https://novita.ai/pricing (verificada em 2026-09-02)
- Cartão do modelo Qwen: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (verificado em 2026-09-02)
- Guia de lançamento Qwen3.8-Max: /qwen3-8-max-on-novita-ai-launch-pricing/
- Início rápido Qwen3.8-Max: /qwen3-8-max-api-quick-start/
