O Qwen3.8 2.4T A95B é um modelo Qwen3.8 com pesos abertos, apenas texto, disponível através da API serverless da Novita AI. Ele é voltado para desenvolvedores que precisam de contexto longo para codificação, pesquisa, raciocínio complexo ou fluxos agentivos, mantendo uma opção de serviço com pesos abertos. A Novita lista o ID do modelo como qwen/qwen3.8-2.4t-a95b, uma janela de contexto de 1.000.000 de tokens, máximo de 131.072 tokens de saída e preços de $2 por 1M de tokens de entrada, $0,25 por 1M de tokens de leitura de cache e $6 por 1M de tokens de saída.
Principais Conclusões
- O Qwen3.8 2.4T A95B é um modelo MoE esparso de pesos abertos com 2,4T de parâmetros totais e 95B de parâmetros ativos.
- A Novita o expõe como um modelo serverless apenas texto com suporte a chamada de função, saídas estruturadas e raciocínio.
- A Novita lista uma janela de contexto de 1.000.000 de tokens e um máximo de 131.072 tokens de saída.
- O modelo é mais adequado para equipes que valorizam portabilidade de pesos abertos e fluxos de trabalho focados em texto do que para cargas de trabalho que exigem entrada visual ou uma camada de produto gerenciada pronta para uso.
Especificações e Preços do Qwen3.8 2.4T A95B
| Campo | Valor Novita |
|---|---|
| Nome de exibição | Qwen3.8 2.4T A95B |
| ID do modelo | qwen/qwen3.8-2.4t-a95b |
| Tipo de modelo | MoE esparso de pesos abertos |
| Parâmetros totais | 2,4T |
| Parâmetros ativos | 95B |
| Janela de contexto | 1.000.000 de tokens |
| Máx. tokens de saída | 131.072 |
| Modalidade de entrada | Texto |
| Modalidade de saída | Texto |
| Endpoints | chat/completions, responses |
| Recursos | Serverless, chamada de função, saídas estruturadas, raciocínio |
| Preço de entrada | $2 / 1M tokens |
| Preço de leitura de cache | $0,25 / 1M tokens |
| Preço de saída | $6 / 1M tokens |
| Nível de taxa mostrado | T1: 30 RPM / 50.000.000 TPM |
| Data de verificação | 2 de setembro de 2026 |
Preços e limites podem mudar. Confirme a página do modelo na Novita AI e a página de preços da Novita AI antes de assumir um compromisso de custo em produção.
O Que o Qwen3.8 2.4T A95B Pode Fazer
O Qwen3.8 2.4T A95B é projetado para cargas de trabalho focadas em texto que se beneficiam de uma grande janela de contexto e forte capacidade de raciocínio. Sua posição de pesos abertos também oferece às equipes um caminho para avaliar o modelo em relação às suas próprias necessidades de serviço e implantação, em vez de tratar um endpoint gerenciado como a única opção.
O modelo é adequado para revisão de código em escala de repositório, pesquisa com múltiplos documentos, raciocínio textual complexo, geração estruturada e loops agentivos que retêm rastros de ferramentas ou estado intermediário. A ficha técnica (model card) do Qwen documenta os pesos do modelo e os arquivos de configuração, listando compatibilidade com stacks de serviço como vLLM e SGLang.
Quando o Qwen3.8 2.4T A95B é uma Boa Escolha
Escolha este modelo quando precisar de:
- portabilidade de pesos abertos e controle sobre a camada de serviço
- codificação com contexto longo, revisão de código ou análise de repositório
- pesquisa apenas texto e raciocínio com múltiplos documentos
- fluxos agentivos usando chamada de função, saídas estuturadas ou raciocínio
- um endpoint hospedado da Novita para avaliação antes de um trabalho de infraestrutura mais profundo
A distinção de pesos abertos é importante quando sua equipe pode posteriormente auto-hospedar, mudar a infraestrutura de serviço ou manter um artefato de modelo consistente em diferentes ambientes. Para o modelo gerenciado Qwen3.8-Max na Novita AI e seu caminho de acesso a nível de produto, veja Qwen3.8-Max na Novita AI.
Quando o Qwen3.8 2.4T A95B Não é a Melhor Opção Padrão
Este modelo não é a melhor opção padrão para entrada de imagem ou visão, pois a Novita lista sua modalidade de entrada como texto. Ele também pode ser mais do que o necessário para classificação curta, extração leve ou prompts de alto volume, onde um modelo menor atenderia ao requisito de qualidade a um custo menor.
Escolha o caminho gerenciado do Qwen3.8-Max quando precisar de sua camada de produto adicional, incluindo entrada de visão ou um fluxo de trabalho gerenciado mais pronto para uso. Se sua principal dúvida é como enviar a primeira requisição, use o Início Rápido da API Qwen3.8-Max em vez desta página de lançamento e decisão.
Acesso à API do Qwen3.8 2.4T A95B na Novita AI
A página do modelo da Novita lista o ID da API como qwen/qwen3.8-2.4t-a95b e suporta as famílias de endpoints chat/completions e responses. O ponto de entrada da API compatível com OpenAI da Novita é https://api.novita.ai/openai.
Esta seção fornece intencionalmente apenas informações de acesso. Não inclui um passo a passo da primeira requisição, parâmetros completos de requisição ou etapas de solução de problemas; esses itens pertencem a um guia de início rápido ou de funcionalidades.
FAQ
Qual é o ID do modelo na Novita?
Use qwen/qwen3.8-2.4t-a95b.
O Qwen3.8 2.4T A95B tem pesos abertos?
Sim. A ficha técnica do Qwen fornece os pesos do modelo e os arquivos de configuração para o modelo pós-treinado. A disponibilidade de pesos abertos não significa que toda implantação terá o mesmo hardware, perfil de serviço ou desempenho.
Quais limites de contexto e saída a Novita lista?
A Novita lista uma janela de contexto de 1.000.000 de tokens e um máximo de 131.072 tokens de saída.
Quanto custa na Novita AI?
A Novita lista $2 por 1M de tokens de entrada, $0,25 por 1M de tokens de leitura de cache e $6 por 1M de tokens de saída, conforme verificado em 2 de setembro de 2026.
É o mesmo que Qwen3.8-Max?
É o modelo de pesos abertos Qwen3.8 2.4T A95B, enquanto Qwen3.8-Max é o caminho separado do serviço gerenciado. Compare as capacidades verificadas e os requisitos de acesso para sua carga de trabalho antes de escolher entre eles.
Fontes
- Página do modelo Novita: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (verificado em 2026-09-02)
- Página de preços Novita: https://novita.ai/pricing (verificado em 2026-09-02)
- Ficha técnica do Qwen: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (verificado em 2026-09-02)
- Guia de lançamento Qwen3.8-Max: /qwen3-8-max-on-novita-ai-launch-pricing/
- Início rápido Qwen3.8-Max: /qwen3-8-max-api-quick-start/
