Qwen3.8 2.4T A95B en Novita AI: API de peso abierto con 1M de contexto

Qwen3.8 2.4T A95B en Novita AI: API de peso abierto con 1M de contexto

Qwen3.8 2.4T A95B es un modelo Qwen3.8 de peso abierto, solo texto, disponible a través de la API serverless de Novita AI. Está dirigido a desarrolladores que necesitan contextos largos para programación, investigación, razonamiento complejo o flujos de trabajo agentivos, manteniendo una opción de servicio de peso abierto. Novita lista el ID del modelo como qwen/qwen3.8-2.4t-a95b, una ventana de contexto de 1,000,000 de tokens, un máximo de 131,072 tokens de salida, y precios de $2 por cada 1M de tokens de entrada, $0.25 por cada 1M de tokens de lectura de caché, y $6 por cada 1M de tokens de salida.

Puntos clave

  • Qwen3.8 2.4T A95B es un modelo MoE disperso de peso abierto con 2.4T de parámetros totales y 95B de parámetros activos.
  • Novita lo expone como un modelo serverless solo texto con llamada a funciones, salidas estructuradas y soporte de razonamiento.
  • Novita lista una ventana de contexto de 1,000,000 de tokens y un máximo de salida de 131,072 tokens.
  • El modelo es más adecuado para equipos que valoran la portabilidad del peso abierto y los flujos de trabajo centrados en texto, que para cargas de trabajo que requieren entrada visual o una capa de producto gestionada llave en mano.

Especificaciones y precios de Qwen3.8 2.4T A95B

Campo Valor en Novita
Nombre mostrado Qwen3.8 2.4T A95B
ID del modelo qwen/qwen3.8-2.4t-a95b
Tipo de modelo MoE disperso de peso abierto
Parámetros totales 2.4T
Parámetros activos 95B
Ventana de contexto 1,000,000 tokens
Máx. tokens de salida 131,072
Modalidad de entrada Texto
Modalidad de salida Texto
Endpoints chat/completions, responses
Funcionalidades Serverless, llamada a funciones, salidas estructuradas, razonamiento
Precio de entrada $2 / 1M tokens
Precio de lectura de caché $0.25 / 1M tokens
Precio de salida $6 / 1M tokens
Nivel de tasa mostrado T1: 30 RPM / 50,000,000 TPM
Fecha de consulta 2 de septiembre de 2026

Los precios y límites pueden cambiar. Confirma en la página del modelo Novita AI y en la página de precios de Novita AI antes de comprometerte con un costo de producción.

Qué puede hacer Qwen3.8 2.4T A95B

Qwen3.8 2.4T A95B está diseñado para cargas de trabajo centradas en texto que se benefician de una gran ventana de contexto y una fuerte capacidad de razonamiento. Su posicionamiento de peso abierto también brinda a los equipos la posibilidad de evaluar el modelo frente a sus propios requisitos de servicio e implementación, en lugar de tratar un endpoint gestionado como la única opción.

El modelo es adecuado para revisiones de código a escala de repositorio, investigación multidocumento, razonamiento textual complejo, generación estructurada y bucles agentivos que retienen rastros de herramientas o estado intermedio. La ficha del modelo Qwen documenta los pesos del modelo y los archivos de configuración, y lista la compatibilidad con stacks de servicio como vLLM y SGLang.

Cuándo es una buena elección Qwen3.8 2.4T A95B

Elige este modelo cuando necesites:

  • portabilidad de peso abierto y control sobre la capa de servicio
  • programación, revisión de código o análisis de repositorios con contexto largo
  • investigación solo texto y razonamiento multidocumento
  • flujos de trabajo agentivos mediante llamada a funciones, salidas estructuradas o razonamiento
  • un endpoint alojado en Novita para evaluación antes de un trabajo de infraestructura más profundo

La distinción de peso abierto importa cuando tu equipo pueda más adelante autoalojar, cambiar la infraestructura de servicio o mantener un mismo artefacto de modelo en distintos entornos. Para el modelo gestionado Qwen3.8-Max en Novita AI y su vía de acceso a nivel de producto, consulta Qwen3.8-Max en Novita AI.

Cuándo Qwen3.8 2.4T A95B no es la mejor opción por defecto

Este modelo no es la mejor opción por defecto para entrada de imágenes o visión, ya que Novita lista su modalidad de entrada como texto. Tampoco es necesario si realizas clasificación corta, extracción ligera o indicaciones de alto volumen donde un modelo más pequeño cumpliría el requisito de calidad a un costo menor.

Elige la vía del modelo gestionado Qwen3.8-Max cuando necesites su capa adicional de producto, incluyendo entrada de visión o un flujo de trabajo gestionado más llave en mano. Si tu pregunta principal es cómo enviar la primera solicitud, usa la Guía de inicio rápido de la API de Qwen3.8-Max en lugar de esta página de lanzamiento y decisión.

Acceso a la API de Qwen3.8 2.4T A95B en Novita AI

La página del modelo de Novita lista el ID de la API como qwen/qwen3.8-2.4t-a95b y soporta las familias de endpoints chat/completions y responses. El punto de entrada de la API compatible con OpenAI de Novita es https://api.novita.ai/openai.

Esta sección solo proporciona información de acceso. No incluye un recorrido para la primera solicitud, parámetros completos de solicitud ni pasos de resolución de problemas; esos pertenecen a una guía de inicio rápido o de funciones detallada.

Preguntas frecuentes

¿Cuál es el ID del modelo en Novita?

Usa qwen/qwen3.8-2.4t-a95b.

¿Qwen3.8 2.4T A95B es de peso abierto?

Sí. La ficha del modelo Qwen proporciona los pesos del modelo y los archivos de configuración para el modelo post-entrenado. La disponibilidad de peso abierto no significa que cada implementación tenga el mismo hardware, servicio o perfil de rendimiento.

¿Qué límites de contexto y salida lista Novita?

Novita lista una ventana de contexto de 1,000,000 de tokens y un máximo de salida de 131,072 tokens.

¿Cuánto cuesta en Novita AI?

Novita lista $2 por cada 1M de tokens de entrada, $0.25 por cada 1M de tokens de lectura de caché y $6 por cada 1M de tokens de salida, según lo consultado el 2 de septiembre de 2026.

¿Es lo mismo que Qwen3.8-Max?

Es el modelo Qwen3.8 2.4T A95B de peso abierto, mientras que Qwen3.8-Max es la vía de servicio gestionado por separado. Compara las capacidades verificadas y los requisitos de acceso para tu carga de trabajo antes de elegir entre ellos.

Fuentes

Artículos recomendados