Qwen3.8 2.4T A95B en Novita AI: Acceso y Precios del Modelo de Pesos Abiertos

Qwen3.8 2.4T A95B en Novita AI: Acceso y Precios del Modelo de Pesos Abiertos

Qwen3.8 2.4T A95B es un modelo Qwen3.8 de pesos abiertos, solo texto, disponible a través de la API serverless de Novita AI. Está orientado a desarrolladores que necesitan codificación de contexto largo, investigación, razonamiento complejo o flujos de trabajo de agentes, manteniendo a la vez una opción de servicio con pesos abiertos. Novita lista el ID del modelo como qwen/qwen3.8-2.4t-a95b, una ventana de contexto de 1,000,000 de tokens, un máximo de 131,072 tokens de salida, y precios de $2 por 1M de tokens de entrada, $0.25 por 1M de tokens de lectura de caché y $6 por 1M de tokens de salida.

Aspectos Clave

  • Qwen3.8 2.4T A95B es un modelo MoE disperso de pesos abiertos con 2.4T de parámetros totales y 95B de parámetros activos.
  • Novita lo expone como un modelo serverless solo texto con soporte para llamada a funciones, salidas estructuradas y razonamiento.
  • Novita lista una ventana de contexto de 1,000,000 de tokens y un máximo de salida de 131,072 tokens.
  • El modelo es más adecuado para equipos que valoran la portabilidad de pesos abiertos y flujos de trabajo centrados en texto, que para cargas de trabajo que requieren entrada de visión o una capa de producto gestionada llave en mano.

Especificaciones y Precios de Qwen3.8 2.4T A95B

Campo Valor de Novita
Nombre mostrado Qwen3.8 2.4T A95B
ID del modelo qwen/qwen3.8-2.4t-a95b
Tipo de modelo MoE disperso de pesos abiertos
Parámetros totales 2.4T
Parámetros activos 95B
Ventana de contexto 1,000,000 tokens
Máx. tokens de salida 131,072
Modalidad de entrada Texto
Modalidad de salida Texto
Endpoints chat/completions, responses
Funcionalidades Serverless, llamada a funciones, salidas estructuradas, razonamiento
Precio de entrada $2 / 1M tokens
Precio de lectura de caché $0.25 / 1M tokens
Precio de salida $6 / 1M tokens
Nivel de tasa mostrado T1: 30 RPM / 50,000,000 TPM
Fecha de verificación 2 de septiembre de 2026

Los precios y límites pueden cambiar. Confirma en la página del modelo de Novita AI y en la página de precios de Novita AI antes de asumir un costo de producción.

Qué Puede Hacer Qwen3.8 2.4T A95B

Qwen3.8 2.4T A95B está diseñado para cargas de trabajo centradas en texto que se benefician de una ventana de contexto grande y una fuerte capacidad de razonamiento. Su posicionamiento de pesos abiertos también brinda a los equipos una ruta para evaluar el modelo según sus propios requisitos de servicio e implementación, en lugar de tratar un endpoint gestionado como la única opción.

El modelo es adecuado para revisión de código a escala de repositorio, investigación multidocumento, razonamiento textual complejo, generación estructurada y bucles de agentes que retienen trazas de herramientas o estado intermedio. La tarjeta del modelo Qwen documenta los pesos y archivos de configuración del modelo y lista compatibilidad con stacks de servicio como vLLM y SGLang.

Cuándo Qwen3.8 2.4T A95B es una Buena Opción

Elige este modelo cuando necesites:

  • portabilidad de pesos abiertos y control sobre la capa de servicio
  • codificación de contexto largo, revisión de código o análisis de repositorios
  • investigación solo texto y razonamiento multidocumento
  • flujos de trabajo de agentes que utilicen llamada a funciones, salidas estructuradas o razonamiento
  • un endpoint alojado de Novita para evaluación antes de un trabajo de infraestructura más profundo

La distinción de pesos abiertos es importante cuando tu equipo pueda más adelante auto-alojar, cambiar la infraestructura de servicio, o mantener un artefacto de modelo consistente en todos los entornos. Para el modelo gestionado Qwen3.8-Max en Novita AI y su ruta de acceso a nivel de producto, consulta Qwen3.8-Max en Novita AI.

Cuándo Qwen3.8 2.4T A95B No es la Mejor Opción por Defecto

Este modelo no es la mejor opción por defecto para entrada de imágenes o visión, ya que Novita lista su modalidad de entrada como texto. También puede ser más de lo que necesitas para clasificación corta, extracción ligera o prompts de alto volumen donde un modelo más pequeño cumpliría con el requisito de calidad a un costo menor.

Elige la ruta gestionada de Qwen3.8-Max en su lugar cuando necesites su capa de producto adicional, incluyendo entrada de visión o un flujo de trabajo gestionado más llave en mano. Si tu pregunta principal es cómo enviar la primera solicitud, utiliza la Guía de Inicio Rápido de la API de Qwen3.8-Max en lugar de esta página de lanzamiento y decisión.

Acceso a la API de Qwen3.8 2.4T A95B en Novita AI

La página del modelo de Novita lista el ID de la API como qwen/qwen3.8-2.4t-a95b y soporta las familias de endpoints chat/completions y responses. El punto de entrada de la API compatible con OpenAI de Novita es https://api.novita.ai/openai.

Esta sección proporciona información de acceso intencionalmente. No incluye un tutorial de primera solicitud, parámetros de solicitud completos ni pasos de solución de problemas; esos elementos pertenecen a una guía de inicio rápido o de características 4.4.

FAQ

¿Cuál es el ID del modelo en Novita?

Usa qwen/qwen3.8-2.4t-a95b.

¿Qwen3.8 2.4T A95B tiene pesos abiertos?

Sí. La tarjeta del modelo Qwen proporciona los pesos y archivos de configuración del modelo post-entrenado. La disponibilidad de pesos abiertos no significa que cada implementación tenga el mismo hardware, servicio o perfil de rendimiento.

¿Qué límites de contexto y salida lista Novita?

Novita lista una ventana de contexto de 1,000,000 de tokens y un máximo de salida de 131,072 tokens.

¿Cuánto cuesta en Novita AI?

Novita lista $2 por 1M de tokens de entrada, $0.25 por 1M de tokens de lectura de caché y $6 por 1M de tokens de salida, verificado el 2 de septiembre de 2026.

¿Es esto lo mismo que Qwen3.8-Max?

Es el modelo Qwen3.8 2.4T A95B de pesos abiertos, mientras que Qwen3.8-Max es la ruta de servicio gestionado separada. Compara las capacidades verificadas y los requisitos de acceso para tu carga de trabajo antes de elegir entre ellos.

Fuentes

Artículos Recomendados