Qwen3.8 2.4T A95B es un modelo Qwen3.8 de solo texto y pesos abiertos, disponible a través de la API serverless de Novita AI. Está diseñado para desarrolladores que necesitan codificación con contexto largo, investigación, razonamiento complejo o flujos de trabajo agentivos, manteniendo una opción de servido con pesos abiertos. Novita lista el ID del modelo como qwen/qwen3.8-2.4t-a95b, una ventana de contexto de 1,000,000 de tokens, un máximo de 131,072 tokens de salida, y precios de $2 por 1M de tokens de entrada, $0.25 por 1M de tokens de lectura de caché y $6 por 1M de tokens de salida.
Conclusiones Clave
- Qwen3.8 2.4T A95B es un modelo MoE disperso de pesos abiertos con 2.4T de parámetros totales y 95B de parámetros activos.
- Novita lo expone como un modelo serverless de solo texto con llamada a funciones, salidas estructuradas y soporte de razonamiento.
- Novita lista una ventana de contexto de 1,000,000 de tokens y un máximo de salida de 131,072 tokens.
- El modelo es más adecuado para equipos que valoran la portabilidad de pesos abiertos y flujos de trabajo centrados en texto que para cargas de trabajo que requieren entrada visual o una capa de producto gestionada llave en mano.
Especificaciones y Precios de Qwen3.8 2.4T A95B
| Campo | Valor de Novita |
|---|---|
| Nombre mostrado | Qwen3.8 2.4T A95B |
| ID del modelo | qwen/qwen3.8-2.4t-a95b |
| Tipo de modelo | MoE disperso de pesos abiertos |
| Parámetros totales | 2.4T |
| Parámetros activos | 95B |
| Ventana de contexto | 1,000,000 tokens |
| Máximo de tokens de salida | 131,072 |
| Modalidad de entrada | Texto |
| Modalidad de salida | Texto |
| Endpoints | chat/completions, responses |
| Características | Serverless, llamada a funciones, salidas estructuradas, razonamiento |
| Precio de entrada | $2 / 1M tokens |
| Precio de lectura de caché | $0.25 / 1M tokens |
| Precio de salida | $6 / 1M tokens |
| Nivel de tasa mostrado | T1: 30 RPM / 50,000,000 TPM |
| Fecha de verificación | 2 de septiembre de 2026 |
Los precios y límites pueden cambiar. Confirme la página del modelo de Novita AI y la página de precios de Novita AI antes de asumir un compromiso de costos en producción.
Qué Puede Hacer Qwen3.8 2.4T A95B
Qwen3.8 2.4T A95B está diseñado para cargas de trabajo centradas en texto que se benefician de una gran ventana de contexto y una sólida capacidad de razonamiento. Su posicionamiento de pesos abiertos también brinda a los equipos un camino para evaluar el modelo según sus propios requisitos de servido e implementación, en lugar de tratar un endpoint gestionado como la única opción.
El modelo es adecuado para revisiones de código a escala de repositorio, investigación multidocumento, razonamiento textual complejo, generación estructurada y bucles de agente que conservan trazas de herramientas o estado intermedio. La tarjeta del modelo Qwen documenta los pesos y archivos de configuración del modelo y lista la compatibilidad con stacks de servido como vLLM y SGLang.
Cuándo Qwen3.8 2.4T A95B Es una Buena Opción
Elija este modelo cuando necesite:
- portabilidad de pesos abiertos y control sobre la capa de servido
- codificación con contexto largo, revisión de código o análisis de repositorio
- investigación solo de texto y razonamiento multidocumento
- flujos de trabajo agentivos que usen llamada a funciones, salidas estructuradas o razonamiento
- un endpoint alojado de Novita para evaluación antes de un trabajo de infraestructura más profundo
La distinción de pesos abiertos importa cuando su equipo puede más adelante autoalojar, cambiar la infraestructura de servido o mantener un artefacto de modelo consistente entre entornos. Para el modelo gestionado Qwen3.8-Max en Novita AI y su ruta de acceso a nivel de producto, consulte Qwen3.8-Max en Novita AI.
Cuándo Qwen3.8 2.4T A95B No Es la Mejor Opción Predeterminada
Este modelo no es la mejor opción predeterminada para entrada de imágenes o visión porque Novita lista su modalidad de entrada como texto. También puede ser más de lo que necesita para clasificación corta, extracción ligera o indicaciones de alto volumen donde un modelo más pequeño cumpliría el requisito de calidad a un costo menor.
Elija la ruta gestionada Qwen3.8-Max en su lugar cuando necesite su capa de producto adicional, incluyendo entrada de visión o un flujo de trabajo gestionado más llave en mano. Si su pregunta principal es cómo enviar la primera solicitud, use la Guía de inicio rápido de la API de Qwen3.8-Max en lugar de esta página de lanzamiento y decisión.
Acceso a la API de Qwen3.8 2.4T A95B en Novita AI
La página del modelo de Novita lista el ID del modelo de API como qwen/qwen3.8-2.4t-a95b y admite las familias de endpoints chat/completions y responses. El punto de entrada de la API compatible con OpenAI de Novita es https://api.novita.ai/openai.
Esta sección proporciona intencionalmente solo información de acceso. No incluye un tutorial de primera solicitud, parámetros de solicitud completos ni pasos de solución de problemas; esos pertenecen a una guía de inicio rápido o una guía de características 4.4.
FAQ
¿Cuál es el ID del modelo de Novita?
Use qwen/qwen3.8-2.4t-a95b.
¿Qwen3.8 2.4T A95B tiene pesos abiertos?
Sí. La tarjeta del modelo Qwen proporciona los pesos y archivos de configuración para el modelo post-entrenado. La disponibilidad de pesos abiertos no significa que cada implementación tenga el mismo perfil de hardware, servido o rendimiento.
¿Qué límites de contexto y salida lista Novita?
Novita lista una ventana de contexto de 1,000,000 de tokens y un máximo de salida de 131,072 tokens.
¿Cuánto cuesta en Novita AI?
Novita lista $2 por 1M de tokens de entrada, $0.25 por 1M de tokens de lectura de caché y $6 por 1M de tokens de salida, verificado el 2 de septiembre de 2026.
¿Es esto lo mismo que Qwen3.8-Max?
Es el modelo Qwen3.8 2.4T A95B de pesos abiertos, mientras que Qwen3.8-Max es la ruta de servicio gestionado separada. Compare las capacidades verificadas y los requisitos de acceso para su carga de trabajo antes de elegir entre ellos.
Fuentes
- Página del modelo de Novita: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (verificado el 2026-09-02)
- Página de precios de Novita: https://novita.ai/pricing (verificado el 2026-09-02)
- Tarjeta del modelo Qwen: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (verificado el 2026-09-02)
- Guía de lanzamiento de Qwen3.8-Max: /qwen3-8-max-on-novita-ai-launch-pricing/
- Inicio rápido de Qwen3.8-Max: /qwen3-8-max-api-quick-start/
