- Puntos clave
- Línea Ling-3.0 de un vistazo
- Qué comparten las variantes
- Elige Ling-3.0-flash para la línea base general
- Elige Ling-3.0-flash-fin para flujos de trabajo financieros
- Elige Ling-3.0-flash-sante para tareas de salud y medicina
- Elige Ling-3.0-flash-vl para solicitudes de imagen y video
- Una regla práctica de enrutamiento
- Precia la decisión, no el nombre
- Preguntas frecuentes
- Artículos recomendados
Comienza con la solicitud, no con el nombre del modelo. Usa Ling-3.0-flash como base general de texto y agente, Ling-3.0-flash-fin para flujos de trabajo financieros, Ling-3.0-flash-sante para salud y medicina, y Ling-3.0-flash-VL cuando la solicitud incluya imágenes o video. Los cuatro son endpoints de chat serverless en Novita AI con el mismo contexto de 262,144 tokens y salida máxima de 32,768 tokens, pero las diferencias en afinamiento de dominio, modalidades de entrada y precios actuales convierten el ID del modelo en una decisión de enrutamiento.
Los cuatro modelos comparten la misma base Flash de 124B parámetros. Activan aproximadamente 5.1B parámetros por token, excepto Flash-VL con alrededor de 5.5B. Por lo tanto, las variantes de dominio y capacidad no son una escalera de pequeña a grande. Son rutas a través de la misma arquitectura.
Puntos clave
- Línea base de texto y uso de herramientas:
ling-3.0-flashes adecuado para cargas de trabajo generales de agente y texto de contexto largo. - Ajuste financiero:
ling-3.0-flash-fines la opción a probar para inversiones, mercados y otros flujos de trabajo específicos del ámbito financiero. - Ajuste médico:
ling-3.0-flash-santees la opción a probar para flujos de trabajo de razonamiento en salud y medicina. - Ruta multimodal:
ling-3.0-flash-vles el único miembro de la familia en Novita AI que actualmente acepta entrada de imágenes y video junto con texto.
Línea Ling-3.0 de un vistazo
El catálogo de modelos fue verificado el 9 de septiembre de 2026. Los precios y la disponibilidad pueden cambiar, así que vuelve a consultar la página de modelos en vivo antes de fijar una estimación o una ruta de producción.
| ID del modelo | Mejor ajuste | Parámetros totales / activos | Modalidades | Contexto / salida máxima | Precio actual por 1M tokens |
|---|---|---|---|---|---|
inclusionai/ling-3.0-flash |
Inferencia general de agente, razonamiento y uso de herramientas | 124B / ~5.1B | Texto → texto | 262,144 / 32,768 | $0.06 entrada; $0.18 salida |
inclusionai/ling-3.0-flash-fin |
Razonamiento financiero y flujos de trabajo de múltiples pasos | 124B / ~5.1B | Texto → texto | 262,144 / 32,768 | $0 entrada; $0 salida |
inclusionai/ling-3.0-flash-sante |
Razonamiento en salud y medicina más capacidad general | 124B / ~5.1B | Texto → texto | 262,144 / 32,768 | $0 entrada; $0 salida |
inclusionai/ling-3.0-flash-vl |
Capturas de pantalla, gráficos, documentos, video y agentes visuales | 124B / ~5.5B | Texto + imagen + video → texto | 262,144 / 32,768 | $0 entrada; $0 salida |
El catálogo también enumera acceso serverless, razonamiento y llamada a funciones para cada modelo. ling-3.0-flash-vl y ling-3.0-flash-sante exponen adicionalmente un endpoint compatible con Anthropic; los otros dos listan chat/completions.
Qué comparten las variantes
Cada modelo está construido sobre Ling-3.0-flash. El catálogo de Novita y la ficha oficial del modelo Flash describen la ruta base Flash como un MoE de 124B parámetros con aproximadamente 5.1B parámetros activos por token; Flash-VL también tiene 124B pero activa alrededor de 5.5B. Esto significa que la elección entre las variantes Flash se basa principalmente en el énfasis del dominio, la modalidad de entrada, el estado del precio y el comportamiento de latencia, no en una diferencia en la escala total de la arquitectura.
Los cuatro listados actualmente muestran los mismos límites de contexto y salida de Novita: 262,144 tokens de entrada y 32,768 tokens de salida. Esta igualdad hace que el contexto sea un filtro inicial pobre. El ajuste, la modalidad, el costo y la latencia medida son mejores formas de reducir la línea antes de realizar evaluaciones comparativas.
Elige Ling-3.0-flash para la línea base general
Usa Ling-3.0-flash cuando tu carga de trabajo sea solo texto y aún no tenga una especialización vertical clara. Es la primera prueba natural para chat, análisis de documentos, agentes de múltiples pasos, controles de razonamiento y llamadas a herramientas. La guía de inicio rápido muestra el flujo de solicitudes compatible con OpenAI.
También es el modelo de control justo para comparaciones. Si Fin o Sante no mejoran tus trazas específicas de tareas, tienes evidencia para mantener la ruta general en lugar de agregar un ID de modelo adicional.
Elige Ling-3.0-flash-fin para flujos de trabajo financieros
Usa Ling-3.0-flash-fin cuando la tarea dependa del vocabulario financiero y el razonamiento financiero de múltiples pasos. El listado de Novita describe el modelo como mejorado para finanzas y adecuado para flujos de trabajo de inversión del mundo real, planificación a largo plazo y ejecución, manteniendo la capacidad de razonamiento, codificación y matemáticas.
No es un sistema de cumplimiento ni un sustituto de tus controles de datos. Mantén las citas, documentos fuente, cálculos y pasos de aprobación en la aplicación. Para análisis de cartera, revisión de ganancias, síntesis de investigaciones o redacción de procesos de inversión, compara Fin con el modelo Flash general en ejemplos de tu dominio real.
Elige Ling-3.0-flash-sante para tareas de salud y medicina
Usa Ling-3.0-flash-sante cuando la solicitud involucre razonamiento sobre conocimiento médico, lenguaje de seguridad clínica, recuperación de evidencia o flujos de trabajo médicos a largo plazo. Novita describe a Sante como construido sobre Ling-3.0-flash, con 124B parámetros totales y aproximadamente 5.1B parámetros activos. También hay disponible una guía de inicio rápido de chat completions.
El uso médico añade requisitos más allá de la elección del modelo: manejo de privacidad, revisión humana, rutas de escalamiento, procedencia y reglas regulatorias locales. Sante es el miembro de la familia a evaluar para redacción y razonamiento médico, pero tu producto aún debe verificar los resultados antes de cualquier acción clínicamente relevante.
Elige Ling-3.0-flash-vl para solicitudes de imagen y video
Usa Ling-3.0-flash-VL cuando el modelo deba ver algo: capturas de pantalla, gráficos, formularios, documentos, imágenes de productos o videos cortos. Es la única variante en el listado actual de Novita que acepta entrada de imagen y video con salida de texto.
La prueba útil es si la evidencia visual cambia la acción que toma el sistema. Un agente de navegador podría leer una pantalla, elegir un control, llamar a una herramienta y verificar el resultado; un asistente de informes podría extraer una serie de un gráfico. Para solicitudes solo de texto, envía la solicitud al modelo Flash base a menos que tus pruebas muestren una razón para usar VL.
Una regla práctica de enrutamiento
Usa una configuración pequeña en lugar de dispersar IDs de modelo en tu código:
model_routes = {
"agente_texto_general": "inclusionai/ling-3.0-flash",
"flujo_financiero": "inclusionai/ling-3.0-flash-fin",
"flujo_medico": "inclusionai/ling-3.0-flash-sante",
"imagen_o_video": "inclusionai/ling-3.0-flash-vl",
}
Luego deja que los metadatos de la carga de trabajo elijan la ruta. Comienza con Flash general para trabajo de agente solo texto y VL cuando haya contenido de imagen o video. Agrega Fin o Sante solo cuando tus trazas de dominio muestren que la ruta especializada vale la sobrecarga adicional de evaluación y operaciones.
Precia la decisión, no el nombre
Los precios actuales del catálogo se dividen en dos patrones. El modelo Flash general lista $0.06 por millón de tokens de entrada y $0.18 por millón de tokens de salida. Fin, Sante y VL listan $0 para ambos. Esos precios cero son promociones instantáneas en vivo, no garantías permanentes.
Para estimaciones de producción reales, registra el tamaño del prompt, el tamaño de la respuesta, el comportamiento de caché, los reintentos, la frecuencia de llamadas a herramientas y el número de turnos del modelo por acción del usuario. Una ruta con un precio de lista más alto puede ser más barata si resuelve una tarea en menos turnos o menos repeticiones; un listado gratuito no elimina el costo de pruebas, operaciones o revisión de calidad.
Preguntas frecuentes
¿Cuántos modelos Ling-3.0 ofrece Novita AI?
El catálogo verificado lista cuatro: ling-3.0-flash, ling-3.0-flash-fin, ling-3.0-flash-sante y ling-3.0-flash-vl.
¿Todos los cuatro modelos tienen la misma ventana de contexto?
Sí. Los listados actuales de Novita muestran 262,144 tokens de contexto y 32,768 tokens de salida máxima para cada modelo.
¿Qué modelo Ling-3.0 debo usar para capturas de pantalla o video?
Usa inclusionai/ling-3.0-flash-vl. Es el miembro de la familia que Novita lista actualmente con entrada de texto, imagen y video.
¿Son permanentes los precios gratuitos de Ling-3.0?
No. Fin, Sante y VL actualmente listan $0 de entrada y $0 de salida, pero el precio es un valor del catálogo en vivo. Vuelve a verificarlo antes de usarlo en producción.
