Ling-3.0-flash en Novita AI: API gratuita para inferencia de agentes
Usa Ling-3.0-flash gratis en Novita AI: un modelo MoE de 124B con 5.1B de parámetros activos, contexto de 262K, razonamiento y llamadas a funciones.
Usa Ling-3.0-flash gratis en Novita AI: un modelo MoE de 124B con 5.1B de parámetros activos, contexto de 262K, razonamiento y llamadas a funciones.
Macaron V1 Venti es un buque insignia 748B Mixture-of-LoRA para codificación, agentes y GenUI. Conoce sus especificaciones, disponibilidad en Novita AI, precios y casos de uso...
Hy3 está disponible gratuitamente en Novita AI a través de una API serverless. 295B MoE, 21B parámetros activos, contexto de 256K, tres modos de razonamiento y $0 por token.
GLM 5.2 está disponible en Novita AI con 1M de contexto, 128K de salida máxima, llamada a funciones, salidas estructuradas y acceso a API serverless.
Nemotron 3 Nano 30B A3B ya está disponible en Novita AI como un LLM sin servidor con finalizaciones de chat compatibles con OpenAI, contexto de 256K y precios por token de pago...
Qwen3.7-Max está disponible en Novita AI para codificación agencial y flujos de trabajo de contexto largo. Revisa el acceso a la API, precios, límites y casos de uso.
DeepSeek-V4-Flash ya está disponible a través de Novita AI. Modelo MoE de 284B, contexto de 1M de tokens, modos de razonamiento seleccionables. $0.14/M de entrada. API...
Ling-2.6-1T es el modelo a escala de billones de Ant Group construido sobre MLA + Hybrid Linear Attention — no es un MoE estándar. Alcanza SOTA de código abierto en benchmarks...
Ling-2.6-flash es un modelo MoE de 104B (7.4B activos) que ofrece 340 tokens/s y 7 veces mejor eficiencia de tokens que Nemotron-3-Super en benchmarks de agentes. Ya disponible...
Kimi K2.6 ya está en Novita AI. Modelo open-source MoE de 1T, contexto de 256K, 58.6% en SWE-Bench Pro, diseñado para codificación autónoma de largo plazo. Pruébalo gratis...
GLM-5.1 de Z.ai ya está disponible en Novita AI — lidera SWE-Bench Pro con 58.4 y ejecuta tareas de codificación autónomas durante 8 horas. Pruébalo con nuestra API serverless,...
Gemma 4 ya está disponible en Novita AI — 4 tamaños de modelo, 3 arquitecturas, soporte de visión en toda la gama, soporte de audio en E2B y E4B.
Descubre MiniMax Speech 2.5, una solución para clonación de voz de alta precisión con tiempos de respuesta rápidos y soporte multilingüe.
Accede a la API de GLM-4.6V en Novita AI: modelo de visión-lenguaje de 106B parámetros, contexto de 128K tokens, llamada nativa a funciones y comprensión documental multimodal...