Família Ling-3.0 na Novita AI: Comparação Completa da Linha e Qual Variante Usar
Compare quatro modelos Ling-3.0 na Novita AI por adequação, parâmetros ativos, contexto, modalidades e preços atuais para escolher a variante serverless correta.
Compare quatro modelos Ling-3.0 na Novita AI por adequação, parâmetros ativos, contexto, modalidades e preços atuais para escolher a variante serverless correta.
Explore o GLM-5.3 Flash na Novita AI: ID do modelo, contexto de 1M, saída de 128K, entrada multimodal, preços e onde ele se encaixa para agentes de codificação.
Conheça o Ling-3.0-flash-Fin no Novita AI: um MoE de 124B aprimorado para finanças, com contexto de 256K, saída máxima de 32K e preço de US$ 0 por milhão de tokens.
DeepSeek V4 Pro 0813 é o lançamento GA no Novita AI com DSpark, licença MIT, contexto de 1M e preços atualizados.
Macaron V1 Venti é um modelo principal 748B Mixture-of-LoRA para codificação, agentes e GenUI. Veja suas especificações, disponibilidade no Novita AI, preços e casos de uso ideais.
Guia passo a passo para configurar o CoBuddy (baidu/cobuddy) no Claude Code usando o endpoint compatível com OpenAI da Novita AI. Configuração da API, preços e dicas de fluxo...
O Nemotron 3 Nano 30B A3B está disponível na Novita AI como um LLM Serverless com chat completions compatível com OpenAI, contexto de 256K e precificação por token conforme o uso.
CoBuddy está disponível na Novita AI como uma API de LLM focada em codificação para geração de código, assistentes de codificação e fluxos de trabalho de agentes de IA.
Use o MiniMax M3 no Novita AI para codificação, fluxos de trabalho agenticos, contexto de 1 milhão de tokens e entrada multimodal com APIs compatíveis com OpenAI.
O Qwen3.7-Max está disponível na Novita AI para codificação agente e fluxos de trabalho de contexto longo. Veja acesso à API, preços, limites e casos de uso.
O cache KV externo do PegaFlow ajuda equipes de serving vLLM a preservar e compartilhar o cache KV entre reinicializações, instâncias e nós RDMA.
O DeepSeek-V4-Flash está disponível via Novita AI com a atualização de 31 de julho de 2026. Mesmo design MoE 284B/13B, contexto de 1M e preços de US$ 0,14/US$ 0,28.
Ling-2.6-flash é um modelo MoE de 104B (7.4B ativos) que oferece 340 tokens/s e eficiência de tokens 7x melhor que o Nemotron-3-Super em benchmarks de agentes. Disponível agora...
O Kimi K2.6 já está na Novita AI. Modelo open-source MoE de 1T, contexto de 256K, 58,6% no SWE-Bench Pro — construído para codificação agentica de longo horizonte. Experimente...