Ling-3.0 Tiny sur Novita AI : MoE 7,9B, contexte 256K et tarif de lancement
Ling-3.0 Tiny sur Novita AI : identifiant de modèle vérifié, architecture MoE 7,9B, contexte 256K, appels de fonction et tarif de lancement actuel.
Ling-3.0 Tiny sur Novita AI : identifiant de modèle vérifié, architecture MoE 7,9B, contexte 256K, appels de fonction et tarif de lancement actuel.
Utilisez Ling-3.0-flash gratuitement sur Novita AI : un modèle MoE de 124B avec 5,1B de paramètres actifs, 262K de contexte, raisonnement et appel de fonction.
Macaron V1 Venti est un modèle phare Mixture-of-LoRA de 748B pour le code, les agents et la GenUI. Découvrez ses spécifications, sa disponibilité sur Novita AI, ses tarifs et...
Utilisez DeepSeek dans Claude Code via l'API V4 Flash sur Novita AI. Définissez quatre variables d'environnement, obtenez un contexte de 1 million de tokens et réduisez les...
Kimi K2.7 Code est disponible sur Novita AI avec accès à l'API de chat compatible OpenAI, contexte 256K, appel d'outils et entrées multimodales.
Nemotron 3 Nano 30B A3B est disponible sur Novita AI en tant que LLM serverless avec des complétions de chat compatibles OpenAI, 256K de contexte, et une tarification à l'usage...
CoBuddy est disponible sur Novita AI en tant qu'API LLM spécialisée dans le codage pour la génération de code, les assistants de codage et les workflows d'agents IA.
Utilisez MiniMax M3 sur Novita AI pour le codage, les workflows agentiques, le contexte 1M tokens et l’entrée multimodale avec des API compatibles OpenAI.
Qwen3.7-Max est disponible sur Novita AI pour le codage agentique et les workflows à long contexte. Consultez l'accès API, les tarifs, les limites et les cas d'utilisation.
Le cache KV externe PegaFlow aide les équipes de déploiement vLLM à préserver et partager le cache KV entre redémarrages, instances et nœuds RDMA.
DeepSeek-V4-Pro est un modèle MoE open-source de 1,6 billion de paramètres, obtenant un score n°1 au LiveCodeBench (93,5) et un contexte de 1 million de tokens. Disponible dès...
Kimi K2.6 est désormais disponible sur Novita AI. Modèle open-source MoE à 1T, contexte 256K, 58,6% sur SWE-Bench Pro — conçu pour le codage agentique longue durée. Essayez-le...
GLM-5.1 de Z.ai est désormais disponible sur Novita AI — il obtient le meilleur score au SWE-Bench Pro avec 58,4 et exécute des tâches de codage autonomes pendant 8 heures....
Gemma 4 est désormais disponible sur Novita AI — 4 tailles de modèle, 3 architectures, support de la vision sur toute la gamme, support audio sur E2B et E4B.