Novita AI 24 octobre 2024 Allocation dynamique des ressources GPU pour les charges de travail Kubernetes
Novita AI 21 octobre 2024 Ajout dynamique de mappages de ports à des conteneurs Docker en cours d’exécution
Novita AI 2 février 2024 Méthodes de quantification pour un accélération 100X de l'inférence de grands modèles de langage