Inicio rápido de la API de Macaron V1 Venti: endpoint gratuito de contexto de 1M en Novita AI

Inicio rápido de la API de Macaron V1 Venti: endpoint gratuito de contexto de 1M en Novita AI

Macaron V1 Venti es la vía más rápida al modelo Macaron insignia de Novita si necesitas un flujo de trabajo con contexto de 1M para codificación, agentes o GenUI. Comienza con una solicitud pequeña de solo texto y luego amplía la escala una vez que el endpoint y la autenticación funcionen.

Para una visión general más amplia del modelo, consulta Macaron V1 Venti en Novita AI.

Cuándo usar esta guía de inicio rápido

Usa esta guía cuando tu carga de trabajo necesite contexto largo, uso de herramientas o generación de UI nativa de código, en lugar de respuestas breves de chat. La página del modelo Macaron V1 Venti en Novita enumera acceso serverless, llamada de funciones y razonamiento, con entrada y salida de texto.

Paso 1: Obtén tu clave de API de Novita

Crea una clave de API de Novita y guárdala en el servidor.

export NOVITA_API_KEY="your_api_key_here"

Paso 2: Confirma el ID del modelo y el endpoint

Campo Valor
ID del modelo mindai/macaron-v1-venti
URL base https://api.novita.ai/openai/v1
Endpoint de finalización de chat https://api.novita.ai/openai/v1/chat/completions
Ventana de contexto 1.048.576 tokens
Máximo de tokens de salida 131.072
Entrada Texto
Salida Texto
Características API serverless, llamada de funciones, razonamiento
Nivel de límite de frecuencia mostrado T1: 30 RPM, 50.000.000 TPM

En el momento de la comprobación del 28 de julio de 2026, Novita mostraba Macaron V1 Venti como gratis por tiempo limitado con precios de $0 de entrada y $0 de salida. Verifica la página del modelo en vivo antes de presupuestar su uso en producción.

Paso 3: Envía tu primera solicitud

Comienza con un prompt breve de solo texto para verificar la autenticación, el enrutamiento y el análisis.

Summarize the main risks in a repository-wide refactor in 5 bullet points.

Paso 4: Lee la respuesta

Para finalizaciones de chat estándar, lee la respuesta desde choices[0].message.content. Mantén los metadatos de la solicitud, el uso de tokens y el estado HTTP en tus registros para poder rastrear llamadas lentas o costosas más tarde.

Paso 5: Revisa precios, límites y errores comunes

La lista actual importa más que una entrada de blog desactualizada. Vuelve a revisar la página del modelo antes del lanzamiento si dependes del precio gratuito, de un nivel de tarifa específico o de la ventana completa de contexto de 1M.

Los errores comunes de configuración incluyen:

  • Usar el nombre visible en lugar de mindai/macaron-v1-venti.
  • Apuntar el SDK a la URL base incorrecta.
  • Enviar un prompt enorme antes de confirmar la conectividad básica.
  • Suponer que cada solicitud de contexto largo debe usar el límite máximo de salida.

Ejemplo en Python

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-venti",
    messages=[
        {"role": "system", "content": "You are a concise coding assistant."},
        {"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

Ejemplo con cURL

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-venti",
    "messages": [
      {
        "role": "system",
        "content": "You are a concise coding assistant."
      },
      {
        "role": "user",
        "content": "List the safest first steps for refactoring a large monorepo."
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

Parámetros clave

Parámetro Comienza con Por qué importa
model mindai/macaron-v1-venti Selecciona el modelo alojado
messages Prompt corto de sistema + usuario Verifica rápidamente la ruta de la API
temperature 0.2 Mantiene estable la salida de pruebas
max_tokens 400 Evita respuestas iniciales demasiado grandes
tools Una función a la vez Útil para agentes y flujos de trabajo
response_format Solo si tu analizador está listo Valida JSON antes de publicar

Prompts para codificación, agentes y GenUI

Codificación

Usa Macaron V1 Venti para refactorizaciones que tienen en cuenta el repositorio, planes de migración o resúmenes de revisión de código cuando el contexto circundante sea importante.

Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.

Agentes

Usa la llamada de funciones cuando el modelo deba elegir una herramienta en lugar de responder directamente.

Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.

GenUI

Úsalo para la generación de interfaces cuando quieras ideas de UI estructuradas a partir de un brief de producto.

Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.

Solución de problemas

La API devuelve un error de autenticación

Confirma que el token de portador esté configurado en el mismo shell o runtime que realiza la solicitud.

No se encuentra el modelo

Vuelve a verificar el ID del modelo: mindai/macaron-v1-venti.

La solicitud es demasiado grande

Comienza con algo más pequeño y luego añade contexto gradualmente. Una ventana de 1M de tokens es capacidad, no una señal para enviarlo todo a la vez.

Preguntas frecuentes

¿Está Macaron V1 Venti disponible en Novita AI?

Sí. La página del modelo en vivo lo lista como un modelo serverless.

¿Qué endpoint debo usar?

Usa https://api.novita.ai/openai/v1/chat/completions.

¿Admite uso de herramientas?

Sí. Novita lista la llamada de funciones como una característica del modelo.

¿El modelo es gratuito ahora mismo?

La lista comprobada el 28 de julio de 2026 mostraba precios de $0 de entrada y $0 de salida, marcado como gratis por tiempo limitado.

Artículos recomendados

Fuentes consultadas el 28 de julio de 2026: página del modelo Macaron V1 Venti, referencia de la API de finalización de chat de Novita