- Cuándo usar esta guía de inicio rápido
- Paso 1: Obtén tu clave de API de Novita
- Paso 2: Confirma el ID del modelo y el endpoint
- Paso 3: Envía tu primera solicitud
- Paso 4: Lee la respuesta
- Paso 5: Revisa precios, límites y errores comunes
- Ejemplo en Python
- Ejemplo con cURL
- Parámetros clave
- Indicaciones para codificación, agentes y GenUI
- Solución de problemas
- Preguntas frecuentes
- Artículos recomendados
Macaron V1 Tall es la opción Macaron más ligera cuando necesitas contexto largo sin pasar directamente al modelo insignia. Úsalo para codificación, bucles de agentes o indicaciones de GenUI, y comienza con una solicitud breve de solo texto antes de ampliar a flujos de trabajo más largos.
Para la descripción general del modelo, consulta Macaron V1 Tall en Novita AI.
Para la comparación con el modelo insignia, consulta Macaron V1 Venti en Novita AI.
Cuándo usar esta guía de inicio rápido
Usa esta guía cuando tu carga de trabajo necesite suficiente contexto para manejar el estado del repositorio, rastros de herramientas o especificaciones de UI, pero no requiera la ventana de contexto más grande del catálogo.
Paso 1: Obtén tu clave de API de Novita
Crea una clave de API de Novita y consérvala en el servidor.
export NOVITA_API_KEY="your_api_key_here"
Paso 2: Confirma el ID del modelo y el endpoint
| Campo | Valor |
|---|---|
| ID del modelo | mindai/macaron-v1-tall |
| URL base | https://api.novita.ai/openai/v1 |
| Endpoint de chat completions | https://api.novita.ai/openai/v1/chat/completions |
| Ventana de contexto | 262,144 tokens |
| Máximo de tokens de salida | 32,768 |
| Entrada | Texto |
| Salida | Texto |
| Alojamiento | API serverless de Novita AI |
En el momento de la verificación del 29 de julio de 2026, Novita listó Macaron V1 Tall como gratuito por tiempo limitado con precios de $0 de entrada y $0 de salida. Verifica la página en vivo del modelo antes de presupuestar su uso en producción.
Paso 3: Envía tu primera solicitud
Comienza con una indicación breve de solo texto para verificar la autenticación, el enrutamiento y el parseo.
Summarize the main risks in a repository-wide refactor in 5 bullet points.
Paso 4: Lee la respuesta
Para los chat completions estándar, lee la respuesta desde choices[0].message.content. Mantén los metadatos de la solicitud, el uso de tokens y el estado HTTP en tus registros para poder rastrear llamadas lentas o costosas más adelante.
Paso 5: Revisa precios, límites y errores comunes
La lista actual es más importante que una publicación de blog desactualizada. Vuelve a revisar la página del modelo antes del lanzamiento si dependes del precio gratuito o de la ventana de contexto completa de 262K.
Los errores comunes de configuración incluyen:
- Usar el nombre visible en lugar de
mindai/macaron-v1-tall. - Apuntar el SDK a la URL base incorrecta.
- Enviar una indicación enorme antes de confirmar la conectividad básica.
- Suponer que toda solicitud de contexto largo debe usar el límite máximo de salida.
Ejemplo en Python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-tall",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Ejemplo con cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-tall",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Parámetros clave
| Parámetro | Comienza con | Por qué importa |
|---|---|---|
model |
mindai/macaron-v1-tall |
Selecciona el modelo alojado |
messages |
Indicación breve de sistema + usuario | Verifica rápidamente la ruta de la API |
temperature |
0.2 |
Mantiene estable la salida de prueba |
max_tokens |
400 |
Evita primeras respuestas demasiado grandes |
tools |
Una función a la vez | Útil para agentes y flujos de trabajo |
response_format |
Solo si tu analizador está listo | Valida JSON antes de publicar |
Indicaciones para codificación, agentes y GenUI
Codificación
Usa Macaron V1 Tall para refactorizaciones que tienen en cuenta el repositorio, planes de migración o resúmenes de revisión de código cuando el contexto circundante sea importante.
Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.
Agentes
Usa la llamada a funciones cuando el modelo deba elegir una herramienta en lugar de responder directamente.
Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.
GenUI
Úsalo para la generación de interfaces cuando quieras ideas estructuradas de UI a partir de un brief de producto.
Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.
Solución de problemas
La API devuelve un error de autenticación
Confirma que el token de portador esté configurado en el mismo shell o entorno de ejecución que realiza la solicitud.
No se encuentra el modelo
Vuelve a verificar el ID del modelo: mindai/macaron-v1-tall.
La solicitud es demasiado grande
Comienza más pequeño y luego agrega contexto gradualmente. Una ventana de 262K tokens es capacidad, no una señal para enviarlo todo de una vez.
Preguntas frecuentes
¿Está disponible Macaron V1 Tall en Novita AI?
Sí. La lista en vivo lo muestra como un modelo serverless.
¿Qué endpoint debo usar?
Usa https://api.novita.ai/openai/v1/chat/completions.
¿Admite uso de herramientas?
Revisa la página en vivo del modelo para conocer las etiquetas de funciones actuales antes de depender de llamadas a herramientas en producción.
¿El modelo es gratuito ahora mismo?
La lista verificada el 29 de julio de 2026 mostró precios de $0 de entrada y $0 de salida, marcados como gratuitos por tiempo limitado.
Artículos recomendados
- Macaron V1 Tall en Novita AI: modelo MoL gratuito de contexto 262K para chat, agentes y codificación
- Inicio rápido de Macaron V1 Venti en Novita AI: contexto de 1M, endpoint y ejemplos
- Macaron V1 Venti en Novita AI: modelo insignia Mixture-of-LoRA de 748B para codificación, agentes y GenUI
Fuentes consultadas el 29 de julio de 2026: biblioteca de modelos de Novita AI, referencia de la API de chat completions de Novita
