- Cuándo usar esta guía de inicio rápido
- Paso 1: Obtén tu clave de API de Novita
- Paso 2: Confirma el ID del modelo y el endpoint
- Paso 3: Envía tu primera solicitud
- Paso 4: Lee la respuesta
- Paso 5: Verifica precios, límites y errores comunes
- Ejemplo en Python
- Ejemplo con cURL
- Parámetros clave
- Programación, Agentes e Indicaciones de GenUI
- Solución de problemas
- Preguntas frecuentes
- Artículos recomendados
Macaron V1 Tall es la opción más ligera de Macaron cuando necesitas un contexto largo sin saltar directamente al modelo insignia. Úsalo para programación, bucles de agentes o indicaciones de GenUI, y comienza con una solicitud corta solo de texto antes de expandirte a flujos de trabajo más largos.
Si estás eligiendo el stack de programación Python a su alrededor, compara el Mejor IA para programar en Python en 2026.
Para una visión general del modelo, consulta Macaron V1 Tall en Novita AI.
Para la comparación con el modelo insignia, consulta Macaron V1 Venti en Novita AI.
Cuándo usar esta guía de inicio rápido
Usa esta guía cuando tu carga de trabajo necesite suficiente contexto para manejar el estado del repositorio, trazas de herramientas o especificaciones de interfaz de usuario, pero no necesite la ventana de contexto más grande del catálogo.
Paso 1: Obtén tu clave de API de Novita
Crea una clave de API de Novita y mantenla en el lado del servidor.
export NOVITA_API_KEY="tu_clave_api_aqui"
Paso 2: Confirma el ID del modelo y el endpoint
| Campo | Valor |
|---|---|
| ID del modelo | mindai/macaron-v1-tall |
| URL base | https://api.novita.ai/openai/v1 |
| Endpoint de finalización de chat | https://api.novita.ai/openai/v1/chat/completions |
| Ventana de contexto | 262,144 tokens |
| Máximo de tokens de salida | 32,768 |
| Entrada | Texto |
| Salida | Texto |
| Alojamiento | API serverless de Novita AI |
En el momento de la verificación el 29 de julio de 2026, Novita mostraba Macaron V1 Tall como gratuito por tiempo limitado con $0 de entrada y $0 de salida. Verifica la página del modelo en vivo antes de presupuestar el uso en producción.
Paso 3: Envía tu primera solicitud
Comienza con una indicación corta solo de texto para verificar autenticación, enrutamiento y análisis.
Resume los principales riesgos en una refactorización de todo el repositorio en 5 viñetas.
Paso 4: Lee la respuesta
Para las finalizaciones de chat estándar, lee la respuesta desde choices[0].message.content. Mantén los metadatos de la solicitud, el uso de tokens y el estado HTTP en tus registros para poder rastrear llamadas lentas o costosas más adelante.
Paso 5: Verifica precios, límites y errores comunes
La lista actual importa más que una publicación de blog desactualizada. Vuelve a verificar la página del modelo antes del lanzamiento si dependes del precio gratuito o de la ventana de contexto completa de 262K.
Los errores comunes de configuración incluyen:
- Usar el nombre mostrado en lugar de
mindai/macaron-v1-tall. - Apuntar el SDK a la URL base incorrecta.
- Enviar una indicación enorme antes de confirmar la conectividad básica.
- Asumir que cada solicitud de contexto largo debe usar el límite máximo de salida.
Ejemplo en Python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-tall",
messages=[
{"role": "system", "content": "Eres un asistente de programación conciso."},
{"role": "user", "content": "Enumera los primeros pasos más seguros para refactorizar un monorepo grande."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Ejemplo con cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-tall",
"messages": [
{
"role": "system",
"content": "Eres un asistente de programación conciso."
},
{
"role": "user",
"content": "Enumera los primeros pasos más seguros para refactorizar un monorepo grande."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Parámetros clave
| Parámetro | Empieza con | Por qué es importante |
|---|---|---|
model |
mindai/macaron-v1-tall |
Selecciona el modelo alojado |
messages |
Indicación corta de sistema + usuario | Verifica la ruta de la API rápidamente |
temperature |
0.2 |
Mantiene estable la salida de prueba |
max_tokens |
400 |
Evita primeras respuestas demasiado grandes |
tools |
Una función a la vez | Útil para agentes y flujos de trabajo |
response_format |
Solo si tu analizador está listo | Valida JSON antes de enviar a producción |
Programación, Agentes e Indicaciones de GenUI
Programación
Usa Macaron V1 Tall para refactorizaciones conscientes del repositorio, planes de migración o resúmenes de revisión de código cuando el contexto circundante sea importante.
Revisa este módulo para detectar riesgos de migración, identifica cambios rupturistas y sugiere el plan de parche seguro más pequeño.
Agentes
Usa la llamada a funciones cuando el modelo deba elegir una herramienta en lugar de responder directamente.
Llama a la herramienta de búsqueda de tickets solo si el usuario hace referencia a un ID de problema existente. De lo contrario, responde con un plan breve.
GenUI
Úsalo para generación de interfaces cuando quieras ideas de UI estructuradas a partir de un resumen de producto.
Convierte este resumen de producto en un diseño de panel limpio con secciones, acciones, estados vacíos y reglas de validación.
Solución de problemas
La API devuelve un error de autenticación
Confirma que el token de portador esté configurado en el mismo shell o entorno de ejecución que realiza la solicitud.
No se puede encontrar el modelo
Vuelve a verificar el ID del modelo: mindai/macaron-v1-tall.
La solicitud es demasiado grande
Empieza más pequeño y luego agrega contexto gradualmente. Una ventana de 262K tokens es capacidad, no una señal para enviar todo de una vez.
Preguntas frecuentes
¿Está disponible Macaron V1 Tall en Novita AI?
Sí. La lista en vivo lo muestra como un modelo serverless.
¿Qué endpoint debo usar?
Usa https://api.novita.ai/openai/v1/chat/completions.
¿Admite el uso de herramientas?
Revisa la página del modelo en vivo para conocer las etiquetas de funciones actuales antes de depender de llamadas a herramientas en producción.
¿El modelo es gratuito ahora mismo?
La lista verificada el 29 de julio de 2026 mostraba un precio de $0 de entrada y $0 de salida, marcado como gratuito por tiempo limitado.
Artículos recomendados
- Macaron V1 Tall en Novita AI: modelo MoL gratuito de contexto 262K para chat, agentes y programación
- Inicio rápido de Macaron V1 Venti en Novita AI: contexto de 1M, endpoint y ejemplos
- Macaron V1 Venti en Novita AI: modelo insignia de 748B Mixture-of-LoRA para programación, agentes y GenUI
Fuentes consultadas el 29 de julio de 2026: Biblioteca de modelos de Novita AI, Referencia de la API de finalización de chat de Novita
