- Puntos clave
- ¿Qué es Macaron V1 Tall?
- Acceso a la API de Macaron V1 Tall en Novita AI
- Resumen de especificaciones y precios de Macaron V1 Tall
- Señales de benchmark y rendimiento de Macaron V1 Tall
- Capacidades clave para desarrolladores
- Cuándo usar Macaron V1 Tall
- Cuándo no usar Macaron V1 Tall
- Cómo encaja Macaron V1 Tall en tu flujo de API
- Conclusión
- Preguntas frecuentes
- Artículos recomendados
Macaron V1 Tall es la forma más sencilla de entrar en la familia Macaron si quieres un contexto largo sin empezar en el nivel insignia. Según lo verificado el 29 de julio de 2026, Novita lo lista con el ID de modelo mindai/macaron-v1-tall, una ventana de contexto de 262,144 tokens, 32,768 tokens máximos de salida, razonamiento, llamada de funciones y un precio gratuito por tiempo limitado de $0 por millón de tokens de entrada y salida.
Para el inicio rápido, consulta Guía de inicio rápido de Macaron V1 Tall para codificación, agentes y GenUI.
Si estás decidiendo entre las dos variantes de Macaron, compara primero esta guía con Macaron V1 Venti en Novita AI.
Puntos clave
- Macaron V1 Tall está disponible en Novita AI como
mindai/macaron-v1-tall. - Novita lo describe como el modelo Macaron V1 eficiente, construido sobre Qwen3.6-35B-A3B con cuatro adaptadores LoRA especializados.
- La ficha actual de Novita muestra una ventana de contexto de 262,144 tokens y 32,768 tokens máximos de salida.
- Las funciones alojadas incluyen actualmente razonamiento y llamada de funciones a través del flujo de chat completions.
- El precio fue listado como gratuito por tiempo limitado el 29 de julio de 2026, con $0 de entrada y $0 de salida por token.
¿Qué es Macaron V1 Tall?
Macaron V1 Tall es el modelo más ligero de la línea Macaron V1. En Novita AI, la descripción oficial lo llama la variante eficiente de la familia y dice que está construido sobre Qwen3.6-35B-A3B con cuatro adaptadores LoRA especializados para trabajo de chat, agentes, codificación y GenUI.
Esa descripción importa porque Tall no está posicionado como un chatbot genérico. La historia de la familia trata sobre especialización enrutada: el modelo base maneja razonamiento amplio mientras que los adaptadores LoRA sesgan el sistema hacia cargas de trabajo específicas para desarrolladores. En la práctica, eso hace que Tall sea más fácil de evaluar frente a tareas reales como asistentes que usan herramientas, ayuda de codificación consciente del repositorio y generación estructurada de UI, en lugar de solo conversación libre.
La distinción más importante es operativa. Si Venti es la opción insignia de Macaron para equipos que quieren la configuración más grande con mucho contexto, Tall es el modelo de menor riesgo para evaluar primero. Mantiene el mismo posicionamiento de familia, pero con un perfil de despliegue más pequeño y una API serverless alojada.
Acceso a la API de Macaron V1 Tall en Novita AI
Novita AI actualmente expone Macaron V1 Tall a través de su biblioteca de modelos alojados y su API LLM compatible con OpenAI. La página del modelo lista mindai/macaron-v1-tall como el ID de modelo exacto, mientras que la documentación de la API dirige a los desarrolladores a la ruta estándar de chat completions en https://api.novita.ai/openai/v1/chat/completions.
La ficha alojada actual también muestra dos familias de endpoints: chat/completions y anthropic. Para la mayoría de las integraciones existentes con Novita, el punto de partida más fácil sigue siendo la ruta de chat completions compatible con OpenAI, porque se alinea con el resto del catálogo de LLM y con la referencia de API publicada.
Debido a que esta es una visión general de lanzamiento y de fuente de verdad, la pregunta útil no es “¿Cómo escribo la primera solicitud?” sino “¿Está realmente disponible el modelo y qué contrato publica Novita hoy?” En ese punto, la respuesta actual es clara: Tall está disponible como modelo de texto serverless con razonamiento y llamada de funciones en el conjunto de funciones alojadas.
Resumen de especificaciones y precios de Macaron V1 Tall
La siguiente tabla refleja la página de modelo en vivo de Novita AI y la documentación de la API LLM verificada el 29 de julio de 2026.
| Campo | Detalles |
|---|---|
| Nombre mostrado | Macaron V1 Tall |
| ID de modelo | mindai/macaron-v1-tall |
| URL base | https://api.novita.ai/openai |
| Familia de endpoint | chat/completions; la página del modelo también lista anthropic |
| Contexto / límites | 262,144 tokens de contexto; 32,768 tokens máximos de salida |
| Precio | $0 de entrada y $0 de salida por 1M de tokens; etiquetado como gratuito por tiempo limitado |
| Mejor uso | Flujos de agentes, soporte de codificación, sistemas de chat y experimentos GenUI que necesitan contexto largo sin empezar desde el nivel de modelo más grande |
Estos detalles fueron verificados contra la página de modelo en vivo y la documentación de la API LLM de Novita AI el 29 de julio de 2026.
Detalles adicionales de la página de modelo actual:
| Especificación | Valor actual |
|---|---|
| Modelo base | Qwen3.6-35B-A3B |
| Nota de arquitectura | Macaron V1 con cuatro adaptadores LoRA especializados |
| Modalidad de entrada | Texto |
| Modalidad de salida | Texto |
| Funciones alojadas | Serverless, razonamiento, llamada de funciones |
| Instantánea de cuotas | Entradas RPM escalonadas de 30 RPM a 6000 RPM, según el nivel de cuenta |
| Etiquetas de estado | Nuevo; gratuito por tiempo limitado |
El precio gratuito es útil, pero debe tratarse como una condición temporal de lanzamiento, no como una suposición de presupuesto permanente. Si estás planeando un despliegue de producción, vuelve a revisar la página de modelo en vivo antes de hacer estimaciones de costos finales o compromisos de contrato.
Señales de benchmark y rendimiento de Macaron V1 Tall
La ficha actual de Novita no publica un paquete de benchmarks, una garantía de latencia ni un resumen de leaderboard externo para Macaron V1 Tall. Esto significa que este artículo no debería afirmar que Tall supera a otro modelo en codificación, uso de herramientas o calidad de agente sin evidencia separada.
El encuadre de lanzamiento más defendible es más estrecho. Novita posiciona a Tall como un modelo eficiente de la familia Macaron para chat, agentes, codificación y GenUI, y la página alojada confirma las funciones de API y los precios relevantes. Eso es suficiente para justificar una evaluación. No es suficiente para reclamar liderazgo de categoría.
Si estás comparando Tall con otro modelo alojado, usa tus propias comprobaciones a nivel de carga de trabajo: finalización de tareas, validez de llamadas a herramientas, latencia, consumo de tokens y esfuerzo de corrección. Esas mediciones te dirán más que un conteo de parámetros o una descripción de familia.
Capacidades clave para desarrolladores
Flujos de chat y asistente con contexto largo
La ventana de contexto de 262K es lo suficientemente grande para flujos de asistente que necesitan conservar antecedentes sustanciales: requisitos de producto, SOP internos, estado previo de la conversación, notas de soporte o rastros largos de planificación. Eso le da a Tall una ventaja clara sobre los modelos de chat de contexto corto cuando los prompts necesitan rutinariamente más de unos pocos documentos o instrucciones.
Sistemas de agentes que usan herramientas
Novita actualmente lista la llamada de funciones y el razonamiento en el conjunto de funciones alojadas. Eso convierte a Tall en un candidato razonable para agentes que deben inspeccionar el estado, elegir una herramienta, generar argumentos y continuar después de que llegue un resultado de herramienta. El modelo todavía no reemplaza el diseño de sistema: tu aplicación debe gestionar los permisos de herramientas, reintentos, validación y reversión.
Soporte de codificación con un perfil de despliegue más pequeño
Macaron V1 Tall se describe como el miembro más eficiente de la familia, que es exactamente la razón correcta para probarlo en triaje de repositorios, planificación de parches, resúmenes de revisión de código o asistencia al desarrollador en el IDE. No toda tarea de codificación necesita el modelo más grande disponible. Un modelo enrutado más pequeño puede ser la mejor opción cuando quieres contexto largo y especialización sin recurrir a la opción más cara o más lenta.
Experimentación con GenUI
La descripción de Novita incluye explícitamente la capacidad de UI generativa nativa de código en el posicionamiento de la familia. Eso no significa que debas renderizar salida arbitraria del modelo directamente en producción. Sí significa que Tall es un candidato relevante para prototipar flujos de generación de interfaces donde el modelo convierte requisitos en pantallas, árboles de componentes o planes estructurados de UI.
Cuándo usar Macaron V1 Tall
Usa Macaron V1 Tall cuando tu carga de trabajo se beneficie de tres cosas al mismo tiempo: contexto largo, especialización orientada a desarrolladores y una ruta de evaluación con menor fricción que un modelo insignia.
Buenos candidatos incluyen:
- Asistentes de chat internos que necesitan conservar contexto sustancial de políticas o productos.
- Ayudantes de codificación que razonan a través de varios archivos, notas de incidencias y comentarios previos de revisión.
- Agentes que usan herramientas donde la llamada de funciones importa más que la entrada multimodal.
- Prototipos GenUI que convierten requisitos detallados en estructura de interfaz o planes de implementación.
- Equipos que quieren probar la familia Macaron mientras el precio alojado actual permanezca gratuito por tiempo limitado.
Tall también es una primera parada práctica si tu modelo actual está perdiendo contexto o fallando flujos de varios pasos, pero aún no estás listo para pasar a una clase de modelo mucho más grande.
Cuándo no usar Macaron V1 Tall
No elijas Tall por defecto para cada carga de trabajo de texto solo porque sea nuevo o gratuito.
Es una opción más débil cuando:
- Tu carga de trabajo es corta, repetitiva y fácil de enrutar a través de un modelo más pequeño y barato.
- Necesitas entrada de imagen, audio o video en el endpoint alojado, porque la ficha actual es de texto a texto.
- Tu contrato de producción depende de una afirmación de benchmark publicada que no está disponible para Tall.
- Necesitas la opción más grande de la familia Macaron porque la tarea está dominada por un contexto muy amplio y experimentación a nivel insignia.
- No puedes tolerar que cambie una promoción de lanzamiento, porque el precio actual es explícitamente gratuito por tiempo limitado.
Si el requisito real es clasificación predecible de baja latencia o extracción ligera a muy alto volumen, un modelo más simple puede seguir siendo la opción de producción más limpia.
Cómo encaja Macaron V1 Tall en tu flujo de API
Macaron V1 Tall encaja en el mismo flujo de alto nivel que otros LLM alojados en Novita:
- Confirma que tu cuenta puede acceder al modelo.
- Usa la URL base compatible con OpenAI
https://api.novita.ai/openai. - Establece el ID de modelo en
mindai/macaron-v1-tall. - Envía solicitudes a través de chat completions y agrega definiciones de funciones si tu aplicación usa llamadas a herramientas.
Ese contrato es suficiente para la planificación de integración, las decisiones de enrutamiento y la revisión de arquitectura. Este artículo se detiene intencionalmente ahí. No incluye fragmentos completos de SDK, recorridos de payload de solicitud ni solución de problemas porque eso pertenece a una guía de inicio rápido dedicada, no a una publicación de lanzamiento/fuente de verdad.
Conclusión
Macaron V1 Tall es el modelo de la familia Macaron con el que empezar cuando quieres una opción alojada de contexto largo para chat, agentes que usan herramientas, soporte de codificación o experimentos GenUI sin comenzar en el nivel más grande. El 29 de julio de 2026, Novita AI lo lista como disponible ahora, serverless, con razonamiento habilitado, capaz de llamada de funciones y gratuito por tiempo limitado.
El siguiente paso correcto es probarlo en tareas reales, no solo con un prompt de hola mundo. Usa la ventana gratuita actual para comparar Tall contra el modelo que ya te resulta confiable, especialmente en flujos de codificación de varios pasos y de agentes. Si mantiene mejor el contexto, llama a las herramientas de manera confiable y mantiene una latencia aceptable, merece un lugar en la evaluación de producción.
Prueba Macaron V1 Tall en Novita AI
Preguntas frecuentes
¿Está Macaron V1 Tall disponible en Novita AI?
Sí. Según lo verificado el 29 de julio de 2026, Novita AI lista Macaron V1 Tall en la biblioteca de modelos alojados con el ID de modelo mindai/macaron-v1-tall.
¿Cuál es el ID de modelo de Macaron V1 Tall?
El ID de modelo actual de Novita AI es mindai/macaron-v1-tall.
¿Es Macaron V1 Tall gratuito en Novita AI?
La página del modelo verificada el 29 de julio de 2026 listó $0 por millón de tokens de entrada y $0 por millón de tokens de salida, y etiquetó el modelo como gratuito por tiempo limitado. Vuelve a revisar la página en vivo antes de presupuestar su uso en producción.
¿Qué ventana de contexto soporta Macaron V1 Tall?
Novita AI actualmente lista una ventana de contexto de 262,144 tokens y 32,768 tokens máximos de salida para Macaron V1 Tall.
¿Soporta Macaron V1 Tall la llamada de funciones?
Sí. El conjunto de funciones alojadas actual en la página del modelo de Novita incluye llamada de funciones y razonamiento.
¿Es Macaron V1 Tall multimodal en Novita AI?
No en la ficha alojada actual. Novita actualmente muestra entrada de texto y salida de texto para este modelo.
Artículos recomendados
- Macaron V1 Venti en Novita AI: insignia Mixture-of-LoRA de 748B para codificación, agentes y GenUI
- Inicio rápido de Macaron V1 Venti en Novita AI: contexto de 1M, endpoint y ejemplos
- Guía de inicio rápido de Macaron V1 Tall para codificación, agentes y GenUI
Fuentes verificadas el 29 de julio de 2026: Página del modelo Macaron V1 Tall, Referencia de API de chat completions de Novita, Referencia de API de listado de modelos de Novita
