- Puntos clave
- ¿Qué es Macaron V1 Tall?
- Acceso a la API de Macaron V1 Tall en Novita AI
- Resumen de especificaciones y precios de Macaron V1 Tall
- Señales de rendimiento y benchmarks de Macaron V1 Tall
- Capacidades clave para desarrolladores
- Cuándo usar Macaron V1 Tall
- Cuándo no usar Macaron V1 Tall
- Cómo encaja Macaron V1 Tall en tu flujo de trabajo de API
- Conclusión
- Preguntas frecuentes
- Artículos recomendados
Macaron V1 Tall es la forma más sencilla de entrar en la familia Macaron si deseas un contexto largo sin empezar desde el nivel insignia. Según lo verificado el 29 de julio de 2026, Novita lo lista con el ID de modelo mindai/macaron-v1-tall, una ventana de contexto de 262,144 tokens, un máximo de 32,768 tokens de salida, razonamiento, llamada a funciones y un precio gratuito por tiempo limitado de $0 por millón de tokens de entrada y salida.
Para un inicio rápido, consulta Guía de inicio rápido de Macaron V1 Tall para codificación, agentes y GenUI.
Si estás decidiendo entre las dos variantes de Macaron, compara primero esta guía con Macaron V1 Venti en Novita AI.
Puntos clave
- Macaron V1 Tall está disponible en Novita AI como
mindai/macaron-v1-tall. - Novita lo describe como el modelo eficiente de Macaron V1, construido sobre Qwen3.6-35B-A3B con cuatro adaptadores LoRA especializados.
- La lista actual de Novita muestra una ventana de contexto de 262,144 tokens y un máximo de 32,768 tokens de salida.
- Las funciones alojadas actualmente incluyen razonamiento y llamada a funciones a través del flujo de trabajo de completado de chat.
- El precio se listó como gratuito por tiempo limitado el 29 de julio de 2026, con $0 por token de entrada y $0 por token de salida.
¿Qué es Macaron V1 Tall?
Macaron V1 Tall es el modelo más ligero de la línea Macaron V1. En Novita AI, la descripción oficial lo llama la variante eficiente de la familia y dice que está construido sobre Qwen3.6-35B-A3B con cuatro adaptadores LoRA especializados para trabajo de chat, agente, codificación y GenUI.
Esa descripción importa porque Tall no está posicionado como un chatbot genérico. La historia de la familia trata sobre especialización enrutada: el modelo base maneja el razonamiento amplio mientras que los adaptadores LoRA sesgan el sistema hacia cargas de trabajo específicas para desarrolladores. En la práctica, eso hace que Tall sea más fácil de evaluar frente a tareas reales como asistentes que usan herramientas, ayuda de codificación consciente del repositorio y generación estructurada de UI, en lugar de solo conversación libre.
La distinción más importante es operativa. Si Venti es la opción insignia de Macaron para equipos que desean la configuración más grande con mucho contexto, Tall es el modelo de menor riesgo para evaluar primero. Mantiene el mismo posicionamiento familiar, pero con un perfil de implementación más pequeño y una API alojada sin servidor.
Acceso a la API de Macaron V1 Tall en Novita AI
Novita AI expone actualmente Macaron V1 Tall a través de su biblioteca de modelos alojados y API LLM compatible con OpenAI. La página del modelo lista mindai/macaron-v1-tall como el ID de modelo exacto, mientras que la documentación de la API dirige a los desarrolladores a la ruta estándar de completado de chat en https://api.novita.ai/openai/v1/chat/completions.
La lista alojada actual también muestra dos familias de endpoints: chat/completions y anthropic. Para la mayoría de las integraciones existentes de Novita, el punto de partida más fácil sigue siendo la ruta de completado de chat compatible con OpenAI porque se alinea con el resto del catálogo de LLM y con la referencia de API publicada.
Debido a que este es un lanzamiento y una visión general de fuente de verdad, la pregunta útil no es “¿Cómo escribo la primera solicitud?” sino “¿Está realmente disponible el modelo y qué contrato publica Novita hoy?” Sobre ese punto, la respuesta actual es clara: Tall está disponible como un modelo de texto sin servidor con razonamiento y llamada a funciones en el conjunto de funciones alojadas.
Resumen de especificaciones y precios de Macaron V1 Tall
La siguiente tabla refleja la página del modelo en vivo de Novita AI y la documentación de la API LLM verificada el 29 de julio de 2026.
| Campo | Detalles |
|---|---|
| Nombre mostrado | Macaron V1 Tall |
| ID de modelo | mindai/macaron-v1-tall |
| URL base | https://api.novita.ai/openai |
| Familia de endpoint | chat/completions; la página del modelo también lista anthropic |
| Contexto / límites | 262,144 tokens de contexto; 32,768 tokens máximos de salida |
| Precio | $0 de entrada y $0 de salida por 1M de tokens; etiquetado como gratuito por tiempo limitado |
| Mejor ajuste | Flujos de trabajo de agentes, soporte de codificación, sistemas de chat y experimentos de GenUI que necesitan contexto largo sin empezar desde el nivel de modelo más grande |
Estos detalles se verificaron contra la página del modelo en vivo de Novita AI y la documentación de la API LLM el 29 de julio de 2026.
Detalles adicionales de la página del modelo actual:
| Especificación | Valor actual |
|---|---|
| Modelo base | Qwen3.6-35B-A3B |
| Nota de arquitectura | Macaron V1 con cuatro adaptadores LoRA especializados |
| Modalidad de entrada | Texto |
| Modalidad de salida | Texto |
| Funciones alojadas | Sin servidor, razonamiento, llamada a funciones |
| Instantánea de cuota | Entradas RPM escalonadas desde 30 RPM hasta 6000 RPM, según el nivel de cuenta |
| Etiquetas de estado | Nuevo; gratuito por tiempo limitado |
El precio gratuito es útil, pero debe tratarse como una condición de lanzamiento temporal, no como una suposición presupuestaria permanente. Si estás planificando un despliegue en producción, vuelve a verificar la página del modelo en vivo antes de las estimaciones de costos finales o compromisos contractuales.
Señales de rendimiento y benchmarks de Macaron V1 Tall
La lista actual de Novita no publica un paquete de benchmarks, garantía de latencia o resumen de tablas de clasificación externas para Macaron V1 Tall. Eso significa que este artículo no debe afirmar que Tall supera a otro modelo en codificación, uso de herramientas o calidad de agente sin evidencia separada.
El encuadre de lanzamiento más defendible es más limitado. Novita posiciona a Tall como un modelo eficiente de la familia Macaron para chat, agentes, codificación y GenUI, y la página alojada confirma las funciones de API y precios relevantes. Eso es suficiente para justificar la evaluación. No es suficiente para reclamar liderazgo en la categoría.
Si estás comparando Tall con otro modelo alojado, usa tus propias verificaciones a nivel de carga de trabajo: finalización de tareas, validez de llamadas a herramientas, latencia, consumo de tokens y esfuerzo de corrección. Esas mediciones te dirán más que un recuento de parámetros o una descripción familiar.
Capacidades clave para desarrolladores
Chat de contexto largo y flujos de asistente
La ventana de contexto de 262K es lo suficientemente grande para flujos de trabajo de asistente que necesitan preservar antecedentes sustanciales: requisitos de producto, SOP internos, estado de conversación anterior, notas de soporte o trazas de planificación largas. Eso le da a Tall una clara ventaja sobre los modelos de chat de contexto corto cuando los prompts rutinariamente necesitan más de unos pocos documentos o instrucciones.
Sistemas de agentes que usan herramientas
Novita lista actualmente llamada a funciones y razonamiento en el conjunto de funciones alojadas. Eso convierte a Tall en un candidato razonable para agentes que tienen que inspeccionar el estado, elegir una herramienta, generar argumentos y continuar después de que llegue un resultado de herramienta. El modelo aún no reemplaza el diseño del sistema: tu aplicación debe gestionar los permisos de herramientas, reintentos, validación y reversión.
Soporte de codificación con un perfil de implementación más pequeño
Macaron V1 Tall se describe como el miembro más eficiente de la familia, que es exactamente la razón correcta para probarlo en triaje de repositorios, planificación de parches, resúmenes de revisión de código o asistencia de desarrollo del lado del IDE. No todas las tareas de codificación necesitan el modelo más grande disponible. Un modelo enrutado más pequeño puede ser la mejor opción cuando deseas contexto largo y especialización sin recurrir por defecto a la opción más cara o lenta.
Experimentación con GenUI
La descripción de Novita incluye explícitamente capacidad de UI Generativa nativa de código en el posicionamiento familiar. Eso no significa que debas renderizar la salida arbitraria del modelo directamente en producción. Sí significa que Tall es un candidato relevante para prototipar flujos de trabajo de generación de interfaces donde el modelo mapea requisitos en pantallas, árboles de componentes o planes de UI estructurados.
Cuándo usar Macaron V1 Tall
Usa Macaron V1 Tall cuando tu carga de trabajo se beneficie de tres cosas al mismo tiempo: contexto largo, especialización orientada a desarrolladores y una ruta de evaluación de menor fricción que un modelo insignia.
Buenos candidatos incluyen:
- Asistentes de chat internos que necesitan retener un contexto sustancial de políticas o productos.
- Ayudantes de codificación que razonan a través de varios archivos, notas de incidencias y comentarios de revisión anteriores.
- Agentes que usan herramientas donde la llamada a funciones importa más que la entrada multimodal.
- Prototipos de GenUI que convierten requisitos detallados en estructura de interfaz o planes de implementación.
- Equipos que quieren probar la familia Macaron mientras el precio alojado actual sigue siendo gratuito por tiempo limitado.
Tall también es una primera parada práctica si tu modelo actual está perdiendo contexto o fallando en flujos de trabajo de múltiples pasos, pero aún no estás listo para moverte a una clase de modelo mucho más grande.
Cuándo no usar Macaron V1 Tall
No elijas Tall por defecto para cada carga de trabajo de texto solo porque es nuevo o gratuito.
Es una opción más débil cuando:
- Tu carga de trabajo es corta, repetitiva y fácil de enrutar a través de un modelo pequeño y barato.
- Necesitas entrada de imagen, audio o video en el endpoint alojado, porque la lista actual es texto de entrada y texto de salida.
- Tu contrato de producción depende de una afirmación de benchmark publicada que no está disponible para Tall.
- Necesitas la opción más grande de la familia Macaron porque la tarea está dominada por un contexto muy amplio y experimentación a nivel insignia.
- No puedes tolerar que una promoción de lanzamiento cambie, porque el precio actual es explícitamente gratuito por tiempo limitado.
Si el requisito real es clasificación predecible de baja latencia o extracción ligera a muy alto volumen, un modelo más simple puede seguir siendo la opción de producción más limpia.
Cómo encaja Macaron V1 Tall en tu flujo de trabajo de API
Macaron V1 Tall encaja en el mismo flujo de trabajo de alto nivel que otros LLM alojados en Novita:
- Confirma que tu cuenta puede acceder al modelo.
- Usa la URL base compatible con OpenAI
https://api.novita.ai/openai. - Establece el ID de modelo en
mindai/macaron-v1-tall. - Envía solicitudes a través de completados de chat y agrega definiciones de funciones si tu aplicación usa llamada a herramientas.
Ese contrato es suficiente para la planificación de integración, decisiones de enrutamiento y revisión de arquitectura. Este artículo se detiene intencionalmente ahí. No incluye fragmentos completos de SDK, recorridos de payload de solicitud o solución de problemas porque eso pertenece a una guía de inicio rápido dedicada en lugar de una publicación de lanzamiento/fuente de verdad.
Conclusión
Macaron V1 Tall es el modelo de la familia Macaron con el que empezar cuando deseas una opción alojada de contexto largo para chat, agentes que usan herramientas, soporte de codificación o experimentos de GenUI sin comenzar desde el nivel más grande. El 29 de julio de 2026, Novita AI lo lista como disponible ahora, sin servidor, con razonamiento habilitado, capaz de llamar a funciones y gratuito por tiempo limitado.
El siguiente paso correcto es probarlo en tareas reales, no solo en un prompt de “hola mundo”. Usa la ventana gratuita actual para comparar Tall contra el modelo en el que ya confías, especialmente en flujos de trabajo de codificación de múltiples pasos y agentes. Si mantiene mejor el contexto, llama a las herramientas de manera confiable y mantiene una latencia aceptable, se gana un lugar en la evaluación de producción.
Prueba Macaron V1 Tall en Novita AI
Preguntas frecuentes
¿Está disponible Macaron V1 Tall en Novita AI?
Sí. Según lo verificado el 29 de julio de 2026, Novita AI lista Macaron V1 Tall en la biblioteca de modelos alojados con el ID de modelo mindai/macaron-v1-tall.
¿Cuál es el ID de modelo de Macaron V1 Tall?
El ID de modelo actual de Novita AI es mindai/macaron-v1-tall.
¿Es gratuito Macaron V1 Tall en Novita AI?
La página del modelo verificada el 29 de julio de 2026 listaba $0 por millón de tokens de entrada y $0 por millón de tokens de salida, y etiquetaba el modelo como gratuito por tiempo limitado. Vuelve a verificar la página en vivo antes de presupuestar su uso en producción.
¿Qué ventana de contexto soporta Macaron V1 Tall?
Novita AI lista actualmente una ventana de contexto de 262,144 tokens y un máximo de 32,768 tokens de salida para Macaron V1 Tall.
¿Soporta Macaron V1 Tall llamada a funciones?
Sí. El conjunto de funciones alojadas actual en la página del modelo de Novita incluye llamada a funciones y razonamiento.
¿Es multimodal Macaron V1 Tall en Novita AI?
No en la lista alojada actual. Novita muestra actualmente entrada de texto y salida de texto para este modelo.
Artículos recomendados
- Macaron V1 Venti en Novita AI: 748B Mixture-of-LoRA insignia para codificación, agentes y GenUI
- Guía de inicio rápido de Macaron V1 Venti en Novita AI: 1M de contexto, endpoint y ejemplos
- Guía de inicio rápido de Macaron V1 Tall para codificación, agentes y GenUI
Fuentes verificadas el 29 de julio de 2026: Página del modelo Macaron V1 Tall, Referencia de API de completados de chat de Novita, Referencia de API de listar modelos de Novita
