- Puntos Clave
- ¿Qué es Macaron V1 Tall?
- Acceso a la API de Macaron V1 Tall en Novita AI
- Resumen de Especificaciones y Precios de Macaron V1 Tall
- Señales de Rendimiento y Benchmarks de Macaron V1 Tall
- Capacidades Clave para Desarrolladores
- Cuándo Usar Macaron V1 Tall
- Cuándo No Usar Macaron V1 Tall
- Cómo Encaja Macaron V1 Tall en tu Flujo de Trabajo de API
- Conclusión
- Preguntas Frecuentes
- Artículos Recomendados
Macaron V1 Tall ya está disponible en Novita AI como una opción más pequeña y fácil de evaluar dentro de la familia Macaron. Según la comprobación realizada el 29 de julio de 2026, Novita lo lista con el ID de modelo mindai/macaron-v1-tall, una ventana de contexto de 262,144 tokens, un máximo de 32,768 tokens de salida, razonamiento, llamada a funciones y un precio gratuito por tiempo limitado de $0 por millón de tokens de entrada y salida. La conclusión práctica es que Tall es la variante de Macaron que debes probar primero cuando quieras la posición de la familia en chat, agentes, codificación y GenUI, sin pasar directamente al modelo Venti, mucho más grande.
Puntos Clave
- Macaron V1 Tall está disponible en Novita AI como
mindai/macaron-v1-tall. - Novita lo describe como el modelo eficiente de Macaron V1, construido sobre Qwen3.6-35B-A3B con cuatro adaptadores LoRA especializados.
- La lista actual de Novita muestra una ventana de contexto de 262,144 tokens y un máximo de 32,768 tokens de salida.
- Las funciones alojadas actualmente incluyen razonamiento y llamada a funciones a través del flujo de trabajo de completaciones de chat.
- El precio se indicó como gratuito por tiempo limitado el 29 de julio de 2026, con precio de $0 por token de entrada y $0 por token de salida.
¿Qué es Macaron V1 Tall?
Macaron V1 Tall es el modelo de peso más ligero de la línea Macaron V1. En Novita AI, la descripción oficial lo llama la variante eficiente de la familia y dice que está construido sobre Qwen3.6-35B-A3B con cuatro adaptadores LoRA especializados para chat, agentes, codificación y trabajo en GenUI.
Esa descripción es importante porque Tall no se posiciona como un chatbot genérico. La historia de la familia se trata de especialización enrutada: el modelo base maneja el razonamiento amplio mientras que los adaptadores LoRA sesgan el sistema hacia cargas de trabajo específicas para desarrolladores. En la práctica, esto hace que sea más fácil evaluar Tall frente a tareas reales como asistentes que usan herramientas, ayuda de codificación consciente del repositorio y generación estructurada de UI, en lugar de solo conversación libre.
La distinción más importante es operativa. Si Venti es la opción insignia de Macaron para equipos que desean la configuración más grande con mucho contexto, Tall es el modelo de menor riesgo para evaluar primero. Mantiene el mismo posicionamiento familiar, pero con un perfil de implementación más pequeño y una API alojada sin servidor.
Acceso a la API de Macaron V1 Tall en Novita AI
Novita AI expone actualmente Macaron V1 Tall a través de su biblioteca de modelos alojados y API LLM compatible con OpenAI. La página del modelo lista mindai/macaron-v1-tall como el ID de modelo exacto, mientras que la documentación de la API dirige a los desarrolladores a la ruta estándar de completaciones de chat en https://api.novita.ai/openai/v1/chat/completions.
La lista alojada actual también muestra dos familias de endpoints: chat/completions y anthropic. Para la mayoría de las integraciones existentes de Novita, el punto de partida más fácil sigue siendo la ruta de completaciones de chat compatible con OpenAI porque se alinea con el resto del catálogo de LLM y con la referencia de API publicada.
Debido a que esto es un lanzamiento y una visión general de la fuente de verdad, la pregunta útil no es “¿Cómo escribo la primera solicitud?” sino “¿El modelo está realmente disponible y qué contrato publica Novita hoy?”. En ese punto, la respuesta actual es clara: Tall está disponible como un modelo de texto sin servidor con razonamiento y llamada a funciones en el conjunto de funciones alojadas.
Resumen de Especificaciones y Precios de Macaron V1 Tall
La siguiente tabla refleja la página de modelo en vivo de Novita AI y la documentación de la API LLM verificada el 29 de julio de 2026.
| Campo | Detalles |
|---|---|
| Nombre para mostrar | Macaron V1 Tall |
| ID del modelo | mindai/macaron-v1-tall |
| URL base | https://api.novita.ai/openai |
| Familia de endpoint | chat/completions; la página del modelo también lista anthropic |
| Contexto / límites | 262,144 tokens de contexto; 32,768 tokens máximos de salida |
| Precio | $0 de entrada y $0 de salida por 1M de tokens; etiquetado como gratuito por tiempo limitado |
| Mejor uso | Flujos de trabajo de agentes, soporte de codificación, sistemas de chat y experimentos de GenUI que necesitan contexto largo sin comenzar desde el nivel de modelo más grande |
Estos detalles se verificaron contra la página de modelo en vivo de Novita AI y la documentación de la API LLM el 29 de julio de 2026.
Detalles adicionales de la página de modelo actual:
| Especificación | Valor actual |
|---|---|
| Modelo base | Qwen3.6-35B-A3B |
| Nota de arquitectura | Macaron V1 con cuatro adaptadores LoRA especializados |
| Modalidad de entrada | Texto |
| Modalidad de salida | Texto |
| Funciones alojadas | Sin servidor, razonamiento, llamada a funciones |
| Instantánea de cuota | Entradas RPM escalonadas desde 30 RPM hasta 6000 RPM, según el nivel de cuenta |
| Etiquetas de estado | Nuevo; gratuito por tiempo limitado |
El precio gratuito es útil, pero debe tratarse como una condición de lanzamiento temporal, no como una suposición presupuestaria permanente. Si estás planificando un despliegue en producción, vuelve a verificar la página de modelo en vivo antes de finalizar estimaciones de costos o compromisos contractuales.
Señales de Rendimiento y Benchmarks de Macaron V1 Tall
La lista actual de Novita no publica un paquete de benchmarks, garantía de latencia o resumen de tablas de clasificación externas para Macaron V1 Tall. Esto significa que este artículo no debe afirmar que Tall supera a otro modelo en codificación, uso de herramientas o calidad de agente sin evidencia separada.
El marco de lanzamiento más defendible es más limitado. Novita posiciona a Tall como un modelo eficiente de la familia Macaron para chat, agentes, codificación y GenUI, y la página alojada confirma las funciones de API y precios relevantes. Eso es suficiente para justificar la evaluación. No es suficiente para reclamar liderazgo en la categoría.
Si estás comparando Tall con otro modelo alojado, usa tus propias verificaciones a nivel de carga de trabajo: finalización de tareas, validez de llamadas a herramientas, latencia, consumo de tokens y esfuerzo de corrección. Esas mediciones te dirán más que un conteo de parámetros o una descripción de familia.
Capacidades Clave para Desarrolladores
Chat de contexto largo y flujos de asistente
La ventana de contexto de 262K es lo suficientemente grande para flujos de trabajo de asistente que necesitan preservar información de fondo sustancial: requisitos de producto, SOP internos, estado de conversación anterior, notas de soporte o rastros de planificación largos. Eso le da a Tall una clara ventaja sobre los modelos de chat de contexto corto cuando las indicaciones necesitan rutinariamente más de unos pocos documentos o instrucciones.
Sistemas de agentes que usan herramientas
Novita actualmente lista llamada a funciones y razonamiento en el conjunto de funciones alojadas. Eso convierte a Tall en un candidato razonable para agentes que necesitan inspeccionar el estado, elegir una herramienta, generar argumentos y continuar después de que llegue el resultado de una herramienta. El modelo aún no reemplaza el diseño del sistema: tu aplicación debe gestionar los permisos de herramientas, reintentos, validación y reversión.
Soporte de codificación con un perfil de implementación más pequeño
Macaron V1 Tall se describe como el miembro más eficiente de la familia, que es exactamente la razón correcta para probarlo en triaje de repositorios, planificación de parches, resúmenes de revisiones de código o asistencia de desarrollo del lado del IDE. No todas las tareas de codificación necesitan el modelo más grande disponible. Un modelo enrutado más pequeño puede ser la mejor opción cuando deseas contexto largo y especialización sin recurrir por defecto a la opción más costosa o lenta.
Experimentación con GenUI
La descripción de Novita incluye explícitamente la capacidad de UI Generativa nativa de código en el posicionamiento de la familia. Eso no significa que debas renderizar la salida arbitraria del modelo directamente en producción. Pero sí significa que Tall es un candidato relevante para prototipar flujos de trabajo de generación de interfaces donde el modelo mapea requisitos en pantallas, árboles de componentes o planes de UI estructurados.
Cuándo Usar Macaron V1 Tall
Usa Macaron V1 Tall cuando tu carga de trabajo se beneficie de tres cosas al mismo tiempo: contexto largo, especialización orientada a desarrolladores y un camino de evaluación de menor fricción que un modelo insignia.
Buenos candidatos incluyen:
- Asistentes de chat internos que necesitan retener un contexto sustancial de políticas o productos.
- Ayudantes de codificación que razonan a través de varios archivos, notas de problemas y comentarios de revisión anteriores.
- Agentes que usan herramientas donde la llamada a funciones importa más que la entrada multimodal.
- Prototipos de GenUI que convierten requisitos detallados en estructura de interfaz o planes de implementación.
- Equipos que quieren probar la familia Macaron mientras el precio alojado actual permanece gratuito por tiempo limitado.
Tall también es una primera parada práctica si tu modelo actual está perdiendo contexto o fallando en flujos de trabajo de varios pasos, pero aún no estás listo para pasar a una clase de modelo mucho más grande.
Cuándo No Usar Macaron V1 Tall
No elijas Tall por defecto para cada carga de trabajo de texto solo porque es nuevo o gratuito.
Es una opción menos adecuada cuando:
- Tu carga de trabajo es corta, repetitiva y fácil de enrutar a través de un modelo pequeño y barato.
- Necesitas entrada de imagen, audio o video en el endpoint alojado, porque la lista actual es solo texto de entrada y salida.
- Tu contrato de producción depende de una afirmación de benchmark publicada que no está disponible para Tall.
- Necesitas la opción más grande de la familia Macaron porque la tarea está dominada por contexto muy amplio y experimentación de nivel insignia.
- No puedes tolerar que una promoción de lanzamiento cambie, porque el precio actual es explícitamente gratuito por tiempo limitado.
Si el requisito real es clasificación predecible de baja latencia o extracción ligera a muy alto volumen, un modelo más simple puede seguir siendo la opción de producción más limpia.
Cómo Encaja Macaron V1 Tall en tu Flujo de Trabajo de API
Macaron V1 Tall encaja en el mismo flujo de trabajo de alto nivel que otros LLM alojados en Novita:
- Confirma que tu cuenta puede acceder al modelo.
- Usa la URL base compatible con OpenAI
https://api.novita.ai/openai. - Establece el ID del modelo en
mindai/macaron-v1-tall. - Envía solicitudes a través de completaciones de chat y agrega definiciones de funciones si tu aplicación usa llamada a herramientas.
Ese contrato es suficiente para la planificación de integración, decisiones de enrutamiento y revisión de arquitectura. Este artículo se detiene intencionalmente aquí. No incluye fragmentos de SDK completos, ejemplos de cargas de solicitudes o solución de problemas porque eso pertenece a una guía de inicio rápido dedicada, no a una publicación de lanzamiento/fuente de verdad.
Conclusión
Macaron V1 Tall es el modelo de la familia Macaron con el que comenzar cuando deseas una opción alojada de contexto largo para chat, agentes que usan herramientas, soporte de codificación o experimentos de GenUI sin comenzar en el nivel más grande. El 29 de julio de 2026, Novita AI lo lista como disponible ahora, sin servidor, con razonamiento habilitado, capaz de llamar a funciones y gratuito por tiempo limitado.
El siguiente paso correcto es probarlo en tareas reales, no solo en una indicación de “hola mundo”. Usa la ventana gratuita actual para comparar Tall contra el modelo en el que ya confías, especialmente en flujos de trabajo de codificación y agentes de varios pasos. Si mantiene mejor el contexto, llama a las herramientas de manera confiable y mantiene una latencia aceptable, se gana un lugar en la evaluación de producción.
Prueba Macaron V1 Tall en Novita AI
Preguntas Frecuentes
¿Está disponible Macaron V1 Tall en Novita AI?
Sí. Según la comprobación del 29 de julio de 2026, Novita AI lista Macaron V1 Tall en la biblioteca de modelos alojados con el ID de modelo mindai/macaron-v1-tall.
¿Cuál es el ID del modelo Macaron V1 Tall?
El ID de modelo actual de Novita AI es mindai/macaron-v1-tall.
¿Es gratuito Macaron V1 Tall en Novita AI?
La página del modelo verificada el 29 de julio de 2026 listaba $0 por millón de tokens de entrada y $0 por millón de tokens de salida, y etiquetaba el modelo como gratuito por tiempo limitado. Vuelve a verificar la página en vivo antes de presupuestar el uso en producción.
¿Qué ventana de contexto soporta Macaron V1 Tall?
Novita AI actualmente lista una ventana de contexto de 262,144 tokens y un máximo de 32,768 tokens de salida para Macaron V1 Tall.
¿Macaron V1 Tall soporta llamada a funciones?
Sí. El conjunto de funciones alojadas actual en la página del modelo de Novita incluye llamada a funciones y razonamiento.
¿Es Macaron V1 Tall multimodal en Novita AI?
No en la lista alojada actual. Novita actualmente muestra entrada de texto y salida de texto para este modelo.
Artículos Recomendados
- Macaron V1 Venti en Novita AI: Buque Insignia 748B Mixture-of-LoRA para Codificación, Agentes y GenUI
- Ling-3.0-flash en Novita AI: API Gratuita para Inferencia de Agentes
- Qwen3.6-27B en Novita AI: Contexto de 262K para Codificación de Agentes
Fuentes verificadas el 29 de julio de 2026: Página del modelo Macaron V1 Tall, Referencia de API de completaciones de chat de Novita, Referencia de API de listado de modelos de Novita
