- Points clés
- Qu'est-ce que Macaron V1 Tall ?
- Accès à l'API Macaron V1 Tall sur Novita AI
- Résumé des spécifications et des prix de Macaron V1 Tall
- Signaux de performance et de référence de Macaron V1 Tall
- Capacités clés pour les développeurs
- Quand utiliser Macaron V1 Tall
- Quand ne pas utiliser Macaron V1 Tall
- Comment Macaron V1 Tall s'intègre dans votre workflow API
- Conclusion
- FAQ
- Articles recommandés
Macaron V1 Tall est le moyen le plus simple d’entrer dans la famille Macaron si vous souhaitez un long contexte sans commencer par le niveau phare. Vérifié le 29 juillet 2026, Novita le liste avec l’ID de modèle mindai/macaron-v1-tall, une fenêtre de contexte de 262 144 tokens, 32 768 tokens de sortie maximum, le raisonnement, l’appel de fonctions et un prix gratuit limité dans le temps de 0 $ par million de tokens en entrée et en sortie.
Pour un démarrage rapide, consultez Démarrage rapide de Macaron V1 Tall pour le codage, les agents et GenUI.
Si vous hésitez entre les deux variantes de Macaron, comparez d’abord ce guide avec Macaron V1 Venti sur Novita AI.
Points clés
- Macaron V1 Tall est disponible sur Novita AI sous le nom
mindai/macaron-v1-tall. - Novita le décrit comme le modèle Macaron V1 efficace, basé sur Qwen3.6-35B-A3B avec quatre adaptateurs LoRA spécialisés.
- La fiche actuelle de Novita indique une fenêtre de contexte de 262 144 tokens et 32 768 tokens de sortie maximum.
- Les fonctionnalités hébergées incluent actuellement le raisonnement et l’appel de fonctions via le workflow de complétion de chat.
- Les prix étaient indiqués comme gratuits limités dans le temps au 29 juillet 2026, avec un prix de 0 $ pour les tokens d’entrée et de sortie.
Qu’est-ce que Macaron V1 Tall ?
Macaron V1 Tall est le modèle le plus léger de la gamme Macaron V1. Sur Novita AI, la description officielle le qualifie de variante efficace de la famille et précise qu’il est basé sur Qwen3.6-35B-A3B avec quatre adaptateurs LoRA spécialisés pour le chat, les agents, le codage et le travail GenUI.
Cette description est importante car Tall n’est pas positionné comme un chatbot générique. L’histoire de la famille repose sur une spécialisation orientée : le modèle de base gère le raisonnement général tandis que les adaptateurs LoRA orientent le système vers des charges de travail spécifiques pour les développeurs. En pratique, cela rend Tall plus facile à évaluer par rapport à des tâches réelles telles que les assistants utilisant des outils, l’aide au codage prenant en compte le dépôt, et la génération d’UI structurée, plutôt que seulement la conversation libre.
La distinction la plus importante est opérationnelle. Si Venti est l’option Macaron phare pour les équipes qui souhaitent la configuration la plus volumineuse avec un grand contexte, Tall est le modèle à moindre risque à évaluer en premier. Il conserve le même positionnement familial, mais avec un profil de déploiement plus petit et une API hébergée sans serveur.
Accès à l’API Macaron V1 Tall sur Novita AI
Novita AI expose actuellement Macaron V1 Tall via sa bibliothèque de modèles hébergés et son API LLM compatible OpenAI. La page du modèle liste mindai/macaron-v1-tall comme ID de modèle exact, tandis que la documentation de l’API dirige les développeurs vers la route standard de complétion de chat à l’adresse https://api.novita.ai/openai/v1/chat/completions.
La fiche hébergée actuelle montre également deux familles de points de terminaison : chat/completions et anthropic. Pour la plupart des intégrations Novita existantes, le point de départ le plus simple reste le chemin de complétion de chat compatible OpenAI car il s’aligne avec le reste du catalogue LLM et avec la référence API publiée.
Comme il s’agit d’un lancement et d’un aperçu de référence, la question utile n’est pas « Comment écrire la première requête ? » mais « Le modèle est-il réellement disponible, et quel contrat Novita publie-t-il aujourd’hui ? ». Sur ce point, la réponse actuelle est claire : Tall est disponible en tant que modèle de texte sans serveur avec raisonnement et appel de fonctions dans l’ensemble de fonctionnalités hébergées.
Résumé des spécifications et des prix de Macaron V1 Tall
Le tableau suivant reflète la page modèle en direct de Novita AI et la documentation de l’API LLM vérifiée le 29 juillet 2026.
| Champ | Détails |
|---|---|
| Nom d’affichage | Macaron V1 Tall |
| ID du modèle | mindai/macaron-v1-tall |
| URL de base | https://api.novita.ai/openai |
| Famille de point de terminaison | chat/completions ; la page du modèle liste également anthropic |
| Contexte / limites | 262 144 tokens de contexte ; 32 768 tokens de sortie max |
| Prix | 0 $ en entrée et 0 $ en sortie par million de tokens ; étiqueté gratuit limité dans le temps |
| Meilleure adaptation | Workflows d’agents, assistance au codage, systèmes de chat et expériences GenUI nécessitant un long contexte sans commencer par le plus grand niveau de modèle |
Ces détails ont été vérifiés par rapport à la page modèle en direct de Novita AI et à la documentation de l’API LLM le 29 juillet 2026.
Détails supplémentaires de la page modèle actuelle :
| Spécification | Valeur actuelle |
|---|---|
| Modèle de base | Qwen3.6-35B-A3B |
| Note d’architecture | Macaron V1 avec quatre adaptateurs LoRA spécialisés |
| Modalité d’entrée | Texte |
| Modalité de sortie | Texte |
| Fonctionnalités hébergées | Sans serveur, raisonnement, appel de fonctions |
| Instantané de quota | Entrées RPM hiérarchisées de 30 RPM à 6000 RPM, selon le niveau du compte |
| Étiquettes de statut | Nouveau ; gratuit limité dans le temps |
Le prix gratuit est utile, mais il doit être considéré comme une condition de lancement temporaire plutôt qu’une hypothèse budgétaire permanente. Si vous planifiez un déploiement en production, revérifiez la page modèle en direct avant de finaliser les estimations de coûts ou les engagements contractuels.
Signaux de performance et de référence de Macaron V1 Tall
La fiche Novita actuelle ne publie pas de package de référence, de garantie de latence ou de résumé de classement externe pour Macaron V1 Tall. Cela signifie que cet article ne doit pas prétendre que Tall surpasse un autre modèle en matière de codage, d’utilisation d’outils ou de qualité d’agent sans preuves séparées.
Le cadrage de lancement le plus défendable est plus étroit. Novita positionne Tall comme un modèle efficace de la famille Macaron pour le chat, les agents, le codage et GenUI, et la page hébergée confirme les fonctionnalités API et les prix pertinents. Cela suffit pour justifier une évaluation. Ce n’est pas suffisant pour revendiquer un leadership de catégorie.
Si vous comparez Tall avec un autre modèle hébergé, utilisez vos propres vérifications au niveau de la charge de travail : achèvement des tâches, validité des appels d’outils, latence, consommation de tokens et effort de correction. Ces mesures vous en diront plus qu’un nombre de paramètres ou une description de famille.
Capacités clés pour les développeurs
Chat à long contexte et flux d’assistants
La fenêtre de contexte de 262K est suffisamment grande pour les workflows d’assistants qui doivent conserver un contexte substantiel : exigences produit, SOP internes, état de conversation précédent, notes de support ou longues traces de planification. Cela donne à Tall un avantage clair sur les modèles de chat à court contexte lorsque les invites nécessitent régulièrement plus de quelques documents ou instructions.
Systèmes d’agents utilisant des outils
Novita liste actuellement l’appel de fonctions et le raisonnement dans l’ensemble de fonctionnalités hébergées. Cela fait de Tall un candidat raisonnable pour les agents qui doivent inspecter l’état, choisir un outil, générer des arguments et continuer après l’arrivée d’un résultat d’outil. Le modèle ne remplace toujours pas la conception système : votre application doit gérer les permissions des outils, les tentatives, la validation et le rollback.
Assistance au codage avec un profil de déploiement plus petit
Macaron V1 Tall est décrit comme le membre le plus efficace de la famille, ce qui est exactement la bonne raison de l’essayer pour le triage de dépôt, la planification de correctifs, les résumés de revue de code ou l’assistance aux développeurs côté IDE. Toutes les tâches de codage n’ont pas besoin du plus gros modèle disponible. Un modèle orienté plus petit peut être le meilleur choix lorsque vous souhaitez un long contexte et une spécialisation sans opter par défaut pour l’option la plus chère ou la plus lente.
Expérimentation GenUI
La description de Novita inclut explicitement la capacité d’UI générative native au code dans le positionnement de la famille. Cela ne signifie pas que vous devez restituer directement la sortie arbitraire du modèle en production. Cela signifie que Tall est un candidat pertinent pour prototyper des workflows de génération d’interface où le modèle transforme des exigences en écrans, arbres de composants ou plans d’UI structurés.
Quand utiliser Macaron V1 Tall
Utilisez Macaron V1 Tall lorsque votre charge de travail bénéficie de trois choses à la fois : un long contexte, une spécialisation orientée développeur et un chemin d’évaluation à moindre friction par rapport à un modèle phare.
Les bons candidats incluent :
- Assistants de chat internes qui doivent conserver un contexte substantiel de politique ou de produit.
- Aides au codage qui raisonnent sur plusieurs fichiers, notes de problème et commentaires de revue précédents.
- Agents utilisant des outils où l’appel de fonctions importe plus que l’entrée multimodale.
- Prototypes GenUI qui transforment des exigences détaillées en structure d’interface ou en plans d’implémentation.
- Équipes qui souhaitent tester la famille Macaron alors que le prix hébergé actuel reste gratuit limité dans le temps.
Tall est également un premier arrêt pratique si votre modèle actuel perd du contexte ou échoue dans des workflows multi-étapes, mais que vous n’êtes pas encore prêt à passer à une classe de modèle beaucoup plus grande.
Quand ne pas utiliser Macaron V1 Tall
Ne choisissez pas Tall par défaut pour chaque charge de travail textuelle simplement parce qu’il est nouveau ou gratuit.
Il est moins adapté lorsque :
- Votre charge de travail est courte, répétitive et facile à router via un petit modèle bon marché.
- Vous avez besoin d’une entrée image, audio ou vidéo sur le point de terminaison hébergé, car la fiche actuelle est texte en entrée et texte en sortie.
- Votre contrat de production dépend d’une revendication de référence publiée qui n’est pas disponible pour Tall.
- Vous avez besoin de la plus grande option de la famille Macaron car la tâche est dominée par un contexte très large et une expérimentation de niveau phare.
- Vous ne pouvez pas tolérer qu’une promotion de lancement change, car le prix actuel est explicitement gratuit limité dans le temps.
Si le vrai besoin est une classification à faible latence prévisible ou une extraction légère à très grand volume, un modèle plus simple peut encore être le choix de production le plus propre.
Comment Macaron V1 Tall s’intègre dans votre workflow API
Macaron V1 Tall s’intègre dans le même workflow de haut niveau que les autres LLM hébergés par Novita :
- Confirmez que votre compte peut accéder au modèle.
- Utilisez l’URL de base compatible OpenAI
https://api.novita.ai/openai. - Définissez l’ID du modèle sur
mindai/macaron-v1-tall. - Envoyez des requêtes via les complétions de chat et ajoutez des définitions de fonctions si votre application utilise l’appel d’outils.
Ce contrat est suffisant pour la planification de l’intégration, les décisions de routage et la revue d’architecture. Cet article s’arrête intentionnellement là. Il n’inclut pas d’extraits SDK complets, de descriptions de payloads de requêtes ou de dépannage car ceux-ci appartiennent à un guide de démarrage rapide dédié plutôt qu’à un article de lancement/de référence.
Conclusion
Macaron V1 Tall est le modèle de la famille Macaron par lequel commencer lorsque vous souhaitez une option hébergée à long contexte pour le chat, les agents utilisant des outils, l’assistance au codage ou les expériences GenUI sans commencer par le plus grand niveau. Au 29 juillet 2026, Novita AI le liste comme disponible maintenant, sans serveur, avec raisonnement, capable d’appel de fonctions et gratuit limité dans le temps.
La prochaine étape appropriée est de le tester sur des tâches réelles, pas seulement sur une invite « hello world ». Utilisez la fenêtre gratuite actuelle pour comparer Tall au modèle que vous utilisez déjà, en particulier sur les workflows de codage et d’agents multi-étapes. S’il maintient mieux le contexte, appelle les outils de manière fiable et maintient une latence acceptable, il mérite une place dans l’évaluation de production.
Essayez Macaron V1 Tall sur Novita AI
FAQ
Macaron V1 Tall est-il disponible sur Novita AI ?
Oui. Vérifié le 29 juillet 2026, Novita AI liste Macaron V1 Tall dans la bibliothèque de modèles hébergés avec l’ID de modèle mindai/macaron-v1-tall.
Quel est l’ID du modèle Macaron V1 Tall ?
L’ID actuel du modèle Novita AI est mindai/macaron-v1-tall.
Macaron V1 Tall est-il gratuit sur Novita AI ?
La page du modèle vérifiée le 29 juillet 2026 listait 0 $ par million de tokens en entrée et 0 $ par million de tokens en sortie, et étiquetait le modèle comme gratuit limité dans le temps. Revérifiez la page en direct avant de budgétiser une utilisation en production.
Quelle fenêtre de contexte Macaron V1 Tall prend-il en charge ?
Novita AI liste actuellement une fenêtre de contexte de 262 144 tokens et 32 768 tokens de sortie maximum pour Macaron V1 Tall.
Macaron V1 Tall prend-il en charge l’appel de fonctions ?
Oui. L’ensemble de fonctionnalités hébergées actuel sur la page modèle Novita inclut l’appel de fonctions et le raisonnement.
Macaron V1 Tall est-il multimodal sur Novita AI ?
Non, pas sur la fiche hébergée actuelle. Novita montre actuellement une entrée texte et une sortie texte pour ce modèle.
Articles recommandés
- Macaron V1 Venti sur Novita AI : fleuron 748B Mixture-of-LoRA pour le codage, les agents et GenUI
- Démarrage rapide de Macaron V1 Venti sur Novita AI : contexte 1M, point de terminaison et exemples
- Démarrage rapide de Macaron V1 Tall pour le codage, les agents et GenUI
Sources vérifiées le 29 juillet 2026 : Page du modèle Macaron V1 Tall, Référence API de complétion de chat Novita, Référence API de liste de modèles Novita
