Macaron V1 Tall sur Novita AI : Modèle MoL gratuit avec 262 000 tokens de contexte pour chat, agents et codage

Macaron V1 Tall sur Novita AI : Modèle MoL gratuit avec 262 000 tokens de contexte pour chat, agents et codage

Macaron V1 Tall est le moyen le plus simple d’entrer dans la famille Macaron si vous souhaitez un long contexte sans commencer par le niveau phare. Vérifié au 29 juillet 2026, Novita le répertorie avec l’ID de modèle mindai/macaron-v1-tall, une fenêtre de contexte de 262 144 tokens, 32 768 tokens de sortie maximum, le raisonnement, l’appel de fonctions et un prix gratuit limité dans le temps de 0 $ par million de tokens d’entrée et de sortie.

Pour un démarrage rapide, consultez le Guide de démarrage rapide de Macaron V1 Tall pour le codage, les agents et la GenUI.

Si vous hésitez entre les deux variantes Macaron, comparez d’abord ce guide avec Macaron V1 Venti sur Novita AI.

Points clés

  • Macaron V1 Tall est disponible sur Novita AI sous le nom mindai/macaron-v1-tall.
  • Novita le décrit comme le modèle Macaron V1 efficace, construit sur Qwen3.6-35B-A3B avec quatre adaptateurs LoRA spécialisés.
  • La fiche Novita actuelle affiche une fenêtre de contexte de 262 144 tokens et 32 768 tokens de sortie maximum.
  • Les fonctionnalités hébergées incluent actuellement le raisonnement et l’appel de fonctions via le workflow de complétion de chat.
  • La tarification était indiquée comme gratuite limitée dans le temps au 29 juillet 2026, avec un tarif de 0 $ par token d’entrée et 0 $ par token de sortie.

Qu’est-ce que Macaron V1 Tall ?

Macaron V1 Tall est le modèle plus léger de la gamme Macaron V1. Sur Novita AI, la description officielle le qualifie de variante efficace de la famille et précise qu’il est construit sur Qwen3.6-35B-A3B avec quatre adaptateurs LoRA spécialisés pour le chat, les agents, le codage et la GenUI.

Cette description est importante car Tall n’est pas positionné comme un chatbot générique. L’histoire de la famille repose sur une spécialisation routée : le modèle de base gère le raisonnement large tandis que les adaptateurs LoRA orientent le système vers des charges de travail de développeur spécifiques. En pratique, cela rend Tall plus facile à évaluer face à des tâches réelles telles que les assistants utilisant des outils, l’aide au codage contextuelle et la génération d’interfaces structurées, plutôt que seulement la conversation libre.

La distinction la plus importante est opérationnelle. Si Venti est l’option Macaron phare pour les équipes qui souhaitent la configuration la plus lourde en contexte, Tall est le modèle à moindre risque à évaluer en premier. Il conserve le même positionnement familial, mais avec un profil de déploiement plus léger et une API hébergée sans serveur.

Accès à l’API Macaron V1 Tall sur Novita AI

Novita AI expose actuellement Macaron V1 Tall via sa bibliothèque de modèles hébergés et son API LLM compatible OpenAI. La page du modèle liste mindai/macaron-v1-tall comme ID de modèle exact, tandis que la documentation API oriente les développeurs vers la route standard de complétion de chat à l’adresse https://api.novita.ai/openai/v1/chat/completions.

La fiche hébergée actuelle montre également deux familles de points de terminaison : chat/completions et anthropic. Pour la plupart des intégrations Novita existantes, le point de départ le plus simple reste la route de complétion de chat compatible OpenAI, car elle s’aligne avec le reste du catalogue LLM et avec la référence API publiée.

Comme il s’agit d’un aperçu de lancement, la question utile n’est pas « Comment écrire la première requête ? » mais « Le modèle est-il réellement disponible, et quel contrat Novita publie-t-il aujourd’hui ? » Sur ce point, la réponse actuelle est claire : Tall est disponible en tant que modèle textuel sans serveur avec raisonnement et appel de fonctions dans l’ensemble de fonctionnalités hébergées.

Résumé des spécifications et de la tarification de Macaron V1 Tall

Le tableau suivant reflète la page de modèle en direct de Novita AI et la documentation API LLM vérifiées le 29 juillet 2026.

Champ Détails
Nom d’affichage Macaron V1 Tall
ID du modèle mindai/macaron-v1-tall
URL de base https://api.novita.ai/openai
Famille de points de terminaison chat/completions ; la page du modèle liste également anthropic
Contexte / limites 262 144 tokens de contexte ; 32 768 tokens de sortie max
Tarification 0 $ entrée et 0 $ sortie par 1 M de tokens ; étiqueté gratuit limité dans le temps
Meilleure adaptation Workflows d’agents, support de codage, systèmes de chat et expériences GenUI nécessitant un long contexte sans partir du plus grand niveau de modèle

Ces détails ont été vérifiés par rapport à la page de modèle en direct et à la documentation API LLM de Novita AI le 29 juillet 2026.

Détails supplémentaires de la page de modèle actuelle :

Spécification Valeur actuelle
Modèle de base Qwen3.6-35B-A3B
Note d’architecture Macaron V1 avec quatre adaptateurs LoRA spécialisés
Modalité d’entrée Texte
Modalité de sortie Texte
Fonctionnalités hébergées Sans serveur, raisonnement, appel de fonctions
Aperçu des quotas Entrées RPM hiérarchisées de 30 RPM à 6000 RPM, selon le niveau du compte
Étiquettes de statut Nouveau ; gratuit limité dans le temps

Le prix gratuit est utile, mais il doit être traité comme une condition de lancement temporaire plutôt que comme une hypothèse budgétaire permanente. Si vous planifiez un déploiement en production, revérifiez la page du modèle en direct avant d’établir des estimations de coûts finales ou des engagements contractuels.

Signaux de performance et de benchmark de Macaron V1 Tall

La fiche Novita actuelle ne publie pas de package de benchmark, de garantie de latence ou de résumé de classement externe pour Macaron V1 Tall. Cela signifie que cet article ne doit pas prétendre que Tall surpasse un autre modèle en codage, utilisation d’outils ou qualité d’agent sans preuve séparée.

Le cadrage de lancement le plus défendable est plus étroit. Novita positionne Tall comme un modèle efficace de la famille Macaron pour le chat, les agents, le codage et la GenUI, et la page hébergée confirme les fonctionnalités API et la tarification pertinentes. Cela suffit pour justifier une évaluation. Ce n’est pas suffisant pour revendiquer un leadership de catégorie.

Si vous comparez Tall avec un autre modèle hébergé, utilisez vos propres vérifications au niveau de la charge de travail : achèvement des tâches, validité des appels d’outils, latence, consommation de tokens et effort de correction. Ces mesures vous en diront plus qu’un nombre de paramètres ou une description de famille.

Capacités clés pour les développeurs

Chat longue-contexte et flux d’assistant

La fenêtre de contexte de 262 000 tokens est suffisamment grande pour les workflows d’assistant qui doivent conserver un contexte substantiel : exigences produit, SOP internes, état de conversation antérieur, notes de support ou longues traces de planification. Cela donne à Tall un avantage clair sur les modèles de chat à court contexte lorsque les prompts nécessitent régulièrement plus de quelques documents ou instructions.

Systèmes d’agents utilisant des outils

Novita liste actuellement l’appel de fonctions et le raisonnement dans l’ensemble de fonctionnalités hébergées. Cela fait de Tall un candidat raisonnable pour les agents qui doivent inspecter l’état, choisir un outil, générer des arguments et continuer après l’arrivée d’un résultat d’outil. Le modèle ne remplace toujours pas la conception système : votre application doit gérer les permissions d’outils, les tentatives, la validation et le rollback.

Support de codage avec un profil de déploiement plus léger

Macaron V1 Tall est décrit comme le membre le plus efficace de la famille, ce qui est exactement la bonne raison de l’essayer pour le triage de dépôt, la planification de correctifs, les résumés de révision de code ou l’assistance au développement côté IDE. Toutes les tâches de codage n’ont pas besoin du plus grand modèle disponible. Un modèle routé plus petit peut être le meilleur choix lorsque vous voulez un long contexte et une spécialisation sans recourir par défaut à l’option la plus chère ou la plus lente.

Expérimentation GenUI

La description de Novita inclut explicitement la capacité de Génération d’Interface Utilisateur native dans le positionnement de la famille. Cela ne signifie pas que vous devez restituer directement une sortie de modèle arbitraire en production. Cela signifie que Tall est un candidat pertinent pour prototyper des workflows de génération d’interface où le modèle traduit des exigences en écrans, arbres de composants ou plans d’interface structurés.

Quand utiliser Macaron V1 Tall

Utilisez Macaron V1 Tall lorsque votre charge de travail bénéficie de trois choses à la fois : un long contexte, une spécialisation orientée développeur et un chemin d’évaluation à moindre friction qu’un modèle phare.

Les bons candidats incluent :

  • Assistants de chat internes qui doivent conserver un contexte politique ou produit substantiel.
  • Aides au codage qui raisonnent sur plusieurs fichiers, notes de problème et commentaires de révision antérieurs.
  • Agents utilisant des outils où l’appel de fonctions importe plus que l’entrée multimodale.
  • Prototypes GenUI qui transforment des exigences détaillées en structure d’interface ou plans d’implémentation.
  • Équipes qui souhaitent tester la famille Macaron pendant que le prix hébergé actuel reste gratuit limité dans le temps.

Tall est également un premier arrêt pratique si votre modèle actuel perd du contexte ou échoue dans des workflows multi-étapes, mais que vous n’êtes pas encore prêt à passer à une classe de modèle beaucoup plus grande.

Quand ne pas utiliser Macaron V1 Tall

Ne choisissez pas Tall par défaut pour chaque charge de travail textuelle simplement parce qu’il est nouveau ou gratuit.

Il est moins adapté lorsque :

  • Votre charge de travail est courte, répétitive et facile à router via un petit modèle bon marché.
  • Vous avez besoin d’une entrée image, audio ou vidéo sur le point de terminaison hébergé, car la fiche actuelle est texte en entrée et texte en sortie.
  • Votre contrat de production dépend d’une revendication de benchmark publiée qui n’est pas disponible pour Tall.
  • Vous avez besoin de la plus grande option de la famille Macaron car la tâche est dominée par un contexte très large et une expérimentation de niveau phare.
  • Vous ne pouvez pas tolérer un changement de promotion de lancement, car le prix actuel est explicitement gratuit limité dans le temps.

Si le vrai besoin est une classification à faible latence prévisible ou une extraction légère à très grand volume, un modèle plus simple peut encore être le choix de production le plus propre.

Comment Macaron V1 Tall s’intègre dans votre workflow API

Macaron V1 Tall s’intègre dans le même workflow de haut niveau que les autres LLM hébergés par Novita :

  1. Confirmez que votre compte peut accéder au modèle.
  2. Utilisez l’URL de base compatible OpenAI https://api.novita.ai/openai.
  3. Définissez l’ID du modèle sur mindai/macaron-v1-tall.
  4. Envoyez des requêtes via les complétions de chat et ajoutez des définitions de fonctions si votre application utilise l’appel d’outils.

Ce contrat est suffisant pour la planification d’intégration, les décisions de routage et la revue d’architecture. Cet article s’arrête intentionnellement là. Il n’inclut pas d’extraits SDK complets, de détails de payload de requête ou de dépannage, car ceux-ci appartiennent à un guide de démarrage rapide dédié plutôt qu’à un article de lancement.

Conclusion

Macaron V1 Tall est le modèle de la famille Macaron par lequel commencer lorsque vous voulez une option hébergée à long contexte pour le chat, les agents utilisant des outils, le support de codage ou les expériences GenUI sans commencer au plus grand niveau. Au 29 juillet 2026, Novita AI le répertorie comme disponible maintenant, sans serveur, avec raisonnement, appel de fonctions et gratuit limité dans le temps.

La bonne prochaine étape est de le tester sur des tâches réelles, pas seulement avec une invite de type hello-world. Profitez de la fenêtre gratuite actuelle pour comparer Tall avec le modèle en lequel vous avez déjà confiance, en particulier sur les workflows de codage multi-étapes et d’agents. S’il maintient mieux le contexte, appelle les outils de manière fiable et maintient une latence acceptable, il mérite une place dans l’évaluation en production.

Essayez Macaron V1 Tall sur Novita AI

FAQ

Macaron V1 Tall est-il disponible sur Novita AI ?

Oui. Vérifié au 29 juillet 2026, Novita AI répertorie Macaron V1 Tall dans la bibliothèque de modèles hébergés avec l’ID de modèle mindai/macaron-v1-tall.

Quel est l’ID du modèle Macaron V1 Tall ?

L’ID de modèle Novita AI actuel est mindai/macaron-v1-tall.

Macaron V1 Tall est-il gratuit sur Novita AI ?

La page du modèle vérifiée le 29 juillet 2026 indiquait 0 $ par million de tokens d’entrée et 0 $ par million de tokens de sortie, et étiquetait le modèle comme gratuit limité dans le temps. Revérifiez la page en direct avant de budgétiser une utilisation en production.

Quelle fenêtre de contexte Macaron V1 Tall prend-il en charge ?

Novita AI liste actuellement une fenêtre de contexte de 262 144 tokens et 32 768 tokens de sortie maximum pour Macaron V1 Tall.

Macaron V1 Tall prend-il en charge l’appel de fonctions ?

Oui. L’ensemble de fonctionnalités hébergées actuel sur la page de modèle Novita inclut l’appel de fonctions et le raisonnement.

Macaron V1 Tall est-il multimodal sur Novita AI ?

Non sur la fiche hébergée actuelle. Novita montre actuellement une entrée texte et une sortie texte pour ce modèle.

Articles recommandés

Sources vérifiées le 29 juillet 2026 : Page du modèle Macaron V1 Tall, Référence API de complétion de chat Novita, Référence API de liste de modèles Novita