- Quand utiliser ce guide de démarrage rapide
- Étape 1 : Obtenez votre clé API Novita
- Étape 2 : Vérifiez l’ID du modèle et l’endpoint
- Étape 3 : Envoyez votre première requête
- Étape 4 : Lire la réponse
- Étape 5 : Vérifiez les prix, les limites et les erreurs courantes
- Exemple Python
- Exemple cURL
- Paramètres clés
- Codage, agents et invites GenUI
- Dépannage
- FAQ
- Articles recommandés
Macaron V1 Tall est l’option Macaron plus légère lorsque vous souhaitez un contexte long sans passer directement au modèle phare. Utilisez-le pour le codage, les boucles d’agent ou les invites GenUI, et commencez par une petite requête textuelle avant d’étendre à des workflows plus longs.
Si vous choisissez la pile de codage Python autour de lui, comparez Meilleure IA pour coder en Python en 2026.
Pour une vue d’ensemble du modèle, consultez Macaron V1 Tall sur Novita AI.
Pour la comparaison avec le modèle phare, consultez Macaron V1 Venti sur Novita AI.
Quand utiliser ce guide de démarrage rapide
Utilisez ce guide lorsque votre charge de travail a besoin de suffisamment de contexte pour transporter l’état du dépôt, les traces d’outils ou les spécifications d’interface, mais n’a pas besoin de la plus grande fenêtre de contexte du catalogue.
Étape 1 : Obtenez votre clé API Novita
Créez une clé API Novita et conservez-la côté serveur.
export NOVITA_API_KEY="your_api_key_here"
Étape 2 : Vérifiez l’ID du modèle et l’endpoint
| Champ | Valeur |
|---|---|
| ID du modèle | mindai/macaron-v1-tall |
| URL de base | https://api.novita.ai/openai/v1 |
| Endpoint de complétion de chat | https://api.novita.ai/openai/v1/chat/completions |
| Fenêtre de contexte | 262 144 jetons |
| Sortie maximale | 32 768 jetons |
| Entrée | Texte |
| Sortie | Texte |
| Hébergement | API serverless Novita AI |
Au moment de la vérification du 29 juillet 2026, Novita répertoriait Macaron V1 Tall comme gratuit à durée limitée avec un tarif de 0 $ en entrée et 0 $ en sortie. Vérifiez la page du modèle en direct avant de budgétiser une utilisation en production.
Étape 3 : Envoyez votre première requête
Commencez par une invite textuelle courte pour vérifier l’authentification, le routage et l’analyse.
Summarize the main risks in a repository-wide refactor in 5 bullet points.
Étape 4 : Lire la réponse
Pour les complétions de chat standard, lisez la réponse dans choices[0].message.content. Conservez les métadonnées de la requête, l’utilisation des jetons et le statut HTTP dans vos journaux afin de pouvoir tracer les appels lents ou coûteux plus tard.
Étape 5 : Vérifiez les prix, les limites et les erreurs courantes
La liste actuelle compte plus qu’un ancien article de blog. Revérifiez la page du modèle avant le lancement si vous dépendez du tarif gratuit ou de la fenêtre de contexte complète de 262K.
Les erreurs de configuration courantes incluent :
- Utiliser le nom d’affichage au lieu de
mindai/macaron-v1-tall. - Pointer le SDK vers une mauvaise URL de base.
- Envoyer une invite énorme avant de confirmer la connectivité de base.
- Supposer que chaque requête à long contexte doit utiliser le plafond de sortie maximal.
Exemple Python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-tall",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Exemple cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-tall",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Paramètres clés
| Paramètre | Valeur initiale | Pourquoi c’est important |
|---|---|---|
model |
mindai/macaron-v1-tall |
Sélectionne le modèle hébergé |
messages |
Invite système + utilisateur courte | Vérifie rapidement le chemin de l’API |
temperature |
0.2 |
Maintient une sortie de test stable |
max_tokens |
400 |
Évite des premières réponses trop volumineuses |
tools |
Une fonction à la fois | Utile pour les agents et les workflows |
response_format |
Seulement si votre analyseur est prêt | Validez le JSON avant la mise en production |
Codage, agents et invites GenUI
Codage
Utilisez Macaron V1 Tall pour les refactorisations tenant compte du dépôt, les plans de migration ou les résumés de revue de code lorsque le contexte environnant compte.
Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.
Agents
Utilisez l’appel de fonction lorsque le modèle doit choisir un outil au lieu de répondre directement.
Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.
GenUI
Utilisez-le pour la génération d’interfaces lorsque vous souhaitez des idées d’interface structurées à partir d’un brief produit.
Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.
Dépannage
L’API renvoie une erreur d’authentification
Confirmez que le jeton bearer est défini dans le même shell ou runtime qui effectue la requête.
Le modèle est introuvable
Revérifiez l’ID du modèle : mindai/macaron-v1-tall.
La requête est trop volumineuse
Commencez plus petit, puis ajoutez le contexte progressivement. Une fenêtre de 262 000 jetons est une capacité, pas un signal pour tout envoyer d’un coup.
FAQ
Macaron V1 Tall est-il disponible sur Novita AI ?
Oui. La liste en direct le présente comme un modèle serverless.
Quel endpoint dois-je utiliser ?
Utilisez https://api.novita.ai/openai/v1/chat/completions.
Prend-il en charge l’utilisation d’outils ?
Vérifiez la page du modèle en direct pour connaître les étiquettes de fonctionnalités actuelles avant de dépendre des appels d’outils en production.
Le modèle est-il gratuit pour le moment ?
La liste vérifiée le 29 juillet 2026 affichait un tarif de 0 $ en entrée et 0 $ en sortie, marqué comme gratuit à durée limitée.
Articles recommandés
- Macaron V1 Tall sur Novita AI : modèle MoL gratuit avec contexte 262K pour le chat, les agents et le codage
- Démarrage rapide de Macaron V1 Venti sur Novita AI : contexte 1M, endpoint et exemples
- Macaron V1 Venti sur Novita AI : modèle phare 748B Mixture-of-LoRA pour le codage, les agents et GenUI
Sources vérifiées le 29 juillet 2026 : bibliothèque de modèles Novita AI, référence API de complétion de chat Novita
