- Quand utiliser ce guide de démarrage rapide
- Étape 1 : Obtenez votre clé API Novita
- Étape 2 : Confirmez l'ID du modèle et l'endpoint
- Étape 3 : Envoyez votre première requête
- Étape 4 : Lisez la réponse
- Étape 5 : Vérifiez la tarification, les limites et les erreurs courantes
- Exemple Python
- Exemple cURL
- Paramètres clés
- Prompts pour le codage, les agents et GenUI
- Dépannage
- FAQ
- Articles recommandés
Macaron V1 Tall est l’option Macaron plus légère lorsque vous avez besoin d’un contexte long sans passer directement au modèle phare. Utilisez-le pour le codage, les boucles d’agents ou les prompts GenUI, et commencez par une petite requête textuelle avant de passer à des workflows plus longs.
Pour une vue d’ensemble du modèle, consultez Macaron V1 Tall sur Novita AI.
Pour la comparaison avec le modèle phare, consultez Macaron V1 Venti sur Novita AI.
Quand utiliser ce guide de démarrage rapide
Utilisez ce guide lorsque votre charge de travail a besoin d’assez de contexte pour contenir l’état du dépôt, les traces d’outils ou les spécifications d’interface utilisateur, mais n’a pas besoin de la plus grande fenêtre de contexte du catalogue.
Étape 1 : Obtenez votre clé API Novita
Créez une clé API Novita et conservez-la côté serveur.
export NOVITA_API_KEY="your_api_key_here"
Étape 2 : Confirmez l’ID du modèle et l’endpoint
| Champ | Valeur |
|---|---|
| ID du modèle | mindai/macaron-v1-tall |
| URL de base | https://api.novita.ai/openai/v1 |
| Endpoint de complétion de chat | https://api.novita.ai/openai/v1/chat/completions |
| Fenêtre de contexte | 262 144 tokens |
| Tokens de sortie maximum | 32 768 |
| Entrée | Texte |
| Sortie | Texte |
| Hébergement | API serverless Novita AI |
Lors de la vérification effectuée le 29 juillet 2026, Novita listait Macaron V1 Tall comme gratuit à durée limitée avec une tarification $0 en entrée et $0 en sortie. Vérifiez la page du modèle en direct avant de budgétiser une utilisation en production.
Étape 3 : Envoyez votre première requête
Commencez par un court prompt textuel pour vérifier l’authentification, le routage et l’analyse.
Résumez les principaux risques d'une refonte à l'échelle d'un dépôt en 5 points.
Étape 4 : Lisez la réponse
Pour les complétions de chat standard, lisez la réponse dans choices[0].message.content. Conservez les métadonnées de la requête, l’utilisation des tokens et le statut HTTP dans vos journaux afin de pouvoir tracer les appels lents ou coûteux ultérieurement.
Étape 5 : Vérifiez la tarification, les limites et les erreurs courantes
La liste actuelle est plus importante qu’un article de blog obsolète. Revérifiez la page du modèle avant le lancement si vous dépendez d’une tarification gratuite ou de la fenêtre de contexte complète de 262K.
Les erreurs de configuration courantes incluent :
- Utiliser le nom d’affichage au lieu de
mindai/macaron-v1-tall. - Pointer le SDK vers la mauvaise URL de base.
- Envoyer un prompt énorme avant de confirmer la connectivité de base.
- Supposer que chaque requête avec contexte long doit utiliser la limite de sortie maximale.
Exemple Python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-tall",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Exemple cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-tall",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Paramètres clés
| Paramètre | Commencez par | Pourquoi c’est important |
|---|---|---|
model |
mindai/macaron-v1-tall |
Sélectionne le modèle hébergé |
messages |
Prompt court système + utilisateur | Vérifie rapidement le chemin API |
temperature |
0.2 |
Maintient la sortie de test stable |
max_tokens |
400 |
Évite des premières réponses trop volumineuses |
tools |
Une fonction à la fois | Utile pour les agents et les workflows |
response_format |
Uniquement si votre analyseur est prêt | Validez le JSON avant de déployer |
Prompts pour le codage, les agents et GenUI
Codage
Utilisez Macaron V1 Tall pour les refontes tenant compte du dépôt, les plans de migration ou les résumés de révision de code lorsque le contexte environnant est important.
Examinez ce module pour les risques de migration, identifiez les changements cassants et suggérez le plus petit plan de correctif sécurisé.
Agents
Utilisez l’appel de fonction lorsque le modèle doit choisir un outil plutôt que de répondre directement.
Appelez l'outil de recherche de ticket uniquement si l'utilisateur fait référence à un ID de problème existant. Sinon, répondez par un court plan.
GenUI
Utilisez-le pour la génération d’interface lorsque vous souhaitez des idées d’interface utilisateur structurées à partir d’un brief produit.
Transformez ce brief produit en une mise en page de tableau de bord propre avec des sections, des actions, des états vides et des règles de validation.
Dépannage
L’API renvoie une erreur d’authentification
Confirmez que le token porteur est défini dans le même shell ou runtime qui effectue la requête.
Le modèle est introuvable
Vérifiez à nouveau l’ID du modèle : mindai/macaron-v1-tall.
La requête est trop volumineuse
Commencez plus petit, puis ajoutez du contexte progressivement. Une fenêtre de 262K tokens est une capacité, pas un signal pour tout envoyer d’un coup.
FAQ
Macaron V1 Tall est-il disponible sur Novita AI ?
Oui. La liste en direct le montre comme un modèle serverless.
Quel endpoint dois-je utiliser ?
Utilisez https://api.novita.ai/openai/v1/chat/completions.
Prend-il en charge l’utilisation d’outils ?
Consultez la page du modèle en direct pour les étiquettes de fonctionnalités actuelles avant de dépendre des appels d’outils en production.
Le modèle est-il gratuit actuellement ?
La liste vérifiée le 29 juillet 2026 affichait une tarification $0 en entrée et $0 en sortie, marquée comme gratuite à durée limitée.
Articles recommandés
- Macaron V1 Tall sur Novita AI : Modèle MoL gratuit à 262K de contexte pour le chat, les agents et le codage
- Guide de démarrage rapide Macaron V1 Venti sur Novita AI : 1M de contexte, endpoint et exemples
- Macaron V1 Venti sur Novita AI : Modèle phare Mixture-of-LoRA de 748B pour le codage, les agents et GenUI
Sources vérifiées le 29 juillet 2026 : Bibliothèque de modèles Novita AI, Référence API de complétion de chat Novita
