Démarrage rapide de l'API Macaron V1 Tall pour le codage, les agents et GenUI

Démarrage rapide de l'API Macaron V1 Tall pour le codage, les agents et GenUI

Macaron V1 Tall est disponible sur Novita AI via l’API de complétion de chat compatible OpenAI. Utilisez-le lorsque vous avez besoin d’une fenêtre de contexte de taille moyenne pour le codage, les boucles d’agents ou les invites GenUI, et commencez par une petite requête textuelle avant de passer à des workflows plus longs.

Quand utiliser ce guide de démarrage rapide

Utilisez ce guide lorsque votre charge de travail nécessite suffisamment de contexte pour transporter l’état du dépôt, les traces d’outils ou les spécifications d’interface utilisateur, mais n’a pas besoin de la plus grande fenêtre de contexte du catalogue.

Étape 1 : Obtenez votre clé API Novita

Créez une clé API Novita et conservez-la côté serveur.

export NOVITA_API_KEY="votre_cle_api_ici"

Étape 2 : Confirmez l’ID du modèle et le point de terminaison

Champ Valeur
ID du modèle mindai/macaron-v1-tall
URL de base https://api.novita.ai/openai/v1
Point de terminaison de complétion de chat https://api.novita.ai/openai/v1/chat/completions
Fenêtre de contexte 262 144 tokens
Tokens de sortie maximum 32 768
Entrée Texte
Sortie Texte
Hébergement API serverless Novita AI

Au moment de la vérification le 29 juillet 2026, Novita listait Macaron V1 Tall comme gratuit à durée limitée avec une tarification $0 en entrée et $0 en sortie. Vérifiez la page du modèle en direct avant de budgétiser une utilisation en production.

Étape 3 : Envoyez votre première requête

Commencez par une invite courte et textuelle pour vérifier l’authentification, le routage et l’analyse.

Résumez les principaux risques d'une refactorisation à l'échelle du dépôt en 5 points.

Étape 4 : Lisez la réponse

Pour les complétions de chat standard, lisez la réponse depuis choices[0].message.content. Conservez les métadonnées de la requête, l’utilisation des tokens et le statut HTTP dans vos journaux afin de pouvoir tracer les appels lents ou coûteux ultérieurement.

Étape 5 : Vérifiez la tarification, les limites et les erreurs courantes

La liste actuelle est plus importante qu’un article de blog obsolète. Revérifiez la page du modèle avant le lancement si vous dépendez d’une tarification gratuite ou de la fenêtre de contexte complète de 262K.

Les erreurs de configuration courantes incluent :

  • Utiliser le nom d’affichage au lieu de mindai/macaron-v1-tall.
  • Pointer le SDK vers la mauvaise URL de base.
  • Envoyer une invite énorme avant de confirmer la connectivité de base.
  • Supposer que chaque requête à long contexte doit utiliser le plafond de sortie maximum.

Exemple Python

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-tall",
    messages=[
        {"role": "system", "content": "Vous êtes un assistant de codage concis."},
        {"role": "user", "content": "Listez les premières étapes les plus sûres pour refactoriser un grand monorepo."},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

Exemple cURL

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-tall",
    "messages": [
      {
        "role": "system",
        "content": "Vous êtes un assistant de codage concis."
      },
      {
        "role": "user",
        "content": "Listez les premières étapes les plus sûres pour refactoriser un grand monorepo."
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

Paramètres clés

Paramètre Commencez par Pourquoi c’est important
model mindai/macaron-v1-tall Sélectionne le modèle hébergé
messages Invite système + utilisateur courte Vérifie rapidement le chemin de l’API
temperature 0.2 Maintient la sortie de test stable
max_tokens 400 Évite les premières réponses trop volumineuses
tools Une fonction à la fois Utile pour les agents et les workflows
response_format Uniquement si votre analyseur est prêt Validez le JSON avant de déployer

Invites pour le codage, les agents et GenUI

Codage

Utilisez Macaron V1 Tall pour les refactorisations conscientes du dépôt, les plans de migration ou les résumés de révision de code lorsque le contexte environnant est important.

Examinez ce module pour les risques de migration, identifiez les changements cassants et suggérez le plus petit plan de correctif sûr.

Agents

Utilisez l’appel de fonction lorsque le modèle doit choisir un outil plutôt que de répondre directement.

Appelez l'outil de recherche de ticket uniquement si l'utilisateur fait référence à un ID de problème existant. Sinon, répondez avec un plan court.

GenUI

Utilisez-le pour la génération d’interface lorsque vous souhaitez des idées d’interface utilisateur structurées à partir d’un brief produit.

Transformez ce brief produit en une mise en page de tableau de bord propre avec des sections, des actions, des états vides et des règles de validation.

Dépannage

L’API renvoie une erreur d’authentification

Confirmez que le jeton d’accès est défini dans le même shell ou runtime qui effectue la requête.

Le modèle est introuvable

Vérifiez à nouveau l’ID du modèle : mindai/macaron-v1-tall.

La requête est trop volumineuse

Commencez plus petit, puis ajoutez du contexte progressivement. Une fenêtre de 262K tokens est une capacité, pas un signal pour tout envoyer à la fois.

FAQ

Macaron V1 Tall est-il disponible sur Novita AI ?

Oui. La liste en direct le montre comme un modèle serverless.

Quel point de terminaison dois-je utiliser ?

Utilisez https://api.novita.ai/openai/v1/chat/completions.

Prend-il en charge l’utilisation d’outils ?

Vérifiez la page du modèle en direct pour les étiquettes de fonctionnalités actuelles avant de dépendre des appels d’outils en production.

Le modèle est-il gratuit actuellement ?

La liste vérifiée le 29 juillet 2026 indiquait une tarification $0 en entrée et $0 en sortie, marquée comme gratuite à durée limitée.

Articles recommandés

Sources vérifiées le 29 juillet 2026 : Bibliothèque de modèles Novita AI, Référence de l’API de complétion de chat Novita