Démarrage rapide de Macaron V1 Tall sur Novita AI : première requête, endpoint et contexte gratuit de 262K

Démarrage rapide de Macaron V1 Tall sur Novita AI : première requête, endpoint et contexte gratuit de 262K

Macaron V1 Tall est l’option Macaron plus légère lorsque vous souhaitez un contexte long sans passer directement au modèle phare. Utilisez-le pour le codage, les boucles d’agent ou les invites GenUI, et commencez par une petite requête textuelle avant de passer à des workflows plus longs.

Si vous choisissez la stack de codage Python associée, comparez Meilleures IA pour coder en Python en 2026.

Pour une vue d’ensemble du modèle, consultez Macaron V1 Tall sur Novita AI.

Pour la comparaison avec le modèle phare, consultez Macaron V1 Venti sur Novita AI.

Quand utiliser ce démarrage rapide

Utilisez ce guide lorsque votre charge de travail nécessite suffisamment de contexte pour contenir l’état du dépôt, les traces d’outils ou les spécifications UI, sans avoir besoin de la plus grande fenêtre de contexte du catalogue.

Étape 1 : Obtenez votre clé API Novita

Créez une clé API Novita et conservez-la côté serveur.

export NOVITA_API_KEY="your_api_key_here"

Étape 2 : Confirmez l’ID de modèle et l’endpoint

Champ Valeur
Identifiant du modèle mindai/macaron-v1-tall
URL de base https://api.novita.ai/openai/v1
Point de terminaison des chat completions https://api.novita.ai/openai/v1/chat/completions
Fenêtre de contexte 262 144 jetons
Jetons de sortie max 32 768
Entrée Texte
Sortie Texte
Hébergement API serverless Novita AI

Au moment de la vérification du 29 juillet 2026, Novita listait Macaron V1 Tall comme gratuit à durée limitée avec une tarification à 0 $ en entrée et 0 $ en sortie. Vérifiez la page du modèle en direct avant de budgétiser une utilisation en production.

Étape 3 : Envoyez votre première requête

Commencez par une invite courte, uniquement textuelle, pour vérifier l’authentification, le routage et l’analyse.

Summarize the main risks in a repository-wide refactor in 5 bullet points.

Étape 4 : Lisez la réponse

Pour les chat completions standard, lisez la réponse dans choices[0].message.content. Conservez les métadonnées de requête, l’utilisation des jetons et le statut HTTP dans vos journaux pour pouvoir retracer les appels lents ou coûteux ultérieurement.

Étape 5 : Vérifiez la tarification, les limites et les erreurs courantes

La fiche actuelle du modèle est plus fiable qu’un billet de blog obsolète. Revérifiez la page du modèle avant le lancement si vous dépendez de la gratuité ou de la fenêtre complète de 262K de contexte.

Les erreurs de configuration courantes incluent :

  • Utiliser le nom d’affichage au lieu de mindai/macaron-v1-tall.
  • Pointer le SDK vers une mauvaise URL de base.
  • Envoyer une invite énorme avant de confirmer la connectivité de base.
  • Supposer que chaque requête en contexte long doit utiliser la limite maximale de sortie.

Exemple Python

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-tall",
    messages=[
        {"role": "system", "content": "You are a concise coding assistant."},
        {"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

Exemple cURL

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-tall",
    "messages": [
      {
        "role": "system",
        "content": "You are a concise coding assistant."
      },
      {
        "role": "user",
        "content": "List the safest first steps for refactoring a large monorepo."
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

Paramètres clés

Paramètre Valeur de départ Pourquoi c’est important
model mindai/macaron-v1-tall Sélectionne le modèle hébergé
messages Invite système + utilisateur courte Vérifie rapidement le chemin API
temperature 0.2 Maintient la stabilité des sorties de test
max_tokens 400 Évite des premières réponses trop grandes
tools Un outil à la fois Utile pour les agents et les workflows
response_format Uniquement si votre analyseur est prêt Validez le JSON avant la mise en production

Codage, agents et invites GenUI

Codage

Utilisez Macaron V1 Tall pour les refactorisations tenant compte du dépôt, les plans de migration ou les synthèses de revue de code lorsque le contexte environnant est important.

Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.

Agents

Utilisez l’appel de fonction lorsque le modèle doit choisir un outil plutôt que de répondre directement.

Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.

GenUI

Utilisez-le pour la génération d’interface lorsque vous souhaitez des idées d’interface structurées à partir d’un brief produit.

Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.

Dépannage

L’API renvoie une erreur d’authentification

Confirmez que le jeton porteur est défini dans le même shell ou runtime qui effectue la requête.

Le modèle est introuvable

Revérifiez l’ID du modèle : mindai/macaron-v1-tall.

La requête est trop volumineuse

Commencez plus petit, puis ajoutez du contexte progressivement. Une fenêtre de 262K jetons est une capacité, pas un signal pour tout envoyer d’un coup.

FAQ

Macaron V1 Tall est-il disponible sur Novita AI ?

Oui. La fiche en direct le présente comme un modèle serverless.

Quel endpoint dois-je utiliser ?

Utilisez https://api.novita.ai/openai/v1/chat/completions.

Prend-il en charge l’utilisation d’outils ?

Vérifiez les étiquettes de fonctionnalité actuelles sur la page du modèle en direct avant de dépendre des appels d’outils en production.

Le modèle est-il gratuit actuellement ?

La fiche consultée le 29 juillet 2026 affichait une tarification à 0 $ en entrée et 0 $ en sortie, marquée comme gratuite à durée limitée.

Articles recommandés

Sources vérifiées le 29 juillet 2026 : bibliothèque de modèles Novita AI, référence API chat completions de Novita