Guide de démarrage rapide de Macaron V1 Venti pour le codage, les agents et GenUI

Guide de démarrage rapide de Macaron V1 Venti pour le codage, les agents et GenUI

Macaron V1 Venti est disponible sur Novita AI via l’API de chat complétions compatible OpenAI. Utilisez-le lorsque vous avez besoin d’une très large fenêtre de contexte pour le codage, les boucles d’agents ou les prompts GenUI, et commencez par une petite requête textuelle avant de passer à des workflows plus longs.

Pour une vue d’ensemble du modèle, consultez Macaron V1 Venti on Novita AI.

Quand utiliser ce guide de démarrage rapide

Utilisez ce guide lorsque votre charge de travail nécessite un contexte long, l’utilisation d’outils ou la génération d’UI native par code plutôt que de courtes réponses de chat. La page du modèle Macaron V1 Venti sur Novita répertorie l’accès serverless, l’appel de fonctions et le raisonnement, avec une entrée textuelle et une sortie textuelle.

Étape 1 : Obtenez votre clé API Novita

Créez une clé API Novita et conservez-la côté serveur.

export NOVITA_API_KEY="your_api_key_here"

Étape 2 : Confirmez l’ID du modèle et l’endpoint

Champ Valeur
ID du modèle mindai/macaron-v1-venti
URL de base https://api.novita.ai/openai/v1
Endpoint de chat complétions https://api.novita.ai/openai/v1/chat/completions
Fenêtre de contexte 1 048 576 tokens
Tokens max en sortie 131 072
Entrée Texte
Sortie Texte
Fonctionnalités API serverless, appel de fonctions, raisonnement
Niveau de limite de débit affiché T1 : 30 RPM, 50 000 000 TPM

Au moment de la vérification le 28 juillet 2026, Novita a répertorié Macaron V1 Venti comme gratuit à durée limitée avec une tarification $0 en entrée et $0 en sortie. Vérifiez la page du modèle en direct avant de budgétiser une utilisation en production.

Étape 3 : Envoyez votre première requête

Commencez par un court prompt textuel pour vérifier l’authentification, le routage et l’analyse.

Summarize the main risks in a repository-wide refactor in 5 bullet points.

Étape 4 : Lisez la réponse

Pour les chat complétions standard, lisez la réponse depuis choices[0].message.content. Conservez les métadonnées de la requête, l’utilisation des tokens et le statut HTTP dans vos logs afin de pouvoir tracer ultérieurement les appels lents ou coûteux.

Étape 5 : Vérifiez la tarification, les limites et les erreurs courantes

La liste actuelle est plus importante qu’un article de blog obsolète. Revérifiez la page du modèle avant le lancement si vous dépendez d’une tarification gratuite, d’un niveau de débit spécifique ou de la fenêtre de contexte complète de 1M.

Les erreurs de configuration courantes incluent :

  • Utiliser le nom d’affichage au lieu de mindai/macaron-v1-venti.
  • Pointer le SDK vers la mauvaise URL de base.
  • Envoyer un prompt énorme avant de confirmer la connectivité de base.
  • Supposer que chaque requête à contexte long doit utiliser la capacité de sortie maximale.

Exemple en Python

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-venti",
    messages=[
        {"role": "system", "content": "You are a concise coding assistant."},
        {"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

Exemple en cURL

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-venti",
    "messages": [
      {
        "role": "system",
        "content": "You are a concise coding assistant."
      },
      {
        "role": "user",
        "content": "List the safest first steps for refactoring a large monorepo."
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

Paramètres clés

Paramètre Commencez par Pourquoi c’est important
model mindai/macaron-v1-venti Sélectionne le modèle hébergé
messages Prompt système + utilisateur court Vérifie rapidement le chemin de l’API
temperature 0.2 Maintient la sortie de test stable
max_tokens 400 Évite les premières réponses trop volumineuses
tools Une fonction à la fois Utile pour les agents et les workflows
response_format Seulement si votre analyseur est prêt Validez le JSON avant de déployer

Prompts pour le codage, les agents et GenUI

Codage

Utilisez Macaron V1 Venti pour des refactoring tenant compte du dépôt, des plans de migration ou des résumés de révision de code lorsque le contexte environnant est important.

Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.

Agents

Utilisez l’appel de fonctions lorsque le modèle doit choisir un outil plutôt que de répondre directement.

Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.

GenUI

Utilisez-le pour la génération d’interface lorsque vous souhaitez des idées d’UI structurées à partir d’un brief produit.

Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.

Dépannage

L’API renvoie une erreur d’authentification

Confirmez que le jeton bearer est défini dans le même shell ou environnement d’exécution qui effectue la requête.

Le modèle est introuvable

Revérifiez l’ID du modèle : mindai/macaron-v1-venti.

La requête est trop volumineuse

Commencez plus petit, puis ajoutez du contexte progressivement. Une fenêtre de 1M tokens est une capacité, pas un signal pour tout envoyer d’un coup.

FAQ

Macaron V1 Venti est-il disponible sur Novita AI ?

Oui. La page du modèle en direct le répertorie comme un modèle serverless.

Quel endpoint dois-je utiliser ?

Utilisez https://api.novita.ai/openai/v1/chat/completions.

Prend-il en charge l’utilisation d’outils ?

Oui. Novita répertorie l’appel de fonctions comme une fonctionnalité du modèle.

Le modèle est-il gratuit actuellement ?

La liste vérifiée le 28 juillet 2026 indiquait une tarification de $0 en entrée et $0 en sortie, marquée comme gratuite à durée limitée.

Articles recommandés

Sources vérifiées le 28 juillet 2026 : Macaron V1 Venti model page, Novita chat completions API reference