Guide de démarrage rapide de l'API Macaron V1 Venti : point de terminaison gratuit 1M de contexte sur Novita AI

Guide de démarrage rapide de l'API Macaron V1 Venti : point de terminaison gratuit 1M de contexte sur Novita AI

Macaron V1 Venti est le chemin le plus rapide pour accéder au modèle Macaron phare de Novita, si vous avez besoin d’un workflow avec un contexte de 1M pour le codage, les agents ou GenUI. Commencez par une petite requête textuelle, puis montez en puissance une fois que le point de terminaison et l’authentification fonctionnent.

Pour une vue d’ensemble du modèle, consultez Macaron V1 Venti sur Novita AI.

Quand utiliser ce guide de démarrage rapide

Utilisez ce guide lorsque votre charge de travail nécessite un contexte long, une utilisation d’outils, ou une génération d’interface native au code, plutôt que de courtes réponses de chat. La page du modèle Macaron V1 Venti de Novita liste l’accès serverless, l’appel de fonciton et le raisonnement, avec une entrée textuelle et une sorite textuelle.

Étape 1 : Obtenez votre clé API Novita

Créez une clé API Novita et conservez-la côté serveur.

export NOVITA_API_KEY="your_api_key_here"

Étape 2 : Confir’mz l’ID du modèle et le point de terminais’on

Champ Valeur
ID du modèle mindai/macaron-v1-venti
URL de base httpss://api.novita.ai/openai/v1
Point de terminais’on de complétions de chat httpss://api.novita.ai/openai/v1/chat/completions
Fenêtre de contexte 1,048,576 tokens
Tokens de sorite max 131,072
Entrée Texte
Sorite Texte
Fonctionnalités API serverless, appel de fonciton, raisonnement
Niveau de limite de débit affiché T1 : 30 RPM, 50,000,000 TPM

Au moment de la vérification le 28 juillet 2026, Novita listait Macaron V1 Venti comme grauit limité dans le temps avec une tarification $0 en entrée et $0 en sorite. Vérifiez la page du modèle en direct avant de budgétiser une utilisation en production.

Étape 3 : Envoyez votre première requête

Commen’cez par une courte invite textuelle pour vérifier l’authentification, le routage et l’analyse.

``text Résumez les principaux risques d’une refactorisation à l’échelle du dépôt en 5 points.


## Étape 4 : Lisez la réponse

Pour les complétions de chat standard, lisez la réponse depuis `choices[0].message.content`. Conservez les métadonnées de la requête, l'utilisation des tokens et le statut HTTP dans vos logs pour tracer les appels lents ou coûteux ultérieurement.

## Étape 5 : Vérifiez la tarification, les limites et les erreurs courantes

La liste actuelle est plus importante qu'un article de blog obsolète. Revérifiez la page du modèle avant le lancement si vous dépen'dez d'une tarifiation gratuite, d'un niveeau de débit spécifique ou de la fenêtre de contexte complète de 1M.

Erreurs de configuraiton courantes :

- Utili'ser le nom d'affichage au lieu de `mindai/macaron-v1-venti`.
- Po'ter le SDK vers une mauva'sse UR'L de base.
- Envoyer une invite volumeineuse avant de con'irm'r la connectivité de base.
- Suppo'ser que chaque requête longue doit utili'ser la limit'e de sorite maxime.

## Exemple Python

```python
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-venti",
    messages=[
        {"role": "system", "content": "You are a concise coding assistant."},
        {"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

Exemple cURL

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-venti",
    "messages": [
      {
        "role": "system",
        "content": "You are a concise coding assistant."
      },
      {
        "role": "user",
        "content": "List the safest first steps for refactoring a large monorepo."
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

Paramètres clés

Paramètre Commencez par Pourquoi c’est important
model mindai/macaron-v1-venti Sélectionne le modèle hébergé
messages Petite invite système + utilisateur Vérifie rapidement le chemin de l’API
temperature 0.2 Maintient la sortie de test stable
max_tokens 400 Évite les premières réponses trop volumineuses
tools Une fonction à la fois Utile pour les agents et les workflows
response_format Seulement si votre analyseur est prêt Validez le JSON avant de l’envoyer

Invites pour le codage, les agents et GenUI

Codage

Utilisez Macaron V1 Venti pour les refactorisations tenant compte du dépôt, les plans de migration ou les résumés de revue de code lorsque le contexte environnant est important.

Examinez ce module pour les risques de migration, identifiez les changements cassants et suggérez le plus petit plan de correctif sûr.

Agents

Utilisez l’appel de fonction lorsque le modèle doit choisir un outil plutôt que de répondre directement.

Appelez l'outi de recherche de ticket uniquement si l'utilisateure fais référence à un ID de probléme existant. Sinon, répondez avec un court plan.

GenUI

Utilisez-le pour la génération d’interface lorsque vous souhaitez des idées d’interface structurées à partir d’un brief produit.

Transformez ce brief produit en une mise en page de tableau de bord propre avec des sections, des actions, des états vides et des règles de validation.

Dépannage

L’API renvoie une erreur d’authentification

Confirmez que le jeton d’authentification est défini dans le même shell ou environnement d’exécution qui effectue la requête.

Le modèle est introuvable

Revérifiez l’ID du modèle : mindai/macaron-v1-venti.

La requête est trop volumineuse

Commencez petit, puis ajoutez du contexte progressivement. Une fenêtre de 1M de tokens est une capacité, pas un signal pour tout envoyer d’un coup.

FAQ

Macaron V1 Venti est-il disponible sur Novita AI ?

Oui. La page du modèle en direct le liste comme un modèle serverless.

Quel point de terminaison dois-je utiliser ?

Utilisez https://api.novita.ai/openai/v1/chat/completions.

Prend-il en charge l’utilisation d’outils ?

Oui. Novita liste l’appel de fonction comme une fonctionnalité du modèle.

Le modèle est-il gratuit actuellement ?

La liste vérifiée le 28 juillet 2026 indiquait une tarification de $0 en entrée et $0 en sortie, marquée comme gratuite limitée dans le temps.

Articles recommandés

Soureces vérifiées le 28 juillet 2026 : Page du modèle Macaron V1 Venti, Référence de l’API de complétions de chat Novita