- Quand utiliser ce guide de démarrage rapide
- Étape 1 : Obtenez votre clé API Novita
- Étape 2 : Vérifiez l'ID du modèle et l'endpoint
- Étape 3 : Envoyez votre première requête
- Étape 4 : Lisez la réponse
- Étape 5 : Vérifiez les tarifs, les limites et les erreurs courantes
- Exemple Python
- Exemple cURL
- Paramètres clés
- Invites pour le codage, les agents et GenUI
- Dépannage
- FAQ
- Articles recommandés
Macaron V1 Venti est le chemin le plus rapide vers le modèle Macaron phare de Novita si vous avez besoin d’un workflow avec contexte de 1M pour le codage, les agents ou GenUI. Commencez par une petite requête textuelle, puis montez en charge une fois que l’endpoint et l’authentification fonctionnent.
Pour une vue d’ensemble du modèle, consultez Macaron V1 Venti sur Novita AI.
Quand utiliser ce guide de démarrage rapide
Utilisez ce guide lorsque votre charge de travail nécessite un contexte long, l’utilisation d’outils ou la génération d’UI native au code, plutôt que de courtes réponses de chat. La page du modèle Macaron V1 Venti sur Novita répertorie l’accès serverless, l’appel de fonctions et le raisonnement, avec entrée et sortie de texte.
Étape 1 : Obtenez votre clé API Novita
Créez une clé API Novita et conservez-la côté serveur.
export NOVITA_API_KEY="your_api_key_here"
Étape 2 : Vérifiez l’ID du modèle et l’endpoint
| Champ | Valeur |
|---|---|
| ID du modèle | mindai/macaron-v1-venti |
| URL de base | https://api.novita.ai/openai/v1 |
| Endpoint de chat completions | https://api.novita.ai/openai/v1/chat/completions |
| Fenêtre de contexte | 1 048 576 tokens |
| Max de tokens de sortie | 131 072 |
| Entrée | Texte |
| Sortie | Texte |
| Fonctionnalités | API serverless, appel de fonctions, raisonnement |
| Niveau de limite de débit affiché | T1 : 30 RPM, 50 000 000 TPM |
Au moment de la vérification le 28 juillet 2026, Novita proposait Macaron V1 Venti en gratuit limité dans le temps, avec un tarif de 0 $ en entrée et 0 $ en sortie. Vérifiez la page du modèle en direct avant de budgétiser une utilisation en production.
Étape 3 : Envoyez votre première requête
Commencez par une invite textuelle courte pour vérifier l’authentification, le routage et l’analyse.
Summarize the main risks in a repository-wide refactor in 5 bullet points.
Étape 4 : Lisez la réponse
Pour les chat completions standard, lisez la réponse depuis choices[0].message.content. Conservez les métadonnées de requête, l’utilisation de tokens et le statut HTTP dans vos journaux afin de pouvoir tracer plus tard les appels lents ou coûteux.
Étape 5 : Vérifiez les tarifs, les limites et les erreurs courantes
La fiche actuelle est plus importante qu’un article de blog obsolète. Revérifiez la page du modèle avant le lancement si vous dépendez de la gratuité, d’un niveau de débit spécifique ou de la fenêtre de contexte complète de 1M.
Les erreurs de configuration courantes incluent :
- Utiliser le nom d’affichage au lieu de
mindai/macaron-v1-venti. - Pointer le SDK vers une mauvaise URL de base.
- Envoyer une invite énorme avant de confirmer la connectivité de base.
- Supposer que chaque requête à contexte long doit utiliser la limite maximale de sortie.
Exemple Python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Exemple cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Paramètres clés
| Paramètre | Commencez par | Pourquoi c’est important |
|---|---|---|
model |
mindai/macaron-v1-venti |
Sélectionne le modèle hébergé |
messages |
Invite système + utilisateur courte | Vérifie rapidement le chemin de l’API |
temperature |
0.2 |
Maintient la stabilité des sorties de test |
max_tokens |
400 |
Évite des premières réponses trop volumineuses |
tools |
Une fonction à la fois | Utile pour les agents et les workflows |
response_format |
Uniquement si votre analyseur est prêt | Validez le JSON avant de déployer |
Invites pour le codage, les agents et GenUI
Codage
Utilisez Macaron V1 Venti pour des refactorisations conscientes du dépôt, des plans de migration ou des résumés de revue de code lorsque le contexte environnant compte.
Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.
Agents
Utilisez l’appel de fonctions lorsque le modèle doit choisir un outil au lieu de répondre directement.
Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.
GenUI
Utilisez-le pour la génération d’interfaces lorsque vous souhaitez des idées d’UI structurées à partir d’un brief produit.
Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.
Dépannage
L’API renvoie une erreur d’authentification
Vérifiez que le jeton d’accès (bearer token) est défini dans le même shell ou runtime qui effectue la requête.
Le modèle est introuvable
Revérifiez l’ID du modèle : mindai/macaron-v1-venti.
La requête est trop volumineuse
Commencez plus petit, puis ajoutez du contexte progressivement. Une fenêtre de 1M tokens est une capacité, pas un signal pour tout envoyer d’un coup.
FAQ
Macaron V1 Venti est-il disponible sur Novita AI ?
Oui. La page du modèle en direct le répertorie comme modèle serverless.
Quel endpoint dois-je utiliser ?
Utilisez https://api.novita.ai/openai/v1/chat/completions.
Prend-il en charge l’utilisation d’outils ?
Oui. Novita répertorie l’appel de fonctions comme une fonctionnalité du modèle.
Le modèle est-il gratuit actuellement ?
La fiche vérifiée le 28 juillet 2026 affichait un tarif de 0 $ en entrée et 0 $ en sortie, marqué comme gratuit limité dans le temps.
Articles recommandés
- Macaron V1 Venti sur Novita AI : flagship 748B Mixture-of-LoRA pour le codage, les agents et GenUI
- Démarrage rapide de Macaron V1 Tall pour le codage, les agents et GenUI
- Comment utiliser Codex avec les modèles Novita AI : guide de configuration complet
Sources vérifiées le 28 juillet 2026 : page du modèle Macaron V1 Venti, référence API des chat completions Novita
