Macaron V1 Venti est le chemin le plus rapide pour accéder au modèle Macaron phare de Novita, si vous avez besoin d’un workflow avec un contexte de 1M pour le codage, les agents ou GenUI. Commencez par une petite requête textuelle, puis montez en puissance une fois que le point de terminaison et l’authentification fonctionnent.
Pour une vue d’ensemble du modèle, consultez Macaron V1 Venti sur Novita AI.
Quand utiliser ce guide de démarrage rapide
Utilisez ce guide lorsque votre charge de travail nécessite un contexte long, une utilisation d’outils, ou une génération d’interface native au code, plutôt que de courtes réponses de chat. La page du modèle Macaron V1 Venti de Novita liste l’accès serverless, l’appel de fonciton et le raisonnement, avec une entrée textuelle et une sorite textuelle.
Étape 1 : Obtenez votre clé API Novita
Créez une clé API Novita et conservez-la côté serveur.
export NOVITA_API_KEY="your_api_key_here"
Étape 2 : Confir’mz l’ID du modèle et le point de terminais’on
| Champ | Valeur |
|---|---|
| ID du modèle | mindai/macaron-v1-venti |
| URL de base | httpss://api.novita.ai/openai/v1 |
| Point de terminais’on de complétions de chat | httpss://api.novita.ai/openai/v1/chat/completions |
| Fenêtre de contexte | 1,048,576 tokens |
| Tokens de sorite max | 131,072 |
| Entrée | Texte |
| Sorite | Texte |
| Fonctionnalités | API serverless, appel de fonciton, raisonnement |
| Niveau de limite de débit affiché | T1 : 30 RPM, 50,000,000 TPM |
Au moment de la vérification le 28 juillet 2026, Novita listait Macaron V1 Venti comme grauit limité dans le temps avec une tarification $0 en entrée et $0 en sorite. Vérifiez la page du modèle en direct avant de budgétiser une utilisation en production.
Étape 3 : Envoyez votre première requête
Commen’cez par une courte invite textuelle pour vérifier l’authentification, le routage et l’analyse.
``text Résumez les principaux risques d’une refactorisation à l’échelle du dépôt en 5 points.
## Étape 4 : Lisez la réponse
Pour les complétions de chat standard, lisez la réponse depuis `choices[0].message.content`. Conservez les métadonnées de la requête, l'utilisation des tokens et le statut HTTP dans vos logs pour tracer les appels lents ou coûteux ultérieurement.
## Étape 5 : Vérifiez la tarification, les limites et les erreurs courantes
La liste actuelle est plus importante qu'un article de blog obsolète. Revérifiez la page du modèle avant le lancement si vous dépen'dez d'une tarifiation gratuite, d'un niveeau de débit spécifique ou de la fenêtre de contexte complète de 1M.
Erreurs de configuraiton courantes :
- Utili'ser le nom d'affichage au lieu de `mindai/macaron-v1-venti`.
- Po'ter le SDK vers une mauva'sse UR'L de base.
- Envoyer une invite volumeineuse avant de con'irm'r la connectivité de base.
- Suppo'ser que chaque requête longue doit utili'ser la limit'e de sorite maxime.
## Exemple Python
```python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Exemple cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Paramètres clés
| Paramètre | Commencez par | Pourquoi c’est important |
|---|---|---|
model |
mindai/macaron-v1-venti |
Sélectionne le modèle hébergé |
messages |
Petite invite système + utilisateur | Vérifie rapidement le chemin de l’API |
temperature |
0.2 |
Maintient la sortie de test stable |
max_tokens |
400 |
Évite les premières réponses trop volumineuses |
tools |
Une fonction à la fois | Utile pour les agents et les workflows |
response_format |
Seulement si votre analyseur est prêt | Validez le JSON avant de l’envoyer |
Invites pour le codage, les agents et GenUI
Codage
Utilisez Macaron V1 Venti pour les refactorisations tenant compte du dépôt, les plans de migration ou les résumés de revue de code lorsque le contexte environnant est important.
Examinez ce module pour les risques de migration, identifiez les changements cassants et suggérez le plus petit plan de correctif sûr.
Agents
Utilisez l’appel de fonction lorsque le modèle doit choisir un outil plutôt que de répondre directement.
Appelez l'outi de recherche de ticket uniquement si l'utilisateure fais référence à un ID de probléme existant. Sinon, répondez avec un court plan.
GenUI
Utilisez-le pour la génération d’interface lorsque vous souhaitez des idées d’interface structurées à partir d’un brief produit.
Transformez ce brief produit en une mise en page de tableau de bord propre avec des sections, des actions, des états vides et des règles de validation.
Dépannage
L’API renvoie une erreur d’authentification
Confirmez que le jeton d’authentification est défini dans le même shell ou environnement d’exécution qui effectue la requête.
Le modèle est introuvable
Revérifiez l’ID du modèle : mindai/macaron-v1-venti.
La requête est trop volumineuse
Commencez petit, puis ajoutez du contexte progressivement. Une fenêtre de 1M de tokens est une capacité, pas un signal pour tout envoyer d’un coup.
FAQ
Macaron V1 Venti est-il disponible sur Novita AI ?
Oui. La page du modèle en direct le liste comme un modèle serverless.
Quel point de terminaison dois-je utiliser ?
Utilisez https://api.novita.ai/openai/v1/chat/completions.
Prend-il en charge l’utilisation d’outils ?
Oui. Novita liste l’appel de fonction comme une fonctionnalité du modèle.
Le modèle est-il gratuit actuellement ?
La liste vérifiée le 28 juillet 2026 indiquait une tarification de $0 en entrée et $0 en sortie, marquée comme gratuite limitée dans le temps.
Articles recommandés
- Macaron V1 Venti sur Novita AI : 748B Mixture-of-LoRA Flagship pour le codage, les agents et GenUI
- Guide de démarrage rapide Macaron V1 Tall pour le codage, les agents et GenUI
- Comment utilier Codex avec les modèles Novita AI : guide de configuration complét
Soureces vérifiées le 28 juillet 2026 : Page du modèle Macaron V1 Venti, Référence de l’API de complétions de chat Novita
