- Wann dieser Quick Start verwendet werden sollte
- Schritt 1: Holen Sie sich Ihren Novita-API-Schlüssel
- Schritt 2: Bestätigen Sie Modell-ID und Endpunkt
- Schritt 3: Senden Sie Ihre erste Anfrage
- Schritt 4: Lesen Sie die Antwort
- Schritt 5: Überprüfen Sie Preisgestaltung, Limits und häufige Fehler
- Python-Beispiel
- cURL-Beispiel
- Wichtige Parameter
- Coding-, Agents- und GenUI-Prompts
- Fehlerbehebung
- FAQ
- Empfohlene Artikel
Macaron V1 Venti ist der schnellste Weg zu Novitas Flaggschiff-Modell Macaron, wenn Sie einen 1M-Kontext-Workflow für Coding, Agents oder GenUI benötigen. Beginnen Sie mit einer kleinen, rein textbasierten Anfrage und skalieren Sie dann hoch, sobald Endpunkt und Authentifizierung funktionieren.
Eine umfassende Modellübersicht finden Sie unter Macaron V1 Venti auf Novita AI.
Wann dieser Quick Start verwendet werden sollte
Verwenden Sie diesen Leitfaden, wenn Ihre Arbeitslast einen langen Kontext, Tool-Nutzung oder code-native UI-Generierung erfordert – nicht nur kurze Chat-Antworten. Die Novita-Modellseite von Macaron V1 Venti listet serverlosen Zugriff, Function Calling und Reasoning sowie Texteingabe und Textausgabe auf.
Schritt 1: Holen Sie sich Ihren Novita-API-Schlüssel
Erstellen Sie einen Novita-API-Schlüssel und bewahren Sie ihn serverseitig auf.
export NOVITA_API_KEY="your_api_key_here"
Schritt 2: Bestätigen Sie Modell-ID und Endpunkt
| Feld | Wert |
|---|---|
| Modell-ID | mindai/macaron-v1-venti |
| Basis-URL | https://api.novita.ai/openai/v1 |
| Chat-Completions-Endpunkt | https://api.novita.ai/openai/v1/chat/completions |
| Kontextfenster | 1.048.576 Token |
| Maximale Ausgabe-Token | 131.072 |
| Eingabe | Text |
| Ausgabe | Text |
| Funktionen | Serverlose API, Function Calling, Reasoning |
| Rate-Limit-Stufe (angezeigt) | T1: 30 RPM, 50.000.000 TPM |
Zum Zeitpunkt der Überprüfung am 28. Juli 2026 listete Novita Macaron V1 Venti als zeitlich begrenzt kostenlos mit 0 $ Eingabe und 0 $ Ausgabe Preisgestaltung. Überprüfen Sie die aktuelle Modellseite, bevor Sie die Produktionsnutzung budgetieren.
Schritt 3: Senden Sie Ihre erste Anfrage
Beginnen Sie mit einem kurzen, reinen Text-Prompt, um Authentifizierung, Routing und Parsing zu überprüfen.
Fasse die Hauptrisiken eines repository-weiten Refactorings in 5 Aufzählungspunkten zusammen.
Schritt 4: Lesen Sie die Antwort
Bei Standard-Chat-Completions lesen Sie die Antwort aus choices[0].message.content. Protokollieren Sie Anfrage-Metadaten, Token-Verbrauch und HTTP-Status, damit Sie später langsame oder teure Aufrufe nachverfolgen können.
Schritt 5: Überprüfen Sie Preisgestaltung, Limits und häufige Fehler
Die aktuelle Auflistung ist wichtiger als ein veralteter Blogbeitrag. Überprüfen Sie die Modellseite vor dem Start erneut, wenn Sie auf kostenlose Preisgestaltung, eine bestimmte Rate-Stufe oder das volle 1M-Kontextfenster angewiesen sind.
Häufige Einrichtungsfehler sind:
- Verwendung des Anzeigenamens anstelle von
mindai/macaron-v1-venti. - Das SDK auf die falsche Basis-URL ausrichten.
- Senden eines riesigen Prompts, bevor die grundlegende Konnektivität bestätigt wurde.
- Annahme, dass jede Anfrage mit langem Kontext das maximale Ausgabelimit nutzen sollte.
Python-Beispiel
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
cURL-Beispiel
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Wichtige Parameter
| Parameter | Starten mit | Warum wichtig |
|---|---|---|
model |
mindai/macaron-v1-venti |
Wählt das gehostete Modell aus |
messages |
Kurzer System- + User-Prompt | Überprüft schnell den API-Pfad |
temperature |
0.2 |
Hält Testausgaben stabil |
max_tokens |
400 |
Vermeidet übermäßig große erste Antworten |
tools |
Eine Funktion nach der anderen | Nützlich für Agents und Workflows |
response_format |
Nur wenn Ihr Parser bereit ist | JSON vor dem Ausliefern validieren |
Coding-, Agents- und GenUI-Prompts
Coding
Nutzen Sie Macaron V1 Venti für repository-bewusste Refactorings, Migrationspläne oder Code-Review-Zusammenfassungen, wenn der umgebende Kontext wichtig ist.
Überprüfe dieses Modul auf Migrationsrisiken, identifiziere Breaking Changes und schlage den kleinstmöglichen sicheren Patch-Plan vor.
Agents
Verwenden Sie Function Calling, wenn das Modell ein Tool auswählen soll, anstatt direkt zu antworten.
Rufe das Ticket-Lookup-Tool nur auf, wenn der Benutzer eine vorhandene Issue-ID erwähnt. Ansonsten antworte mit einem kurzen Plan.
GenUI
Nutzen Sie es zur Schnittstellengenerierung, wenn Sie strukturierte UI-Ideen aus einer Produktbeschreibung wünschen.
Wandle diese Produktbeschreibung in ein sauberes Dashboard-Layout mit Abschnitten, Aktionen, Leerzuständen und Validierungsregeln um.
Fehlerbehebung
Die API gibt einen Authentifizierungsfehler zurück
Stellen Sie sicher, dass der Bearer-Token in derselben Shell oder Runtime gesetzt ist, die die Anfrage ausführt.
Das Modell kann nicht gefunden werden
Überprüfen Sie die Modell-ID: mindai/macaron-v1-venti.
Die Anfrage ist zu groß
Fangen Sie kleiner an und fügen Sie dann schrittweise Kontext hinzu. Ein 1M-Token-Fenster ist eine Kapazität, kein Signal, alles auf einmal zu senden.
FAQ
Ist Macaron V1 Venti auf Novita AI verfügbar?
Ja. Die aktuelle Modellseite listet es als serverloses Modell.
Welchen Endpunkt soll ich verwenden?
Verwenden Sie https://api.novita.ai/openai/v1/chat/completions.
Unterstützt es die Nutzung von Tools?
Ja. Novita listet Function Calling als Modellfunktion.
Ist das Modell derzeit kostenlos?
Die am 28. Juli 2026 überprüfte Auflistung zeigte eine Preisgestaltung von 0 $ Eingabe und 0 $ Ausgabe, gekennzeichnet als zeitlich begrenzt kostenlos.
Empfohlene Artikel
- Macaron V1 Venti auf Novita AI: 748B Mixture-of-LoRA Flaggschiff für Coding, Agents und GenUI
- Macaron V1 Tall Quick Start für Coding, Agents und GenUI
- Wie man Codex mit Novita AI Modellen verwendet: Vollständige Einrichtungsanleitung
Quellen überprüft am 28. Juli 2026: Macaron V1 Venti Modellseite, Novita Chat Completions API Referenz
