- Wann dieser Schnellstart verwendet werden sollte
- Schritt 1: Holen Sie sich Ihren Novita-API-Schlüssel
- Schritt 2: Bestätigen Sie Modell-ID und Endpunkt
- Schritt 3: Senden Sie Ihre erste Anfrage
- Schritt 4: Lesen Sie die Antwort
- Schritt 5: Preise, Limits und häufige Fehler prüfen
- Python-Beispiel
- cURL-Beispiel
- Wichtige Parameter
- Coding-, Agents- und GenUI-Prompts
- Fehlerbehebung
- FAQ
- Empfohlene Artikel
Macaron V1 Venti ist der schnellste Weg zu Novitas Flaggschiff-Modell Macaron, wenn Sie einen Workflow mit 1M-Kontext für Coding, Agents oder GenUI benötigen. Beginnen Sie mit einer kleinen, reinen Textanfrage und skalieren Sie dann hoch, sobald Endpunkt und Authentifizierung funktionieren.
Eine umfassendere Modellübersicht finden Sie unter Macaron V1 Venti auf Novita AI.
Wann dieser Schnellstart verwendet werden sollte
Verwenden Sie diese Anleitung, wenn Ihr Workload lange Kontexte, Tool-Nutzung oder code-native UI-Generierung erfordert, anstatt kurze Chat-Antworten. Die Novita-Modellseite von Macaron V1 Venti listet serverlosen Zugriff, Funktionsaufruf und Reasoning auf, mit Texteingabe und Textausgabe.
Schritt 1: Holen Sie sich Ihren Novita-API-Schlüssel
Erstellen Sie einen Novita-API-Schlüssel und bewahren Sie ihn serverseitig auf.
export NOVITA_API_KEY="your_api_key_here"
Schritt 2: Bestätigen Sie Modell-ID und Endpunkt
| Feld | Wert |
|---|---|
| Modell-ID | mindai/macaron-v1-venti |
| Basis-URL | https://api.novita.ai/openai/v1 |
| Chat-Completions-Endpunkt | https://api.novita.ai/openai/v1/chat/completions |
| Kontextfenster | 1.048.576 Token |
| Maximale Ausgabetoken | 131.072 |
| Eingabe | Text |
| Ausgabe | Text |
| Funktionen | Serverlose API, Funktionsaufruf, Reasoning |
| Angezeigte Rate-Limit-Stufe | T1: 30 RPM, 50.000.000 TPM |
Zum Zeitpunkt der Überprüfung am 28. Juli 2026 listete Novita Macaron V1 Venti als zeitlich begrenzt kostenlos mit $0 Eingabe und $0 Ausgabe auf. Überprüfen Sie die Live-Modellseite, bevor Sie die Produktionsnutzung budgetieren.
Schritt 3: Senden Sie Ihre erste Anfrage
Beginnen Sie mit einem kurzen, reinen Text-Prompt, um Authentifizierung, Routing und Parsing zu überprüfen.
Fassen Sie die Hauptrisiken eines repository-weiten Refactorings in 5 Aufzählungspunkten zusammen.
Schritt 4: Lesen Sie die Antwort
Für standardmäßige Chat-Completions lesen Sie die Antwort aus choices[0].message.content aus. Behalten Sie Anfragemetadaten, Token-Nutzung und HTTP-Status in Ihren Logs, um später langsame oder teure Aufrufe nachverfolgen zu können.
Schritt 5: Preise, Limits und häufige Fehler prüfen
Die aktuelle Auflistung ist wichtiger als ein veralteter Blogbeitrag. Überprüfen Sie die Modellseite vor dem Start erneut, wenn Sie von kostenlosen Preisen, einer bestimmten Rate-Stufe oder dem vollen 1M-Kontextfenster abhängig sind.
Häufige Einrichtungsfehler sind:
- Verwendung des Anzeigenamens anstelle von
mindai/macaron-v1-venti. - Die SDK auf die falsche Basis-URL ausrichten.
- Senden eines riesigen Prompts, bevor die grundlegende Konnektivität bestätigt wurde.
- Annahme, dass jede Anfrage mit langem Kontext das maximale Ausgabelimit nutzen sollte.
Python-Beispiel
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
cURL-Beispiel
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Wichtige Parameter
| Parameter | Startwert | Warum wichtig |
|---|---|---|
model |
mindai/macaron-v1-venti |
Wählt das gehostete Modell aus |
messages |
Kurzer System- + Benutzer-Prompt | Überprüft schnell den API-Pfad |
temperature |
0.2 |
Hält die Testausgabe stabil |
max_tokens |
400 |
Vermeidet übermäßig große erste Antworten |
tools |
Jeweils eine Funktion | Nützlich für Agents und Workflows |
response_format |
Nur wenn Ihr Parser bereit ist | JSON vor der Auslieferung validieren |
Coding-, Agents- und GenUI-Prompts
Coding
Verwenden Sie Macaron V1 Venti für repository-bewusste Refactorings, Migrationspläne oder Code-Review-Zusammenfassungen, wenn der umgebende Kontext wichtig ist.
Überprüfen Sie dieses Modul auf Migrationsrisiken, identifizieren Sie Breaking Changes und schlagen Sie den kleinsten sicheren Patch-Plan vor.
Agents
Verwenden Sie Funktionsaufrufe, wenn das Modell ein Tool auswählen soll, anstatt direkt zu antworten.
Rufen Sie das Ticket-Lookup-Tool nur auf, wenn der Benutzer auf eine vorhandene Issue-ID verweist. Andernfalls antworten Sie mit einem kurzen Plan.
GenUI
Verwenden Sie es für die Schnittstellengenerierung, wenn Sie strukturierte UI-Ideen aus einer Produktbeschreibung wünschen.
Verwandeln Sie diese Produktbeschreibung in ein übersichtliches Dashboard-Layout mit Abschnitten, Aktionen, Leerzuständen und Validierungsregeln.
Fehlerbehebung
Die API gibt einen Authentifizierungsfehler zurück
Stellen Sie sicher, dass der Bearer-Token in derselben Shell oder Runtime gesetzt ist, die die Anfrage stellt.
Das Modell kann nicht gefunden werden
Überprüfen Sie die Modell-ID: mindai/macaron-v1-venti.
Die Anfrage ist zu groß
Beginnen Sie kleiner, dann fügen Sie schrittweise Kontext hinzu. Ein 1M-Token-Fenster ist eine Kapazität, kein Signal, alles auf einmal zu senden.
FAQ
Ist Macaron V1 Venti auf Novita AI verfügbar?
Ja. Die Live-Modellseite listet es als serverloses Modell.
Welchen Endpunkt soll ich verwenden?
Verwenden Sie https://api.novita.ai/openai/v1/chat/completions.
Unterstützt es die Tool-Nutzung?
Ja. Novita listet Funktionsaufruf als Modellfunktion.
Ist das Modell derzeit kostenlos?
Die am 28. Juli 2026 überprüfte Auflistung zeigte einen Preis von $0 für Eingabe und $0 für Ausgabe, gekennzeichnet als zeitlich begrenzt kostenlos.
Empfohlene Artikel
- Macaron V1 Venti on Novita AI: 748B Mixture-of-LoRA Flagship for Coding, Agents, and GenUI
- Macaron V1 Tall Quick Start for Coding, Agents, and GenUI
- How to Use Codex with Novita AI Models: Complete Setup Guide
Quellen, überprüft am 28. Juli 2026: Macaron V1 Venti Modellseite, Novita Chat Completions API-Referenz
