- Wann dieser Schnellstart verwendet werden sollte
- Schritt 1: Holen Sie sich Ihren Novita-API-Schlüssel
- Schritt 2: Bestätigen Sie Modell-ID und Endpunkt
- Schritt 3: Senden Sie Ihre erste Anfrage
- Schritt 4: Lesen Sie die Antwort
- Schritt 5: Überprüfen Sie Preise, Limits und häufige Fehler
- Python-Beispiel
- cURL-Beispiel
- Wichtige Parameter
- Coding, Agents und GenUI-Prompts
- Troubleshooting
- FAQ
- Empfohlene Artikel
Macaron V1 Venti ist auf Novita AI über die OpenAI-kompatible Chat-Completions-API verfügbar. Verwenden Sie es, wenn Sie ein sehr großes Kontextfenster für Coding, Agenten-Loops oder GenUI-Prompts benötigen, und beginnen Sie mit einer kleinen, reinen Textanfrage, bevor Sie zu längeren Workflows erweitern.
Für den breiteren Modellüberblick siehe Macaron V1 Venti auf Novita AI.
Wann dieser Schnellstart verwendet werden sollte
Verwenden Sie diesen Leitfaden, wenn Ihr Workload langes Kontext, Tool-Nutzung oder code-native UI-Generierung statt kurzer Chat-Antworten benötigt. Die Novita-Modellseite von Macaron V1 Venti listet serverlosen Zugriff, Funktionsaufruf und Reasoning auf, mit Texteingabe und Textausgabe.
Schritt 1: Holen Sie sich Ihren Novita-API-Schlüssel
Erstellen Sie einen Novita-API-Schlüssel und bewahren Sie ihn serverseitig auf.
export NOVITA_API_KEY="your_api_key_here"
Schritt 2: Bestätigen Sie Modell-ID und Endpunkt
| Feld | Wert |
|---|---|
| Modell-ID | mindai/macaron-v1-venti |
| Basis-URL | https://api.novita.ai/openai/v1 |
| Chat-Completions-Endpunkt | https://api.novita.ai/openai/v1/chat/completions |
| Kontextfenster | 1.048.576 Token |
| Maximale Ausgabetoken | 131.072 |
| Eingabe | Text |
| Ausgabe | Text |
| Funktionen | Serverlose API, Funktionsaufruf, Reasoning |
| Angezeigte Ratenlimit-Stufe | T1: 30 RPM, 50.000.000 TPM |
Zum Zeitpunkt der Überprüfung am 28. Juli 2026 listete Novita Macaron V1 Venti als zeitlich begrenzt kostenlos mit $0 Eingabe und $0 Ausgabe Preisen. Überprüfen Sie die aktuelle Modellseite, bevor Sie die Produktion budgetieren.
Schritt 3: Senden Sie Ihre erste Anfrage
Beginnen Sie mit einem kurzen, reinen Text-Prompt, um Authentifizierung, Routing und Parsing zu überprüfen.
Summarize the main risks in a repository-wide refactor in 5 bullet points.
Schritt 4: Lesen Sie die Antwort
Für standardmäßige Chat-Completions lesen Sie die Antwort aus choices[0].message.content. Behalten Sie Anfrage-Metadaten, Token-Verbrauch und HTTP-Status in Ihren Logs, um später langsame oder teure Aufrufe nachverfolgen zu können.
Schritt 5: Überprüfen Sie Preise, Limits und häufige Fehler
Die aktuelle Listung ist wichtiger als ein veralteter Blogbeitrag. Überprüfen Sie die Modellseite vor dem Start erneut, wenn Sie von kostenlosen Preisen, einer bestimmten Tarifstufe oder dem vollen 1M-Kontextfenster abhängig sind.
Häufige Einrichtungsfehler sind:
- Verwendung des Anzeigenamens anstelle von
mindai/macaron-v1-venti. - Das SDK auf die falsche Basis-URL verweisen.
- Senden eines riesigen Prompts, bevor die grundlegende Konnektivität bestätigt wurde.
- Annahme, dass jede Langkontext-Anfrage das maximale Ausgabelimit nutzen sollte.
Python-Beispiel
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
cURL-Beispiel
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Wichtige Parameter
| Parameter | Beginnen Sie mit | Warum es wichtig ist |
|---|---|---|
model |
mindai/macaron-v1-venti |
Wählt das gehostete Modell |
messages |
Kurzer System- + Benutzer-Prompt | Überprüft schnell den API-Pfad |
temperature |
0.2 |
Hält die Testausgabe stabil |
max_tokens |
400 |
Vermeidet übermäßig große erste Antworten |
tools |
Eine Funktion nach der anderen | Nützlich für Agents und Workflows |
response_format |
Nur wenn Ihr Parser bereit ist | JSON vor dem Versand validieren |
Coding, Agents und GenUI-Prompts
Coding
Verwenden Sie Macaron V1 Venti für repo-bewusste Refactorings, Migrationspläne oder Code-Review-Zusammenfassungen, wenn der umgebende Kontext wichtig ist.
Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.
Agents
Verwenden Sie Funktionsaufrufe, wenn das Modell ein Tool auswählen soll, anstatt direkt zu antworten.
Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.
GenUI
Verwenden Sie es für die Generierung von Benutzeroberflächen, wenn Sie strukturierte UI-Ideen aus einer Produktbeschreibung wünschen.
Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.
Troubleshooting
Die API gibt einen Authentifizierungsfehler zurück
Stellen Sie sicher, dass das Bearer-Token in derselben Shell oder Laufzeitumgebung gesetzt ist, die die Anfrage stellt.
Das Modell kann nicht gefunden werden
Überprüfen Sie die Modell-ID: mindai/macaron-v1-venti.
Die Anfrage ist zu groß
Beginnen Sie kleiner und fügen Sie dann schrittweise Kontext hinzu. Ein 1M-Token-Fenster ist Kapazität, kein Signal, alles auf einmal zu senden.
FAQ
Ist Macaron V1 Venti auf Novita AI verfügbar?
Ja. Die aktuelle Modellseite listet es als serverloses Modell.
Welchen Endpunkt sollte ich verwenden?
Verwenden Sie https://api.novita.ai/openai/v1/chat/completions.
Unterstützt es Tool-Nutzung?
Ja. Novita listet Funktionsaufruf als Modellfunktion.
Ist das Modell derzeit kostenlos?
Die am 28. Juli 2026 überprüfte Listung zeigte $0 Eingabe- und $0 Ausgabepreise, gekennzeichnet als zeitlich begrenzt kostenlos.
Empfohlene Artikel
- Macaron V1 Venti auf Novita AI: 748B Mixture-of-LoRA Flaggschiff für Coding, Agents und GenUI
- Wie man Codex mit Novita AI Modellen verwendet: Vollständige Setup-Anleitung
- Wie man Funktionsaufrufe von DeepSeek V3 verwendet
Quellen überprüft am 28. Juli 2026: Macaron V1 Venti Modellseite, Novita Chat-Completions API Referenz
