Novita AI LLM, API

Apodex 1.1 Mini auf Novita AI: API-Schnellstart und Preisgestaltung

Apodex 1.1 Mini auf Novita AI: API-Schnellstart und Preisgestaltung

Apodex 1.1 Mini ist auf Novita AI über eine OpenAI-kompatible API verfügbar. Setzen Sie das Modell auf apodex/apodex-1.1-mini, senden Sie Anfragen an https://api.novita.ai/v3/openai und nutzen Sie den 256K-Token-Kontext des Modells für lange Coding-, Tool-Use- und Agent-Workflows. Seit dem 1. Oktober 2026 listet Novita die Preisgestaltung für Eingabe und Ausgabe mit 0 $ pro Million Token als Launch-Aktion, prüfen Sie daher die Live-Modellseite, bevor Sie das Modell in ein Produktionsbudget einplanen.

Was ist Apodex 1.1 Mini?

Apodex 1.1 Mini ist ein Mixture-of-Experts-Modell mit 35B Parametern aus der Apodex 1.1-Serie. Novita beschreibt es als Qwen3.5-MoE-Architektur, die auf dedizierten H200-GPU-Flotten mit TP4-Tensorparallelität, Prefix-Cache-bewusstem Routing und MTP-Spekulativdekodierung bereitgestellt wird. Diese Deployment-Details sind nützlicher Kontext für Entwickler, die Latenz und Durchsatz bewerten, aber sie ersetzen nicht die Messung Ihrer eigenen Prompts und Tool-Workflows.

Das Modell ist ein Text-in-, Text-out-Chatmodell. Es ist über Novitas serverlose API verfügbar und unterstützt die im Modellkatalog aufgeführten Endpunkte chat/completions, Anthropic und Responses. Für den kürzesten Migrationspfad verwenden Sie den unten gezeigten OpenAI-kompatiblen chat/completions-Endpunkt.

Die Modellseite von Apodex 1.1 Mini ist die maßgebliche Quelle für den aktuellen Modellstatus, unterstützte Funktionen und den Zugang zum Playground.

Apodex 1.1 Mini Spezifikationen

Spezifikation Wert
Modell-ID apodex/apodex-1.1-mini
Modellfamilie Apodex 1.1
Architektur Qwen3.5-MoE
Parameteranzahl 35B
Kontextfenster 262,144 Token (256K)
Maximale Ausgabe 262,144 Token (256K)
Eingabe und Ausgabe Text rein, Text raus
Funktionen Funktionsaufruf, strukturierte Ausgaben, Reasoning
API-Endpunkte Chat Completions, Anthropic, Responses
Hosting Novita serverlose API

Der 256K-Kontext von Apodex 1.1 Mini ist der praktischste Grund, es mit großen Repositories, langen Spezifikationen oder mehrstufigen Agent-Traces zu testen. Ein großer Kontext bedeutet nicht, dass jede Anfrage den gesamten Workspace enthalten sollte: Entfernen Sie irrelevante Dateien, halten Sie Tool-Ergebnisse begrenzt und messen Sie sowohl Qualität als auch Latenz bei repräsentativen Eingaben.

So rufen Sie Apodex 1.1 Mini auf

Sie benötigen einen Novita-API-Schlüssel. Erstellen oder verwalten Sie einen unter Key Management und bewahren Sie ihn in einer Umgebungsvariable auf, anstatt ihn in die Versionskontrolle zu legen.

Installieren Sie den OpenAI Python-Client

pip install openai

Senden Sie eine erste Anfrage

Der Endpunkt ist OpenAI-kompatibel, daher benötigt der Standard-OpenAI-Client nur eine Novita-Basis-URL, einen API-Schlüssel und eine Modell-ID.

import os

from openai import OpenAI


client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/v3/openai",
)

response = client.chat.completions.create(
    model="apodex/apodex-1.1-mini",
    messages=[
        {
            "role": "system",
            "content": "You are a concise coding assistant.",
        },
        {
            "role": "user",
            "content": "Explain why a database index can speed up a query.",
        },
    ],
    max_tokens=512,
)

print(response.choices[0].message.content)

Legen Sie den Schlüssel fest, bevor Sie das Skript ausführen:

export NOVITA_API_KEY="your_novita_api_key"
python apodex_example.py

Für eine rohe HTTP-Integration lautet die entsprechende Anfrage:

curl https://api.novita.ai/v3/openai/chat/completions \
  -H "Authorization: Bearer $NOVITA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "apodex/apodex-1.1-mini",
    "messages": [
      {"role": "user", "content": "Give me three names for a log parser."}
    ],
    "max_tokens": 128
  }'

Siehe die LLM-API-Dokumentation für das allgemeine Anfrageformat und unterstützte Client-Muster.

Streaming-Antworten

Für Chat-Oberflächen setzen Sie stream=True und geben Sie jedes Delta aus, sobald es ankommt. Streaming ändert, wie Ihre Anwendung die Antwort empfängt; es ändert nicht die Modell-ID oder die Authentifizierungseinrichtung.

stream = client.chat.completions.create(
    model="apodex/apodex-1.1-mini",
    messages=[{"role": "user", "content": "Write a short commit message for a bug fix."}],
    max_tokens=128,
    stream=True,
)

for chunk in stream:
    text = chunk.choices[0].delta.content
    if text:
        print(text, end="", flush=True)

So verwenden Sie Tool-Aufrufe

Der Modellkatalog listet native Funktionsaufrufe und strukturierte Ausgaben als unterstützte Funktionen auf. Eine Tool-Definition teilt dem Modell mit, was Ihre Anwendung tun kann; Ihre Anwendung ist weiterhin für Ausführung, Validierung, Berechtigungen und das endgültige Tool-Ergebnis verantwortlich.

tools = [
    {
        "type": "function",
        "function": {
            "name": "get_weather",
            "description": "Get the current weather for a city.",
            "parameters": {
                "type": "object",
                "properties": {
                    "city": {"type": "string"},
                },
                "required": ["city"],
                "additionalProperties": False,
            },
        },
    }
]

response = client.chat.completions.create(
    model="apodex/apodex-1.1-mini",
    messages=[
        {"role": "user", "content": "What's the weather in Seattle?"},
    ],
    tools=tools,
    tool_choice="auto",
)

message = response.choices[0].message
if message.tool_calls:
    tool_call = message.tool_calls[0]
    print(tool_call.function.name)
    print(tool_call.function.arguments)

Behandeln Sie die Argumente als nicht vertrauenswürdige Modellausgabe. Parsen Sie das JSON, validieren Sie die Stadt anhand Ihrer eigenen Eingaberegeln, erzwingen Sie die Autorisierung, bevor Sie einen externen Dienst aufrufen, und senden Sie das Tool-Ergebnis in einer Folgeanfrage zurück. Lassen Sie nicht zu, dass ein vom Modell generiertes Argument direkt zu einem Shell-Befehl, einer SQL-Anweisung oder einem privilegierten API-Aufruf wird.

Die Modellseite listet auch Reasoning-Unterstützung auf. Die genauen Reasoning-Steuerelemente und das Antwortverhalten können je nach Client und Endpunkt variieren. Beginnen Sie daher mit dem Standardverhalten und bestätigen Sie die aktuelle API-Dokumentation, bevor Sie sich auf einen anbieterspezifischen Reasoning-Parameter verlassen.

Was kostet Apodex 1.1 Mini?

Seit dem 1. Oktober 2026 zeigen Novitas Modellkatalog und Preisseite Apodex 1.1 Mini als kostenlos für Eingabe- und Ausgabe-Token an:

Nutzung Aktuell gelisteter Preis
Eingabe 0 $ pro Million Token
Ausgabe 0 $ pro Million Token

Dies ist eine aktuelle Launch-Aktion, keine Garantie für dauerhaft kostenlosen Zugang. Preise, Ratenbegrenzungen und Verfügbarkeit können sich ändern. Prüfen Sie die Live-Preisseite von Novita und die Apodex-Modellseite unmittelbar bevor Sie Produktionskosten schätzen oder sich auf eine lang laufende Workload festlegen.

Selbst bei einem gelisteten Preis von 0 $ sollten Sie Budgets und Ratenbegrenzungen auf Anwendungsebene festlegen. Anfragen mit großem Kontext können erhebliche Rechenressourcen verbrauchen und können Kontingenten für Konto, Endpunkt oder Aktionen unterliegen. Zeichnen Sie die Token-Nutzung aus API-Antworten auf, wenn verfügbar, und halten Sie ein Fallback-Modell konfiguriert, falls Ihre Anwendung auf kontinuierlichen Zugang angewiesen ist.

Für wen ist es geeignet?

Apodex 1.1 Mini ist ein guter Kandidat für:

  • Coding-Assistenten, die lange Dateien oder Repository-Kontext untersuchen müssen.
  • Agent-Workflows, die Tools aufrufen und strukturierte Daten zurückgeben.
  • Prototypen, bei denen ein 256K-Kontextfenster nützlich ist, aber das Selbsthosting eines großen Modells unnötig ist.
  • Evaluierungen von MoE-Inferenz, Langkontextverhalten und Reasoning-Workflows auf einer gehosteten API.

Es ist möglicherweise nicht die richtige Wahl, wenn Sie Bild- oder Audioeingabe, einen festen langfristigen Preisvertrag oder eine modellspezifische Funktion benötigen, die Novita für diesen Endpunkt nicht auflistet. Der Katalog listet derzeit nur Text-Ein- und -Ausgabe auf, daher sollten multimodale Anfragen ein Modell verwenden, dessen Seite diese Modalitäten explizit unterstützt.

Vergleichen Sie für eine Produktionsbewertung die Antwortqualität bei Ihren echten Prompts, die Gültigkeit von Tool-Aufrufen, die Zeit bis zum ersten Token, die Gesamtlatenz und das Verhalten beim Kontext-Trimming. Ein einzelner kurzer Prompt kann Ihnen nicht sagen, ob ein Langkontextmodell für Ihre Anwendung geeignet ist.

Häufig gestellte Fragen

Was ist die Modell-ID von Apodex 1.1 Mini?

Verwenden Sie apodex/apodex-1.1-mini im Anfragetext.

Wie viel Kontext unterstützt Apodex 1.1 Mini?

Novita listet ein Kontextfenster von 262,144 Token auf, das auf den Modell- und Preisseiten als 256K angezeigt wird. Die aufgeführte maximale Ausgabe beträgt ebenfalls 262,144 Token.

Ist Apodex 1.1 Mini auf Novita AI kostenlos?

Die Preise für Eingabe und Ausgabe sind derzeit mit 0 $ pro Million Token seit dem 1. Oktober 2026 gelistet. Behandeln Sie dies als Launch-Aktion und überprüfen Sie die Live-Preisseite, bevor Sie eine Kostenschätzung veröffentlichen oder im großen Maßstab bereitstellen.

Unterstützt es Funktionsaufrufe?

Ja. Der Modellkatalog listet Funktionsaufrufe und strukturierte Ausgaben als unterstützte Funktionen auf. Ihre Anwendung muss weiterhin Tool-Argumente validieren und Tools sicher ausführen.

Welche API sollte ich zuerst verwenden?

Verwenden Sie den OpenAI-kompatiblen Chat Completions-Endpunkt unter https://api.novita.ai/v3/openai/chat/completions für die einfachste Integration. Der Modellkatalog listet auch Anthropic- und Responses-Endpunkte auf.

Wo kann ich Apodex 1.1 Mini ausprobieren?

Öffnen Sie die Modellseite von Apodex 1.1 Mini, um den aktuellen Status zu prüfen und den Playground zu starten.

Empfohlene Artikel

Ähnliche Beiträge