Novita AI LLM, API

Ling 3.0 Flash Sante Schnellstart: Erster Chat-API-Aufruf

Ling 3.0 Flash Sante Schnellstart: Erster Chat-API-Aufruf

Dieser Schnellstart zeigt, wie Sie über die OpenAI-kompatible API von Novita eine erste Text-Chat-Completions-Anfrage an Ling 3.0 Flash Sante senden. Verwenden Sie https://api.novita.ai/openai als Basis-URL, inclusionai/ling-3.0-flash-sante als Modell-ID und POST https://api.novita.ai/openai/v1/chat/completions als Anfragepfad. Die aktuelle Novita-Listung beschreibt ein 124B-Parameter-Mixture-of-Experts-Modell mit etwa 5,1B aktiven Parametern pro Token, einem Kontextfenster von 262.144 Token, einer maximalen Ausgabe von 32.768 Token, Texteingabe und -ausgabe, Reasoning und Function Calling. Diese Seite ist der Implementierungsleitfaden, nicht die Einführungsübersicht; für Modellpositionierung, Anwendungsempfehlungen und aktuelle Preise siehe Ling 3.0 Flash Sante auf Novita AI: Kostenlose API, Spezifikationen und Preise.

Ling 3.0 Flash Sante Python- und cURL-Integrationsanleitung

Verwenden Sie diese Seite, wenn die praktische Frage lautet, wie Sie authentifizieren, den Modell-Route bestätigen, eine kleine Anfrage senden und die Antwort parsen. Sie ist für einen ersten Integrationstest konzipiert, nicht für die Auswahl eines klinischen Workflows oder die Validierung eines Modells für einen Anwendungsfall mit hohem Risiko.

Ling 3.0 Flash Sante ist ein Textmodell. Die gehostete Listung hebt medizinisches Wissen Reasoning, klinische Sicherheit, evidenzbasierte Abfrage und medizinische Langzeitaufgaben hervor, listet aber auch allgemeine Reasoning-, Programmier- und agentische Fähigkeiten auf. Diese Bezeichnungen beschreiben die beabsichtigten Fähigkeitsbereiche des Modells; sie ersetzen keine Evaluierung an Ihren Daten, Quellenprüfung, Datenschutzkontrollen oder qualifizierte Überprüfung.

Schritt 1: Holen Sie sich Ihren Novita-API-Schlüssel

Erstellen Sie einen Novita-API-Schlüssel und bewahren Sie ihn außerhalb der Versionskontrolle auf. Exportieren Sie ihn für einen lokalen Smoke-Test als Umgebungsvariable:

export NOVITA_API_KEY="your_api_key"

Setzen Sie den Schlüssel nicht in ein Browser-Bundle, ein öffentliches Repository oder eine Client-seitige Anwendung. Laden Sie ihn für einen bereitgestellten Dienst aus dem Secret-Manager des Dienstes und rotieren Sie ihn gemäß der Berechtigungsrichtlinie Ihres Teams.

Schritt 2: Bestätigen Sie die Modell-ID und den Endpunkt

Überprüfen Sie vor dem Schreiben von Anwendungscode die Live-Ling 3.0 Flash Sante Modellseite. Die folgenden Werte wurden am 4. September 2026 überprüft.

Feld Wert
Modell-ID inclusionai/ling-3.0-flash-sante
Basis-URL https://api.novita.ai/openai
Chat-Completions-Endpunkt POST https://api.novita.ai/openai/v1/chat/completions
Kontextfenster 262.144 Token (angezeigt als 256K)
Maximale Ausgabe 32.768 Token (angezeigt als 32K)
Eingabe und Ausgabe Text
Gelistete Funktionen Function Calling, Reasoning
Katalog-Anfragerate 30 Anfragen pro Minute
Gelisteter Eingabepreis 0 $ pro 1M Token
Gelisteter Ausgabepreis 0 $ pro 1M Token

Preise, Grenzwerte und Verfügbarkeit sind Live-Katalogwerte. Überprüfen Sie sie erneut, bevor Sie budgetieren oder eine Integration in die Produktion überführen. Der Katalog-Anfrageratenwert ist keine Zusage, dass jedes Konto oder jeder Workload denselben Durchsatz erhält.

Schritt 3: Senden Sie Ihre erste Anfrage

Beginnen Sie mit einem kurzen, unkritischen Prompt. Eine kleine Anfrage isoliert Authentifizierungs- und Routingfehler, bevor Sie langen Kontext, Tools oder anwendungsspezifische Daten hinzufügen.

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "inclusionai/ling-3.0-flash-sante",
    "messages": [
      {
        "role": "system",
        "content": "You are a concise technical assistant. Do not provide diagnosis or treatment advice."
      },
      {
        "role": "user",
        "content": "Return a three-item checklist for testing a text classification API."
      }
    ],
    "max_tokens": 256,
    "temperature": 0.2
  }'

Die Anfrage verwendet das standard messages-Array und die genaue Modell-ID. Der max_tokens- Wert is bewusst kle in für einen Smok eTest. Erhöhn Sie ihn erst, wenndie An greater, Antwortunsparsung,Zeitoververarbungund Fehlerbehandung zuverläsig funktionirenn.<|im_end|>

Ähnliche Beiträge