Ling-3.0-flash auf Novita AI: Kostenlose API für agentisches Inferenzieren
Nutzen Sie Ling-3.0-flash kostenlos auf Novita AI: ein 124B-MoE-Modell mit 5,1B aktiven Parametern, 262K-Kontext, Reasoning und Funktionsaufruf.
Nutzen Sie Ling-3.0-flash kostenlos auf Novita AI: ein 124B-MoE-Modell mit 5,1B aktiven Parametern, 262K-Kontext, Reasoning und Funktionsaufruf.
Macaron V1 Venti ist ein 748B Mixture-of-LoRA Flaggschiff für Coding, Agents und GenUI. Erfahren Sie mehr über die Spezifikationen, Verfügbarkeit auf Novita AI, Preise und...
Hy3 ist auf Novita AI kostenlos über eine serverlose API verfügbar. 295B MoE, 21B aktive Parameter, 256K Kontext, drei Reasoning-Modi und 0 $ pro Token.
Schritt-für-Schritt-Anleitung zur Konfiguration von CoBuddy (baidu/cobuddy) in Claude Code mit dem OpenAI-kompatiblen Endpunkt von Novita AI. API-Einrichtung, Preise und Tipps...
Nutzen Sie DeepSeek in Claude Code über die V4 Flash API auf Novita AI. Setzen Sie vier Umgebungsvariablen, erhalten Sie 1M-Token-Kontext und senken Sie die Kosten um das...
GLM 5.2 ist auf Novita AI verfügbar mit 1M Kontext, 128K maximaler Ausgabe, Funktionsaufruf, strukturierten Ausgaben und serverlosem API-Zugriff.
Kimi K2.7 Code ist live auf Novita AI mit OpenAI-kompatiblem Chat-API-Zugriff, 256K Kontext, Tool-Nutzung und multimodalen Eingaben.
Nemotron 3 Nano 30B A3B ist auf Novita AI als Serverless LLM mit OpenAI-kompatiblen Chat Completions, 256K Kontext und nutzungsabhängiger Token-Abrechnung verfügbar.
CoBuddy ist auf Novita AI als Coding-LLM-API für Codegenerierung, Coding-Assistenten und KI-Agent-Workflows verfügbar.
Nutzen Sie MiniMax M3 auf Novita AI für Coding, agentische Workflows, 1M-Token-Kontext und multimodale Eingabe mit OpenAI-kompatiblen APIs.
Nutzen Sie Qwen3.6-27B auf Novita AI über die OpenAI-kompatible API. Siehe Modell-ID, Preise, 262K Kontext, Anwendungsfälle im Coding und Fallstricke.
Qwen3.7-Max ist auf Novita AI für agentisches Codieren und Long-Context-Workflows verfügbar. Erfahren Sie mehr über API-Zugriff, Preise, Limits und Anwendungsfälle.
PegaFlow externer KV-Cache hilft vLLM-Serving-Teams, KV-Cache über Neustarts, Instanzen und RDMA-Knoten hinweg zu bewahren und zu teilen.
DeepSeek-V4-Pro ist ein 1,6-Billionen-Parameter Open-Source-MoE-Modell mit einem LiveCodeBench-Score von 93,5 (Pass@1) und 1M-Token-Kontext. Jetzt erhältlich über Novita AI.