Novita AI LLM, API

Apodex 1.1 Mini sur Novita AI : démarrage rapide et tarification de l’API

Apodex 1.1 Mini sur Novita AI : démarrage rapide et tarification de l’API

Apodex 1.1 Mini est disponible sur Novita AI via une API compatible OpenAI. Définissez le modèle sur apodex/apodex-1.1-mini, envoyez vos requêtes à https://api.novita.ai/v3/openai, et utilisez le contexte de 256K tokens pour de longues tâches de codage, l’utilisation d’outils et les workflows d’agents. Au 1er octobre 2026, Novita affiche une tarification de 0 $ par million de tokens pour l’entrée et la sortie, à titre de promotion de lancement. Vérifiez donc la page du modèle en direct avant d’intégrer ce modèle dans un budget de production.

Qu’est-ce qu’Apodex 1.1 Mini ?

Apodex 1.1 Mini est un modèle mixture-of-experts de 35 milliards de paramètres dans la série Apodex 1.1. Novita le décrit comme utilisant une architecture Qwen3.5-MoE et le sert sur des flottes dédiées de GPU H200 avec un parallélisme tensoriel TP4, un routage sensible au cache de préfixes et un décodage spéculatif MTP. Ces détails de déploiement sont un contexte utile pour les développeurs qui évaluent la latence et le débit, mais ils ne remplacent pas la mesure de vos propres prompts et workflows d’outils.

Le modèle est un modèle de chat texte en entrée, texte en sortie. Il est disponible via l’API serverless de Novita et prend en charge les points de terminaison chat/completions, Anthropic et Responses listés dans le catalogue de modèles. Pour un chemin de migration le plus court, utilisez le point de terminaison chat/completions compatible OpenAI ci-dessous.

La page du modèle Apodex 1.1 Mini est la source de vérité pour le statut actuel du modèle, les fonctionnalités prises en charge et l’accès au playground.

Spécifications d’Apodex 1.1 Mini

Spécification Valeur
ID du modèle apodex/apodex-1.1-mini
Famille de modèles Apodex 1.1
Architecture Qwen3.5-MoE
Nombre de paramètres 35B
Fenêtre de contexte 262 144 tokens (256K)
Sortie maximale 262 144 tokens (256K)
Entrée et sortie Texte en entrée, texte en sortie
Fonctionnalités Appel de fonctions, sorties structurées, raisonnement
Points de terminaison API Chat Completions, Anthropic, Responses
Hébergement API serverless Novita

Le contexte de 256K d’Apodex 1.1 Mini est la raison la plus pratique de le tester avec de grands dépôts, des spécifications longues ou des traces d’agents multi-étapes. Un grand contexte ne signifie pas que chaque requête doit inclure tout l’espace de travail : éliminez les fichiers inutiles, maintenez les résultats d’outils limités et mesurez à la fois la qualité et la latence sur des entrées représentatives.

Comment appeler Apodex 1.1 Mini

Vous avez besoin d’une clé API Novita. Créez-la ou gérez-la depuis Key Management, puis conservez-la dans une variable d’environnement plutôt que dans le contrôle de source.

Installer le client Python OpenAI

pip install openai

Envoyer une première requête

Le point de terminaison est compatible OpenAI, donc le client OpenAI standard n’a besoin que de l’URL de base Novita, de la clé API et de l’ID du modèle.

import os

from openai import OpenAI


client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/v3/openai",
)

response = client.chat.completions.create(
    model="apodex/apodex-1.1-mini",
    messages=[
        {
            "role": "system",
            "content": "You are a concise coding assistant.",
        },
        {
            "role": "user",
            "content": "Explain why a database index can speed up a query.",
        },
    ],
    max_tokens=512,
)

print(response.choices[0].message.content)

Définissez la clé avant d’exécuter le script :

export NOVITA_API_KEY="your_novita_api_key"
python apodex_example.py

Pour une intégration HTTP brute, la requête équivalente est :

curl https://api.novita.ai/v3/openai/chat/completions \
  -H "Authorization: Bearer $NOVITA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "apodex/apodex-1.1-mini",
    "messages": [
      {"role": "user", "content": "Give me three names for a log parser."}
    ],
    "max_tokens": 128
  }'

Consultez la documentation de l’API LLM pour le format de requête plus large et les modèles de clients pris en charge.

Réponses en streaming

Pour les interfaces de chat, définissez stream=True et affichez chaque delta au fur et à mesure. Le streaming modifie la manière dont votre application reçoit la réponse ; il ne change pas l’ID du modèle ni la configuration d’authentification.

stream = client.chat.completions.create(
    model="apodex/apodex-1.1-mini",
    messages=[{"role": "user", "content": "Write a short commit message for a bug fix."}],
    max_tokens=128,
    stream=True,
)

for chunk in stream:
    text = chunk.choices[0].delta.content
    if text:
        print(text, end="", flush=True)

Comment utiliser l’appel d’outils

Le catalogue de modèles liste l’appel de fonctions natif et les sorties structurées comme fonctionnalités prises en charge. Une définition d’outil indique au modèle ce que votre application peut faire ; votre application conserve toujours l’exécution, la validation, les autorisations et le résultat final de l’outil.

tools = [
    {
        "type": "function",
        "function": {
            "name": "get_weather",
            "description": "Get the current weather for a city.",
            "parameters": {
                "type": "object",
                "properties": {
                    "city": {"type": "string"},
                },
                "required": ["city"],
                "additionalProperties": False,
            },
        },
    }
]

response = client.chat.completions.create(
    model="apodex/apodex-1.1-mini",
    messages=[
        {"role": "user", "content": "What's the weather in Seattle?"},
    ],
    tools=tools,
    tool_choice="auto",
)

message = response.choices[0].message
if message.tool_calls:
    tool_call = message.tool_calls[0]
    print(tool_call.function.name)
    print(tool_call.function.arguments)

Traitez les arguments comme une sortie de modèle non fiable. Analysez le JSON, validez la ville par rapport à vos propres règles d’entrée, imposez l’autorisation avant d’appeler un service externe et renvoyez le résultat de l’outil dans une requête de suivi. Ne laissez pas un argument généré par le modèle devenir directement une commande shell, une instruction SQL ou un appel API privilégié.

La page du modèle mentionne également la prise en charge du raisonnement. Les contrôles exacts du raisonnement et le comportement de réponse peuvent varier selon le client et le point de terminaison. Commencez donc par le comportement par défaut et confirmez la documentation API actuelle avant de dépendre d’un paramètre de raisonnement spécifique au fournisseur.

Combien coûte Apodex 1.1 Mini ?

Au 1er octobre 2026, le catalogue de modèles et la page de tarification de Novita affichent Apodex 1.1 Mini comme gratuit pour les tokens d’entrée et de sortie :

Usage Prix actuellement listé
Entrée 0 $ par million de tokens
Sortie 0 $ par million de tokens

Il s’agit d’une promotion de lancement actuelle, pas d’une garantie d’accès gratuit permanent. Les tarifs, les limites de débit et la disponibilité peuvent changer. Consultez la page de tarification en direct de Novita et la page du modèle Apodex immédiatement avant d’estimer les coûts de production ou de vous engager dans une charge de travail de longue durée.

Même à un prix listé de 0 $, définissez des budgets et des limites de débit au niveau de l’application. Les requêtes à grand contexte peuvent consommer une puissance de calcul considérable et être soumises à des limites de compte, de point de terminaison ou promotionnelles. Enregistrez l’utilisation des tokens à partir des réponses API lorsque cela est possible, et configurez un modèle de secours si votre application dépend d’un accès continu.

Qui devrait l’utiliser ?

Apodex 1.1 Mini est un bon candidat pour :

  • Les assistants de codage qui doivent inspecter de longs fichiers ou le contexte d’un dépôt.
  • Les workflows d’agents qui appellent des outils et renvoient des données structurées.
  • Les prototypes où une fenêtre de contexte de 256K est utile mais où l’auto-hébergement d’un grand modèle est inutile.
  • Les évaluations d’inférence MoE, de comportement à contexte long et de workflows de raisonnement sur une API hébergée.

Il peut ne pas convenir lorsque vous avez besoin d’une entrée image ou audio, d’un contrat de prix fixe à long terme ou d’une fonctionnalité spécifique au modèle que Novita ne liste pas pour ce point de terminaison. Le catalogue répertorie actuellement uniquement l’entrée et la sortie textuelles, donc les requêtes multimodales doivent utiliser un modèle dont la page prend explicitement en charge ces modalités.

Pour une évaluation de production, comparez la qualité des réponses sur vos prompts réels, la validité des appels d’outils, le temps jusqu’au premier token, la latence totale et le comportement de réduction du contexte. Un seul prompt court ne peut pas vous dire si un modèle à contexte long convient à votre application.

Questions fréquemment posées

Quel est l’ID du modèle Apodex 1.1 Mini ?

Utilisez apodex/apodex-1.1-mini dans le corps de la requête.

Quelle est la taille du contexte pris en charge par Apodex 1.1 Mini ?

Novita liste une fenêtre de contexte de 262 144 tokens, affichée comme 256K sur les pages du modèle et de tarification. La sortie maximale listée est également de 262 144 tokens.

Apodex 1.1 Mini est-il gratuit sur Novita AI ?

Les prix d’entrée et de sortie sont actuellement listés à 0 $ par million de tokens au 1er octobre 2026. Considérez cela comme une promotion de lancement et vérifiez la page de tarification en direct avant de publier une estimation de coût ou de déployer à grande échelle.

Prend-il en charge l’appel de fonctions ?

Oui. Le catalogue de modèles liste l’appel de fonctions et les sorties structurées comme fonctionnalités prises en charge. Votre application doit toujours valider les arguments des outils et les exécuter de manière sécurisée.

Quelle API devrais-je utiliser en premier ?

Utilisez le point de terminaison Chat Completions compatible OpenAI à l’adresse https://api.novita.ai/v3/openai/chat/completions pour l’intégration la plus simple. Le catalogue de modèles répertorie également les points de terminaison Anthropic et Responses.

Où puis-je essayer Apodex 1.1 Mini ?

Ouvrez la page du modèle Apodex 1.1 Mini pour vérifier le statut actuel et lancer le playground.

Articles recommandés

Articles associés