Apodex 1.1 Mini est disponible sur Novita AI via une API compatible OpenAI. Définissez le modèle sur apodex/apodex-1.1-mini, envoyez vos requêtes à https://api.novita.ai/v3/openai, et utilisez le contexte de 256K tokens pour de longues tâches de codage, l’utilisation d’outils et les workflows d’agents. Au 1er octobre 2026, Novita affiche une tarification de 0 $ par million de tokens pour l’entrée et la sortie, à titre de promotion de lancement. Vérifiez donc la page du modèle en direct avant d’intégrer ce modèle dans un budget de production.
Qu’est-ce qu’Apodex 1.1 Mini ?
Apodex 1.1 Mini est un modèle mixture-of-experts de 35 milliards de paramètres dans la série Apodex 1.1. Novita le décrit comme utilisant une architecture Qwen3.5-MoE et le sert sur des flottes dédiées de GPU H200 avec un parallélisme tensoriel TP4, un routage sensible au cache de préfixes et un décodage spéculatif MTP. Ces détails de déploiement sont un contexte utile pour les développeurs qui évaluent la latence et le débit, mais ils ne remplacent pas la mesure de vos propres prompts et workflows d’outils.
Le modèle est un modèle de chat texte en entrée, texte en sortie. Il est disponible via l’API serverless de Novita et prend en charge les points de terminaison chat/completions, Anthropic et Responses listés dans le catalogue de modèles. Pour un chemin de migration le plus court, utilisez le point de terminaison chat/completions compatible OpenAI ci-dessous.
La page du modèle Apodex 1.1 Mini est la source de vérité pour le statut actuel du modèle, les fonctionnalités prises en charge et l’accès au playground.
Spécifications d’Apodex 1.1 Mini
| Spécification | Valeur |
|---|---|
| ID du modèle | apodex/apodex-1.1-mini |
| Famille de modèles | Apodex 1.1 |
| Architecture | Qwen3.5-MoE |
| Nombre de paramètres | 35B |
| Fenêtre de contexte | 262 144 tokens (256K) |
| Sortie maximale | 262 144 tokens (256K) |
| Entrée et sortie | Texte en entrée, texte en sortie |
| Fonctionnalités | Appel de fonctions, sorties structurées, raisonnement |
| Points de terminaison API | Chat Completions, Anthropic, Responses |
| Hébergement | API serverless Novita |
Le contexte de 256K d’Apodex 1.1 Mini est la raison la plus pratique de le tester avec de grands dépôts, des spécifications longues ou des traces d’agents multi-étapes. Un grand contexte ne signifie pas que chaque requête doit inclure tout l’espace de travail : éliminez les fichiers inutiles, maintenez les résultats d’outils limités et mesurez à la fois la qualité et la latence sur des entrées représentatives.
Comment appeler Apodex 1.1 Mini
Vous avez besoin d’une clé API Novita. Créez-la ou gérez-la depuis Key Management, puis conservez-la dans une variable d’environnement plutôt que dans le contrôle de source.
Installer le client Python OpenAI
pip install openai
Envoyer une première requête
Le point de terminaison est compatible OpenAI, donc le client OpenAI standard n’a besoin que de l’URL de base Novita, de la clé API et de l’ID du modèle.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/v3/openai",
)
response = client.chat.completions.create(
model="apodex/apodex-1.1-mini",
messages=[
{
"role": "system",
"content": "You are a concise coding assistant.",
},
{
"role": "user",
"content": "Explain why a database index can speed up a query.",
},
],
max_tokens=512,
)
print(response.choices[0].message.content)
Définissez la clé avant d’exécuter le script :
export NOVITA_API_KEY="your_novita_api_key"
python apodex_example.py
Pour une intégration HTTP brute, la requête équivalente est :
curl https://api.novita.ai/v3/openai/chat/completions \
-H "Authorization: Bearer $NOVITA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "apodex/apodex-1.1-mini",
"messages": [
{"role": "user", "content": "Give me three names for a log parser."}
],
"max_tokens": 128
}'
Consultez la documentation de l’API LLM pour le format de requête plus large et les modèles de clients pris en charge.
Réponses en streaming
Pour les interfaces de chat, définissez stream=True et affichez chaque delta au fur et à mesure. Le streaming modifie la manière dont votre application reçoit la réponse ; il ne change pas l’ID du modèle ni la configuration d’authentification.
stream = client.chat.completions.create(
model="apodex/apodex-1.1-mini",
messages=[{"role": "user", "content": "Write a short commit message for a bug fix."}],
max_tokens=128,
stream=True,
)
for chunk in stream:
text = chunk.choices[0].delta.content
if text:
print(text, end="", flush=True)
Comment utiliser l’appel d’outils
Le catalogue de modèles liste l’appel de fonctions natif et les sorties structurées comme fonctionnalités prises en charge. Une définition d’outil indique au modèle ce que votre application peut faire ; votre application conserve toujours l’exécution, la validation, les autorisations et le résultat final de l’outil.
tools = [
{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get the current weather for a city.",
"parameters": {
"type": "object",
"properties": {
"city": {"type": "string"},
},
"required": ["city"],
"additionalProperties": False,
},
},
}
]
response = client.chat.completions.create(
model="apodex/apodex-1.1-mini",
messages=[
{"role": "user", "content": "What's the weather in Seattle?"},
],
tools=tools,
tool_choice="auto",
)
message = response.choices[0].message
if message.tool_calls:
tool_call = message.tool_calls[0]
print(tool_call.function.name)
print(tool_call.function.arguments)
Traitez les arguments comme une sortie de modèle non fiable. Analysez le JSON, validez la ville par rapport à vos propres règles d’entrée, imposez l’autorisation avant d’appeler un service externe et renvoyez le résultat de l’outil dans une requête de suivi. Ne laissez pas un argument généré par le modèle devenir directement une commande shell, une instruction SQL ou un appel API privilégié.
La page du modèle mentionne également la prise en charge du raisonnement. Les contrôles exacts du raisonnement et le comportement de réponse peuvent varier selon le client et le point de terminaison. Commencez donc par le comportement par défaut et confirmez la documentation API actuelle avant de dépendre d’un paramètre de raisonnement spécifique au fournisseur.
Combien coûte Apodex 1.1 Mini ?
Au 1er octobre 2026, le catalogue de modèles et la page de tarification de Novita affichent Apodex 1.1 Mini comme gratuit pour les tokens d’entrée et de sortie :
| Usage | Prix actuellement listé |
|---|---|
| Entrée | 0 $ par million de tokens |
| Sortie | 0 $ par million de tokens |
Il s’agit d’une promotion de lancement actuelle, pas d’une garantie d’accès gratuit permanent. Les tarifs, les limites de débit et la disponibilité peuvent changer. Consultez la page de tarification en direct de Novita et la page du modèle Apodex immédiatement avant d’estimer les coûts de production ou de vous engager dans une charge de travail de longue durée.
Même à un prix listé de 0 $, définissez des budgets et des limites de débit au niveau de l’application. Les requêtes à grand contexte peuvent consommer une puissance de calcul considérable et être soumises à des limites de compte, de point de terminaison ou promotionnelles. Enregistrez l’utilisation des tokens à partir des réponses API lorsque cela est possible, et configurez un modèle de secours si votre application dépend d’un accès continu.
Qui devrait l’utiliser ?
Apodex 1.1 Mini est un bon candidat pour :
- Les assistants de codage qui doivent inspecter de longs fichiers ou le contexte d’un dépôt.
- Les workflows d’agents qui appellent des outils et renvoient des données structurées.
- Les prototypes où une fenêtre de contexte de 256K est utile mais où l’auto-hébergement d’un grand modèle est inutile.
- Les évaluations d’inférence MoE, de comportement à contexte long et de workflows de raisonnement sur une API hébergée.
Il peut ne pas convenir lorsque vous avez besoin d’une entrée image ou audio, d’un contrat de prix fixe à long terme ou d’une fonctionnalité spécifique au modèle que Novita ne liste pas pour ce point de terminaison. Le catalogue répertorie actuellement uniquement l’entrée et la sortie textuelles, donc les requêtes multimodales doivent utiliser un modèle dont la page prend explicitement en charge ces modalités.
Pour une évaluation de production, comparez la qualité des réponses sur vos prompts réels, la validité des appels d’outils, le temps jusqu’au premier token, la latence totale et le comportement de réduction du contexte. Un seul prompt court ne peut pas vous dire si un modèle à contexte long convient à votre application.
Questions fréquemment posées
Quel est l’ID du modèle Apodex 1.1 Mini ?
Utilisez apodex/apodex-1.1-mini dans le corps de la requête.
Quelle est la taille du contexte pris en charge par Apodex 1.1 Mini ?
Novita liste une fenêtre de contexte de 262 144 tokens, affichée comme 256K sur les pages du modèle et de tarification. La sortie maximale listée est également de 262 144 tokens.
Apodex 1.1 Mini est-il gratuit sur Novita AI ?
Les prix d’entrée et de sortie sont actuellement listés à 0 $ par million de tokens au 1er octobre 2026. Considérez cela comme une promotion de lancement et vérifiez la page de tarification en direct avant de publier une estimation de coût ou de déployer à grande échelle.
Prend-il en charge l’appel de fonctions ?
Oui. Le catalogue de modèles liste l’appel de fonctions et les sorties structurées comme fonctionnalités prises en charge. Votre application doit toujours valider les arguments des outils et les exécuter de manière sécurisée.
Quelle API devrais-je utiliser en premier ?
Utilisez le point de terminaison Chat Completions compatible OpenAI à l’adresse https://api.novita.ai/v3/openai/chat/completions pour l’intégration la plus simple. Le catalogue de modèles répertorie également les points de terminaison Anthropic et Responses.
Où puis-je essayer Apodex 1.1 Mini ?
Ouvrez la page du modèle Apodex 1.1 Mini pour vérifier le statut actuel et lancer le playground.
Articles recommandés
- Comment utiliser l’appel de fonctions de DeepSeek V3 — Passez en revue le modèle d’appel de fonctions de base et le flux de requêtes orienté outils.
- Comment utiliser Novita AI avec OpenCode : guide de configuration ultime — Connectez un point de terminaison Novita compatible OpenAI à un workflow de codage.
- Services d’API LLM comparés : direct, unifié, passerelle ou auto-hébergé — Comparez les approches d’API hébergées avant de choisir une stratégie d’intégration.