Novita AI LLM, API

Apodex 1.1 Mini en Novita AI: Inicio rápido con API y precios

Apodex 1.1 Mini en Novita AI: Inicio rápido con API y precios

Apodex 1.1 Mini está disponible en Novita AI a través de una API compatible con OpenAI. Configura el modelo como apodex/apodex-1.1-mini, envía solicitudes a https://api.novita.ai/v3/openai y usa el contexto de 256K tokens del modelo para tareas largas de codificación, uso de herramientas y flujos de agente. A partir del 1 de octubre de 2026, Novita lista los precios de entrada y salida en $0 por millón de tokens como promoción de lanzamiento, así que verifica la página del modelo en vivo antes de incluir el modelo en un presupuesto de producción.

¿Qué es Apodex 1.1 Mini?

Apodex 1.1 Mini es un modelo de mezcla de expertos (MoE) de 35B parámetros en la serie Apodex 1.1. Novita lo describe como un modelo con arquitectura Qwen3.5-MoE servido en flotas dedicadas de GPU H200 con paralelismo tensorial TP4, enrutamiento consciente de caché de prefijos y decodificación especulativa MTP. Estos detalles de implementación son útiles para que los desarrolladores evalúen la latencia y el rendimiento, pero no reemplazan la medición de tus propios prompts y flujos de trabajo con herramientas.

El modelo es un modelo de chat con entrada y salida de texto. Está disponible a través de la API sin servidor (serverless) de Novita y admite los endpoints chat/completions, Anthropic y Responses que se enumeran en el catálogo de modelos. Para la ruta de migración más corta, usa el endpoint chat/completions compatible con OpenAI que se muestra a continuación.

La página del modelo Apodex 1.1 Mini es la fuente de verdad para el estado actual del modelo, las características admitidas y el acceso al playground.

Especificaciones de Apodex 1.1 Mini

Especificación Valor
ID del modelo apodex/apodex-1.1-mini
Familia del modelo Apodex 1.1
Arquitectura Qwen3.5-MoE
Número de parámetros 35B
Ventana de contexto 262 144 tokens (256K)
Salida máxima 262 144 tokens (256K)
Entrada y salida Texto a texto
Características Llamada a funciones, salidas estructuradas, razonamiento
Endpoints de API Chat Completions, Anthropic, Responses
Alojamiento API serverless de Novita

El contexto de 256K de Apodex 1.1 Mini es la razón más práctica para probarlo con repositorios grandes, especificaciones largas o trazas de agentes de varios pasos. Un contexto grande no significa que cada solicitud deba incluir todo el espacio de trabajo: recorta archivos irrelevantes, mantén los resultados de herramientas acotados y mide tanto la calidad como la latencia en entradas representativas.

Cómo llamar a Apodex 1.1 Mini

Necesitas una clave de API de Novita. Créala o adminístrala desde Gestión de claves y luego guárdala en una variable de entorno en lugar de incluirla en el control de versiones.

Instala el cliente de Python de OpenAI

pip install openai

Envía una primera solicitud

El endpoint es compatible con OpenAI, por lo que el cliente estándar de OpenAI solo necesita una URL base de Novita, una clave de API y el ID del modelo.

import os

from openai import OpenAI


client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/v3/openai",
)

response = client.chat.completions.create(
    model="apodex/apodex-1.1-mini",
    messages=[
        {
            "role": "system",
            "content": "Eres un asistente de codificación conciso.",
        },
        {
            "role": "user",
            "content": "Explica por qué un índice de base de datos puede acelerar una consulta.",
        },
    ],
    max_tokens=512,
)

print(response.choices[0].message.content)

Configura la clave antes de ejecutar el script:

export NOVITA_API_KEY="tu_clave_api_de_novita"
python apodex_example.py

Para una integración HTTP sin procesar, la solicitud equivalente es:

curl https://api.novita.ai/v3/openai/chat/completions \
  -H "Authorization: Bearer $NOVITA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "apodex/apodex-1.1-mini",
    "messages": [
      {"role": "user", "content": "Dame tres nombres para un analizador de logs."}
    ],
    "max_tokens": 128
  }'

Consulta la documentación de la API LLM para obtener el formato de solicitud más amplio y los patrones de cliente compatibles.

Respuestas en streaming

Para interfaces de chat, configura stream=True e imprime cada delta a medida que llega. El streaming cambia cómo tu aplicación recibe la respuesta; no cambia el ID del modelo ni la configuración de autenticación.

stream = client.chat.completions.create(
    model="apodex/apodex-1.1-mini",
    messages=[{"role": "user", "content": "Escribe un mensaje de commit corto para una corrección de errores."}],
    max_tokens=128,
    stream=True,
)

for chunk in stream:
    text = chunk.choices[0].delta.content
    if text:
        print(text, end="", flush=True)

Cómo usar la llamada a herramientas

El catálogo de modelos enumera la llamada a funciones nativa y las salidas estructuradas como características compatibles. Una definición de herramienta le dice al modelo qué puede hacer tu aplicación; tu aplicación sigue siendo responsable de la ejecución, validación, permisos y el resultado final de la herramienta.

tools = [
    {
        "type": "function",
        "function": {
            "name": "get_weather",
            "description": "Obtén el clima actual de una ciudad.",
            "parameters": {
                "type": "object",
                "properties": {
                    "city": {"type": "string"},
                },
                "required": ["city"],
                "additionalProperties": False,
            },
        },
    }
]

response = client.chat.completions.create(
    model="apodex/apodex-1.1-mini",
    messages=[
        {"role": "user", "content": "¿Qué tiempo hace en Seattle?"},
    ],
    tools=tools,
    tool_choice="auto",
)

message = response.choices[0].message
if message.tool_calls:
    tool_call = message.tool_calls[0]
    print(tool_call.function.name)
    print(tool_call.function.arguments)

Trata los argumentos como una salida no confiable del modelo. Analiza el JSON, valida la ciudad según tus propias reglas de entrada, aplica autorización antes de llamar a un servicio externo y envía el resultado de la herramienta en una solicitud de seguimiento. No dejes que un argumento generado por el modelo se convierta directamente en un comando de shell, una declaración SQL o una llamada API privilegiada.

La página del modelo también enumera soporte de razonamiento. Los controles de razonamiento exactos y el comportamiento de respuesta pueden variar según el cliente y el endpoint, así que comienza con el comportamiento predeterminado y confirma la documentación de API actual antes de depender de un parámetro de razonamiento específico del proveedor.

¿Cuánto cuesta Apodex 1.1 Mini?

A partir del 1 de octubre de 2026, el catálogo de modelos y la página de precios de Novita muestran Apodex 1.1 Mini como gratuito tanto para tokens de entrada como de salida:

Uso Precio actual listado
Entrada $0 por millón de tokens
Salida $0 por millón de tokens

Esto es una promoción de lanzamiento actual, no una garantía de acceso gratuito permanente. Los precios, límites de velocidad y disponibilidad pueden cambiar. Verifica la página de precios en vivo de Novita y la página del modelo Apodex inmediatamente antes de estimar costos de producción o comprometerte con una carga de trabajo de larga duración.

Incluso con un precio listado de $0, establece presupuestos y límites de velocidad a nivel de aplicación. Las solicitudes con contexto grande pueden consumir una computación sustancial y pueden estar sujetas a límites de cuenta, endpoint o promoción. Registra el uso de tokens de las respuestas de la API cuando esté disponible y mantén un modelo de respaldo configurado si tu aplicación depende de acceso continuo.

¿Quién debería usarlo?

Apodex 1.1 Mini es un buen candidato para:

  • Asistentes de codificación que necesitan inspeccionar archivos largos o contexto de repositorio.
  • Flujos de agente que llaman herramientas y devuelven datos estructurados.
  • Prototipos donde una ventana de contexto de 256K es útil pero alojar un modelo grande por ti mismo es innecesario.
  • Evaluaciones de inferencia MoE, comportamiento de contexto largo y flujos de razonamiento en una API alojada.

Puede no ser la opción adecuada cuando necesitas entrada de imagen o audio, un contrato de precio fijo a largo plazo, o una característica específica del modelo que Novita no lista para este endpoint. El catálogo actualmente enumera entrada y salida solo de texto, por lo que las solicitudes multimodales deben usar un modelo cuya página admita explícitamente esas modalidades.

Para una evaluación de producción, compara la calidad de las respuestas en tus prompts reales, la validez de las llamadas a herramientas, el tiempo hasta el primer token, la latencia total y el comportamiento de recorte de contexto. Un solo prompt corto no puede decirte si un modelo de contexto largo es un buen ajuste para tu aplicación.

Preguntas frecuentes

¿Cuál es el ID del modelo Apodex 1.1 Mini?

Usa apodex/apodex-1.1-mini en el cuerpo de la solicitud.

¿Cuánto contexto admite Apodex 1.1 Mini?

Novita lista una ventana de contexto de 262 144 tokens, mostrada como 256K en las páginas del modelo y de precios. El máximo de salida listado también es de 262 144 tokens.

¿Apodex 1.1 Mini es gratuito en Novita AI?

Los precios de entrada y salida están actualmente listados como $0 por millón de tokens a partir del 1 de octubre de 2026. Trátalo como una promoción de lanzamiento y verifica la página de precios en vivo antes de publicar una estimación de costos o implementar a escala.

¿Admite llamada a funciones?

Sí. El catálogo de modelos enumera la llamada a funciones y salidas estructuradas como características compatibles. Tu aplicación aún debe validar los argumentos de las herramientas y ejecutar las herramientas de manera segura.

¿Qué API debería usar primero?

Usa el endpoint Chat Completions compatible con OpenAI en https://api.novita.ai/v3/openai/chat/completions para la integración más simple. El catálogo de modelos también enumera endpoints Anthropic y Responses.

¿Dónde puedo probar Apodex 1.1 Mini?

Abre la página del modelo Apodex 1.1 Mini para verificar el estado actual y lanzar el playground.

Artículos recomendados

Publicaciones relacionadas