O Apodex 1.1 Mini está disponível no Novita AI por meio de uma API compatível com OpenAI. Defina o modelo como apodex/apodex-1.1-mini, envie solicitações para https://api.novita.ai/v3/openai e use o contexto de 256K tokens do modelo para codificação longa, uso de ferramentas e fluxos de agente. Em 1º de outubro de 2026, o Novita lista preços de entrada e saída em $0 por milhão de tokens como promoção de lançamento, então verifique a página do modelo ao vivo antes de colocar o modelo em um orçamento de produção.
O que é o Apodex 1.1 Mini?
O Apodex 1.1 Mini é um modelo mixture-of-experts de 35B parâmetros da série Apodex 1.1. A Novita o descreve como usando uma arquitetura Qwen3.5-MoE e o serve em frotas dedicadas de GPUs H200 com paralelismo de tensor TP4, roteamento com cache de prefixo e decodificação especulativa MTP. Esses detalhes de implantação são contexto útil para desenvolvedores que avaliam latência e taxa de transferência, mas não substituem a medição dos seus próprios prompts e fluxos de ferramentas.
O modelo é um modelo de chat texto-para-texto. Ele está disponível através da API serverless da Novita e suporta os endpoints chat/completions, Anthropic e Responses listados no catálogo de modelos. Para o caminho de migração mais curto, use o endpoint chat/completions compatível com OpenAI mostrado abaixo.
A página do modelo Apodex 1.1 Mini é a fonte de verdade para o status atual do modelo, recursos suportados e acesso ao playground.
Especificações do Apodex 1.1 Mini
| Especificação | Valor |
|---|---|
| ID do modelo | apodex/apodex-1.1-mini |
| Família do modelo | Apodex 1.1 |
| Arquitetura | Qwen3.5-MoE |
| Número de parâmetros | 35B |
| Janela de contexto | 262.144 tokens (256K) |
| Saída máxima | 262.144 tokens (256K) |
| Entrada e saída | Texto para texto |
| Recursos | Chamada de funções, saídas estruturadas, raciocínio |
| Endpoints de API | Chat Completions, Anthropic, Responses |
| Hospedagem | API serverless Novita |
O contexto de 256K do Apodex 1.1 Mini é o motivo mais prático para testá-lo com repositórios grandes, especificações longas ou rastreamentos de agentes em múltiplas etapas. Um contexto grande não significa que cada solicitação deva incluir todo o workspace: remova arquivos irrelevantes, mantenha os resultados das ferramentas limitados e meça tanto a qualidade quanto a latência em entradas representativas.
Como chamar o Apodex 1.1 Mini
Você precisa de uma chave de API da Novita. Crie ou gerencie uma em Key Management e mantenha-a em uma variável de ambiente em vez de colocá-la no controle de versão.
Instale o cliente Python da OpenAI
pip install openai
Envie uma primeira solicitação
O endpoint é compatível com OpenAI, então o cliente padrão da OpenAI só precisa da URL base da Novita, da chave de API e do ID do modelo.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/v3/openai",
)
response = client.chat.completions.create(
model="apodex/apodex-1.1-mini",
messages=[
{
"role": "system",
"content": "You are a concise coding assistant.",
},
{
"role": "user",
"content": "Explain why a database index can speed up a query.",
},
],
max_tokens=512,
)
print(response.choices[0].message.content)
Defina a chave antes de executar o script:
export NOVITA_API_KEY="your_novita_api_key"
python apodex_example.py
Para uma integração HTTP bruta, a solicitação equivalente é:
curl https://api.novita.ai/v3/openai/chat/completions \
-H "Authorization: Bearer $NOVITA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "apodex/apodex-1.1-mini",
"messages": [
{"role": "user", "content": "Give me three names for a log parser."}
],
"max_tokens": 128
}'
Consulte a documentação da API LLM para conhecer o formato de solicitação mais amplo e os padrões de cliente suportados.
Respostas em streaming
Para interfaces de chat, defina stream=True e imprima cada delta conforme chegar. O streaming muda como sua aplicação recebe a resposta; ele não altera o ID do modelo nem a configuração de autenticação.
stream = client.chat.completions.create(
model="apodex/apodex-1.1-mini",
messages=[{"role": "user", "content": "Write a short commit message for a bug fix."}],
max_tokens=128,
stream=True,
)
for chunk in stream:
text = chunk.choices[0].delta.content
if text:
print(text, end="", flush=True)
Como usar a chamada de ferramentas
O catálogo de modelos lista chamada nativa de funções e saídas estruturadas como recursos suportados. Uma definição de ferramenta informa ao modelo o que sua aplicação pode fazer; sua aplicação ainda é responsável pela execução, validação, permissões e pelo resultado final da ferramenta.
tools = [
{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get the current weather for a city.",
"parameters": {
"type": "object",
"properties": {
"city": {"type": "string"},
},
"required": ["city"],
"additionalProperties": False,
},
},
}
]
response = client.chat.completions.create(
model="apodex/apodex-1.1-mini",
messages=[
{"role": "user", "content": "What's the weather in Seattle?"},
],
tools=tools,
tool_choice="auto",
)
message = response.choices[0].message
if message.tool_calls:
tool_call = message.tool_calls[0]
print(tool_call.function.name)
print(tool_call.function.arguments)
Trate os argumentos como saída não confiável do modelo. Analise o JSON, valide a cidade de acordo com suas próprias regras de entrada, aplique autorização antes de chamar um serviço externo e envie o resultado da ferramenta de volta em uma solicitação de acompanhamento. Não deixe que um argumento gerado pelo modelo se torne diretamente um comando de shell, uma instrução SQL ou uma chamada de API privilegiada.
A página do modelo também lista suporte a raciocínio. Os controles exatos de raciocínio e o comportamento da resposta podem variar conforme o cliente e o endpoint, portanto comece com o comportamento padrão e confirme a documentação atual da API antes de depender de um parâmetro de raciocínio específico do provedor.
Quanto custa o Apodex 1.1 Mini?
Em 1º de outubro de 2026, o catálogo de modelos e a página de preços da Novita mostram o Apodex 1.1 Mini como gratuito para tokens de entrada e saída:
| Uso | Preço listado atual |
|---|---|
| Entrada | $0 por milhão de tokens |
| Saída | $0 por milhão de tokens |
Esta é uma promoção de lançamento atual, não uma garantia de acesso gratuito permanente. Preços, limites de taxa e disponibilidade podem mudar. Verifique a página de preços ao vivo da Novita e a página do modelo Apodex imediatamente antes de estimar custos de produção ou se comprometer com uma carga de trabalho de longa duração.
Mesmo com preço listado de $0, defina orçamentos e limites de taxa no nível da aplicação. Solicitações com contexto grande podem consumir computação significativa e podem estar sujeitas a limites de conta, endpoint ou promoção. Registre o uso de tokens nas respostas da API quando disponível e mantenha um modelo reserva configurado se sua aplicação depender de acesso contínuo.
Quem deve usar?
O Apodex 1.1 Mini é um bom candidato para:
- Assistentes de codificação que precisam inspecionar arquivos longos ou contexto de repositório.
- Fluxos de agente que chamam ferramentas e retornam dados estruturados.
- Protótipos onde uma janela de contexto de 256K é útil, mas auto-hospedar um modelo grande é desnecessário.
- Avaliações de inferência MoE, comportamento de contexto longo e fluxos de raciocínio em uma API hospedada.
Pode não ser a escolha certa quando você precisa de entrada de imagem ou áudio, um contrato de preço fixo de longo prazo ou um recurso específico do modelo que a Novita não lista para este endpoint. O catálogo atualmente lista entrada e saída apenas de texto, portanto solicitações multimodais devem usar um modelo cuja página suporte explicitamente essas modalidades.
Para uma avaliação de produção, compare a qualidade das respostas em seus prompts reais, a validade das chamadas de ferramentas, o tempo até o primeiro token, a latência total e o comportamento de corte de contexto. Um único prompt curto não pode dizer se um modelo de contexto longo é adequado para sua aplicação.
Perguntas frequentes
Qual é o ID do modelo Apodex 1.1 Mini?
Use apodex/apodex-1.1-mini no corpo da solicitação.
Quanto contexto o Apodex 1.1 Mini suporta?
A Novita lista uma janela de contexto de 262.144 tokens, exibida como 256K nas páginas do modelo e de preços. A saída máxima listada também é de 262.144 tokens.
O Apodex 1.1 Mini é gratuito no Novita AI?
Os preços de entrada e saída estão atualmente listados como $0 por milhão de tokens em 1º de outubro de 2026. Trate isso como uma promoção de lançamento e verifique a página de preços ao vivo antes de publicar uma estimativa de custo ou implantar em escala.
Ele suporta chamada de funções?
Sim. O catálogo de modelos lista chamada de funções e saídas estruturadas como recursos suportados. Sua aplicação ainda deve validar os argumentos das ferramentas e executá-las com segurança.
Qual API devo usar primeiro?
Use o endpoint Chat Completions compatível com OpenAI em https://api.novita.ai/v3/openai/chat/completions para a integração mais simples. O catálogo de modelos também lista endpoints Anthropic e Responses.
Onde posso experimentar o Apodex 1.1 Mini?
Abra a página do modelo Apodex 1.1 Mini para verificar o status atual e iniciar o playground.
Artigos recomendados
- Como usar a chamada de funções do DeepSeek V3 — Revise o padrão central de chamada de funções e o fluxo de solicitações orientado a ferramentas.
- Como usar o Novita AI com o OpenCode: o guia definitivo de configuração — Conecte um endpoint Novita compatível com OpenAI a um fluxo de codificação.
- Serviços de API LLM comparados: direto, unificado, gateway ou auto-hospedado — Compare abordagens de API hospedada antes de escolher uma estratégia de integração.