Início Rápido da API Macaron V1 Venti: Endpoint de Contexto 1M Grátis na Novita AI

Início Rápido da API Macaron V1 Venti: Endpoint de Contexto 1M Grátis na Novita AI

Macaron V1 Venti é o caminho mais rápido para o modelo Macaron flagship da Novita se você precisa de um fluxo de trabalho com contexto de 1M para codificação, agentes ou GenUI. Comece com uma pequena requisição apenas de texto, depois escale quando o endpoint e a autenticação estiverem funcionando.

Para uma visão geral mais ampla do modelo, veja Macaron V1 Venti na Novita AI.

Quando Usar Este Início Rápido

Use este guia quando sua carga de trabalho precisar de contexto longo, uso de ferramentas ou geração de UI nativa em código, em vez de respostas curtas de chat. A página do modelo Macaron V1 Venti na Novita lista acesso serverless, function calling e raciocínio, com entrada e saída de texto.

Passo 1: Obtenha sua Chave de API da Novita

Crie uma chave de API da Novita e mantenha-a no lado do servidor.

export NOVITA_API_KEY="sua_chave_api_aqui"

Passo 2: Confirme o ID do Modelo e o Endpoint

Campo Valor
ID do Modelo mindai/macaron-v1-venti
URL Base https://api.novita.ai/openai/v1
Endpoint de chat completions https://api.novita.ai/openai/v1/chat/completions
Janela de contexto 1.048.576 tokens
Máximo de tokens de saída 131.072
Entrada Texto
Saída Texto
Recursos API serverless, function calling, raciocínio
Tier de limite de taxa mostrado T1: 30 RPM, 50.000.000 TPM

No momento verificado em 28 de julho de 2026, a Novita listou o Macaron V1 Venti como grátis por tempo limitado com preços de $0 entrada e $0 saída. Verifique a página ativa do modelo antes de orçar para uso em produção.

Passo 3: Envie Sua Primeira Requisição

Comece com um prompt curto apenas de texto para verificar autenticação, roteamento e parsing.

Resuma os principais riscos em uma refatoração em todo o repositório em 5 pontos.

Passo 4: Leia a Resposta

Para chat completions padrão, leia a resposta de choices[0].message.content. Mantenha os metadados da requisição, uso de tokens e status HTTP em seus logs para rastrear chamadas lentas ou caras posteriormente.

Passo 5: Verifique Preços, Limites e Erros Comuns

A listagem atual é mais importante do que uma postagem de blog desatualizada. Reavalie a página do modelo antes do lançamento se você depende de preços grátis, de um tier de taxa específico ou da janela de contexto completa de 1M.

Erros comuns de configuração incluem:

  • Usar o nome de exibição em vez de mindai/macaron-v1-venti.
  • Apontar o SDK para a URL base errada.
  • Enviar um prompt enorme antes de confirmar a conectividade básica.
  • Assumir que toda requisição de contexto longo deve usar o limite máximo de saída.

Exemplo em Python

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-venti",
    messages=[
        {"role": "system", "content": "Você é um assistente de codificação conciso."},
        {"role": "user", "content": "Liste os primeiros passos mais seguros para refatorar um grande monorepo."},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

Exemplo em cURL

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-venti",
    "messages": [
      {
        "role": "system",
        "content": "Você é um assistente de codificação conciso."
      },
      {
        "role": "user",
        "content": "Liste os primeiros passos mais seguros para refatorar um grande monorepo."
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

Parâmetros Principais

Parâmetro Comece com Por que importa
model mindai/macaron-v1-venti Seleciona o modelo hospedado
messages Prompt curto de sistema + usuário Verifica rapidamente o caminho da API
temperature 0.2 Mantém a saída de teste estável
max_tokens 400 Evita respostas iniciais muito grandes
tools Uma função por vez Útil para agentes e fluxos de trabalho
response_format Apenas se seu parser estiver pronto Valide JSON antes de enviar

Prompts para Codificação, Agentes e GenUI

Codificação

Use o Macaron V1 Venti para refatorações conscientes do repositório, planos de migração ou resumos de revisão de código quando o contexto ao redor importa.

Revise este módulo em busca de riscos de migração, identifique mudanças que quebram a compatibilidade e sugira o menor plano de correção segura.

Agentes

Use function calling quando o modelo deve escolher uma ferramenta em vez de responder diretamente.

Chame a ferramenta de consulta de ticket apenas se o usuário referenciar um ID de problema existente. Caso contrário, responda com um plano curto.

GenUI

Use para geração de interface quando você quer ideias de UI estruturadas a partir de um briefing de produto.

Transforme este briefing de produto em um layout de dashboard limpo com seções, ações, estados vazios e regras de validação.

Solução de Problemas

A API retorna um erro de autenticação

Confirme se o token bearer está definido no mesmo shell ou runtime que faz a requisição.

O modelo não pode ser encontrado

Verifique novamente o ID do modelo: mindai/macaron-v1-venti.

A requisição é muito grande

Comece menor, depois adicione contexto gradualmente. Uma janela de 1 milhão de tokens é capacidade, não um sinal para enviar tudo de uma vez.

FAQ

O Macaron V1 Venti está disponível na Novita AI?

Sim. A página ativa do modelo lista-o como um modelo serverless.

Qual endpoint devo usar?

Use https://api.novita.ai/openai/v1/chat/completions.

Ele suporta uso de ferramentas?

Sim. A Novita lista function calling como um recurso do modelo.

O modelo é grátis agora?

A listagem verificada em 28 de julho de 2026 mostrou preços de $0 entrada e $0 saída, marcado como grátis por tempo limitado.

Artigos Recomendados

Fontes verificadas em 28 de julho de 2026: Página do modelo Macaron V1 Venti, Referência da API chat completions da Novita