Início Rápido do Macaron V1 Venti para Codificação, Agentes e GenUI

Início Rápido do Macaron V1 Venti para Codificação, Agentes e GenUI

O Macaron V1 Venti está disponível na Novita AI através da API de chat completions compatível com OpenAI. Use-o quando precisar de uma janela de contexto muito grande para codificação, loops de agentes ou prompts de GenUI, e comece com uma solicitação pequena apenas de texto antes de expandir para fluxos de trabalho mais longos.

Para uma visão geral mais ampla do modelo, veja Macaron V1 Venti na Novita AI.

Quando Usar Este Início Rápido

Use este guia quando sua carga de trabalho precisar de contexto longo, uso de ferramentas ou geração de interface nativa de código, em vez de respostas curtas de chat. A página do modelo Macaron V1 Venti na Novita lista acesso serverless, chamada de função e raciocínio, com entrada e saída de texto.

Passo 1: Obtenha sua Chave de API da Novita

Crie uma chave de API da Novita e mantenha-a no lado do servidor.

export NOVITA_API_KEY="sua_chave_api_aqui"

Passo 2: Confirme o ID do Modelo e o Endpoint

Campo Valor
ID do Modelo mindai/macaron-v1-venti
URL Base https://api.novita.ai/openai/v1
Endpoint de chat completions https://api.novita.ai/openai/v1/chat/completions
Janela de contexto 1.048.576 tokens
Máximo de tokens de saída 131.072
Entrada Texto
Saída Texto
Recursos API serverless, chamada de função, raciocínio
Nível de limite de taxa mostrado T1: 30 RPM, 50.000.000 TPM

No momento verificado em 28 de julho de 2026, a Novita listava o Macaron V1 Venti como gratuito por tempo limitado com $0 de entrada e $0 de saída. Verifique a página do modelo ao vivo antes de orçar o uso em produção.

Passo 3: Envie sua Primeira Solicitação

Comece com um prompt curto apenas de texto para verificar autenticação, roteamento e análise.

Resuma os principais riscos em uma refatoração em todo o repositório em 5 pontos.

Passo 4: Leia a Resposta

Para chat completions padrão, leia a resposta de choices[0].message.content. Mantenha metadados da solicitação, uso de tokens e status HTTP em seus logs para rastrear chamadas lentas ou caras posteriormente.

Passo 5: Verifique Preços, Limites e Erros Comuns

A listagem atual é mais importante do que uma postagem de blog desatualizada. Reconfira a página do modelo antes do lançamento se você depender de preços gratuitos, de um nível de taxa específico ou da janela completa de 1M de contexto.

Erros comuns de configuração incluem:

  • Usar o nome de exibição em vez de mindai/macaron-v1-venti.
  • Apontar o SDK para a URL base errada.
  • Enviar um prompt enorme antes de confirmar a conectividade básica.
  • Assumir que toda solicitação de contexto longo deve usar o limite máximo de saída.

Exemplo em Python

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-venti",
    messages=[
        {"role": "system", "content": "Você é um assistente de codificação conciso."},
        {"role": "user", "content": "Liste os primeiros passos mais seguros para refatorar um monorepo grande."},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

Exemplo em cURL

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-venti",
    "messages": [
      {
        "role": "system",
        "content": "Você é um assistente de codificação conciso."
      },
      {
        "role": "user",
        "content": "Liste os primeiros passos mais seguros para refatorar um monorepo grande."
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

Parâmetros Principais

Parâmetro Comece com Por que é importante
model mindai/macaron-v1-venti Seleciona o modelo hospedado
messages Prompt curto de sistema + usuário Verifica rapidamente o caminho da API
temperature 0.2 Mantém a saída do teste estável
max_tokens 400 Evita respostas iniciais muito grandes
tools Uma função por vez Útil para agentes e fluxos de trabalho
response_format Apenas se seu analisador estiver pronto Valide JSON antes de enviar

Prompts para Codificação, Agentes e GenUI

Codificação

Use o Macaron V1 Venti para refatorações com consciência de repositório, planos de migração ou resumos de revisão de código quando o contexto ao redor for importante.

Revise este módulo quanto a riscos de migração, identifique mudanças que quebram a compatibilidade e sugira o menor plano de correção seguro.

Agentes

Use chamada de função quando o modelo deve escolher uma ferramenta em vez de responder diretamente.

Chame a ferramenta de consulta de ticket apenas se o usuário referenciar um ID de problema existente. Caso contrário, responda com um plano curto.

GenUI

Use para geração de interface quando quiser ideias de UI estruturadas a partir de um resumo de produto.

Transforme este resumo de produto em um layout de painel limpo com seções, ações, estados vazios e regras de validação.

Solução de Problemas

A API retorna um erro de autenticação

Confirme que o token de portador está definido no mesmo shell ou ambiente de execução que faz a solicitação.

O modelo não pode ser encontrado

Verifique novamente o ID do modelo: mindai/macaron-v1-venti.

A solicitação é muito grande

Comece menor e adicione contexto gradualmente. Uma janela de 1M de tokens é capacidade, não um sinal para enviar tudo de uma vez.

FAQ

O Macaron V1 Venti está disponível na Novita AI?

Sim. A página do modelo ao vivo o lista como um modelo serverless.

Qual endpoint devo usar?

Use https://api.novita.ai/openai/v1/chat/completions.

Ele suporta uso de ferramentas?

Sim. A Novita lista chamada de função como um recurso do modelo.

O modelo é gratuito agora?

A listagem verificada em 28 de julho de 2026 mostrava preços de $0 de entrada e $0 de saída, marcado como gratuito por tempo limitado.

Artigos Recomendados

Fontes verificadas em 28 de julho de 2026: Página do modelo Macaron V1 Venti, Referência da API de chat completions da Novita