Macaron V1 Tall: Guia Rápido para Codificação, Agentes e GenUI

Macaron V1 Tall: Guia Rápido para Codificação, Agentes e GenUI

O Macaron V1 Tall está disponível na Novita AI através da API de chat completions compatível com OpenAI. Use-o quando você precisar de uma janela de contexto de tamanho médio para codificação, loops de agente ou prompts de GenUI, e comece com uma requisição pequena apenas de texto antes de expandir para fluxos de trabalho mais longos.

Quando Usar Este Guia Rápido

Use este guia quando sua carga de trabalho precisar de contexto suficiente para carregar estado do repositório, rastros de ferramentas ou especificações de UI, mas não precisar da maior janela de contexto do catálogo.

Passo 1: Obtenha sua Chave de API da Novita

Crie uma chave de API da Novita e mantenha-a no lado do servidor.

export NOVITA_API_KEY="sua_chave_api_aqui"

Passo 2: Confirme o ID do Modelo e o Endpoint

Campo Valor
ID do Modelo mindai/macaron-v1-tall
URL Base https://api.novita.ai/openai/v1
Endpoint de chat completions https://api.novita.ai/openai/v1/chat/completions
Janela de contexto 262.144 tokens
Máximo de tokens de saída 32.768
Entrada Texto
Saída Texto
Hospedagem API serverless da Novita AI

No momento da verificação em 29 de julho de 2026, a Novita listava o Macaron V1 Tall como gratuito por tempo limitado com $0 de entrada e $0 de saída. Verifique a página do modelo ao vivo antes de orçar o uso em produção.

Passo 3: Envie Sua Primeira Requisição

Comece com um prompt curto apenas de texto para verificar autenticação, roteamento e análise.

Resuma os principais riscos em uma refatoração em todo o repositório em 5 tópicos.

Passo 4: Leia a Resposta

Para chat completions padrão, leia a resposta de choices[0].message.content. Mantenha metadados da requisição, uso de tokens e status HTTP em seus logs para que você possa rastrear chamadas lentas ou caras posteriormente.

Passo 5: Verifique Preços, Limites e Erros Comuns

A listagem atual é mais importante do que uma postagem de blog desatualizada. Reconfira a página do modelo antes do lançamento se você depender de preços gratuitos ou da janela de contexto completa de 262K.

Erros comuns de configuração incluem:

  • Usar o nome de exibição em vez de mindai/macaron-v1-tall.
  • Apontar o SDK para a URL base errada.
  • Enviar um prompt enorme antes de confirmar a conectividade básica.
  • Assumir que toda requisição de contexto longo deve usar o limite máximo de saída.

Exemplo em Python

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-tall",
    messages=[
        {"role": "system", "content": "Você é um assistente de codificação conciso."},
        {"role": "user", "content": "Liste os primeiros passos mais seguros para refatorar um grande monorepo."},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

Exemplo em cURL

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-tall",
    "messages": [
      {
        "role": "system",
        "content": "Você é um assistente de codificação conciso."
      },
      {
        "role": "user",
        "content": "Liste os primeiros passos mais seguros para refatorar um grande monorepo."
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

Parâmetros Principais

Parâmetro Comece com Por que é importante
model mindai/macaron-v1-tall Seleciona o modelo hospedado
messages Prompt curto de sistema + usuário Verifica o caminho da API rapidamente
temperature 0.2 Mantém a saída de teste estável
max_tokens 400 Evita primeiras respostas muito grandes
tools Uma função por vez Útil para agentes e fluxos de trabalho
response_format Apenas se seu parser estiver pronto Valide JSON antes de lançar

Prompts para Codificação, Agentes e GenUI

Codificação

Use o Macaron V1 Tall para refatorações com consciência do repositório, planos de migração ou resumos de revisão de código quando o contexto ao redor for importante.

Revise este módulo para riscos de migração, identifique mudanças que quebram compatibilidade e sugira o menor plano de correção seguro.

Agentes

Use chamada de função quando o modelo deve escolher uma ferramenta em vez de responder diretamente.

Chame a ferramenta de consulta de ticket apenas se o usuário fizer referência a um ID de issue existente. Caso contrário, responda com um plano curto.

GenUI

Use para geração de interface quando você deseja ideias de UI estruturadas a partir de um resumo de produto.

Transforme este resumo de produto em um layout de dashboard limpo com seções, ações, estados vazios e regras de validação.

Solução de Problemas

A API retorna um erro de autenticação

Confirme que o token de portador está definido no mesmo shell ou runtime que faz a requisição.

O modelo não pode ser encontrado

Verifique novamente o ID do modelo: mindai/macaron-v1-tall.

A requisição é muito grande

Comece menor e adicione contexto gradualmente. Uma janela de 262K tokens é capacidade, não um sinal para enviar tudo de uma vez.

FAQ

O Macaron V1 Tall está disponível na Novita AI?

Sim. A listagem ao vivo mostra-o como um modelo serverless.

Qual endpoint devo usar?

Use https://api.novita.ai/openai/v1/chat/completions.

Ele suporta uso de ferramentas?

Verifique a página do modelo ao vivo para os rótulos de recursos atuais antes de depender de chamadas de ferramentas em produção.

O modelo é gratuito agora?

A listagem verificada em 29 de julho de 2026 mostrava preços de $0 de entrada e $0 de saída, marcado como gratuito por tempo limitado.

Artigos Recomendados

Fontes verificadas em 29 de julho de 2026: Biblioteca de modelos da Novita AI, Referência da API de chat completions da Novita