- Quando Usar Este Início Rápido
- Passo 1: Obtenha sua Chave de API da Novita
- Passo 2: Confirme o ID do Modelo e o Endpoint
- Passo 3: Envie Sua Primeira Requisição
- Passo 4: Leia a Resposta
- Passo 5: Verifique Preços, Limites e Erros Comuns
- Exemplo em Python
- Exemplo em cURL
- Parâmetros Principais
- Prompts para Codificação, Agentes e GenUI
- Solução de Problemas
- FAQ
- Artigos Recomendados
Macaron V1 Venti é o caminho mais rápido para o modelo Macaron flagship da Novita se você precisa de um fluxo de trabalho com contexto de 1M para codificação, agentes ou GenUI. Comece com uma pequena requisição apenas de texto, depois escale quando o endpoint e a autenticação estiverem funcionando.
Para uma visão geral mais ampla do modelo, veja Macaron V1 Venti na Novita AI.
Quando Usar Este Início Rápido
Use este guia quando sua carga de trabalho precisar de contexto longo, uso de ferramentas ou geração de UI nativa em código, em vez de respostas curtas de chat. A página do modelo Macaron V1 Venti na Novita lista acesso serverless, function calling e raciocínio, com entrada e saída de texto.
Passo 1: Obtenha sua Chave de API da Novita
Crie uma chave de API da Novita e mantenha-a no lado do servidor.
export NOVITA_API_KEY="sua_chave_api_aqui"
Passo 2: Confirme o ID do Modelo e o Endpoint
| Campo | Valor |
|---|---|
| ID do Modelo | mindai/macaron-v1-venti |
| URL Base | https://api.novita.ai/openai/v1 |
| Endpoint de chat completions | https://api.novita.ai/openai/v1/chat/completions |
| Janela de contexto | 1.048.576 tokens |
| Máximo de tokens de saída | 131.072 |
| Entrada | Texto |
| Saída | Texto |
| Recursos | API serverless, function calling, raciocínio |
| Tier de limite de taxa mostrado | T1: 30 RPM, 50.000.000 TPM |
No momento verificado em 28 de julho de 2026, a Novita listou o Macaron V1 Venti como grátis por tempo limitado com preços de $0 entrada e $0 saída. Verifique a página ativa do modelo antes de orçar para uso em produção.
Passo 3: Envie Sua Primeira Requisição
Comece com um prompt curto apenas de texto para verificar autenticação, roteamento e parsing.
Resuma os principais riscos em uma refatoração em todo o repositório em 5 pontos.
Passo 4: Leia a Resposta
Para chat completions padrão, leia a resposta de choices[0].message.content. Mantenha os metadados da requisição, uso de tokens e status HTTP em seus logs para rastrear chamadas lentas ou caras posteriormente.
Passo 5: Verifique Preços, Limites e Erros Comuns
A listagem atual é mais importante do que uma postagem de blog desatualizada. Reavalie a página do modelo antes do lançamento se você depende de preços grátis, de um tier de taxa específico ou da janela de contexto completa de 1M.
Erros comuns de configuração incluem:
- Usar o nome de exibição em vez de
mindai/macaron-v1-venti. - Apontar o SDK para a URL base errada.
- Enviar um prompt enorme antes de confirmar a conectividade básica.
- Assumir que toda requisição de contexto longo deve usar o limite máximo de saída.
Exemplo em Python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "Você é um assistente de codificação conciso."},
{"role": "user", "content": "Liste os primeiros passos mais seguros para refatorar um grande monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Exemplo em cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "Você é um assistente de codificação conciso."
},
{
"role": "user",
"content": "Liste os primeiros passos mais seguros para refatorar um grande monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Parâmetros Principais
| Parâmetro | Comece com | Por que importa |
|---|---|---|
model |
mindai/macaron-v1-venti |
Seleciona o modelo hospedado |
messages |
Prompt curto de sistema + usuário | Verifica rapidamente o caminho da API |
temperature |
0.2 |
Mantém a saída de teste estável |
max_tokens |
400 |
Evita respostas iniciais muito grandes |
tools |
Uma função por vez | Útil para agentes e fluxos de trabalho |
response_format |
Apenas se seu parser estiver pronto | Valide JSON antes de enviar |
Prompts para Codificação, Agentes e GenUI
Codificação
Use o Macaron V1 Venti para refatorações conscientes do repositório, planos de migração ou resumos de revisão de código quando o contexto ao redor importa.
Revise este módulo em busca de riscos de migração, identifique mudanças que quebram a compatibilidade e sugira o menor plano de correção segura.
Agentes
Use function calling quando o modelo deve escolher uma ferramenta em vez de responder diretamente.
Chame a ferramenta de consulta de ticket apenas se o usuário referenciar um ID de problema existente. Caso contrário, responda com um plano curto.
GenUI
Use para geração de interface quando você quer ideias de UI estruturadas a partir de um briefing de produto.
Transforme este briefing de produto em um layout de dashboard limpo com seções, ações, estados vazios e regras de validação.
Solução de Problemas
A API retorna um erro de autenticação
Confirme se o token bearer está definido no mesmo shell ou runtime que faz a requisição.
O modelo não pode ser encontrado
Verifique novamente o ID do modelo: mindai/macaron-v1-venti.
A requisição é muito grande
Comece menor, depois adicione contexto gradualmente. Uma janela de 1 milhão de tokens é capacidade, não um sinal para enviar tudo de uma vez.
FAQ
O Macaron V1 Venti está disponível na Novita AI?
Sim. A página ativa do modelo lista-o como um modelo serverless.
Qual endpoint devo usar?
Use https://api.novita.ai/openai/v1/chat/completions.
Ele suporta uso de ferramentas?
Sim. A Novita lista function calling como um recurso do modelo.
O modelo é grátis agora?
A listagem verificada em 28 de julho de 2026 mostrou preços de $0 entrada e $0 saída, marcado como grátis por tempo limitado.
Artigos Recomendados
- Macaron V1 Venti na Novita AI: 748B Mixture-of-LoRA Flagship para Codificação, Agentes e GenUI
- Início Rápido do Macaron V1 Tall para Codificação, Agentes e GenUI
- Como Usar Codex com Modelos da Novita AI: Guia de Configuração Completo
Fontes verificadas em 28 de julho de 2026: Página do modelo Macaron V1 Venti, Referência da API chat completions da Novita
