- Quando Usar Este Início Rápido
- Passo 1: Obtenha sua Chave de API da Novita
- Passo 2: Confirme o ID do Modelo e o Endpoint
- Passo 3: Envie sua Primeira Solicitação
- Passo 4: Leia a Resposta
- Passo 5: Verifique Preços, Limites e Erros Comuns
- Exemplo em Python
- Exemplo em cURL
- Parâmetros Principais
- Prompts para Codificação, Agentes e GenUI
- Solução de Problemas
- FAQ
- Artigos Recomendados
O Macaron V1 Venti está disponível na Novita AI através da API de chat completions compatível com OpenAI. Use-o quando precisar de uma janela de contexto muito grande para codificação, loops de agentes ou prompts de GenUI, e comece com uma solicitação pequena apenas de texto antes de expandir para fluxos de trabalho mais longos.
Para uma visão geral mais ampla do modelo, veja Macaron V1 Venti na Novita AI.
Quando Usar Este Início Rápido
Use este guia quando sua carga de trabalho precisar de contexto longo, uso de ferramentas ou geração de interface nativa de código, em vez de respostas curtas de chat. A página do modelo Macaron V1 Venti na Novita lista acesso serverless, chamada de função e raciocínio, com entrada e saída de texto.
Passo 1: Obtenha sua Chave de API da Novita
Crie uma chave de API da Novita e mantenha-a no lado do servidor.
export NOVITA_API_KEY="sua_chave_api_aqui"
Passo 2: Confirme o ID do Modelo e o Endpoint
| Campo | Valor |
|---|---|
| ID do Modelo | mindai/macaron-v1-venti |
| URL Base | https://api.novita.ai/openai/v1 |
| Endpoint de chat completions | https://api.novita.ai/openai/v1/chat/completions |
| Janela de contexto | 1.048.576 tokens |
| Máximo de tokens de saída | 131.072 |
| Entrada | Texto |
| Saída | Texto |
| Recursos | API serverless, chamada de função, raciocínio |
| Nível de limite de taxa mostrado | T1: 30 RPM, 50.000.000 TPM |
No momento verificado em 28 de julho de 2026, a Novita listava o Macaron V1 Venti como gratuito por tempo limitado com $0 de entrada e $0 de saída. Verifique a página do modelo ao vivo antes de orçar o uso em produção.
Passo 3: Envie sua Primeira Solicitação
Comece com um prompt curto apenas de texto para verificar autenticação, roteamento e análise.
Resuma os principais riscos em uma refatoração em todo o repositório em 5 pontos.
Passo 4: Leia a Resposta
Para chat completions padrão, leia a resposta de choices[0].message.content. Mantenha metadados da solicitação, uso de tokens e status HTTP em seus logs para rastrear chamadas lentas ou caras posteriormente.
Passo 5: Verifique Preços, Limites e Erros Comuns
A listagem atual é mais importante do que uma postagem de blog desatualizada. Reconfira a página do modelo antes do lançamento se você depender de preços gratuitos, de um nível de taxa específico ou da janela completa de 1M de contexto.
Erros comuns de configuração incluem:
- Usar o nome de exibição em vez de
mindai/macaron-v1-venti. - Apontar o SDK para a URL base errada.
- Enviar um prompt enorme antes de confirmar a conectividade básica.
- Assumir que toda solicitação de contexto longo deve usar o limite máximo de saída.
Exemplo em Python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "Você é um assistente de codificação conciso."},
{"role": "user", "content": "Liste os primeiros passos mais seguros para refatorar um monorepo grande."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Exemplo em cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "Você é um assistente de codificação conciso."
},
{
"role": "user",
"content": "Liste os primeiros passos mais seguros para refatorar um monorepo grande."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Parâmetros Principais
| Parâmetro | Comece com | Por que é importante |
|---|---|---|
model |
mindai/macaron-v1-venti |
Seleciona o modelo hospedado |
messages |
Prompt curto de sistema + usuário | Verifica rapidamente o caminho da API |
temperature |
0.2 |
Mantém a saída do teste estável |
max_tokens |
400 |
Evita respostas iniciais muito grandes |
tools |
Uma função por vez | Útil para agentes e fluxos de trabalho |
response_format |
Apenas se seu analisador estiver pronto | Valide JSON antes de enviar |
Prompts para Codificação, Agentes e GenUI
Codificação
Use o Macaron V1 Venti para refatorações com consciência de repositório, planos de migração ou resumos de revisão de código quando o contexto ao redor for importante.
Revise este módulo quanto a riscos de migração, identifique mudanças que quebram a compatibilidade e sugira o menor plano de correção seguro.
Agentes
Use chamada de função quando o modelo deve escolher uma ferramenta em vez de responder diretamente.
Chame a ferramenta de consulta de ticket apenas se o usuário referenciar um ID de problema existente. Caso contrário, responda com um plano curto.
GenUI
Use para geração de interface quando quiser ideias de UI estruturadas a partir de um resumo de produto.
Transforme este resumo de produto em um layout de painel limpo com seções, ações, estados vazios e regras de validação.
Solução de Problemas
A API retorna um erro de autenticação
Confirme que o token de portador está definido no mesmo shell ou ambiente de execução que faz a solicitação.
O modelo não pode ser encontrado
Verifique novamente o ID do modelo: mindai/macaron-v1-venti.
A solicitação é muito grande
Comece menor e adicione contexto gradualmente. Uma janela de 1M de tokens é capacidade, não um sinal para enviar tudo de uma vez.
FAQ
O Macaron V1 Venti está disponível na Novita AI?
Sim. A página do modelo ao vivo o lista como um modelo serverless.
Qual endpoint devo usar?
Use https://api.novita.ai/openai/v1/chat/completions.
Ele suporta uso de ferramentas?
Sim. A Novita lista chamada de função como um recurso do modelo.
O modelo é gratuito agora?
A listagem verificada em 28 de julho de 2026 mostrava preços de $0 de entrada e $0 de saída, marcado como gratuito por tempo limitado.
Artigos Recomendados
- Macaron V1 Venti na Novita AI: Flagship 748B Mixture-of-LoRA para Codificação, Agentes e GenUI
- Como Usar o Codex com Modelos da Novita AI: Guia de Configuração Completo
- Como Usar Chamada de Função do DeepSeek V3
Fontes verificadas em 28 de julho de 2026: Página do modelo Macaron V1 Venti, Referência da API de chat completions da Novita
