- Quando Usar Este Guia de Início Rápido
- Passo 1: Obtenha Sua Chave de API da Novita
- Passo 2: Confirme o ID do Modelo e o Endpoint
- Passo 3: Envie Sua Primeira Solicitação
- Passo 4: Leia a Resposta
- Passo 5: Verifique Preços, Limites e Erros Comuns
- Exemplo em Python
- Exemplo com cURL
- Parâmetros Principais
- Prompts para Codificação, Agentes e GenUI
- Solução de Problemas
- Perguntas Frequentes
- Artigos Recomendados
Macaron V1 Venti é o caminho mais rápido para o modelo Macaron principal da Novita se você precisar de um fluxo de trabalho com contexto de 1M para codificação, agentes ou GenUI. Comece com uma solicitação pequena somente de texto e aumente a escala assim que o endpoint e a autenticação estiverem funcionando.
Para uma visão geral mais ampla do modelo, consulte Macaron V1 Venti na Novita AI.
Quando Usar Este Guia de Início Rápido
Use este guia quando sua carga de trabalho precisar de contexto longo, uso de ferramentas ou geração de UI nativa de código, em vez de respostas curtas de chat. A página do modelo Macaron V1 Venti na Novita lista acesso serverless, chamada de função e raciocínio, com entrada e saída de texto.
Passo 1: Obtenha Sua Chave de API da Novita
Crie uma chave de API da Novita e mantenha-a no lado do servidor.
export NOVITA_API_KEY="your_api_key_here"
Passo 2: Confirme o ID do Modelo e o Endpoint
| Campo | Valor |
|---|---|
| ID do modelo | mindai/macaron-v1-venti |
| URL base | https://api.novita.ai/openai/v1 |
| Endpoint de chat completions | https://api.novita.ai/openai/v1/chat/completions |
| Janela de contexto | 1.048.576 tokens |
| Máximo de tokens de saída | 131.072 |
| Entrada | Texto |
| Saída | Texto |
| Recursos | API serverless, chamada de função, raciocínio |
| Nível de limite de taxa exibido | T1: 30 RPM, 50.000.000 TPM |
No momento da verificação em 28 de julho de 2026, a Novita listava o Macaron V1 Venti como gratuito por tempo limitado, com preços de $0 entrada e $0 saída. Verifique a página do modelo ao vivo antes de orçar o uso em produção.
Passo 3: Envie Sua Primeira Solicitação
Comece com um prompt curto somente de texto para verificar autenticação, roteamento e análise.
Summarize the main risks in a repository-wide refactor in 5 bullet points.
Passo 4: Leia a Resposta
Para chat completions padrão, leia a resposta de choices[0].message.content. Mantenha os metadados da solicitação, o uso de tokens e o status HTTP nos seus logs para rastrear chamadas lentas ou caras mais tarde.
Passo 5: Verifique Preços, Limites e Erros Comuns
A listagem atual importa mais do que um post de blog desatualizado. Reverifique a página do modelo antes do lançamento se você depender de preço gratuito, de um nível de taxa específico ou da janela de contexto completa de 1M.
Erros comuns de configuração incluem:
- Usar o nome de exibição em vez de
mindai/macaron-v1-venti. - Apontar o SDK para a URL base errada.
- Enviar um prompt enorme antes de confirmar a conectividade básica.
- Presumir que toda solicitação de contexto longo deva usar o limite máximo de saída.
Exemplo em Python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Exemplo com cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Parâmetros Principais
| Parâmetro | Comece com | Por que é importante |
|---|---|---|
model |
mindai/macaron-v1-venti |
Seleciona o modelo hospedado |
messages |
Prompt curto de sistema + usuário | Verifica o caminho da API rapidamente |
temperature |
0.2 |
Mantém a saída de teste estável |
max_tokens |
400 |
Evita respostas iniciais grandes demais |
tools |
Uma função por vez | Útil para agentes e fluxos de trabalho |
response_format |
Apenas se o seu parser estiver pronto | Valide o JSON antes de enviar para produção |
Prompts para Codificação, Agentes e GenUI
Codificação
Use o Macaron V1 Venti para refatorações conscientes do repositório, planos de migração ou resumos de revisão de código quando o contexto ao redor for importante.
Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.
Agentes
Use a chamada de função quando o modelo deve escolher uma ferramenta em vez de responder diretamente.
Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.
GenUI
Use-o para geração de interface quando quiser ideias estruturadas de UI a partir de um resumo de produto.
Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.
Solução de Problemas
A API retorna um erro de autenticação
Confirme se o token do portador está definido no mesmo shell ou ambiente de execução que faz a solicitação.
O modelo não pode ser encontrado
Verifique novamente o ID do modelo: mindai/macaron-v1-venti.
A solicitação é grande demais
Comece menor e depois adicione contexto gradualmente. Uma janela de 1M de tokens é capacidade, não um sinal para enviar tudo de uma vez.
Perguntas Frequentes
O Macaron V1 Venti está disponível na Novita AI?
Sim. A página do modelo ao vivo o lista como um modelo serverless.
Qual endpoint devo usar?
Use https://api.novita.ai/openai/v1/chat/completions.
Ele suporta uso de ferramentas?
Sim. A Novita lista a chamada de função como um recurso do modelo.
O modelo está gratuito agora?
A listagem verificada em 28 de julho de 2026 mostrou preços de $0 entrada e $0 saída, marcada como gratuita por tempo limitado.
Artigos Recomendados
- Macaron V1 Venti na Novita AI: principal 748B Mixture-of-LoRA para Codificação, Agentes e GenUI
- Início rápido do Macaron V1 Tall para Codificação, Agentes e GenUI
- Como usar o Codex com os modelos da Novita AI: guia de configuração completo
Fontes verificadas em 28 de julho de 2026: página do modelo Macaron V1 Venti, referência da API de chat completions da Novita
