- Quando Usar Este Guia de Início Rápido
- Etapa 1: Obtenha sua Chave de API da Novita
- Etapa 2: Confirme o ID do Modelo e o Endpoint
- Etapa 3: Envie Sua Primeira Solicitação
- Etapa 4: Leia a Resposta
- Etapa 5: Verifique Preços, Limites e Erros Comuns
- Exemplo em Python
- Exemplo com cURL
- Parâmetros Principais
- Prompts para Codificação, Agentes e GenUI
- Solução de Problemas
- Perguntas Frequentes
- Artigos Recomendados
Macaron V1 Tall é a opção Macaron mais leve quando você precisa de contexto longo sem ir direto para o modelo principal. Use-o para codificação, loops de agentes ou prompts de GenUI, e comece com uma pequena solicitação somente de texto antes de expandir para fluxos de trabalho mais longos.
Para a visão geral do modelo, consulte Macaron V1 Tall na Novita AI.
Para a comparação com o modelo principal, consulte Macaron V1 Venti na Novita AI.
Quando Usar Este Guia de Início Rápido
Use este guia quando sua carga de trabalho precisar de contexto suficiente para carregar o estado do repositório, rastros de ferramentas ou especificações de UI, mas não precisar da maior janela de contexto do catálogo.
Etapa 1: Obtenha sua Chave de API da Novita
Crie uma chave de API da Novita e mantenha-a no lado do servidor.
export NOVITA_API_KEY="your_api_key_here"
Etapa 2: Confirme o ID do Modelo e o Endpoint
| Campo | Valor |
|---|---|
| ID do modelo | mindai/macaron-v1-tall |
| URL base | https://api.novita.ai/openai/v1 |
| Endpoint de conclusão de chat | https://api.novita.ai/openai/v1/chat/completions |
| Janela de contexto | 262.144 tokens |
| Máximo de tokens de saída | 32.768 |
| Entrada | Texto |
| Saída | Texto |
| Hospedagem | API serverless da Novita AI |
No momento da verificação em 29 de julho de 2026, a Novita listou o Macaron V1 Tall como grátis por tempo limitado, com preço de US$ 0 de entrada e US$ 0 de saída. Verifique a página ao vivo do modelo antes de orçar o uso em produção.
Etapa 3: Envie Sua Primeira Solicitação
Comece com um prompt curto somente de texto para verificar autenticação, roteamento e análise.
Summarize the main risks in a repository-wide refactor in 5 bullet points.
Etapa 4: Leia a Resposta
Para conclusões de chat padrão, leia a resposta em choices[0].message.content. Mantenha metadados da solicitação, uso de tokens e status HTTP em seus logs para que você possa rastrear chamadas lentas ou caras posteriormente.
Etapa 5: Verifique Preços, Limites e Erros Comuns
A listagem atual importa mais do que uma postagem desatualizada. Reconsulte a página do modelo antes do lançamento se você depender de preço gratuito ou da janela de contexto completa de 262K.
Erros comuns de configuração incluem:
- Usar o nome de exibição em vez de
mindai/macaron-v1-tall. - Apontar o SDK para a URL base errada.
- Enviar um prompt enorme antes de confirmar a conectividade básica.
- Supor que toda solicitação de contexto longo deve usar o limite máximo de saída.
Exemplo em Python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-tall",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Exemplo com cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-tall",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Parâmetros Principais
| Parâmetro | Comece com | Por que é importante |
|---|---|---|
model |
mindai/macaron-v1-tall |
Seleciona o modelo hospedado |
messages |
Prompt curto de sistema + usuário | Verifica rapidamente o caminho da API |
temperature |
0.2 |
Mantém a saída de teste estável |
max_tokens |
400 |
Evita respostas iniciais grandes demais |
tools |
Uma função por vez | Útil para agentes e fluxos de trabalho |
response_format |
Somente se o seu parser estiver pronto | Valide o JSON antes de enviar |
Prompts para Codificação, Agentes e GenUI
Codificação
Use o Macaron V1 Tall para refatorações que consideram o repositório, planos de migração ou resumos de revisão de código quando o contexto ao redor importa.
Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.
Agentes
Use function calling quando o modelo deve escolher uma ferramenta em vez de responder diretamente.
Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.
GenUI
Use para geração de interfaces quando você quer ideias de UI estruturadas a partir de um resumo de produto.
Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.
Solução de Problemas
A API retorna um erro de autenticação
Confirme se o token de portador está definido no mesmo shell ou runtime que faz a solicitação.
Não é possível encontrar o modelo
Verifique novamente o ID do modelo: mindai/macaron-v1-tall.
A solicitação é grande demais
Comece com menos e adicione contexto gradualmente. Uma janela de 262K tokens é capacidade, não um sinal para enviar tudo de uma vez.
Perguntas Frequentes
O Macaron V1 Tall está disponível na Novita AI?
Sim. A listagem ao vivo mostra que ele é um modelo serverless.
Qual endpoint devo usar?
Use https://api.novita.ai/openai/v1/chat/completions.
Ele suporta uso de ferramentas?
Verifique a página ao vivo do modelo para obter os rótulos de recursos atuais antes de depender de chamadas de ferramentas em produção.
O modelo está gratuito agora?
A listagem verificada em 29 de julho de 2026 mostrou preço de US$ 0 de entrada e US$ 0 de saída, marcado como grátis por tempo limitado.
Artigos Recomendados
- Macaron V1 Tall na Novita AI: modelo MoL gratuito de contexto 262K para chat, agentes e codificação
- Guia de início rápido do Macaron V1 Venti na Novita AI: contexto 1M, endpoint e exemplos
- Macaron V1 Venti na Novita AI: carro-chefe Mixture-of-LoRA de 748B para codificação, agentes e GenUI
Fontes consultadas em 29 de julho de 2026: Biblioteca de modelos da Novita AI, Referência da API de conclusão de chat da Novita
