- Quando Usar Este Guia Rápido
- Passo 1: Obtenha sua Chave de API Novita
- Passo 2: Confirme o ID do Modelo e o Endpoint
- Passo 3: Envie Sua Primeira Requisição
- Passo 4: Leia a Resposta
- Passo 5: Verifique Preços, Limites e Erros Comuns
- Exemplo em Python
- Exemplo em cURL
- Parâmetros Chave
- Codificação, Agentes e Prompts GenUI
- Solução de Problemas
- FAQ
- Artigos Recomendados
Macaron V1 Tall é a opção Macaron mais leve quando você precisa de contexto longo sem pular direto para o modelo principal. Use-o para codificação, loops de agente ou prompts GenUI, e comece com uma requisição pequena apenas de texto antes de expandir para fluxos de trabalho mais longos.
Se você está escolhendo a stack de codificação Python ao redor dele, compare Best AI for Coding Python in 2026.
Para a visão geral do modelo, veja Macaron V1 Tall on Novita AI.
Para a comparação com o modelo principal, veja Macaron V1 Venti on Novita AI.
Quando Usar Este Guia Rápido
Use este guia quando sua carga de trabalho precisar de contexto suficiente para carregar o estado do repositório, rastros de ferramentas ou especificações de UI, mas não precisar da maior janela de contexto do catálogo.
Passo 1: Obtenha sua Chave de API Novita
Crie uma chave de API Novita e mantenha-a no lado do servidor.
export NOVITA_API_KEY="sua_chave_api_aqui"
Passo 2: Confirme o ID do Modelo e o Endpoint
| Campo | Valor |
|---|---|
| ID do modelo | mindai/macaron-v1-tall |
| URL base | https://api.novita.ai/openai/v1 |
| Endpoint de completions de chat | https://api.novita.ai/openai/v1/chat/completions |
| Janela de contexto | 262.144 tokens |
| Máximo de tokens de saída | 32.768 |
| Entrada | Texto |
| Saída | Texto |
| Hospedagem | API serverless do Novita AI |
No momento verificado em 29 de julho de 2026, a Novita listava o Macaron V1 Tall como gratuito por tempo limitado com preço de $0 entrada e $0 saída. Verifique a página do modelo ao vivo antes de orçar o uso em produção.
Passo 3: Envie Sua Primeira Requisição
Comece com um prompt curto apenas de texto para verificar autenticação, roteamento e parsing.
Resuma os principais riscos em uma refatoração em todo o repositório em 5 tópicos.
Passo 4: Leia a Resposta
Para completions de chat padrão, leia a resposta de choices[0].message.content. Mantenha metadados da requisição, uso de tokens e status HTTP em seus logs para que você possa rastrear chamadas lentas ou caras mais tarde.
Passo 5: Verifique Preços, Limites e Erros Comuns
A listagem atual é mais importante do que uma postagem de blog desatualizada. Reconfira a página do modelo antes do lançamento se você depende de preços gratuitos ou da janela completa de 262K de contexto.
Erros comuns de configuração incluem:
- Usar o nome de exibição em vez de
mindai/macaron-v1-tall. - Apontar o SDK para a URL base errada.
- Enviar um prompt enorme antes de confirmar a conectividade básica.
- Assumir que toda requisição de contexto longo deve usar o limite máximo de saída.
Exemplo em Python
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-tall",
messages=[
{"role": "system", "content": "Você é um assistente de codificação conciso."},
{"role": "user", "content": "Liste os primeiros passos mais seguros para refatorar um grande monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
Exemplo em cURL
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-tall",
"messages": [
{
"role": "system",
"content": "Você é um assistente de codificação conciso."
},
{
"role": "user",
"content": "Liste os primeiros passos mais seguros para refatorar um grande monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
Parâmetros Chave
| Parâmetro | Comece com | Por que é importante |
|---|---|---|
model |
mindai/macaron-v1-tall |
Seleciona o modelo hospedado |
messages |
Prompt curto de sistema + usuário | Verifica rapidamente o caminho da API |
temperature |
0.2 |
Mantém a saída de teste estável |
max_tokens |
400 |
Evita respostas iniciais muito grandes |
tools |
Uma função por vez | Útil para agentes e fluxos de trabalho |
response_format |
Apenas se seu parser estiver pronto | Valide JSON antes de enviar |
Codificação, Agentes e Prompts GenUI
Codificação
Use o Macaron V1 Tall para refatorações cientes do repositório, planos de migração ou resumos de revisão de código quando o contexto ao redor for importante.
Revise este módulo para riscos de migração, identifique mudanças que quebram compatibilidade e sugira o menor plano de correção seguro.
Agentes
Use chamada de função quando o modelo deve escolher uma ferramenta em vez de responder diretamente.
Chame a ferramenta de consulta de ticket apenas se o usuário referenciar um ID de issue existente. Caso contrário, responda com um plano curto.
GenUI
Use para geração de interface quando você deseja ideias de UI estruturadas a partir de um briefing de produto.
Transforme este briefing de produto em um layout de dashboard limpo com seções, ações, estados vazios e regras de validação.
Solução de Problemas
A API retorna um erro de autenticação
Confirme que o token bearer está definido no mesmo shell ou runtime que faz a requisição.
O modelo não pode ser encontrado
Verifique novamente o ID do modelo: mindai/macaron-v1-tall.
A requisição é muito grande
Comece menor e adicione contexto gradualmente. Uma janela de 262K tokens é capacidade, não um sinal para enviar tudo de uma vez.
FAQ
O Macaron V1 Tall está disponível no Novita AI?
Sim. A listagem ao vivo mostra ele como um modelo serverless.
Qual endpoint devo usar?
Use https://api.novita.ai/openai/v1/chat/completions.
Ele suporta uso de ferramentas?
Verifique a página do modelo ao vivo para os rótulos de recursos atuais antes de depender de chamadas de ferramentas em produção.
O modelo é gratuito agora?
A listagem verificada em 29 de julho de 2026 mostrava preço de $0 entrada e $0 saída, marcado como gratuito por tempo limitado.
Artigos Recomendados
- Macaron V1 Tall on Novita AI: Free 262K-Context MoL Model for Chat, Agents, and Coding
- Macaron V1 Venti Quick Start on Novita AI: 1M Context, Endpoint, and Examples
- Macaron V1 Venti on Novita AI: 748B Mixture-of-LoRA Flagship for Coding, Agents, and GenUI
Fontes verificadas em 29 de julho de 2026: Novita AI model library, Novita chat completions API reference
