Macaron V1 Venti Quick Start na Novita AI: Contexto de 1M, Endpoint e Exemplos

Macaron V1 Venti Quick Start na Novita AI: Contexto de 1M, Endpoint e Exemplos

Macaron V1 Venti é o caminho mais rápido para o modelo Macaron principal da Novita se você precisar de um fluxo de trabalho com contexto de 1M para codificação, agentes ou GenUI. Comece com uma solicitação pequena somente de texto e aumente a escala assim que o endpoint e a autenticação estiverem funcionando.

Para uma visão geral mais ampla do modelo, consulte Macaron V1 Venti na Novita AI.

Quando Usar Este Guia de Início Rápido

Use este guia quando sua carga de trabalho precisar de contexto longo, uso de ferramentas ou geração de UI nativa de código, em vez de respostas curtas de chat. A página do modelo Macaron V1 Venti na Novita lista acesso serverless, chamada de função e raciocínio, com entrada e saída de texto.

Passo 1: Obtenha Sua Chave de API da Novita

Crie uma chave de API da Novita e mantenha-a no lado do servidor.

export NOVITA_API_KEY="your_api_key_here"

Passo 2: Confirme o ID do Modelo e o Endpoint

Campo Valor
ID do modelo mindai/macaron-v1-venti
URL base https://api.novita.ai/openai/v1
Endpoint de chat completions https://api.novita.ai/openai/v1/chat/completions
Janela de contexto 1.048.576 tokens
Máximo de tokens de saída 131.072
Entrada Texto
Saída Texto
Recursos API serverless, chamada de função, raciocínio
Nível de limite de taxa exibido T1: 30 RPM, 50.000.000 TPM

No momento da verificação em 28 de julho de 2026, a Novita listava o Macaron V1 Venti como gratuito por tempo limitado, com preços de $0 entrada e $0 saída. Verifique a página do modelo ao vivo antes de orçar o uso em produção.

Passo 3: Envie Sua Primeira Solicitação

Comece com um prompt curto somente de texto para verificar autenticação, roteamento e análise.

Summarize the main risks in a repository-wide refactor in 5 bullet points.

Passo 4: Leia a Resposta

Para chat completions padrão, leia a resposta de choices[0].message.content. Mantenha os metadados da solicitação, o uso de tokens e o status HTTP nos seus logs para rastrear chamadas lentas ou caras mais tarde.

Passo 5: Verifique Preços, Limites e Erros Comuns

A listagem atual importa mais do que um post de blog desatualizado. Reverifique a página do modelo antes do lançamento se você depender de preço gratuito, de um nível de taxa específico ou da janela de contexto completa de 1M.

Erros comuns de configuração incluem:

  • Usar o nome de exibição em vez de mindai/macaron-v1-venti.
  • Apontar o SDK para a URL base errada.
  • Enviar um prompt enorme antes de confirmar a conectividade básica.
  • Presumir que toda solicitação de contexto longo deva usar o limite máximo de saída.

Exemplo em Python

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-venti",
    messages=[
        {"role": "system", "content": "You are a concise coding assistant."},
        {"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

Exemplo com cURL

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-venti",
    "messages": [
      {
        "role": "system",
        "content": "You are a concise coding assistant."
      },
      {
        "role": "user",
        "content": "List the safest first steps for refactoring a large monorepo."
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

Parâmetros Principais

Parâmetro Comece com Por que é importante
model mindai/macaron-v1-venti Seleciona o modelo hospedado
messages Prompt curto de sistema + usuário Verifica o caminho da API rapidamente
temperature 0.2 Mantém a saída de teste estável
max_tokens 400 Evita respostas iniciais grandes demais
tools Uma função por vez Útil para agentes e fluxos de trabalho
response_format Apenas se o seu parser estiver pronto Valide o JSON antes de enviar para produção

Prompts para Codificação, Agentes e GenUI

Codificação

Use o Macaron V1 Venti para refatorações conscientes do repositório, planos de migração ou resumos de revisão de código quando o contexto ao redor for importante.

Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.

Agentes

Use a chamada de função quando o modelo deve escolher uma ferramenta em vez de responder diretamente.

Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.

GenUI

Use-o para geração de interface quando quiser ideias estruturadas de UI a partir de um resumo de produto.

Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.

Solução de Problemas

A API retorna um erro de autenticação

Confirme se o token do portador está definido no mesmo shell ou ambiente de execução que faz a solicitação.

O modelo não pode ser encontrado

Verifique novamente o ID do modelo: mindai/macaron-v1-venti.

A solicitação é grande demais

Comece menor e depois adicione contexto gradualmente. Uma janela de 1M de tokens é capacidade, não um sinal para enviar tudo de uma vez.

Perguntas Frequentes

O Macaron V1 Venti está disponível na Novita AI?

Sim. A página do modelo ao vivo o lista como um modelo serverless.

Qual endpoint devo usar?

Use https://api.novita.ai/openai/v1/chat/completions.

Ele suporta uso de ferramentas?

Sim. A Novita lista a chamada de função como um recurso do modelo.

O modelo está gratuito agora?

A listagem verificada em 28 de julho de 2026 mostrou preços de $0 entrada e $0 saída, marcada como gratuita por tempo limitado.

Artigos Recomendados

Fontes verificadas em 28 de julho de 2026: página do modelo Macaron V1 Venti, referência da API de chat completions da Novita