Macaron V1 Tall 快速入门:编程、智能体与 GenUI

Macaron V1 Tall 快速入门:编程、智能体与 GenUI

Macaron V1 Tall 通过兼容 OpenAI 的聊天补全 API 在 Novita AI 上提供。当您需要一个中等大小的上下文窗口用于编程、智能体循环或 GenUI 提示时,请使用它,并在扩展到更长的工作流程之前,从一个简短的纯文本请求开始。

何时使用本快速入门

当您的工作负载需要足够的上下文来承载仓库状态、工具轨迹或 UI 规范,但又不需要目录中最大的上下文窗口时,请使用本指南。

第 1 步:获取您的 Novita API 密钥

创建一个 Novita API 密钥并将其保存在服务端。

export NOVITA_API_KEY="your_api_key_here"

第 2 步:确认模型 ID 和端点

字段
模型 ID mindai/macaron-v1-tall
基础 URL https://api.novita.ai/openai/v1
聊天补全端点 https://api.novita.ai/openai/v1/chat/completions
上下文窗口 262,144 个令牌
最大输出令牌 32,768
输入 文本
输出 文本
托管方式 Novita AI 无服务器 API

在 **2026 年 7 月 29 日 ** 检查时,Novita 将 Macaron V1 Tall 列为 ** 限时免费 **,定价为 **$0 输入 ** 和 $0 输出。在为生产使用做预算之前,请验证实时模型页面。

第 3 步:发送您的第一个请求

从一个简短的纯文本提示开始,以验证身份验证、路由和解析。

用 5 个要点总结仓库级重构的主要风险。

第 4 步:读取响应

对于标准聊天补全,从 choices[0].message.content 读取答案。将请求元数据、令牌使用情况和 HTTP 状态记录在日志中,以便日后追踪缓慢或昂贵的调用。

第 5 步:检查定价、限制和常见错误

当前的列表比过时的博客文章更重要。如果您依赖免费定价或完整的 262K 上下文窗口,请在发布前重新检查模型页面。

常见的设置错误包括:

  • 使用显示名称而不是 mindai/macaron-v1-tall
  • 将 SDK 指向错误的基础 URL。
  • 在确认基本连接之前发送巨大的提示。
  • 假设每个长上下文请求都应使用最大输出上限。

Python 示例

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-tall",
    messages=[
        {"role": "system", "content": "You are a concise coding assistant."},
        {"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

cURL 示例

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-tall",
    "messages": [
      {
        "role": "system",
        "content": "You are a concise coding assistant."
      },
      {
        "role": "user",
        "content": "List the safest first steps for refactoring a large monorepo."
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

关键参数

参数 起始值 重要性
model mindai/macaron-v1-tall 选择托管的模型
messages 简短的 system + user 提示 快速验证 API 路径
temperature 0.2 保持测试输出稳定
max_tokens 400 避免首次响应过大
tools 一次一个函数 对智能体和工作流有用
response_format 仅当您的解析器就绪时 在发布前验证 JSON

编程、智能体与 GenUI 提示

编程

当周围上下文很重要时,使用 Macaron V1 Tall 进行仓库感知的重构、迁移计划或代码审查总结。

审查此模块的迁移风险,识别破坏性变更,并建议最小安全补丁方案。

智能体

当模型应选择工具而不是直接回答时,使用函数调用。

仅当用户引用了现有问题 ID 时才调用工单查找工具。否则用简短的计划回答。

GenUI

当您希望从产品简报中获得结构化的 UI 创意时,使用它进行界面生成。

将此产品简报转化为一个清晰的仪表板布局,包含分区、操作、空状态和验证规则。

故障排除

API 返回身份验证错误

确认承载令牌已在发出请求的同一 shell 或运行时中设置。

找不到模型

仔细检查模型 ID:mindai/macaron-v1-tall

请求过大

从小处着手,然后逐步增加上下文。262K 令牌窗口是容量,而不是一次性发送所有内容的信号。

常见问题

Macaron V1 Tall 在 Novita AI 上可用吗?

是的。实时列表显示它是一个无服务器模型。

我应该使用哪个端点?

使用 https://api.novita.ai/openai/v1/chat/completions

它支持工具使用吗?

在依赖生产中的工具调用之前,请检查实时模型页面以获取当前的功能标签。

这个模型现在是免费的吗?

2026 年 7 月 29 日检查的列表显示 $0 输入和 $0 输出定价,标记为限时免费。

推荐文章

来源检查于 2026 年 7 月 29 日:Novita AI 模型库Novita 聊天补全 API 参考