Macaron V1 Tall 通过兼容 OpenAI 的聊天补全 API 在 Novita AI 上提供。当您需要一个中等大小的上下文窗口用于编程、智能体循环或 GenUI 提示时,请使用它,并在扩展到更长的工作流程之前,从一个简短的纯文本请求开始。
何时使用本快速入门
当您的工作负载需要足够的上下文来承载仓库状态、工具轨迹或 UI 规范,但又不需要目录中最大的上下文窗口时,请使用本指南。
第 1 步:获取您的 Novita API 密钥
创建一个 Novita API 密钥并将其保存在服务端。
export NOVITA_API_KEY="your_api_key_here"
第 2 步:确认模型 ID 和端点
| 字段 | 值 |
|---|---|
| 模型 ID | mindai/macaron-v1-tall |
| 基础 URL | https://api.novita.ai/openai/v1 |
| 聊天补全端点 | https://api.novita.ai/openai/v1/chat/completions |
| 上下文窗口 | 262,144 个令牌 |
| 最大输出令牌 | 32,768 |
| 输入 | 文本 |
| 输出 | 文本 |
| 托管方式 | Novita AI 无服务器 API |
在 **2026 年 7 月 29 日 ** 检查时,Novita 将 Macaron V1 Tall 列为 ** 限时免费 **,定价为 **$0 输入 ** 和 $0 输出。在为生产使用做预算之前,请验证实时模型页面。
第 3 步:发送您的第一个请求
从一个简短的纯文本提示开始,以验证身份验证、路由和解析。
用 5 个要点总结仓库级重构的主要风险。
第 4 步:读取响应
对于标准聊天补全,从 choices[0].message.content 读取答案。将请求元数据、令牌使用情况和 HTTP 状态记录在日志中,以便日后追踪缓慢或昂贵的调用。
第 5 步:检查定价、限制和常见错误
当前的列表比过时的博客文章更重要。如果您依赖免费定价或完整的 262K 上下文窗口,请在发布前重新检查模型页面。
常见的设置错误包括:
- 使用显示名称而不是
mindai/macaron-v1-tall。 - 将 SDK 指向错误的基础 URL。
- 在确认基本连接之前发送巨大的提示。
- 假设每个长上下文请求都应使用最大输出上限。
Python 示例
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-tall",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
cURL 示例
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-tall",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
关键参数
| 参数 | 起始值 | 重要性 |
|---|---|---|
model |
mindai/macaron-v1-tall |
选择托管的模型 |
messages |
简短的 system + user 提示 | 快速验证 API 路径 |
temperature |
0.2 |
保持测试输出稳定 |
max_tokens |
400 |
避免首次响应过大 |
tools |
一次一个函数 | 对智能体和工作流有用 |
response_format |
仅当您的解析器就绪时 | 在发布前验证 JSON |
编程、智能体与 GenUI 提示
编程
当周围上下文很重要时,使用 Macaron V1 Tall 进行仓库感知的重构、迁移计划或代码审查总结。
审查此模块的迁移风险,识别破坏性变更,并建议最小安全补丁方案。
智能体
当模型应选择工具而不是直接回答时,使用函数调用。
仅当用户引用了现有问题 ID 时才调用工单查找工具。否则用简短的计划回答。
GenUI
当您希望从产品简报中获得结构化的 UI 创意时,使用它进行界面生成。
将此产品简报转化为一个清晰的仪表板布局,包含分区、操作、空状态和验证规则。
故障排除
API 返回身份验证错误
确认承载令牌已在发出请求的同一 shell 或运行时中设置。
找不到模型
仔细检查模型 ID:mindai/macaron-v1-tall。
请求过大
从小处着手,然后逐步增加上下文。262K 令牌窗口是容量,而不是一次性发送所有内容的信号。
常见问题
Macaron V1 Tall 在 Novita AI 上可用吗?
是的。实时列表显示它是一个无服务器模型。
我应该使用哪个端点?
使用 https://api.novita.ai/openai/v1/chat/completions。
它支持工具使用吗?
在依赖生产中的工具调用之前,请检查实时模型页面以获取当前的功能标签。
这个模型现在是免费的吗?
2026 年 7 月 29 日检查的列表显示 $0 输入和 $0 输出定价,标记为限时免费。
推荐文章
- Macaron V1 Venti 快速入门:编程、智能体与 GenUI
- Macaron V1 Venti 在 Novita AI 上:748B Mixture-of-LoRA 旗舰模型用于编程、智能体与 GenUI
- Novita AI 上的 GLM 5.2 API
来源检查于 2026 年 7 月 29 日:Novita AI 模型库,Novita 聊天补全 API 参考
