Macaron V1 Venti 可通过兼容 OpenAI 的聊天补全 API 在 Novita AI 上使用。当您需要非常大的上下文窗口进行编程、代理循环或 GenUI 提示时,请使用它,并在扩展到更长的业务流程之前,从一个简短的纯文本请求开始。
有关更广泛的模型概述,请参阅 Macaron V1 Venti on Novita AI。
何时使用此快速入门
当您的工作负载需要长上下文、工具使用或代码原生 UI 生成(而非简短聊天回复)时,请使用本指南。Macaron V1 Venti 的 Novita 模型页面列出了无服务器访问、函数调用和推理功能,支持文本输入和文本输出。
步骤 1:获取 Novita API 密钥
创建一个 Novita API 密钥并保存在服务器端。
export NOVITA_API_KEY="your_api_key_here"
步骤 2:确认模型 ID 和端点
| 字段 | 值 |
|---|---|
| 模型 ID | mindai/macaron-v1-venti |
| 基础 URL | https://api.novita.ai/openai/v1 |
| 聊天补全端点 | https://api.novita.ai/openai/v1/chat/completions |
| 上下文窗口 | 1,048,576 tokens |
| 最大输出 tokens | 131,072 |
| 输入 | 文本 |
| 输出 | 文本 |
| 特性 | 无服务器 API、函数调用、推理 |
| 速率限制层级 | T1:30 RPM,50,000,000 TPM |
在 2026 年 7 月 28 日 ** 检查时,Novita 将 Macaron V1 Venti 列为 ** 限时免费 , 输入 $0 和 ** 输出 $0** 定价。在为生产用途制定预算之前,请验证实时模型页面。
步骤 3:发送第一个请求
从一个简短的纯文本提示开始,以验证认证、路由和解析。
用 5 个要点总结仓库级重构的主要风险。
步骤 4:读取响应
对于标准聊天补全,从 choices[0].message.content 读取答案。将请求元数据、token 使用情况和 HTTP 状态保留在日志中,以便日后追踪慢速或高成本的调用。
步骤 5:检查定价、限制和常见错误
当前的列表比过时的博客文章更重要。如果您依赖免费定价、特定速率层级或完整的 1M 上下文窗口,请在启动前重新检查模型页面。
常见的设置错误包括:
- 使用显示名称而不是
mindai/macaron-v1-venti。 - 将 SDK 指向错误的基础 URL。
- 在确认基本连接之前发送巨大的提示。
- 假设每个长上下文请求都应使用最大输出上限。
Python 示例
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
cURL 示例
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
关键参数
| 参数 | 起始值 | 为何重要 |
|---|---|---|
model |
mindai/macaron-v1-venti |
选择托管模型 |
messages |
简短的系统 + 用户提示 | 快速验证 API 路径 |
temperature |
0.2 |
保持测试输出稳定 |
max_tokens |
400 |
避免过大的首次响应 |
tools |
一次一个函数 | 对于代理和工作流很有用 |
response_format |
仅当您的解析器就绪时 | 在发布前验证 JSON |
编程、代理和 GenUI 提示
编程
当周围上下文很重要时,使用 Macaron V1 Venti 进行仓库感知重构、迁移计划或代码审查总结。
审查此模块的迁移风险,识别破坏性变更,并建议最小的安全补丁方案。
代理
当模型应该选择工具而不是直接回答时,使用函数调用。
仅当用户引用现有问题 ID 时,才调用工单查找工具。否则,用一个简短的计划回答。
GenUI
当您希望从产品简介中获得结构化的 UI 想法时,用于界面生成。
将此产品简介转化为一个清晰的仪表板布局,包含各个部分、操作、空状态和验证规则。
故障排除
API 返回认证错误
确认令牌已在发出请求的同一 shell 或运行时中设置。
找不到模型
仔细检查模型 ID:mindai/macaron-v1-venti。
请求过大
从较小的请求开始,然后逐步添加上下文。1M token 窗口是容量,而不是一次性发送所有内容的信号。
常见问题
Macaron V1 Venti 在 Novita AI 上可用吗?
是的。实时模型页面将其列为无服务器模型。
我应该使用哪个端点?
使用 https://api.novita.ai/openai/v1/chat/completions。
它支持工具使用吗?
是的。Novita 将函数调用列为模型特性。
该模型现在是免费的吗?
2026 年 7 月 28 日检查的列表显示输入 $0 和输出 $0 定价,标记为限时免费。
推荐文章
- Macaron V1 Venti on Novita AI:748B Mixture-of-LoRA 旗舰模型,适用于编程、代理和 GenUI
- 如何使用 Novita AI 模型使用 Codex:完整设置指南
- 如何使用 DeepSeek V3 的函数调用功能
来源检查日期:2026 年 7 月 28 日:Macaron V1 Venti 模型页面,Novita 聊天补全 API 参考
