Macaron V1 Venti 可透過與 OpenAI 相容的聊天補全 API 在 Novita AI 上使用。當你需要非常大的上下文視窗來處理程式碼、代理循環或 GenUI 提示時,請使用它;先從一個簡短的純文字請求開始,再逐步擴展到更長的工作流程。
如需更廣泛的模型概述,請參閱 Macaron V1 Venti on Novita AI。
何時使用此快速入門
當你的工作負載需要長上下文、工具使用或程式碼原生 UI 生成,而不僅僅是簡短的聊天回覆時,請使用此指南。Macaron V1 Venti 的 Novita 模型頁面列出了無伺服器存取、函式呼叫與推理功能,支援文字輸入與文字輸出。
步驟 1:取得你的 Novita API 金鑰
建立一個 Novita API 金鑰,並將其保存在伺服器端。
export NOVITA_API_KEY="your_api_key_here"
步驟 2:確認模型 ID 與端點
| 欄位 | 值 |
|---|---|
| 模型 ID | mindai/macaron-v1-venti |
| 基礎 URL | https://api.novita.ai/openai/v1 |
| 聊天補全端點 | https://api.novita.ai/openai/v1/chat/completions |
| 上下文視窗 | 1,048,576 tokens |
| 最大輸出 tokens | 131,072 |
| 輸入 | 文字 |
| 輸出 | 文字 |
| 功能 | 無伺服器 API、函式呼叫、推理 |
| 顯示的速率限制層級 | T1:30 RPM、50,000,000 TPM |
截至 **2026 年 7 月 28 日 ** 查詢時,Novita 將 Macaron V1 Venti 列為 ** 限時免費 **,定價為 **$0 輸入 ** 與 $0 輸出。在將預算投入生產使用之前,請先確認最新的模型頁面。
步驟 3:發送你的第一個請求
從一個簡短的純文字提示開始,以驗證身份驗證、路由與解析。
Summarize the main risks in a repository-wide refactor in 5 bullet points.
步驟 4:讀取回應
對於標準的聊天補全,從 choices[0].message.content 讀取答案。將請求元資料、Token 用量與 HTTP 狀態記錄在日誌中,以便後續追蹤較慢或成本較高的呼叫。
步驟 5:檢查價格、限制與常見錯誤
當前頁面資訊比過期的部落格文章更為重要。如果你依賴免費定價、特定速率層級或完整的 1M 上下文視窗,請在啟動前重新檢查模型頁面。
常見的設定錯誤包括:
- 使用顯示名稱而非
mindai/macaron-v1-venti。 - 將 SDK 指向錯誤的基礎 URL。
- 在確認基本連線正常之前就發送大量提示。
- 假設每個長上下文請求都應該使用最大輸出上限。
Python 範例
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
cURL 範例
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
關鍵參數
| 參數 | 起始值 | 為什麼重要 |
|---|---|---|
model |
mindai/macaron-v1-venti |
選擇託管模型 |
messages |
簡短的系統 + 使用者提示 | 快速驗證 API 路徑 |
temperature |
0.2 |
保持測試輸出穩定 |
max_tokens |
400 |
避免第一次回應過大 |
tools |
一次一個函式 | 對代理與工作流程有用 |
response_format |
僅當解析器準備好時才使用 | 在發布前驗證 JSON |
程式碼、代理與 GenUI 提示
程式碼
當周圍的上下文很重要時,請使用 Macaron V1 Venti 進行存放庫感知的重構、遷移計畫或程式碼審查摘要。
Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.
代理
當模型應選擇工具而不是直接回答時,請使用函式呼叫。
Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.
GenUI
當你想要根據產品簡介獲得結構化的 UI 想法時,請使用它來生成介面。
Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.
故障排除
API 回傳身份驗證錯誤
確認 Bearer Token 已在執行請求的同一個 shell 或執行環境中設定。
找不到模型
請再次檢查模型 ID:mindai/macaron-v1-venti。
請求過大
先從較小的請求開始,再逐步增加上下文。1M Token 的視窗代表容量上限,而非一次發送所有資料的信號。
常見問題
Macaron V1 Venti 可以在 Novita AI 上使用嗎?
是的。最新模型頁面將其列為無伺服器模型。
我應該使用哪個端點?
使用 https://api.novita.ai/openai/v1/chat/completions。
它支援工具使用嗎?
是的。Novita 將函式呼叫列為模型功能之一。
這個模型現在是免費的嗎?
2026 年 7 月 28 日查詢的頁面顯示 $0 輸入與 $0 輸出定價,標註為限時免費。
推薦文章
- Macaron V1 Venti on Novita AI:748B Mixture-of-LoRA 旗艦模型,適用於程式碼、代理與 GenUI
- 如何將 Codex 與 Novita AI 模型搭配使用:完整設定指南
- 如何使用 DeepSeek V3 的函式呼叫功能
資料來源查詢日期 2026 年 7 月 28 日:Macaron V1 Venti 模型頁面、Novita 聊天補全 API 參考
