Macaron V1 Tall 是較輕量的 Macaron 選項,當你需要長上下文但不想直接跳到旗艦版時。可用於 coding、agent 迴圈或 GenUI 提示詞,並先從一個純文字的請求開始,再擴展到較長的工作流程。
模型總覽請見 Novita AI 上的 Macaron V1 Tall。
旗艦版比較請見 Novita AI 上的 Macaron V1 Venti。
使用這份快速入門的時機
當你的工作負載需要足夠的上下文來攜帶 repository 狀態、工具追蹤或 UI 規格,但不需要目錄中最大的上下文視窗時,請使用本指南。
步驟 1:取得你的 Novita API Key
建立一個 Novita API key,並將其保存在伺服器端。
export NOVITA_API_KEY="your_api_key_here"
步驟 2:確認模型 ID 與端點
| 欄位 | 值 |
|---|---|
| Model ID | mindai/macaron-v1-tall |
| Base URL | https://api.novita.ai/openai/v1 |
| 聊天補全端點 | https://api.novita.ai/openai/v1/chat/completions |
| 上下文視窗 | 262,144 tokens |
| 最大輸出 tokens | 32,768 |
| 輸入 | 文字 |
| 輸出 | 文字 |
| 託管方式 | Novita AI serverless API |
在 **2026 年 7 月 29 日 ** 檢查時,Novita 將 Macaron V1 Tall 列為 ** 限時免費 ** ,定價為 **$0 輸入 ** 與 $0 輸出 。在預算生產使用之前,請先確認即時模型頁面。
步驟 3:送出你的第一個請求
先使用一個簡短的純文字提示詞,以驗證認證、路由與解析。
Summarize the main risks in a repository-wide refactor in 5 bullet points.
步驟 4:讀取回應
對於標準聊天補全(chat completions),請從 choices[0].message.content 讀取答案。將請求中繼資料、token 用量與 HTTP 狀態保留在日誌中,以便日後追蹤緩慢或昂貴的呼叫。
步驟 5:檢查定價、限制與常見錯誤
目前的清單比過時的部落格文章更重要。如果你依賴免費定價或完整的 262K 上下文視窗,請在上線前重新檢查模型頁面。
常見的設定錯誤包括:
- 使用顯示名稱而不是
mindai/macaron-v1-tall。 - 將 SDK 指向錯誤的 base URL。
- 在確認基本連線之前就送出龐大的提示詞。
- 假設每個長上下文請求都應該使用最大輸出上限。
Python 範例
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-tall",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
cURL 範例
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-tall",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
主要參數
| 參數 | 起始值 | 重要性說明 |
|---|---|---|
model |
mindai/macaron-v1-tall |
選取託管的模型 |
messages |
簡短的 system + user 提示詞 | 快速驗證 API 路徑 |
temperature |
0.2 |
維持測試輸出穩定 |
max_tokens |
400 |
避免第一次回應過大 |
tools |
一次一個函式 | 適用於 agents 與 workflows |
response_format |
只在你的 parser 準備好時使用 | 在出貨前驗證 JSON |
Coding、Agents 與 GenUI 提示詞
Coding
當周邊上下文很重要時,使用 Macaron V1 Tall 進行 repository 感知的重構、遷移計畫或程式碼審查摘要。
Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.
Agents
當模型應該選擇工具而不是直接回答時,請使用 function calling。
Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.
GenUI
當你想要從產品簡報中取得結構化的 UI 想法時,可以使用它來生成介面。
Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.
疑難排解
API 回傳認證錯誤
確認 bearer token 已設定在發出請求的同一個 shell 或執行環境中。
找不到模型
請再次確認模型 ID:mindai/macaron-v1-tall。
請求太大
先從較小的請求開始,然後逐步加入上下文。262K-token 的視窗代表容量,而不是代表應該一次送出所有內容。
FAQ
Macaron V1 Tall 在 Novita AI 上可以使用嗎?
可以。即時清單顯示它是一個 serverless 模型。
我應該使用哪個端點?
請使用 https://api.novita.ai/openai/v1/chat/completions。
它支援工具使用嗎?
在依賴於生產環境中的工具呼叫之前,請檢查即時模型頁面上的目前功能標籤。
這個模型現在是免費的嗎?
2026 年 7 月 29 日檢查的清單顯示 $0 輸入與 $0 輸出定價,並標記為限時免費。
推薦文章
- Novita AI 上的 Macaron V1 Tall:免費 262K 上下文的 MoL 模型,適用於聊天、Agents 與 Coding
- Novita AI 上的 Macaron V1 Venti 快速入門:1M 上下文、端點與範例
- Novita AI 上的 Macaron V1 Venti:748B Mixture-of-LoRA 旗艦模型,適用於 Coding、Agents 與 GenUI
檢查來源(2026 年 7 月 29 日):Novita AI 模型庫、Novita 聊天補全 API 參考
