Macaron V1 Tall 可透過與 OpenAI 相容的聊天補全 API 在 Novita AI 上使用。當您需要中等大小的上下文視窗來處理程式碼、AI 代理循環或 GenUI 提示時,請使用它,並先從一個純文字的小型請求開始,再逐步擴展到更長的工作流程。
何時使用此快速入門
當您的工作負載需要足夠的上下文來承載儲存庫狀態、工具追蹤或 UI 規格,但不需要目錄中最大的上下文視窗時,請使用本指南。
步驟 1:取得您的 Novita API 金鑰
建立一個 Novita API 金鑰,並將其保存在伺服器端。
export NOVITA_API_KEY="your_api_key_here"
步驟 2:確認模型 ID 和端點
| 欄位 | 值 |
|---|---|
| 模型 ID | mindai/macaron-v1-tall |
| 基礎 URL | https://api.novita.ai/openai/v1 |
| 聊天補全端點 | https://api.novita.ai/openai/v1/chat/completions |
| 上下文視窗 | 262,144 個 token |
| 最大輸出 token | 32,768 個 token |
| 輸入 | 文字 |
| 輸出 | 文字 |
| 託管方式 | Novita AI 無伺服器 API |
在 2026 年 7 月 29 日 ** 檢查時,Novita 將 Macaron V1 Tall 列為 限時免費 , 輸入 $0 且 ** 輸出 $0。在為生產環境規劃預算前,請先確認最新的模型頁面。
步驟 3:發送您的第一個請求
先從一個簡短的純文字提示開始,以驗證驗證、路由和解析。
用 5 個要點總結儲存庫層級重構的主要風險。
步驟 4:讀取回應
對於標準的聊天補全,請從 choices[0].message.content 讀取答案。將請求元資料、token 使用量和 HTTP 狀態記錄在日誌中,以便日後追蹤緩慢或昂貴的呼叫。
步驟 5:檢查定價、限制和常見錯誤
當前的產品頁面資訊比過時的部落格文章更重要。如果您依賴免費定價或完整的 262K 上下文視窗,請在啟動前重新檢查模型頁面。
常見的設定錯誤包括:
- 使用顯示名稱而不是
mindai/macaron-v1-tall。 - 將 SDK 指向錯誤的基礎 URL。
- 在確認基本連線之前就發送大量提示。
- 假設每個長上下文請求都應使用最大輸出上限。
Python 範例
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-tall",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
cURL 範例
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-tall",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
關鍵參數
| 參數 | 起始值 | 重要性 |
|---|---|---|
model |
mindai/macaron-v1-tall |
選擇託管模型 |
messages |
簡短的系統 + 使用者提示 | 快速驗證 API 路徑 |
temperature |
0.2 |
保持測試輸出穩定 |
max_tokens |
400 |
避免首次回應過大 |
tools |
一次一個函式 | 對 AI 代理和工作流程有用 |
response_format |
僅在解析器準備就緒時使用 | 出貨前先驗證 JSON |
程式碼、AI 代理與 GenUI 提示
程式碼
當周圍的上下文很重要時,使用 Macaron V1 Tall 進行儲存庫感知的重構、遷移計畫或程式碼審查摘要。
Review this module for migration risks, identify breaking changes, and suggest the smallest safe patch plan.
AI 代理
當模型應選擇工具而不是直接回答時,使用函式呼叫。
Call the ticket lookup tool only if the user references an existing issue ID. Otherwise answer with a short plan.
GenUI
當您希望從產品簡介中獲得結構化的 UI 想法時,使用它來產生介面。
Turn this product brief into a clean dashboard layout with sections, actions, empty states, and validation rules.
疑難排解
API 回傳驗證錯誤
確認 bearer token 已在執行請求的相同 shell 或執行環境中設定。
找不到模型
再次確認模型 ID:mindai/macaron-v1-tall。
請求太大
先從較小的請求開始,然後逐步增加上下文。262K token 的視窗是容量上限,而不是一次發送所有內容的信號。
常見問題
Macaron V1 Tall 在 Novita AI 上可用嗎?
是的。最新的產品頁面顯示它是一個無伺服器模型。
我應該使用哪個端點?
使用 https://api.novita.ai/openai/v1/chat/completions。
它支援工具使用嗎?
在依賴生產環境中的工具呼叫之前,請先檢查最新的模型頁面以了解目前的功能標籤。
這個模型目前是免費的嗎?
2026 年 7 月 29 日檢查的產品頁面顯示輸入和輸出定價均為 $0,並標示為限時免費。
推薦文章
- Macaron V1 Venti 快速入門:程式碼、AI 代理與 GenUI
- Macaron V1 Venti 在 Novita AI 上:適用於程式碼、AI 代理與 GenUI 的 748B Mixture-of-LoRA 旗艦模型
- Novita AI 上的 GLM 5.2 API
資料來源檢查日期:2026 年 7 月 29 日:Novita AI 模型庫、Novita 聊天補全 API 參考文件
