Macaron V1 Venti は、コーディング、エージェント、GenUI のための 100 万トークンコンテキストワークフローが必要な場合に、Novita の主力 Macaron モデルへの最速のパスです。まずは小さなテキストのみのリクエストから始め、エンドポイントと認証が正常に動作することを確認してからスケールアップしてください。
モデルの概要については、Novita AI 上の Macaron V1 Venti をご覧ください。
このクイックスタートを使用するタイミング
短いチャット返信ではなく、長いコンテキスト、ツール使用、またはコードネイティブな UI 生成を必要とするワークロードがある場合に、このガイドを使用してください。Macaron V1 Venti の Novita モデルページには、サーバーレスアクセス、関数呼び出し、推論、テキスト入力とテキスト出力がリストされています。
ステップ 1:Novita API キーを取得する
Novita API キーを作成し、サーバーサイドで保管してください。
export NOVITA_API_KEY="your_api_key_here"
ステップ 2:モデル ID とエンドポイントを確認する
| フィールド | 値 |
|---|---|
| モデル ID | mindai/macaron-v1-venti |
| ベース URL | https://api.novita.ai/openai/v1 |
| チャット補完エンドポイント | https://api.novita.ai/openai/v1/chat/completions |
| コンテキストウィンドウ | 1,048,576 トークン |
| 最大出力トークン数 | 131,072 |
| 入力 | テキスト |
| 出力 | テキスト |
| 機能 | サーバーレス API、関数呼び出し、推論 |
| レート制限ティア表示 | T1:30 RPM、50,000,000 TPM |
2026 年 7 月 28 日 ** 時点の確認では、Novita は Macaron V1 Venti を ** 期間限定無料 ** としてリストし、 入力 $0**、** 出力 $0** の料金設定でした。本番運用の予算を立てる前に、ライブのモデルページを確認してください。
ステップ 3:最初のリクエストを送信する
認証、ルーティング、解析を確認するために、短いテキストのみのプロンプトから始めてください。
リポジトリ全体のリファクタリングにおける主なリスクを 5 つの箇条書きで要約してください。
ステップ 4:レスポンスを読み取る
標準的なチャット補完の場合、choices[0].message.content から回答を読み取ります。リクエストのメタデータ、トークン使用量、HTTP ステータスをログに記録しておくことで、後で遅い呼び出しや高コストな呼び出しを追跡できます。
ステップ 5:料金、制限、一般的なエラーを確認する
古いブログ記事よりも、現在のリスト情報の方が重要です。無料料金、特定のレートティア、または完全な 100 万トークンコンテキストウィンドウに依存する場合は、起動前にモデルページを再確認してください。
一般的なセットアップミスは次のとおりです:
- 表示名の代わりに
mindai/macaron-v1-ventiを使用しない。 - SDK を間違ったベース URL に向けている。
- 基本的な接続を確認する前に巨大なプロンプトを送信している。
- すべての長いコンテキストリクエストが最大出力上限を使用すべきだと想定している。
Python の例
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "あなたは簡潔なコーディングアシスタントです。"},
{"role": "user", "content": "大規模なモノレポをリファクタリングするための最も安全な最初のステップをリストアップしてください。"},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
cURL の例
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
主要パラメータ
| パラメータ | 初期値 | 重要性 |
|---|---|---|
model |
mindai/macaron-v1-venti |
ホストされているモデルを選択します |
messages |
短い system + user プロンプト | API パスを迅速に検証します |
temperature |
0.2 |
テスト出力を安定させます |
max_tokens |
400 |
最初のレスポンスが大きくなりすぎるのを防ぎます |
tools |
一度に 1 つの関数 | エージェントやワークフローに役立ちます |
response_format |
パーサーの準備ができている場合のみ | 出荷前に JSON を検証します |
コーディング、エージェント、GenUI のプロンプト
コーディング
周囲のコンテキストが重要な場合に、リポジトリを認識したリファクタリング、移行計画、コードレビューの要約に Macaron V1 Venti を使用します。
移行リスクについてこのモジュールをレビューし、破壊的変更を特定し、最も安全な最小限のパッチ計画を提案してください。
エージェント
モデルが直接回答する代わりにツールを選択すべき場合に、関数呼び出しを使用します。
ユーザーが既存の Issue ID を参照している場合にのみ、チケット検索ツールを呼び出してください。それ以外の場合は、短い計画で回答してください。
GenUI
製品概要から構造化された UI アイデアを生成する場合に使用します。
この製品概要を、セクション、アクション、空の状態、検証ルールを備えたクリーンなダッシュボードレイアウトに変換してください。
トラブルシューティング
API が認証エラーを返す
ベアラートークンが、リクエストを行う同じシェルまたはランタイムで設定されていることを確認してください。
モデルが見つからない
モデル ID を再確認してください:mindai/macaron-v1-venti.
リクエストが大きすぎる
より小さいリクエストから始め、徐々にコンテキストを追加してください。100 万トークンのウィンドウはキャパシティであり、すべてを一度に送信すべきという意味ではありません。
FAQ
Macaron V1 Venti は Novita AI で利用できますか?
はい。ライブのモデルページには、サーバーレスモデルとしてリストされています。
どのエンドポイントを使用すればよいですか?
https://api.novita.ai/openai/v1/chat/completions を使用してください。
ツール使用をサポートしていますか?
はい。Novita は関数呼び出しをモデルの機能としてリストしています。
モデルは現在無料ですか?
2026 年 7 月 28 日に確認したリストでは、入力 $0、出力 $0 の料金設定で、期間限定無料と表示されていました。
おすすめ記事
- Novita AI 上の Macaron V1 Venti:コーディング、エージェント、GenUI のための 748B Mixture-of-LoRA フラッグシップモデル
- コーディング、エージェント、GenUI のための Macaron V1 Tall クイックスタート
- Novita AI モデルで Codex を使用する方法:完全セットアップガイド
2026 年 7 月 28 日確認済みソース:Macaron V1 Venti モデルページ、Novita チャット補完 API リファレンス
