Macaron V1 Tall クイックスタート:コーディング、エージェント、GenUI向け

Macaron V1 Tall クイックスタート:コーディング、エージェント、GenUI向け

Macaron V1 Tallは、OpenAI互換のチャット補完APIを通じてNovita AIで利用できます。コーディング、エージェントループ、GenUIプロンプトに中規模のコンテキストウィンドウが必要な場合に使用し、長いワークフローに拡張する前に、小さなテキストのみのリクエストから始めてください。

このクイックスタートを使用するタイミング

リポジトリの状態、ツールのトレース、UI仕様を保持するのに十分なコンテキストが必要だが、カタログ内で最大のコンテキストウィンドウは必要ないワークロードの場合に、このガイドを使用してください。

ステップ1:Novita APIキーを取得する

Novita APIキーを作成し、サーバー側で管理してください。

export NOVITA_API_KEY="your_api_key_here"

ステップ2:モデルIDとエンドポイントを確認する

フィールド
モデルID mindai/macaron-v1-tall
ベースURL https://api.novita.ai/openai/v1
チャット補完エンドポイント https://api.novita.ai/openai/v1/chat/completions
コンテキストウィンドウ 262,144 トークン
最大出力トークン 32,768
入力 テキスト
出力 テキスト
ホスティング Novita AI サーバーレスAPI

2026年7月29日 ** に確認した時点では、NovitaはMacaron V1 Tallを期間限定無料 $0 input**、$0 output の料金として掲載していました。プロダクション利用の予算を立てる前に、ライブのモデルページを確認してください。

ステップ3:最初のリクエストを送信する

認証、ルーティング、解析を確認するために、短いテキストのみのプロンプトから始めます。

リポジトリ全体のリファクタリングにおける主なリスクを5つの箇条書きで要約してください。

ステップ4:レスポンスを読み取る

標準のチャット補完では、choices[0].message.content から回答を読み取ります。リクエストのメタデータ、トークン使用量、HTTPステータスをログに記録しておくことで、後で遅い呼び出しや高コストな呼び出しを追跡できます。

ステップ5:料金、制限、よくあるエラーを確認する

古いブログ記事よりも、現在の掲載情報の方が重要です。無料料金や完全な262Kコンテキストウィンドウに依存する場合は、ローンチ前にモデルページを再確認してください。

よくあるセットアップの間違いは次のとおりです:

  • 表示名ではなく mindai/macaron-v1-tall を使用すること。
  • SDKが間違ったベースURLを指していること。
  • 基本的な接続を確認する前に、巨大なプロンプトを送信すること。
  • すべての長いコンテキストリクエストが最大出力制限を使用すべきだと想定すること。

Pythonの例

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["NOVITA_API_KEY"],
    base_url="https://api.novita.ai/openai/v1",
)

response = client.chat.completions.create(
    model="mindai/macaron-v1-tall",
    messages=[
        {"role": "system", "content": "あなたは簡潔なコーディングアシスタントです。"},
        {"role": "user", "content": "大規模なモノレポをリファクタリングするための最も安全な最初のステップをリストアップしてください。"},
    ],
    temperature=0.2,
    max_tokens=400,
)

print(response.choices[0].message.content)

cURLの例

curl "https://api.novita.ai/openai/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${NOVITA_API_KEY}" \
  -d '{
    "model": "mindai/macaron-v1-tall",
    "messages": [
      {
        "role": "system",
        "content": "あなたは簡潔なコーディングアシスタントです。"
      },
      {
        "role": "user",
        "content": "大規模なモノレポをリファクタリングするための最も安全な最初のステップをリストアップしてください。"
      }
    ],
    "temperature": 0.2,
    "max_tokens": 400
  }'

主要パラメータ

パラメータ 初期値 重要な理由
model mindai/macaron-v1-tall ホストされているモデルを選択します
messages 短いシステム + ユーザープロンプト APIパスを迅速に検証します
temperature 0.2 テスト出力を安定させます
max_tokens 400 最初のレスポンスが大きくなりすぎるのを防ぎます
tools 一度に1つの関数 エージェントやワークフローに役立ちます
response_format パーサーの準備ができている場合のみ 出荷前にJSONを検証します

コーディング、エージェント、GenUIプロンプト

コーディング

周囲のコンテキストが重要な場合に、リポジトリを認識したリファクタリング、移行計画、またはコードレビューの要約にMacaron V1 Tallを使用します。

このモジュールを移行リスクについてレビューし、破壊的変更を特定し、最も小さな安全なパッチ計画を提案してください。

エージェント

モデルが直接回答する代わりにツールを選択すべき場合に、関数呼び出しを使用します。

ユーザーが既存の課題IDを参照している場合にのみ、チケット検索ツールを呼び出してください。それ以外の場合は、短い計画で回答してください。

GenUI

プロダクト概要から構造化されたUIアイデアを得たい場合に、インターフェース生成に使用します。

このプロダクト概要を、セクション、アクション、空の状態、検証ルールを備えたクリーンなダッシュボードレイアウトに変換してください。

トラブルシューティング

APIが認証エラーを返す

ベアラートークンがリクエストを行う同じシェルまたはランタイムで設定されていることを確認してください。

モデルが見つからない

モデルID mindai/macaron-v1-tall を再確認してください。

リクエストが大きすぎる

小さく始めて、徐々にコンテキストを追加してください。262Kトークンウィンドウは容量であり、すべてを一度に送信するための合図ではありません。

FAQ

Macaron V1 TallはNovita AIで利用できますか?

はい。ライブの掲載情報では、サーバーレスモデルとして表示されています。

どのエンドポイントを使用すればよいですか?

https://api.novita.ai/openai/v1/chat/completions を使用してください。

ツールの使用をサポートしていますか?

プロダクションでツール呼び出しに依存する前に、現在の機能ラベルについてライブのモデルページを確認してください。

このモデルは現在無料ですか?

2026年7月29日に確認した掲載情報では、$0 input、$0 outputの料金で、期間限定無料と表示されていました。

おすすめ記事

出典(2026年7月29日確認):Novita AI モデルライブラリNovita チャット補完APIリファレンス