Macaron V1 Tall が Novita AI で利用可能になりました。Macaron ファミリーの中でも、より小型で評価が容易なエントリーモデルです。2026年7月29日時点で、Novita はモデルID mindai/macaron-v1-tall、262,144トークンのコンテキストウィンドウ、32,768トークンの最大出力トークン、推論、関数呼び出し、そして期間限定無料価格(入出力トークンともに100万トークンあたり$0)で提供しています。実用的なポイントは、Tall が Macaron ファミリーのチャット、エージェント、コーディング、GenUI というポジショニングを、はるかに大規模な Venti モデルに直接飛び込むことなく最初に試すべきバリアントであるということです。
主要なポイント
- Macaron V1 Tall は Novita AI で
mindai/macaron-v1-tallとして公開されています。 - Novita はこれを、Qwen3.6-35B-A3B をベースに4つの専門 LoRA アダプターを備えた、効率的な Macaron V1 モデルと説明しています。
- 現在の Novita のリストでは、262,144トークンのコンテキストウィンドウと32,768トークンの最大出力トークンが示されています。
- ホストされている機能には、現在、チャット補完ワークフローを通じた推論と関数呼び出しが含まれています。
- 価格は2026年7月29日時点で期間限定無料としてリストされ、入力トークン$0、出力トークン$0でした。
Macaron V1 Tall とは?
Macaron V1 Tall は、Macaron V1 ラインにおける軽量モデルです。Novita AI では、公式説明でファミリーの効率的なバリアントと呼ばれ、Qwen3.6-35B-A3B をベースに、チャット、エージェント、コーディング、GenUI 向けの4つの専門 LoRA アダプターを備えているとされています。
この説明が重要なのは、Tall が汎用的なチャットボットとして位置づけられていないからです。ファミリーのストーリーは、ルーティングによる特化にあります。ベースモデルが広範な推論を処理する一方、LoRA アダプターがシステムを特定の開発者ワークロードに偏らせます。実際には、これにより Tall は、自由形式の会話だけでなく、ツールを使用するアシスタント、リポジトリを認識するコーディング支援、構造化された UI 生成といった実際のタスクに対して評価しやすくなっています。
より重要な違いは運用面です。Venti が大規模なコンテキストを必要とするチーム向けのフラッグシップ Macaron オプションであるなら、Tall は最初に評価するためのリスクの低いモデルです。同じファミリーのポジショニングを維持しつつ、より小規模なデプロイプロファイルとホスト型サーバーレス API を提供します。
Novita AI での Macaron V1 Tall API アクセス
Novita AI は現在、Macaron V1 Tall をホスト型モデルライブラリと OpenAI 互換の LLM API を通じて公開しています。モデルページには正確なモデルIDとして mindai/macaron-v1-tall がリストされ、API ドキュメントは開発者を標準のチャット補完ルート https://api.novita.ai/openai/v1/chat/completions に誘導します。
現在のホスト型リストには、chat/completions と anthropic の2つのエンドポイントファミリーも示されています。既存の Novita 統合のほとんどにとって、最も簡単な出発点は依然として OpenAI 互換のチャット補完パスです。これは、LLM カタログの残りや公開されている API リファレンスと整合するためです。
これはローンチと情報源の概要であるため、有用な質問は「最初のリクエストをどう書くか」ではなく、「モデルは実際に利用可能か、そして Novita は今日どのような契約を公開しているか」です。その点について、現在の答えは明確です。Tall は、ホスト型機能セットに推論と関数呼び出しを備えたサーバーレステキストモデルとして利用可能です。
Macaron V1 Tall のスペックと価格概要
以下の表は、2026年7月29日 時点の Novita AI のライブモデルページと LLM API ドキュメントに基づいています。
| 項目 | 詳細 |
|---|---|
| 表示名 | Macaron V1 Tall |
| モデルID | mindai/macaron-v1-tall |
| ベースURL | https://api.novita.ai/openai |
| エンドポイントファミリー | chat/completions;モデルページには anthropic もリスト |
| コンテキスト / 制限 | 262,144 コンテキストトークン;32,768 最大出力トークン |
| 価格 | 100万トークンあたり入力$0、出力$0;期間限定無料と表示 |
| 最適な用途 | エージェントワークフロー、コーディング支援、チャットシステム、最大モデル階層から始めずに長いコンテキストを必要とする GenUI 実験 |
これらの詳細は、2026年7月29日時点の Novita AI のライブモデルページと LLM API ドキュメントで確認されました。
現在のモデルページからの追加詳細:
| 仕様 | 現在の値 |
|---|---|
| ベースモデル | Qwen3.6-35B-A3B |
| アーキテクチャ注記 | 4つの専門 LoRA アダプターを備えた Macaron V1 |
| 入力モダリティ | テキスト |
| 出力モダリティ | テキスト |
| ホスト機能 | サーバーレス、推論、関数呼び出し |
| クォータスナップショット | アカウント階層に応じて30 RPM から6000 RPM までの段階的 RPM エントリ |
| ステータスラベル | 新規;期間限定無料 |
無料価格は有用ですが、恒久的な予算前提ではなく、一時的なローンチ条件として扱うべきです。本番展開を計画している場合は、最終的なコスト見積もりや契約コミットメントの前に、ライブモデルページを再確認してください。
Macaron V1 Tall のベンチマークとパフォーマンスシグナル
現在の Novita のリストには、Macaron V1 Tall のベンチマークパッケージ、レイテンシ保証、外部リーダーボードのサマリーは公開されていません。つまり、この記事は、別個の証拠なしに、Tall がコーディング、ツール使用、エージェント品質で他のモデルに勝ると主張すべきではありません。
より防御的なローンチの枠組みは、より狭いものです。Novita は Tall をチャット、エージェント、コーディング、GenUI 向けの効率的な Macaron ファミリーモデルとして位置づけており、ホスト型ページは関連する API 機能と価格を確認しています。これは評価を正当化するには十分です。カテゴリリーダーシップを主張するには十分ではありません。
Tall を他のホスト型モデルと比較する場合は、独自のワークロードレベルのチェック(タスク完了、ツール呼び出しの有効性、レイテンシ、トークン消費、修正作業)を使用してください。これらの測定値は、パラメータ数やファミリーの説明よりも多くの情報を提供します。
開発者向け主要機能
長文コンテキストのチャットとアシスタントフロー
262K のコンテキストウィンドウは、製品要件、内部 SOP、以前の会話状態、サポートノート、長い計画トレースなど、かなりの背景情報を保持する必要があるアシスタントワークフローに十分な大きさです。これにより、プロンプトが定期的に複数のドキュメントや指示を必要とする場合、Tall は短いコンテキストのチャットモデルに対して明確な優位性を持ちます。
ツールを使用するエージェントシステム
Novita は現在、ホスト型機能セットに関数呼び出しと推論をリストしています。これにより、Tall は状態を検査し、ツールを選択し、引数を生成し、ツール結果が到着した後に継続する必要があるエージェントにとって合理的な候補となります。それでも、モデルはシステム設計を置き換えるものではありません。アプリケーションはツールの権限、リトライ、検証、ロールバックを管理する必要があります。
より小規模なデプロイプロファイルでのコーディング支援
Macaron V1 Tall はファミリーのより効率的なメンバーとして説明されており、これはまさにリポジトリのトリアージ、パッチ計画、コードレビューのサマリー、IDE サイドの開発者支援に試すべき理由です。すべてのコーディングタスクが利用可能な最大のモデルを必要とするわけではありません。より小規模なルーティングモデルは、最も高価または最も遅いオプションにデフォルト設定せずに、長いコンテキストと特化を望む場合に、より適した選択肢となります。
GenUI 実験
Novita の説明には、ファミリーのポジショニングとしてコードネイティブな生成 UI 機能が明示的に含まれています。これは、任意のモデル出力を直接本番環境にレンダリングすべきだという意味ではありません。これは、モデルが要件を画面、コンポーネントツリー、または構造化された UI 計画にマッピングするインターフェース生成ワークフローのプロトタイピングにおいて、Tall が関連する候補であることを意味します。
Macaron V1 Tall を使用すべき場合
ワークロードが、長いコンテキスト、開発者向けの特化、フラッグシップモデルよりも摩擦の少ない評価パスという3つの要素を同時に必要とする場合に、Macaron V1 Tall を使用してください。
適切な候補には以下が含まれます:
- かなりのポリシーや製品コンテキストを保持する必要がある内部チャットアシスタント。
- 複数のファイル、課題ノート、以前のレビューコメントにわたって推論するコーディングヘルパー。
- マルチモーダル入力よりも関数呼び出しが重要なツール使用エージェント。
- 詳細な要件をインターフェース構造や実装計画に変換する GenUI プロトタイプ。
- 現在のホスト型価格が期間限定無料である間に Macaron ファミリーをテストしたいチーム。
Tall は、現在のモデルがコンテキストを失ったり、マルチステップワークフローで失敗したりしているが、はるかに大規模なモデルクラスに移行する準備がまだできていない場合にも、実用的な最初の選択肢です。
Macaron V1 Tall を使用すべきでない場合
新しいから、または無料だからといって、すべてのテキストワークロードにデフォルトで Tall を選択しないでください。
以下の場合には、より弱い適合となります:
- ワークロードが短く、反復的で、より小型で安価なモデルにルーティングしやすい場合。
- ホスト型エンドポイントで画像、音声、動画の入力が必要な場合(現在のリストはテキスト入力、テキスト出力のため)。
- 本番契約が、Tall では利用できない公開ベンチマークの主張に依存している場合。
- タスクが非常に広範なコンテキストとフラッグシップレベルの実験によって支配されているため、Macaron ファミリーの最大オプションが必要な場合。
- ローンチプロモーションが変更されるリスクを許容できない場合(現在の価格は明示的に期間限定無料のため)。
実際の要件が、非常に高いボリュームでの予測可能な低レイテンシ分類や軽量抽出である場合、よりシンプルなモデルが依然としてよりクリーンな本番選択肢となる可能性があります。
Macaron V1 Tall が API ワークフローにどのように適合するか
Macaron V1 Tall は、他の Novita ホスト型 LLM と同じ高レベルのワークフローに適合します:
- アカウントがモデルにアクセスできることを確認します。
- OpenAI 互換のベースURL
https://api.novita.ai/openaiを使用します。 - モデルIDを
mindai/macaron-v1-tallに設定します。 - チャット補完を通じてリクエストを送信し、アプリケーションがツール呼び出しを使用する場合は関数定義を追加します。
この契約は、統合計画、ルーティング決定、アーキテクチャレビューに十分です。この記事は意図的にそこで止めています。完全な SDK スニペット、リクエストペイロードのウォークスルー、トラブルシューティングは含まれていません。これらはローンチ/情報源の投稿ではなく、専用のクイックスタートガイドに属するためです。
結論
Macaron V1 Tall は、最大の階層から始めることなく、チャット、ツールを使用するエージェント、コーディング支援、GenUI 実験向けのホスト型長文コンテキストオプションを求める場合に、Macaron ファミリーで最初に試すべきモデルです。2026年7月29日時点で、Novita AI はこれを、現在利用可能、サーバーレス、推論対応、関数呼び出し可能、期間限定無料としてリストしています。
次の適切なステップは、ハローワールドプロンプトだけでなく、実際のタスクでテストすることです。現在の無料ウィンドウを利用して、特にマルチステップのコーディングとエージェントワークフローにおいて、Tall をすでに信頼しているモデルと比較してください。コンテキストをより適切に保持し、ツールを確実に呼び出し、レイテンシが許容範囲内であれば、本番評価の場に値します。
Novita AI で Macaron V1 Tall を試す
FAQ
Macaron V1 Tall は Novita AI で利用できますか?
はい。2026年7月29日時点で、Novita AI は Macaron V1 Tall をホスト型モデルライブラリにモデルID mindai/macaron-v1-tall としてリストしています。
Macaron V1 Tall のモデルIDは何ですか?
現在の Novita AI モデルIDは mindai/macaron-v1-tall です。
Macaron V1 Tall は Novita AI で無料ですか?
2026年7月29日時点で確認されたモデルページでは、100万入力トークンあたり$0、100万出力トークンあたり$0とリストされ、モデルは期間限定無料とラベル付けされていました。本番使用の予算を立てる前に、ライブページを再確認してください。
Macaron V1 Tall はどのコンテキストウィンドウをサポートしていますか?
Novita AI は現在、Macaron V1 Tall に対して262,144トークンのコンテキストウィンドウと32,768トークンの最大出力トークンをリストしています。
Macaron V1 Tall は関数呼び出しをサポートしていますか?
はい。Novita モデルページの現在のホスト型機能セットには、関数呼び出しと推論が含まれています。
Macaron V1 Tall は Novita AI でマルチモーダルですか?
現在のホスト型リストではそうではありません。Novita は現在、このモデルに対してテキスト入力とテキスト出力を示しています。
おすすめ記事
- Macaron V1 Venti on Novita AI: 748B Mixture-of-LoRA Flagship for Coding, Agents, and GenUI
- Ling-3.0-flash on Novita AI: Free API for Agentic Inference
- Qwen3.6-27B on Novita AI: 262K Context for Agentic Coding
2026年7月29日確認済み情報源: Macaron V1 Tall モデルページ、Novita チャット補完 API リファレンス、Novita モデル一覧 API リファレンス
