Novita AIでのQwen3.8-Max:2.4T MoE、1Mコンテキスト、ローンチプライシング

Novita AIでのQwen3.8-Max:2.4T MoE、1Mコンテキスト、ローンチプライシング

Qwen3.8-Max が Novita AI でサーバーレス API として利用可能になりました。長いコンテキストを扱うコーディングエージェント、ツール利用アシスタント、テキスト主体の自動化ワークフローを構築するチームを対象としています。2026年8月4日現在、Novita はモデル ID を qwen/qwen3.8-max、OpenAI 互換 API アクセスを https://api.novita.ai/openai、コンテキストウィンドウを 1,000,000 トークン、最大出力トークンを 131,072、価格を入力トークン100万トークンあたり $2、キャッシュ読み取りトークン100万トークンあたり $0.25、出力トークン100万トークンあたり $6 としています。すでにリクエスト例が必要で、ローンチの詳細は不要な場合は、Qwen3.8-Max API クイックスタート をご覧ください。

重要ポイント

  • Qwen3.8-Max は、Novita AI の実稼働エンドポイントであり、非常に大きなコンテキストウィンドウとサーバーレス API パスを必要とするエージェント型またはコーディング主体のテキストワークフロー向けです。
  • 確認済みの Novita モデル ID は qwen/qwen3.8-max で、OpenAI 互換アクセスは https://api.novita.ai/openai を通じて行います。
  • Novita は現在、コンテキストトークン 1,000,000、最大出力トークン 131,072、一律料金として入力トークン100万トークンあたり $2、キャッシュ読み取りトークン100万トークンあたり $0.25、出力トークン100万トークンあたり $6 を掲載しています。
  • このページはローンチと意思決定のガイドです。Novita AI で何が利用可能か、モデルの得意分野、ワークロードに適しているかを説明します。ステップバイステップの API クイックスタートではありません。

Qwen3.8-Max とは?

Qwen3.8-Max は、コーディング、共同作業型アシスタンス、長いコンテキストでの推論に特化した大規模 MoE モデルです。実際のところ、作業セットが小さなエンドポイントでは大きすぎる場合に使用するモデルです。リポジトリ規模のコードレビュー、長い issue や PR の履歴、複数ドキュメントの推論、あるいは指示やツール出力、コンテキストを多数のステップにわたってメモリに保持する必要があるエージェントループなどです。

Novita AI 上での主な開発者価値はシンプルです。独自の推論スタックを実行することなく、フラッグシップ Qwen モデル向けのサーバーレスホスト型エンドポイントを利用できます。これにより、モデルの大規模コンテキストと価格設定が本番ワークフローに適合するかどうかを、より深い統合作業に着手する前にテストしやすくなります。

Novita AI での Qwen3.8-Max API アクセス

Novita AI はモデルライブラリに Qwen3.8-Max をモデル ID qwen/qwen3.8-max で掲載しています。すでに OpenAI 互換クライアントを使用しているチームにとって、主要な統合パスは Novita API キー、Novita ベース URL、そしてこのモデル ID です。

このページでは、開発者が通常最初に必要とするローンチレベルの事実(可用性、モデル ID、コンテキスト制限、価格、最適なユースケース)に焦点を当てています。主な関心が最初のリクエストの実行方法や、正確なリクエスト構文をアプリに組み込む方法である場合、それはこのローンチページではなく、クイックスタートページに属します。コーディングエージェント向けに Qwen3.8-Max と他のオープンモデルを比較検討している場合は、コミットする前に 2026年のコーディングエージェント向けオープンソース LLM リーダーボード をご利用ください。

Novita AI 上の Qwen3.8-Max 仕様と価格

フィールド
表示名 Qwen3.8 Max
モデル ID qwen/qwen3.8-max
アクセスパス サーバーレス API
ベース URL https://api.novita.ai/openai
エンドポイントファミリー chat/completions
コンテキスト長 1,000,000
最大出力 131,072
入力価格 $2 / 100万トークン
キャッシュ読み取り価格 $0.25 / 100万トークン
出力価格 $6 / 100万トークン
確認日 2026年8月4日
最適な用途 長いコンテキストのコーディングエージェント、リポジトリレビュー、ツール利用アシスタント、テキスト主体の自動化ワークフロー

価格は変更される可能性があるため、本番展開や顧客向けコストコミットメントの前に、現在の Novita AI 価格ページ を確認してください。記載されている料金は評価のための適切な出発点ですが、実際の支出はコンテキストサイズ、出力長、キャッシュヒット率、リトライ、およびエージェントがターン間で状態をどのようにパックするかによって異なります。

開発者にとって Qwen3.8-Max が重要な理由

注目すべき機能は、Qwen3.8-Max が大規模であることだけではありません。Novita が 1M コンテキストウィンドウを持つホスト型 API エンドポイントとして公開している点です。これにより、どのような種類のワークロードがテスト可能かが変わります。

コーディングエージェントの場合、大きなコンテキストウィンドウにより、モデルターンごとにリポジトリ状態、issue スレッド、アーキテクチャノート、テスト出力などを積極的にトリミングする必要性が軽減されます。エージェントワークフロー全般では、ツールトレース、メモリサマリー、長いユーザー指示のための余裕が増え、小さな作業セットを強制されにくくなります。

価格設定もここで重要です。Qwen3.8-Max は小さなプロンプト向けの低予算ルートではありませんが、フラットなトークン価格とキャッシュ読み取りレートにより、段階的価格表よりも長いコンテキストのワークロードを推定しやすくなっています。システムが長く安定したプロンプトやリポジトリサマリーを再利用する場合、キャッシュ読み取りによってコストプロファイルが大きく変わる可能性があります。

Qwen3.8-Max が適しているケース

Qwen3.8-Max は、以下のワークロードで使用します。

  • 長いコンテキストのコーディングまたはレビューワークフロー
  • 構造化出力を用いたエージェントループ
  • 大きな状態を保持するテキストファーストのアシスタント
  • Novita AI 上のサーバーレス OpenAI 互換アクセス

典型的な例として、リポジトリレベルのコードレビュー、長い PR の要約、複数の長文ドキュメントにわたって推論する必要がある研究アシスタント、ステップ間で大量の中間コンテキストを保持する必要がある自動化エージェントなどがあります。

Qwen3.8-Max が最適なデフォルトではないケース

Qwen3.8-Max は、タスクが小さく短く、簡単にルーティングできる場合には魅力的ではありません。軽量な抽出、分類、短いチャットでは、フラッグシップの長いコンテキストモデルを正当化できないことがよくあります。

また、「最初の API 呼び出しはどうやって行うのか?」という質問に答えるためのページでもありません。これが主なユーザー意図である場合、適切なフォローアップは、検証済みのリクエスト構文とセットアップ手順を含むクイックスタート記事です。

まとめ

Qwen3.8-Max は、チームがすでに小規模モデルでコンテキストのプレッシャーを経験している場合、またはエージェントワークフローがより大きな保持状態で信頼性を増す場合に、最初に評価する価値があります。現在のワークロードが主に短いプロンプト、単純なルーティング、またはコスト重視の大量推論である場合は、小規模モデルを並行してテストし、全体的なタスク成功率、レイテンシ、支出を比較してからデフォルトにしてください。

主な関心が生のコンテキストサイズではなく、Python コーディングワークフローへの適合性である場合は、2026年の Python コーディングに最適な AI を比較してください。

FAQ

どのモデル ID を使用すればよいですか?

qwen/qwen3.8-max を使用してください。

Novita AI が掲載しているコンテキスト長は?

Novita は 1,000,000 トークンのコンテキストウィンドウを掲載しています。

現在の価格は?

Novita は、入力トークン100万トークンあたり $2、出力トークン100万トークンあたり $6、キャッシュ読み取りトークン100万トークンあたり $0.25 を掲載しています。

出典

おすすめ記事