Qwen3.8 2.4T A95B は、Novita AI のサーバーレス API で利用可能なオープンウェイトのテキスト専用 Qwen3.8 モデルです。長いコンテキストを必要とするコーディング、研究、複雑な推論、エージェントワークフローを、オープンウェイトの提供オプションとして維持しながら利用したい開発者を対象としています。Novita はモデル ID を qwen/qwen3.8-2.4t-a95b、コンテキストウィンドウを 1,000,000 トークン、最大出力トークンを 131,072、価格を入力トークン 100 万あたり $2、キャッシュ読み取りトークン 100 万あたり $0.25、出力トークン 100 万あたり $6 として掲載しています。
主なポイント
- Qwen3.8 2.4T A95B は、総パラメータ数 2.4T、活性パラメータ数 95B のオープンウェイトスパース MoE モデルです。
- Novita はこれを、関数呼び出し、構造化出力、推論機能を備えたテキスト専用のサーバーレスモデルとして提供しています。
- Novita は 1,000,000 トークンのコンテキストウィンドウと 131,072 トークンの最大出力を掲載しています。
- このモデルは、ターンキー管理製品レイヤーよりも、オープンウェイトのポータビリティとテキストファーストのワークフローを重視するチームに適しています。
Qwen3.8 2.4T A95B の仕様と価格
| フィールド | Novita の値 |
|---|---|
| 表示名 | Qwen3.8 2.4T A95B |
| モデル ID | qwen/qwen3.8-2.4t-a95b |
| モデルタイプ | オープンウェイトスパース MoE |
| 総パラメータ数 | 2.4T |
| 活性パラメータ数 | 95B |
| コンテキストウィンドウ | 1,000,000 トークン |
| 最大出力トークン | 131,072 |
| 入力モダリティ | テキスト |
| 出力モダリティ | テキスト |
| エンドポイント | chat/completions、responses |
| 機能 | サーバーレス、関数呼び出し、構造化出力、推論 |
| 入力価格 | $2 / 100万トークン |
| キャッシュ読み取り価格 | $0.25 / 100万トークン |
| 出力価格 | $6 / 100万トークン |
| 表示レート tier | T1:30 RPM / 50,000,000 TPM |
| 確認日 | 2026年9月2日 |
価格と制限は変更される可能性があります。本番環境のコストコミットメントを行う前に、Novita AI モデルページ と Novita AI 価格ページ を確認してください。
Qwen3.8 2.4T A95B で可能なこと
Qwen3.8 2.4T A95B は、大きなコンテキストウィンドウと強力な推論能力を活かしたテキストファーストのワークロード向けに設計されています。オープンウェイトであることから、チームは管理エンドポイントを唯一の選択肢として扱うのではなく、独自の提供およびデプロイ要件に照らしてモデルを評価する道筋を得ることができます。
このモデルは、リポジトリ規模のコードレビュー、複数ドキュメントにわたるリサーチ、複雑なテキスト推論、構造化生成、ツールのトレースや中間状態を保持するエージェントループに適しています。Qwen モデルカードにはモデルウェイトと設定ファイルが記載されており、vLLM や SGLang などの推論スタックとの互換性が示されています。
Qwen3.8 2.4T A95B が適しているケース
以下のニーズがある場合にこのモデルを選択してください:
- オープンウェイトによるポータビリティと推論レイヤーの制御
- 長いコンテキストを必要とするコーディング、コードレビュー、リポジトリ分析
- テキスト専用のリサーチと複数ドキュメントの推論
- 関数呼び出し、構造化出力、推論機能を利用したエージェントワークフロー
- より深いインフラストラクチャ作業の前に評価するためのホスト型 Novita エンドポイント
オープンウェイトであることの重要性は、チームが後にセルフホスト、推論インフラの変更、または環境間で一貫したモデルアーティファクトを維持する可能性がある場合に発揮されます。管理された Novita AI の Qwen3.8-Max モデル とそのプロダクトレベルのアクセスパスについては、Novita AI の Qwen3.8-Max を参照してください。
Qwen3.8 2.4T A95B が最適なデフォルトではないケース
このモデルは、画像やビジョン入力には適していません。Novita は入力モダリティをテキストとして掲載しているためです。また、短い分類、軽量な抽出、高ボリュームのプロンプトなど、より小さいモデルで品質要件を満たしつつコストを抑えられるケースには、オーバースペックとなる可能性があります。
代わりに管理された Qwen3.8-Max パスを選択すべきなのは、ビジョン入力やよりターンキーな管理ワークフローなど、追加のプロダクトレイヤーが必要な場合です。最初のリクエストの送信方法が主な関心事である場合は、本ページ(ローンチおよび意思決定ページ)ではなく、Qwen3.8-Max API クイックスタート を参照してください。
Novita AI 上の Qwen3.8 2.4T A95B への API アクセス
Novita のモデルページでは、API モデル ID を qwen/qwen3.8-2.4t-a95b としており、chat/completions および responses エンドポイントファミリーをサポートしています。Novita の OpenAI 互換 API エントリポイントは https://api.novita.ai/openai です。
このセクションはアクセス情報のみを意図的に提供しています。最初のリクエスト手順、完全なリクエストパラメータ、トラブルシューティング手順は含まれていません。これらはクイックスタートガイドや機能ガイドに属する内容です。
よくある質問(FAQ)
Novita のモデル ID は何ですか?
qwen/qwen3.8-2.4t-a95b を使用してください。
Qwen3.8 2.4T A95B はオープンウェイトですか?
はい。Qwen モデルカードでは、ポストトレーニング済みモデルのモデルウェイトと設定ファイルが提供されています。オープンウェイトで利用可能であることは、すべてのデプロイメントが同一のハードウェア、推論、パフォーマンスプロファイルを持つことを意味するものではありません。
Novita が掲載するコンテキストと出力の制限は?
Novita は 1,000,000 トークンのコンテキストウィンドウと 131,072 トークンの最大出力を掲載しています。
Novita AI でのコストは?
Novita は、2026年9月2日時点で、入力トークン 100 万あたり $2、キャッシュ読み取りトークン 100 万あたり $0.25、出力トークン 100 万あたり $6 と掲載しています。
これは Qwen3.8-Max と同じですか?
これはオープンウェイトの Qwen3.8 2.4T A95B モデルであり、Qwen3.8-Max は別の管理サービスパスです。どちらを選択するかに先立ち、検証済みの機能とアクセス要件をワークロードに照らして比較してください。
情報源
- Novita モデルページ:https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b(2026-09-02 確認)
- Novita 価格ページ:https://novita.ai/pricing(2026-09-02 確認)
- Qwen モデルカード:https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B(2026-09-02 確認)
- Qwen3.8-Max ローンチガイド:/qwen3-8-max-on-novita-ai-launch-pricing/
- Qwen3.8-Max クイックスタート:/qwen3-8-max-api-quick-start/
