Qwen3.8 2.4T A95B は、Novita AI のサーバーレス API で利用可能なオープンウェイト、テキスト専用の Qwen3.8 モデルです。長いコンテキストを必要とするコーディング、リサーチ、複雑な推論、エージェントワークフローにおいて、オープンウェイトでの提供オプションを求める開発者に向けて設計されています。Novita はモデル ID を qwen/qwen3.8-2.4t-a95b、コンテキストウィンドウを 1,000,000 トークン、最大出力トークンを 131,072、料金を入力 100 万トークンあたり $2、キャッシュリード 100 万トークンあたり $0.25、出力 100 万トークンあたり $6 としています。
重要なポイント
- Qwen3.8 2.4T A95B は、総パラメータ数 2.4T、アクティブパラメータ数 95B のオープンウェイトなスパース MoE モデルです。
- Novita はこれをテキスト専用のサーバーレスモデルとして公開しており、関数呼び出し、構造化出力、推論機能をサポートしています。
- Novita は 1,000,000 トークンのコンテキストウィンドウと 131,072 トークンの最大出力を掲載しています。
- このモデルは、視覚入力を必要としたり、ターンキーなマネージドプロダクトレイヤーを求めるワークロードよりも、オープンウェイトのポータビリティとテキストファーストのワークフローを重視するチームに適しています。
Qwen3.8 2.4T A95B のスペックと料金
| 項目 | Novita の値 |
|---|---|
| 表示名 | Qwen3.8 2.4T A95B |
| モデル ID | qwen/qwen3.8-2.4t-a95b |
| モデルタイプ | オープンウェイト スパース MoE |
| 総パラメータ数 | 2.4T |
| アクティブパラメータ数 | 95B |
| コンテキストウィンドウ | 1,000,000 トークン |
| 最大出力トークン | 131,072 |
| 入力モダリティ | テキスト |
| 出力モダリティ | テキスト |
| エンドポイント | chat/completions、responses |
| 機能 | サーバーレス、関数呼び出し、構造化出力、推論 |
| 入力料金 | $2 / 100 万トークン |
| キャッシュリード料金 | $0.25 / 100 万トークン |
| 出力料金 | $6 / 100 万トークン |
| 表示レート層 | T1: 30 RPM / 50,000,000 TPM |
| 確認日 | 2026 年 9 月 2 日 |
料金と制限は変更される可能性があります。本番環境でのコストを確定する前に、Novita AI モデルページ と Novita AI 料金ページ で必ずご確認ください。
Qwen3.8 2.4T A95B でできること
Qwen3.8 2.4T A95B は、大きなコンテキストウィンドウと強力な推論能力を活かしたテキストファーストのワークロード向けに設計されています。オープンウェイトであるという特性から、チームはマネージドエンドポイントを唯一の選択肢として扱うのではなく、独自のサーブ環境やデプロイ要件に対してモデルを評価する道筋を得られます。
このモデルは、リポジトリ規模のコードレビュー、マルチドキュメントリサーチ、複雑なテキスト推論、構造化生成、そしてツールのトレースや中間状態を保持するエージェントループに適しています。Qwen のモデルカードには、モデルの重みと設定ファイルが記載されており、vLLM や SGLang などのサーブスタックとの互換性が示されています。
Qwen3.8 2.4T A95B が適しているケース
以下のような場面でこのモデルを選択してください:
- オープンウェイトのポータビリティとサーブレイヤーの制御が必要な場合
- 長いコンテキストのコーディング、コードレビュー、リポジトリ分析を行う場合
- テキストのみのリサーチとマルチドキュメント推論を行う場合
- 関数呼び出し、構造化出力、推論機能を用いたエージェントワークフローを利用する場合
- より深いインフラ構築の前に、ホストされた Novita エンドポイントで評価を行いたい場合
オープンウェイトであることの重要性は、チームが後でセルフホストしたり、サーブインフラを変更したり、環境間で一貫したモデルアーティファクトを維持したりする可能性がある場合に発揮されます。マネージドの Novita AI 上の Qwen3.8-Max モデル とそのプロダクションレベルのアクセスパスについては、Qwen3.8-Max on Novita AI をご覧ください。
Qwen3.8 2.4T A95B が最適なデフォルトではないケース
Novita が入力モダリティをテキストとしているため、このモデルは画像や視覚入力には適していません。また、短い分類、軽量な抽出、あるいは低コストで品質要件を満たせる小規模なモデルで十分な大量プロンプトには、オーバースペックである可能性があります。
視覚入力や、よりターンキーなマネージドワークフローを含む追加のプロダクトレイヤーが必要な場合は、代わりにマネージドの Qwen3.8-Max パスを選択してください。最初のリクエストの送信方法が主な関心事であれば、本記事(ローンチおよび判断ページ)ではなく、Qwen3.8-Max API クイックスタート をご利用ください。
Novita AI での Qwen3.8 2.4T A95B API アクセス
Novita のモデルページでは、API モデル ID が qwen/qwen3.8-2.4t-a95b としてリストされ、chat/completions および responses エンドポイントファミリーをサポートしています。Novita の OpenAI 互換 API エントリポイントは https://api.novita.ai/openai です。
このセクションはアクセス情報のみを提供することを意図しています。最初のリクエストのチュートリアル、完全なリクエストパラメータ、トラブルシューティング手順は含まれていません。これらは別の 4.4 クイックスタートまたは機能ガイドに記載されるべきものです。
FAQ
Novita のモデル ID は何ですか?
qwen/qwen3.8-2.4t-a95b を使用してください。
Qwen3.8 2.4T A95B はオープンウェイトですか?
はい。Qwen のモデルカードには、ポストトレーニングされたモデルの重みと設定ファイルが提供されています。オープンウェイトで利用可能であることは、すべてのデプロイが同一のハードウェア、サーブ環境、パフォーマンスプロファイルを持つことを意味するわけではありません。
Novita が掲載するコンテキストと出力の制限は何ですか?
Novita は 1,000,000 トークンのコンテキストウィンドウと 131,072 トークンの最大出力を掲載しています。
Novita AI での料金はいくらですか?
2026 年 9 月 2 日確認時点で、Novita は入力 100 万トークンあたり $2、キャッシュリード 100 万トークンあたり $0.25、出力 100 万トークンあたり $6 としています。
これは Qwen3.8-Max と同じですか?
これはオープンウェイトの Qwen3.8 2.4T A95B モデルであり、Qwen3.8-Max は別のマネージドサービスのパスです。ワークロードに応じて、検証された機能とアクセス要件を比較した上で選択してください。
出典
- Novita モデルページ: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b(2026-09-02 確認)
- Novita 料金ページ: https://novita.ai/pricing(2026-09-02 確認)
- Qwen モデルカード: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B(2026-09-02 確認)
- Qwen3.8-Max ローンチガイド: /qwen3-8-max-on-novita-ai-launch-pricing/
- Qwen3.8-Max クイックスタート: /qwen3-8-max-api-quick-start/
