Qwen3.8 2.4T A95B は、Novita AI のサーバーレス API で利用可能な、オープンウェイト、テキスト専用の Qwen3.8 モデルです。長いコンテキストを必要とするコーディング、研究、複雑な推論、またはエージェンティックワークフローを、オープンウェイトのサービングオプションを維持しながら実現したい開発者を対象としています。Novita は、モデル ID を qwen/qwen3.8-2.4t-a95b、コンテキストウィンドウを 1,000,000 トークン、最大出力トークンを 131,072、価格を入力 100 万トークンあたり 2 ドル、キャッシュ読み取り 100 万トークンあたり 0.25 ドル、出力 100 万トークンあたり 6 ドルとしています。
重要ポイント
- Qwen3.8 2.4T A95B は、総パラメータ数 2.4T、アクティブパラメータ数 95B のオープンウェイトスパース MoE モデルです。
- Novita は、関数呼び出し、構造化出力、推論をサポートするテキスト専用のサーバーレスモデルとして提供しています。
- Novita は、1,000,000 トークンのコンテキストウィンドウと 131,072 トークンの最大出力を掲載しています。
- このモデルは、ターンキーマネージドプロダクトレイヤーやビジョン入力を必要とするワークロードよりも、オープンウェイトのポータビリテイとテキストファーストのワークフローを重視するチームに適しています。
Qwen3.8 2.4T A95B の仕様と価格
| フィールド | Novita の価値 |
|---|---|
| 表示名 | Qwen3.8 2.4T A95B |
| モデル ID | qwen/qwen3.8-2.4t-a95b |
| モデル種類 | オープンウエイト スパース MoE |
| 総パラメータ数 | 2.4T |
| アクティブパラメータ数 | 95B |
| コンテキストウィンドウ | 1,000,000 トークン |
| 最大出力トークン | 131,072 |
| 入力モダリティ | テキスト |
| 出力モダリティ | テキスト |
| エンドポイント | chat/completions、responses |
| 機能 | サーバーレーレー、関数呼び出し、構造化出力、推論 |
| 入力価格 | 100万トークンあたり $2 |
| キャッシュ読取価格 | 100万トークンあたり $0.25 |
| 出力価格 | 100万トークンあたり $6 |
| 表示レート層 | T1: 30 RPM / 50,000,000 TPM |
| 確認日 | 2026年9月2日 |
価格と制限は変更される可能性があます。プロダクシンでのコストコミッテメントを行う前には、Novita AI モデルページ と Novita AI 価格ページ で確認してください。
Qwen3.8 2.4T A95B でできること
Qwen3.8 2.4T A95B は、大規模なコンテキストウインドウと強力な推論能力を活かすテキストファーストのワークロード向けに設計されています。また、オープンウェイトという位置づけにより、チームはマネージドエンドポイントを唯一の選択肢とせず、自らのサービングとデプロイメント要件に照らしてモデルを評価するパスを得ることできます。
このモデルは、リポジトリ規模のコードレビュー、マルチドキュメント研究、複雑なテキスト推論、構造化生成、およびツールトレースや中間状態を保持するエージェントループに適しています。Qwen のモデルカードには、モ デルの重みと設定ファイルが記載されており、vLLM や SGLang などのサービングスタックとの互換性がリストされています。
Qwen3.8 2.4T A95B が適しているケース
以下の必要がある場合は、こモデルを選択してください:
- オープンウェイトのポータビリテイとサービングレイヤーの制御
- 長いコンテキストのコーディング、コードレビュー、リポジトリ分析
- テキスト専用の研究とマルチドキュメント推論
- 関数呼び出し、構造化出力、推論を用いたエージェントワークフロー
- より深いインララストラクチャ作業の前に、ホステッドの Novita エンドポイントでの評価
オープンウェイトという差別化は、チームが後日セルフホステッドしたり、サービングインフラを変更したり、環境間で一貫したモデルアーテファクトを維持したりする可能性がある場合に重要です。マネージドの Novita AI 上の Qwen3.8-Max モデル とそのプロダクトレベルでのアクセスパスについては、Novita AI 上の Qwen3.8-Max をご覧ください。
Qwen3.8 2.4T A95B が最適なデフォルトではないケース
Novita が入力モダリティをテキストとしているため、このモデルは画像やビジョン入力には最適なデフォルトではありません。また、短い分類、軽量な抽出、または高ボリュームのプロンプトで、より小さいモデルが品質要件を低コストで満たせる場合には、必要以上にオーバースペックとなる可能性があります。
ビジョン入力や、よりターンキーなマネージドワークフローを含む追加のプロダクトレイヤーが必要な場合は、代わりにマネージドの Qwen3.8-Max パスを選択してください。最初のリクエストの送信方法が主な疑問であれば、このローンチと決定ペー Blog ではなく、Qwen3.8-Max API クイックスタート を使用してください。
Novita AI での Qwen3.8 2.4T A95B API アクセス
Novita のモデルページでは、API モデル ID が qwen/qwen3.8-2.4t-a95b としてリストされており、chat/completions と responses のエンドポイントファミリーをサポートしています。Novita の OpenAI 互換 API エントリポイントは、https://api.novita.ai/openai です。
このセクションは、アクセス情報のみを提することを意図しています。最初のリクエストのウォークスルー、完なリクエストパラメータ、トルブルシューティング手順は含まれません。これらは 4.4 クイックスタートまたは機能ガイドに属します。
FAQ
Novita のモデル ID は何ですか?
qwen/qwen3.8-2.4t-a95b を使用します。
Qwen3.8 2.4T A95B はオープンウェイトですか?
はい。Qwen モデルカードには、ポストレーニングされたモデルのモデル重みと設定ファイルが提供されています。オープンウェイトが利用できるからといって、すべてのデプロイメントが同じハードウェア、サービング、パフォーマンスプロファイルを持つわけではありません。
Novita がリストしているコンテキストと出力の制限は?
Novita は、1,000,000 トークのコンテキスウインドウと 131,072 トークの最最大出力をリストしています。
Novita AI でのコストは?
2026 年 9 月 2 日現在、Novita は、入力 100 万トークあたり $2、キャッシュ読取り 100 万トークあたり $0.25、出力 100 万トークあたり $6 としています。
これは Qwen3.8-Max と同じですか?
これはオープンウェイトの Qwen3.8 2.4T A95B モデルであり、Qwen3.8-Max は別のマネージドサービスパスです。ワークロードに応じて、検証された機能とアクセス要件を比較してから選択してください。
出典
- Novita モデルページ: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (2026-09-02 確認)
- Novita 価格ペー: https://novita.ai/pricing (2026-09-02 確認)
- Qwen モデルカード: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (2026-09-02 確認)
- Qwen3.8-Max ローンチガイド: /qwen3-8-max-on-novita-ai-launch-pricing/
- Qwen3.8-Max クイックスタート: /qwen3-8-max-api-quick-start/
