Qwen3.8 2.4T A95B — это модель с открытыми весами, работающая только с текстом, доступная через серверный API Novita AI. Она предназначена для разработчиков, которым нужна длинноконтекстная кодовая работа, исследованя, сложные рассуждения или агентские рабочие процессы с возможностью использования открытых весов. Novita указывает идентификатор модели qwen/qwen3.8-2.4t-a95b, окно контекста 1.000.000 токенов, макcимаьный выод 131.072 токена и цены $2 за 1M входных токенов, $0.25 за 1M токенов чтения и кэша и $6 за 1M выходных токенов.
Ключевые выоды
- Qwen3.8 2.4T A95B — разреженная MoE-модель с открытыми весами, имеющая 2.4T общих параметров и 95B активных параметров.
- Novita предосталяет её как текстовую серверную модель с поддержкой вызова функций, структурированных выводов и рассуждения.
- Novita заявляет окно контекста на 1.000.000 токенов и максимаьный выход 131.072 токена.
- Модель больше подходит командам, ценящим портативость открытых весов и текстовые рабочие процессы, чем для нагрузок, требующих визуального ввода или готового управляемого продукта.
Характеристики и цены Qwen3.8 2.4T A95B
| Поле | Значение Novita |
|---|---|
| Отображаемое имя | Qwen3.8 2.4T A95B |
| Идентификатор модели | qwen/qwen3.8-2.4t-a95b |
| Тип модели | Разреженный MoE с открытыми весами |
| Всего параметров | 2.4T |
| Активных параметров | 95B |
| Окно контекста | 1.000.000 токенов |
| Макс. выходных токенов | 131.072 |
| Входной модальность | Текст |
| Выходная модальность | Текст |
| Endpoint’ы | chat/completions, responses |
| Возможности | Serverless, вызов функций, структурированные выходы, рассуждение |
| Цена за вход | $2 / 1M токенов |
| Цена за чтение из кэша | $0.25 / 1M токенов |
| Цена за выход | $6 / 1M токенов |
| Указанный уровень скорости | T1: 30 RPM / 50.000.000 TPM |
| Дата проверки | 2 сентября 2026 |
Цены и лимиты могут меняться. Перед принятием финансовых обязательств в продуктиве сверяйтесь со страницей модели Novita AI и страницей цен Novita AI.
Что умеет Qwen3.8 2.4T A95B
Qwen3.8 2.4T A95B предназначена для текстовых нагрузок, выигрывающих от большого окна контекста и мощной способности к рассуждению. Её статус с открытыми весами также даёт командам возможность оценить модель под собственные требования к сервингу и развёртыванию, а не рассматривать управляемый endpoint как единственный вариант.
Модель подходит для проверки кода в масштабе репозитория, работы с множеством документов, сложных текстовых рассуждений, структурированной генерации и агентских циклов, которые сохраняют следы инструментов или промежуточное состояние. Карточка модели Qwen содержит веса модели и конфигурационные файлы, а также указание на совместимость со стеками сервинга, такими как vLLM и SGLang.
Когда Qwen3.8 2.4T A95B — хороший выбор
Выбирайте эту модель, когда вам нужно:
- портативность открытых весов и контроль над уровнем сервинга
- длинноконтекстная кодовая работа, проверка кода или анализ репозитория
- текстовые исследования и работа с множеством документов с рассуждением
- агентские рабочие процессы с вызовом функций, структурированными выходами или рассуждением
- хостинг-endpoint от Novita для оценки перед более глубокими работами по инфраструктуре
Различие в открытых весах важно, если ваша команда впоследствии может захотеть развернуть модель самостоятельно, сменить инфраструктуру сервинга или сохранить единый артефакт модели во всех средах. Для управляемой модели Qwen3.8-Max на Novita AI и её доступа на уровне продукта см. Qwen3.8-Max на Novita AI.
Когда Qwen3.8 2.4T A95B не оптимальный выбор
Эта модель не подходит для изображений или визуального ввода, так как Novita указывает её входной модальностью только текст. Она также может быть избыточной для короткой классификации, лёгкого извлечения или запросов с большим объёмом, где меньшая модель удовлетворит требования к качеству при более низкой стоимости.
Выбирайте управляемый путь Qwen3.8-Max, когда вам нужен его дополнительный слой продукта, включая визуальный ввод или более готовый управляемый рабочий процесс. Если ваш главный вопрос — как отправить первый запрос, используйте Краткое руководство по API Qwen3.8-Max вместо этой страницы запуска и принятия решений.
Доступ к API Qwen3.8 2.4T A95B на Novita AI
Страница модели Novita указывает идентификатор API qwen/qwen3.8-2.4t-a95b и поддерживает семейства endpoint’ов chat/completions и responses. Точка входа для API, совместимого с OpenAI, — https://api.novita.ai/openai.
Этот раздел намеренно содержит только информацию о доступе. Он не включает пошаговое руководство по первому запросу, полную структуру параметров запроса или шаги по устранению неполадок; это должно быть в руководстве по быстрому старту или функциональном гиде.
Часто задаваемые вопросы
Какой идентификатор модели в Novita?
Используйте qwen/qwen3.8-2.4t-a95b.
Открыты ли веса Qwen3.8 2.4T A95B?
Да. Карточка модели Qwen содержит веса модели и конфигурационные файлы для пост-обученной модели. Наличие открытых весов не означает, что любые развёртывания имеют одинаковые аппартные средства, сервинг или проиводительность.
Какие лимиты контекста и выхода указывает Novita?
Novita указывает окно контекста на 1.000.000 токенов и максимальны выход 131.072 токена.
Какова стоимость на Novita AI?
Novita заявляет $2 за 1M вхных токенов, $0.25 за 1M токенов чтения из кэша и $6 за 1M выходных токенов по состоянию на 2 сентября 2026 года.
Это то же самое, что Qwen3.8-Max?
Это модель Qwen3.8 2.4T A95B с открытыми весами, тогда как Qwen3.8-Max — это отдельный управляемый сервисный путь. Сравните подтверждённые возможности и требования к доступу для вашей нагрузки, прежде чем выбирать между ними.
Источники
- Страница модели Novita: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (проверено 2026-09-02)
- Страница цен Novita: https://novita.ai/pricing (проверено 2026-09-02)
- Карточка модели Qwen: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (проверено 2026-09-02)
- Руководство по запуску Qwen3.8-Max: /qwen3-8-max-on-novita-ai-launch-pricing/
- Быстрый старт Qwen3.8-Max: /qwen3-8-max-api-quick-start/
