Qwen3.8 2.4T A95B — это модель Qwen3.8 с открытыми весами, только текст, доступная через бессерверное API Novita AI. Она предназначена для разработчиков, которым нужны длинный контекст для кодинга, исследований, сложных рассуждений или агентных рабочих процессов, при этом сохраняя возможность использования модели с открытыми весами. Novita указывает ID модели qwen/qwen3.8-2.4t-a95b, окно контекста 1,000,000 токенов, максимальное количество выходных токенов 131,072, и цены: $2 за 1 млн вводных токенов, $0.25 за 1 млн токенов чтения из кэша и $6 за 1 млн выходных токенов.
Ключевые выводы
- Qwen3.8 2.4T A95B — это разреженная MoE модель с открытыми весами, имеющая 2.4T общих параметров и 95B активных параметров.
- Novita предоставляет её как бессерверную модель только для текста с поддержкой вызова функций, структурированных ответов и рассуждений.
- Novita указывает окно контекста 1,000,000 токенов и максимальный вывод 131,072 токенов.
- Модель лучше подходит для команд, которые ценят портативность с открытыми весами и рабочие процессы, ориентированные на текст, чем для задач, требующих ввода изображений или готового управляемого слоя продукта.
Спецификации и цены Qwen3.8 2.4T A95B
| Поле | Значение Novita |
|---|---|
| Отображаемое имя | Qwen3.8 2.4T A95B |
| ID модели | qwen/qwen3.8-2.4t-a95b |
| Тип модели | Разреженная MoE с открытыми весами |
| Всего параметров | 2.4T |
| Активных параметров | 95B |
| Окно контекста | 1,000,000 токенов |
| Макс. выходных токенов | 131,072 |
| Входная модальность | Текст |
| Выходная модальность | Текст |
| Endpoints | chat/completions, responses |
| Возможности | Бессерверное, вызов функций, структурированные ответы, рассуждения |
| Цена ввода | $2 / 1M токенов |
| Цена чтения из кэша | $0.25 / 1M токенов |
| Цена вывода | $6 / 1M токенов |
| Уровень скорости | T1: 30 RPM / 50,000,000 TPM |
| Дата проверки | 2 сентября 2026 г. |
Цены и лимиты могут измениться. Перед принятием производственных затрат подтвердите страницу модели Novita AI и страницу цен Novita AI.
Что может Qwen3.8 2.4T A95B
Qwen3.8 2.4T A95B предназначен для рабочих нагрузок, ориентированных на текст, которые выигрывают от большого окна контекста и мощных возможностей рассуждения. Его позиционирование с открытыми весами также даёт командам возможность оценить модель по своим собственным требованиям к обслуживанию и развертыванию, а не рассматривать управляемый endpoint как единственный вариант.
Модель подходит для ревью кода на уровне репозитория, многодокументных исследований, сложных текстовых рассуждений, структурированной генерации и агентных циклов, которые сохраняют следы инструментов или промежуточное состояние. В карточке модели Qwen документируются веса модели и файлы конфигурации, а также перечислена совместимость с такими стеками обслуживания, как vLLM и SGLang.
Когда Qwen3.8 2.4T A95B подходит
Выбирайте эту модель, когда вам нужны:
- портативность с открытыми весами и контроль над слоем обслуживания
- кодинг с длинным контекстом, ревью кода или анализ репозитория
- исследования только текста и многодокументные рассуждения
- агентные рабочие процессы с использованием вызова функций, структурированных ответов или рассуждений
- хостинг-конечная точка Novita для оценки перед более глубокой инфраструктурной работой
Различие с открытыми весами имеет значение, когда ваша команда может в дальнейшем самостоятельно разместить модель, изменить инфраструктуру обслуживания или сохранить единый артефакт модели в разных средах. Для управляемой модели Qwen3.8-Max на Novita AI и её доступа на уровне продукта см. Qwen3.8-Max на Novita AI.
Когда Qwen3.8 2.4T A95B не является лучшим выбором по умолчанию
Эта модель не является лучшим выбором по умолчанию для ввода изображений или зрения, поскольку Novita указывает её входную модальность как текст. Она также может оказаться избыточной для короткой классификации, лёгкого извлечения или высокообъёмных промптов, где модель меньшего размера соответствовала бы требованиям к качеству при более низкой стоимости.
Вместо этого выберите управляемый путь Qwen3.8-Max, когда вам нужен его дополнительный продуктный слой, включая ввод изображений или более готовый управляемый рабочий процесс. Если ваш главный вопрос — как отправить первый запрос, используйте Qwen3.8-Max API Quick Start, а не эту страницу запуска и принятия решений.
Доступ к API Qwen3.8 2.4T A95B на Novita AI
На странице модели Novita указан ID API модели как qwen/qwen3.8-2.4t-a95b и поддерживаются семейства endpoint chat/completions и responses. Точка входа API, совместимого с OpenAI, — https://api.novita.ai/openai.
Этот раздел намеренно содержит только информацию о доступе. Он не включает пошаговое руководство по первому запросу, полные параметры запроса или шаги по устранению неполадок; они относятся к краткому руководству или руководству по функциям.
FAQ
Какой ID модели Novita?
Используйте qwen/qwen3.8-2.4t-a95b.
Является ли Qwen3.8 2.4T A95B моделью с открытыми весами?
Да. В карточке модели Qwen предоставлены веса модели и файлы конфигурации для пост-тренированной модели. Доступность с открытыми весами не означает, что каждое развертывание имеет одинаковый аппаратный, сервисный или производительный профиль.
Какие лимиты контекста и вывода указывает Novita?
Novita указывает окно контекста 1,000,000 токенов и максимальный вывод 131,072 токенов.
Сколько это стоит на Novita AI?
Novita указывает $2 за 1 млн вводных токенов, $0.25 за 1 млн токенов чтения из кэша и $6 за 1 млн выходных токенов по состоянию на 2 сентября 2026 г.
Это то же самое, что Qwen3.8-Max?
Это модель с открытыми весами Qwen3.8 2.4T A95B, в то время как Qwen3.8-Max — это отдельный путь управляемого сервиса. Сравните проверенные возможности и требования доступа для вашей рабочей нагрузки, прежде чем выбирать между ними.
Источники
- Страница модели Novita: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (проверено 2026-09-02)
- Страница цен Novita: https://novita.ai/pricing (проверено 2026-09-02)
- Карточка модели Qwen: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (проверено 2026-09-02)
- Руководство по запуску Qwen3.8-Max: /qwen3-8-max-on-novita-ai-launch-pricing/
- Краткое руководство по API Qwen3.8-Max: /qwen3-8-max-api-quick-start/
