Qwen3.8 2.4T A95B на Novita AI: доступ к модели с открытыми весами и цены

Qwen3.8 2.4T A95B на Novita AI: доступ к модели с открытыми весами и цены

Qwen3.8 2.4T A95B — это модель с открытыми весами, работающая только с текстом, доступная через серверный API Novita AI. Она предназначена для разработчиков, которым нужна длинноконтекстная кодовая работа, исследованя, сложные рассуждения или агентские рабочие процессы с возможностью использования открытых весов. Novita указывает идентификатор модели qwen/qwen3.8-2.4t-a95b, окно контекста 1.000.000 токенов, макcимаьный выод 131.072 токена и цены $2 за 1M входных токенов, $0.25 за 1M токенов чтения и кэша и $6 за 1M выходных токенов.

Ключевые выоды

  • Qwen3.8 2.4T A95B — разреженная MoE-модель с открытыми весами, имеющая 2.4T общих параметров и 95B активных параметров.
  • Novita предосталяет её как текстовую серверную модель с поддержкой вызова функций, структурированных выводов и рассуждения.
  • Novita заявляет окно контекста на 1.000.000 токенов и максимаьный выход 131.072 токена.
  • Модель больше подходит командам, ценящим портативость открытых весов и текстовые рабочие процессы, чем для нагрузок, требующих визуального ввода или готового управляемого продукта.

Характеристики и цены Qwen3.8 2.4T A95B

Поле Значение Novita
Отображаемое имя Qwen3.8 2.4T A95B
Идентификатор модели qwen/qwen3.8-2.4t-a95b
Тип модели Разреженный MoE с открытыми весами
Всего параметров 2.4T
Активных параметров 95B
Окно контекста 1.000.000 токенов
Макс. выходных токенов 131.072
Входной модальность Текст
Выходная модальность Текст
Endpoint’ы chat/completions, responses
Возможности Serverless, вызов функций, структурированные выходы, рассуждение
Цена за вход $2 / 1M токенов
Цена за чтение из кэша $0.25 / 1M токенов
Цена за выход $6 / 1M токенов
Указанный уровень скорости T1: 30 RPM / 50.000.000 TPM
Дата проверки 2 сентября 2026

Цены и лимиты могут меняться. Перед принятием финансовых обязательств в продуктиве сверяйтесь со страницей модели Novita AI и страницей цен Novita AI.

Что умеет Qwen3.8 2.4T A95B

Qwen3.8 2.4T A95B предназначена для текстовых нагрузок, выигрывающих от большого окна контекста и мощной способности к рассуждению. Её статус с открытыми весами также даёт командам возможность оценить модель под собственные требования к сервингу и развёртыванию, а не рассматривать управляемый endpoint как единственный вариант.

Модель подходит для проверки кода в масштабе репозитория, работы с множеством документов, сложных текстовых рассуждений, структурированной генерации и агентских циклов, которые сохраняют следы инструментов или промежуточное состояние. Карточка модели Qwen содержит веса модели и конфигурационные файлы, а также указание на совместимость со стеками сервинга, такими как vLLM и SGLang.

Когда Qwen3.8 2.4T A95B — хороший выбор

Выбирайте эту модель, когда вам нужно:

  • портативность открытых весов и контроль над уровнем сервинга
  • длинноконтекстная кодовая работа, проверка кода или анализ репозитория
  • текстовые исследования и работа с множеством документов с рассуждением
  • агентские рабочие процессы с вызовом функций, структурированными выходами или рассуждением
  • хостинг-endpoint от Novita для оценки перед более глубокими работами по инфраструктуре

Различие в открытых весах важно, если ваша команда впоследствии может захотеть развернуть модель самостоятельно, сменить инфраструктуру сервинга или сохранить единый артефакт модели во всех средах. Для управляемой модели Qwen3.8-Max на Novita AI и её доступа на уровне продукта см. Qwen3.8-Max на Novita AI.

Когда Qwen3.8 2.4T A95B не оптимальный выбор

Эта модель не подходит для изображений или визуального ввода, так как Novita указывает её входной модальностью только текст. Она также может быть избыточной для короткой классификации, лёгкого извлечения или запросов с большим объёмом, где меньшая модель удовлетворит требования к качеству при более низкой стоимости.

Выбирайте управляемый путь Qwen3.8-Max, когда вам нужен его дополнительный слой продукта, включая визуальный ввод или более готовый управляемый рабочий процесс. Если ваш главный вопрос — как отправить первый запрос, используйте Краткое руководство по API Qwen3.8-Max вместо этой страницы запуска и принятия решений.

Доступ к API Qwen3.8 2.4T A95B на Novita AI

Страница модели Novita указывает идентификатор API qwen/qwen3.8-2.4t-a95b и поддерживает семейства endpoint’ов chat/completions и responses. Точка входа для API, совместимого с OpenAI, — https://api.novita.ai/openai.

Этот раздел намеренно содержит только информацию о доступе. Он не включает пошаговое руководство по первому запросу, полную структуру параметров запроса или шаги по устранению неполадок; это должно быть в руководстве по быстрому старту или функциональном гиде.

Часто задаваемые вопросы

Какой идентификатор модели в Novita?

Используйте qwen/qwen3.8-2.4t-a95b.

Открыты ли веса Qwen3.8 2.4T A95B?

Да. Карточка модели Qwen содержит веса модели и конфигурационные файлы для пост-обученной модели. Наличие открытых весов не означает, что любые развёртывания имеют одинаковые аппартные средства, сервинг или проиводительность.

Какие лимиты контекста и выхода указывает Novita?

Novita указывает окно контекста на 1.000.000 токенов и максимальны выход 131.072 токена.

Какова стоимость на Novita AI?

Novita заявляет $2 за 1M вхных токенов, $0.25 за 1M токенов чтения из кэша и $6 за 1M выходных токенов по состоянию на 2 сентября 2026 года.

Это то же самое, что Qwen3.8-Max?

Это модель Qwen3.8 2.4T A95B с открытыми весами, тогда как Qwen3.8-Max — это отдельный управляемый сервисный путь. Сравните подтверждённые возможности и требования к доступу для вашей нагрузки, прежде чем выбирать между ними.

Источники

Рекомендованные статьи