Hy3 на Novita AI: запуск, цены и для кого подходит
Hy3 доступен бесплатно на Novita AI через serverless API. 295B MoE, 21B активных параметров, контекст 256K, три режима рассуждений и $0 за токен.
Hy3 доступен бесплатно на Novita AI через serverless API. 295B MoE, 21B активных параметров, контекст 256K, три режима рассуждений и $0 за токен.
Пошаговое руководство по настройке CoBuddy (baidu/cobuddy) в Claude Code с помощью OpenAI-совместимого эндпоинта Novita AI. Настройка API, цены и советы по рабочему процессу...
Используйте DeepSeek в Claude Code через V4 Flash API на Novita AI. Установите четыре переменные окружения, получите контекст на 1 млн токенов и сократите расходы в 20 раз по...
Kimi K2.7 Code доступен на Novita AI с OpenAI-совместимым чат API, контекстом 256K, вызовом инструментов и мультимодальными входами.
Nemotron 3 Nano 30B A3B доступен на Novita AI в качестве серверной LLM с совместимыми с OpenAI чат-завершениями, контекстом 256K и оплатой по токенам.
CoBuddy доступен на Novita AI как API LLM, ориентированный на кодинг, для генерации кода, помощников по кодингу и рабочих процессов AI-агентов.
Qwen3.7-Max доступен на Novita AI для агентного кодирования и длинноконтекстных рабочих процессов. Просмотрите доступ к API, цены, ограничения и варианты использования.
Внешний KV-кэш PegaFlow помогает командам, обслуживающим vLLM, сохранять и делиться KV-кэшем между перезапусками, экземплярами и узлами RDMA.
DeepSeek-V4-Pro — это открытая модель смеси экспертов (MoE) с 1,6 трлн параметров, получившая высший балл LiveCodeBench (93,5) и поддерживающая контекст длиной 1M токенов. Уже...
DeepSeek-V4-Flash теперь доступен через Novita AI. Модель MoE на 284B параметров, контекст на 1M токенов, выбираемые режимы рассуждений. $0.14 за миллион входных токенов. API,...
Ling-2.6-flash — это MoE-модель на 104B параметров (7.4B активных), обеспечивающая скорость 340 токенов/с и в 7 раз лучшую эффективность токенов, чем Nemotron-3-Super, на...
Kimi K2.6 теперь доступен на Novita AI. Открытая MoE-модель на 1 трлн параметров, контекст 256K, 58.6% SWE-Bench Pro — создана для длительного агентного кодирования. Попробуйте...
GLM-5.1 от Z.ai теперь доступен в Novita AI — занимает первое место в SWE-Bench Pro с результатом 58.4 и выполняет автономные задачи по программированию в течение 8 часов....
Изучите преимущества Speech 2.6 для синтеза речи (TTS) и голосовых агентов. Узнайте, как он повышает производительность и эффективность приложений.