Цены на Kimi K3 в Novita AI: $3 за ввод, $15 за вывод и когда его использовать

Цены на Kimi K3 в Novita AI: $3 за ввод, $15 за вывод и когда его использовать

Kimi K3 доступен на Novita AI как флагманская модель Moonshot AI с 2,8 триллионами суммарных параметров, контекстным окном в 1 048 576 токенов и поддержкой ввода текста, изображений и видео. Выбирайте K3, когда вашему приложению требуется очень большой контекст или мультимодальные рассуждения; выбирайте один из вариантов Kimi K2, когда важнее низкая стоимость за токен, меньшее окно контекста или уже существующая интеграция с K2. Текущие цены на K3 от Novita: $3 за миллион входных токенов, $15 за миллион выходных токенов и $0,30 за миллион токенов при чтении из кэша (данные проверены 22 июля 2026 года).

Ключевые выводы

  • Kimi K3 доступен на Novita AI под точным идентификатором модели moonshotai/kimi-k3.
  • На странице модели указаны контекст в 1 млн токенов и максимальный вывод в 1 млн токенов, а также возможности ввода текста, изображений и видео.
  • Текущие бессерверные цены: $3/М за ввод, $15/М за вывод и $0,30/М за чтение из кэша. Цены могут меняться, поэтому перед планированием бюджета уточните их на странице модели.
  • K3 — лучший выбор Kimi для больших репозиториев, длинных исследовательских материалов, мультимодальной работы со знаниями и рабочих процессов, требующих новейшей флагманской модели.
  • K2.5 или K2 Instruct могут быть более разумным выбором для задач, чувствительных к стоимости, работающих только с текстом или уже имеющих интеграцию.

Что такое Kimi K3?

Kimi K3 — новейшая модель Kimi от Moonshot AI и самая мощная модель в линейке Kimi на Novita AI. Её главное отличие — масштаб: на странице модели Novita указано, что модель с 2,8 триллионами параметров построена с использованием Kimi Delta Attention и Attention Residuals, обладает нативным визуальным пониманием и контекстным окном в 1 млн токенов.

Такой размер контекста меняет практический вопрос с “Может ли модель ответить на этот запрос?” на “Могу ли я передать модели полный рабочий набор?”. Кодинг-агент может удерживать в контексте большую часть репозитория. Исследовательский ассистент может работать с большим набором документов без агрессивного дробления на части. Мультимодальный рабочий процесс может комбинировать текст с изображениями или видео вместо разделения этих входных данных на отдельные этапы.

Оборотная сторона — стоимость. Цена вывода K3 значительно выше, чем цены, указанные для старых конечных точек Kimi на Novita, поэтому большее окно контекста наиболее полезно, когда оно снимает реальную сложность приложения или улучшает качество ответов. Это не повод отправлять каждый короткий чат-запрос на флагманскую модель.

Технические характеристики и цены Kimi K3

Следующие значения взяты со страницы модели Kimi K3 на Novita AI, проверено 22 июля 2026 года.

Поле Детали Kimi K3
Издатель Moonshot AI
Идентификатор модели moonshotai/kimi-k3
Примечание по архитектуре 2,8T параметров; Kimi Delta Attention и Attention Residuals
Окно контекста 1 048 576 токенов (1M)
Максимальный вывод 1 048 576 токенов
Ввод Текст, изображение, видео
Вывод Текст
Цена за ввод $3 за миллион токенов
Цена за чтение из кэша $0,30 за миллион токенов
Цена за вывод $15 за миллион токенов
Доступность на Novita Serverless API
Стили API Совместимые с OpenAI и Anthropic конечные точки

Таблица цен основана на использовании: вы платите за обработанные токены, а не за выделение выделенного GPU. Для грубой оценки: 10 миллионов входных токенов и 1 миллион выходных токенов будут стоить $45 без учёта других комиссий на уровне аккаунта или изменений указанных ставок. Ваш собственный трафик имеет большее значение, чем объявленная цена вывода, особенно если запросы длинные, а ответы короткие.

K3 также предлагает цены на чтение из кэша. Повторное использование стабильных системных инструкций, определений инструментов или больших справочных материалов может снизить стоимость повторяющихся запросов, если ваше приложение и шаблон запросов поддерживают кэширование. Относитесь к поведению кэша как к оптимизации, которую нужно измерить, а не как к гарантии, что каждый повторный запрос будет оплачен по тарифу чтения из кэша.

Kimi K3 против семейства Kimi K2

K2 — это не одна единственная конечная точка. Семейство включает более старые варианты K2 Instruct и более новые версии K2.5 и K2.6, каждая со своим профилем возможностей и цен. Поэтому правильное сравнение основано на сценарии использования, а не на общем утверждении, что каждый ответ K3 лучше.

Фактор выбора Kimi K3 Семейство Kimi K2
Позиционирование Новейшая флагманская модель в линейке Kimi на Novita Более ранние варианты с другими компромиссами по стоимости и возможностям
Контекст 1 млн токенов Различается в зависимости от модели; уточните для выбранной конечной точки
Входные модальности Текст, изображение, видео Различается в зависимости от модели; K2.5 поддерживает мультимодальный ввод
Текущая цена K3 на Novita $3/М ввод, $15/М вывод, $0,30/М чтение из кэша Различается в зависимости от версии; проверьте страницу модели перед сравнением
Лучшая причина выбрать Очень большие рабочие наборы и передовые мультимодальные рабочие процессы Более низкая стоимость, известное поведение или существующая интеграция
Риск миграции Новый ID модели и новый базовый уровень для продакшена Существующие запросы, оценки и схемы инструментов уже могут быть настроены

K3 по сравнению с K2.5

K2.5 остаётся разумным выбором для мультимодальных приложений, которым не нужен контекст в миллион токенов. Он может обрабатывать текст, изображения и видео, а его страница модели на Novita указывает меньшее окно контекста и более низкие текущие тарифы, чем у K3. Используйте K2.5, когда ваши запросы легко укладываются в его ограничения, а ваш приоритет — предсказуемые затраты на инференс.

Переходите на K3, когда больший контекст устраняет реальное узкое место: повторяющийся поиск, суммаризацию репозитория по множеству файлов, анализ длинных видео или документов, или запуски агентов, теряющие важное состояние при сжатии. Если рабочая нагрузка — это в основном короткие разговоры или обычные вопросы по кодингу, K2.5 может предложить лучшее сооношение стоимости и задержки.

K3 по сравнению с K2 Instruct

K2 Instruct — это более простой вариант для чата с текстовым вводом и инструментального использования агентом. Его страница на Novita (более старая) указывает контекстное окно в 128 тыс. токенов и более низкие цены, чем у K3. Этого всё ещё может быть достаточно для агентов поддержки, структурированного извлечения, помощи в кодинге для небольших репозиториев и приложенний, которые уже зависят от поведения промптов K2 Instruct.

K3 лучше подходит, когда 128K недостаточно, когда визуальные входные данные являются частью основного рабочего процесса, или когда вы хотите оценить текущий флагман Moonshot AI, а не сохранять старую базу. Не мигрируйте только потому, что у K3 больше параметров: протестируйте свои промпты, вызовы инструментов, формат вывода и задержку на репрезентативном трафике.

Когда использовать Kimi K3

K3 оправдывает свою более высокую цену, когда выполняется одно или несколько из этих условий:

Крупные репозитории и долгоиграющие кодинг-агенты

Используйте K3 для задач, требующих широкого взгляда на кодовую базу: кросс-пакетные рефакторинги, картирование архитектуры, миграции зависимостей или отладку, охватывающую логи, тесты и файлы реализации. Контекст в 1M токенов не делает агента автоматически надежным, но он дает ваму слойю оркестрации больше пространства до того, как придется суммировать или отбрасывать состояние.

Мультимодальная работа со знаниями

K3 принимает на вход текет, изображение и видео. Это делает его кандидатом для таких рабочик процессов, как ревью скриншотов продукта вместе с треованиями, анализ записанных демонстраций вместе с документацией, или извлечение решений из смешанных медиа. Держите контракт на выход узким и валидируйте извлеченные поля, если результат передается в автоматизированную систему.

Длинные исследовательские работы и синтез документов

Когда вопрос зависит от многих первичных документов, K3 может уменьшить количество кода для поиска и сшивки, необходимого для сборки рабочего контекста. Это наиболее полезно для сравнения, синтеза и кросс-документальных вопросов; это не отменяет необходимости определять авторитетные источники или проверять цитаты.

Оценка флагмана

Если вы оцениваете текущее поколение Kimi для нового продукта, K3 — естественная первая конечная точка для бенчмаркинга. Начните с небольшого репрезентативного тестового набора и сравните качество, задержку, длину вывода и общую стоимость с K2.5 или K2 Instruct, прежде чем менять продакшен-стандарт.

Когда K2 — лучший выбор

K3 не является ответом по умолчанию для каждого запроса. Оставайтесь на конечной точке K2, когда:

  • Ваши запросы короткие и только текстовые, так что контекст в 1M не дает практической пользы.
  • Ваше приложение очень чувствительно к цене, и выходные токены доминируют в счете.
  • У вас уже есть стабильный промпт K2, схема инструментов или оценщик структурированного вывода в продакшене.
  • Вам нужна известная задержка, и вы ещё не тестировали K3 при своей нагрузке и уровне конкурентности.
  • Ваша рабочая нагрузка укладывается в контекстное окно выбранного K2 без частого урезания или суммирования.

Полезный шаблон маршрутизации — оставить K2.5 или K2 Instruct в качестве быстрого пути и отправлять на K3 только задачи с большим контекстом, мультимодальные или сложные. Это позволит вам оценить K3 на тех запросах, где его дополнительный контекст и возможности могут окупить себя.

Как получить доступ к Kimi K3 на Novita AI

Страница Kimi K3 включает доступ к Playground, документацию по модeли и детали бессерверного API. Для клиента, совместимого с OpenAI, используйте базовый URL Novita OpenAI и точный идентификатор модели:

Если вы хотите получить первый запрос, проверку цен и процесс устранения неполадок в одном месте, начните с Kimi K3 API quick start.

from openai import Openai

client = Openai(
    api_key="<NOVITA_API_KEY>",
    base_url="https://api.novita.ai/openai",
)

response = client.chat.completions.create(
    model="moonshotai/kimi-k3",
    messages=[
        {"role": "user", "content": "Summarke the key risks in this design."}
    ],
)

print(response.choices[0].message.content)

Сделайте первый продакшен-тест небольшим. Запишите токены запроса, токены завершения, использование кэша, время до первого токена, общую задержку и успешность задачи. Затем повторите ту же оценку с конечной точкой K2, которую вы иначе использовали бы. На странице модели также указан доступ, совместимый с Anthropic, что может быть полезно, если ваше существующее приложение уже использует эту форму клиента.

Заключение

Выбирайте Kimi K3 на Novita AI, когда задача действительно требует большого контекста или мультимодальности, и вы хотите оценить новейший флагман Moonshot AI через бессерверный API. Его контекст в 1M токенов, визуальный ввод и текyщая флагманская позция делaют его сильным кандидатом для кодинг-агентов с дoлгим горизoнтом, исследоватeльских рабoт с бoльшим кoличеством дoкументов и мультмодaльных рaбoчих прoцессов.

Выбирайте K2.5 или K2 Instruсt, когда рабoчая нагрyзка меньше, основана на тексте, чувствительна к цене или уже настрoена вокруг конечной точки K2. Лучшая продaкшен-настройка может быть маршрутизаторо, а не единственный побeдитeль: осeрвите K3 для запросов, котoрым нужег бoлеe ширoкий рабoчий набoр, и деpжите для рутинного трафика K2 с бoлее низкой стoимостью.

Часто задаваемые вопросы

Доступен ли Kimi K3 на Novita AI?

Да. Novita перечисляет Kimi K3 как бессерверную модель с идентификатором moonshotai/kimi-k3. Доступность и цены могyт измениться, поэтому перед развертыванием уточните на странице модели.

Сколько стоит Kimi K3 на Novita AI?

По состоянию на 22 июля 2026 года указанные тарифы: $3 за миллион входных токенов, $15 за миллион выходных токенов и $0,30 за миллион токенов при чтении из кэша. Проверьте страницу модeли для текущeго тарифа перeд оцeнкой прoдакшeнных расхoдов.

Поддерживает ли Kimi K3 изображения и видео?

Да. На странице модeли Novita указaны тeкст, изобрaжeние и видeо как вхоодныe модaльности, а выход — тeкст.

Должeн ли я мигрировать с Kimi K2.5 на K3?

Мигрируйте, когдa ваша рабoчая нагрysка выигрываeт от кoнтeкста K3 в 1M тoкeнов, нoвой флaгманскoй пoзиции или мультимoдальнoгo рабoчeгo прoцeсса. Если K2.5 yжe справляeтся с вашими запрoсами и ваш приоритeт — бoлee низкая стoимoсть, прoвeдитe бeнчмаркинг пeрeд смeнoй.

Какой идентификатор модели у Kimi K3?

Используйте moonshotai/kimi-k3 в конфигурации API Novita.

Рекомендуeмыe статьи