- Когда использовать это руководство
- Шаг 1: Получите ключ API Novita
- Шаг 2: Подтвердите идентификатор модели и конечную точку
- Шаг 3: Отправьте первый запрос
- Шаг 4: Прочитайте ответ
- Шаг 5: Проверьте цены, лимиты и распространённые ошибки
- Пример на Python
- Пример cURL
- Ключевые параметры
- Устранение неполадок
- Часто задаваемые вопросы
- Рекомендуемые статьи
Это краткое руководство показывает, как отправить первый текстовый запрос чат-завершений к Ling 3.0 Flash Sante через совместимый с OpenAI API Novita. Используйте https://api.novita.ai/openai в качестве базового URL, inclusionai/ling-3.0-flash-sante в качестве идентификатора модели и POST https://api.novita.ai/openai/v1/chat/completions в качестве пути запроса. Текущее описание Novita представляет модель смеси экспертов с 124B параметров, из которых около 5,1B активных параметров на токен, окном контекста в 262 144 токена, максимальным выводом в 32 768 токенов, текстовым вводом и выводом, возможностью рассуждения и вызова функций. Информацию о позиционировании модели и ценообразовании см. в статье Ling 3.0 Flash Sante на Novita AI: возможности и цены.
Когда использовать это руководство
Используйте эту страницу, когда практический вопрос заключается в том, как выполнить аутентификацию, подтвердить маршрут модели, отправить небольшой запрос и разобрать ответ. Она предназначена для первого интеграционного теста, а не для выбора клинического рабочего процесса или валидации модели для использования в случае высокой ответственности.
Ling 3.0 Flash Sante — это текстовая модель. Размещённое описание подчёркивает её способности в медицинском рассуждении, клинической безопасности, поиске на основе доказательств и долгосрочных медицинских задачах, а также перечисляет общие возможности рассуждения, программирования и агентного взаимодействия. Эти метки описывают предполагаемые области возможностей модели; они не заменяют оценку на ваших данных, проверку источников, контроль конфиденциальности или квалифицированную экспертизу.
Шаг 1: Получите ключ API Novita
Создайте ключ API Novita, затем храните его вне системы контроля версий. Для локальной проверки экспортируйте его как переменную окружения:
export NOVITA_API_KEY="your_api_key"
Не помещайте ключ в браузерный бандл, публичный репозиторий или клиентское приложение. Для развёрнутого сервиса загружайте его из менеджера секретов сервиса и ротируйте в соответствии с политикой учётных данных вашей команды.
Шаг 2: Подтвердите идентификатор модели и конечную точку
Прежде чем писать код приложения, проверьте актуальную страницу модели Ling 3.0 Flash Sante. Значения ниже были проверены 4 сентября 2026 года.
| Поле | Значение |
|---|---|
| Идентификатор модели | inclusionai/ling-3.0-flash-sante |
| Базовый URL | https://api.novita.ai/openai |
| Конечная точка чат-завершений | POST https://api.novita.ai/openai/v1/chat/completions |
| Окно контекста | 262 144 токена (отображается как 256K) |
| Максимальный вывод | 32 768 токенов (отображается как 32K) |
| Ввод и вывод | Текст |
| Возможности | Вызов функций, рассуждение |
| Скорость запросов по каталогу | 30 запросов в минуту |
| Цена ввода по каталогу | $0 за 1M токенов |
| Цена вывода по каталогу | $0 за 1M токенов |
Цены, лимиты и доступность — это текущие значения каталога. Перепроверьте их перед составлением бюджета или переносом интеграции в продакшн. Значение скорости запросов в каталоге не является гарантией, что каждая учётная запись или нагрузка получит такую же пропускную способность.
Шаг 3: Отправьте первый запрос
Начните с короткого нечувствительного промпта. Небольшой запрос позволяет изолировать ошибки аутентификации и маршрутизации до того, как вы добавите длинный контекст, инструменты или специфичные для приложения данные.
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "inclusionai/ling-3.0-flash-sante",
"messages": [
{
"role": "system",
"content": "You are a concise technical assistant. Do not provide diagnosis or treatment advice."
},
{
"role": "user",
"content": "Return a three-item checklist for testing a text classification API."
}
],
"max_tokens": 256,
"temperature": 0.2
}'
Запрос использует стандартный массив messages и точный идентификатор модели. Значение max_tokens намеренно мало для дымового теста. Увеличивайте его только после того, как запрос, разбор ответа, обработка тайм-аутов и обработка ошибок будут работать надёжно.
Шаг 4: Прочитайте ответ
Успешное чат-завершение возвращает сообщение ассистента в первом выборе (choice). В клиенте или сервисе проверьте код состояния перед разбором JSON, затем обрабатывайте ответ защитно:
{
"choices": [
{
"message": {
"role": "assistant",
"content": "1. Prepare representative labeled inputs.\n2. Measure classification accuracy and refusal behavior.\n3. Inspect errors before increasing traffic."
}
}
]
}
При первом тесте убедитесь, что:
- запрос возвращает успешный HTTP-ответ;
choices[0].message.contentсодержит текст ассистента;- возвращённое поле
modelсоответствует ожидаемой модели (если оно присутствует); - ваше приложение обрабатывает отсутствующее содержимое, ответы с кодом не 200 и тайм-ауты;
- логи содержат метаданные запроса, но никогда не содержат ключ API или излишние чувствительные данные.
Не рассматривайте успешный HTTP-ответ как доказательство готовности медицинского или регулируемого рабочего процесса. Он лишь подтверждает, что этот путь запроса, учётные данные, идентификатор модели и базовый анализатор ответа работают вместе.
Шаг 5: Проверьте цены, лимиты и распространённые ошибки
Прежде чем использовать реальный трафик, повторно проверьте актуальную страницу модели на предмет ценообразования, контекста, максимального вывода, поддерживаемых функций и информации о скорости запросов. Затем протестируйте лимиты, которые важны для вашего приложения: длинные промпты, усечение вывода, повторные попытки, конкурентные запросы и разбор вызовов инструментов.
Наиболее распространённые ошибки первого вызова просты:
- Ошибка 401 или аутентификации:
NOVITA_API_KEYне установлен, истёк, имеет неверный формат или не отправляется как Bearer-токен. - Модель не найдена: в запросе используется отображаемое имя или опечатка вместо
inclusionai/ling-3.0-flash-sante. - Ошибка 404 конечной точки: клиент дублировал или пропустил путь
/v1/chat/completions. Используйте базовый URL только в конфигурации SDK или полный URL в cURL. - Ошибка 400 запроса: проверьте синтаксис JSON и поддерживаемые поля. Начните с
modelиmessages, затем добавляйте необязательные параметры по одному. - Ответ 429 (ограничение скорости): примените экспоненциальную задержку с ограничением, снизьте параллелизм и сравните ваш трафик с текущими лимитами учётной записи и каталога.
- Усечённый ответ: увеличьте
max_tokens, если приложению требуется больше вывода, оставаясь в пределах текущего максимума модели и общего бюджета контекста.
Пример на Python
Python SDK от OpenAI может использовать совместимый базовый URL Novita. Установите SDK в ваше окружение, держите NOVITA_API_KEY установленным и запустите этот пример из серверного процесса:
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.novita.ai/openai",
api_key=os.environ["NOVITA_API_KEY"],
)
response = client.chat.completions.create(
model="inclusionai/ling-3.0-flash-sante",
messages=[
{
"role": "system",
"content": "You are a concise technical assistant. Do not provide diagnosis or treatment advice.",
},
{
"role": "user",
"content": "Explain how to test a text API response parser in three steps.",
},
],
max_tokens=256,
temperature=0.2,
)
print(response.choices[0].message.content)
Этот пример использует только стандартные поля чат-завершений. Как только он заработает, добавьте специфичные для приложения системные инструкции, обработку структурированного вывода или инструменты и тестируйте каждое изменение отдельно.
Пример cURL
Для проверки интеграции из командной строки сохраните запрос в скрипте и сообщайте об ошибках HTTP с помощью --fail-with-body:
curl --fail-with-body "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "inclusionai/ling-3.0-flash-sante",
"messages": [
{
"role": "user",
"content": "List three checks for a reliable JSON response parser."
}
],
"max_tokens": 256,
"temperature": 0.2
}'
--fail-with-body заставляет cURL возвращать код ошибки при HTTP-ошибках, сохраняя тело ответа для отладки. Не вставляйте это тело в публичные логи, если оно содержит промпты или другие чувствительные данные.
Ключевые параметры
model: Используйте точный идентификатор размещённой модели:inclusionai/ling-3.0-flash-sante.messages: Передавайте историю диалога как объекты с ролью и содержимым. Делайте системные инструкции конкретными и явно указывайте ожидаемый формат вывода.max_tokens: Установите верхнюю границу вывода, подходящую для задачи. Текущий максимум каталога — 32 768 токенов, но меньшие значения упрощают проверку ранних тестов.temperature: Более низкое значение может упростить сравнение тестов извлечения или классификации. Оценивайте эффект на ваших собственных промптах, а не предполагайте, что один параметр универсально лучший.tools: В описании указана возможность вызова функций. Если вы добавляете инструменты, определяйте узкие схемы, проверяйте аргументы в вашем приложении и выполняйте логику вне модели.- Параметры рассуждения: В описании указана возможность рассуждения, но не предполагайте, что каждое необязательное поле рассуждения переносимо между SDK. Подтвердите текущую документацию API и поведение модели перед добавлением специфичных для провайдера полей.
Для текстов, связанных со здоровьем, отделяйте генерацию от верификации. Предоставляйте только те данные, которые ваше приложение уполномочено обрабатывать, сохраняйте ссылки на источники, где это возможно, и направляйте значимые результаты квалифицированным рецензентам. Эта статья не предоставляет диагностических или лечебных рекомендаций.
Устранение неполадок
Когда запрос не удаётся, сократите его до минимально воспроизводимого вызова: точный идентификатор модели, одно сообщение пользователя, низкое значение max_tokens и заголовок Bearer. Это облегчает различие между проблемой учётной записи и проблемой клиентской обёртки.
Если минимальный вызов cURL успешен, а вызов SDK — нет, выведите разрешённый URL запроса SDK в безопасном локальном отладочном окружении и сравните его с https://api.novita.ai/openai/v1/chat/completions. Не выводите заголовки авторизации. Если оба вызова успешны, но вывод приложения ненадёжен, держите тест интеграции и модели отдельно от оценки качества задачи.
Для работы с длинным контекстом начинайте с уровня ниже предела в 262 144 токена. Подсчитайте входные сообщения, определения инструментов и ожидаемый вывод вместе, затем тестируйте усечение и поведение при тайм-ауте с репрезентативными запросами. Большой заявленный контекст не гарантирует, что каждый промпт будет полезен или экономичен.
Часто задаваемые вопросы
Какой идентификатор модели я должен отправлять?
Отправляйте inclusionai/ling-3.0-flash-sante. Отображаемое имя Ling 3.0 Flash Sante не заменяет идентификатор модели в теле запроса.
Какую конечную точку использует это руководство?
Оно использует совместимый с OpenAI маршрут чат-завершений по адресу https://api.novita.ai/openai/v1/chat/completions. В конфигурации SDK используйте https://api.novita.ai/openai как базовый URL и позвольте SDK добавлять версионированный путь.
Является ли размещённая модель мультимодальной?
Текущее описание Novita указывает текст как для ввода, так и для вывода. Не отправляйте изображения или аудио, если описание модели явно не добавляет их поддержку.
Могу ли я использовать это для клинических решений?
Это краткое руководство является руководством по интеграции API, а не клиническим руководством. Успешный ответ API не устанавливает клинической безопасности, фактической точности, соответствия нормативным требованиям или разрешения на обработку защищённой информации. Оценивайте любое предполагаемое использование с квалифицированными отраслевыми экспертами и с учётом мер контроля, необходимых для вашего окружения.
