모델 이름이 아닌 요청부터 시작하세요. 일반 텍스트 및 에이전트 기준으로는 Ling-3.0-flash를, 금융 워크플로에는 Ling-3.0-flash-fin을, 건강 및 의료에는 Ling-3.0-flash-sante를, 요청에 이미지나 비디오가 포함된 경우 Ling-3.0-flash-VL을 사용하세요. 네 모델 모두 Novita AI의 서버리스 채팅 엔드포인트로, 동일한 262,144 토큰 컨텍스트와 32,768 토큰 최대 출력을 제공하지만, 도메인 튜닝, 입력 모달리티 및 현재 가격의 차이로 인해 모델 ID가 라우팅 결정 사항이 됩니다.
네 모델은 모두 동일한 124B 파라미터 Flash 베이스를 공유합니다. 토큰당 약 5.1B 파라미터를 활성화하며, Flash-VL만 약 5.5B를 활성화합니다. 따라서 도메인 및 기능 변종은 작은 모델에서 큰 모델로 이어지는 사다리가 아닙니다. 이는 동일한 아키텍처를 통한 경로입니다.
핵심 요점
- 텍스트 및 도구 사용 기준:
ling-3.0-flash는 일반적인 에이전트 및 장문 컨텍스트 텍스트 워크로드에 적합합니다. - 금융 튜닝:
ling-3.0-flash-fin은 투자, 시장 및 기타 금융 특화 워크플로를 테스트할 옵션입니다. - 의료 튜닝:
ling-3.0-flash-sante는 건강 및 의료 추론 워크플로를 테스트할 옵션입니다. - 멀티모달 경로:
ling-3.0-flash-vl은 현재 Novita AI에서 텍스트와 함께 이미지 및 비디오 입력을 허용하는 유일한 제품군 멤버입니다.
Ling-3.0 라인업 한눈에 보기
모델 카탈로그는 2026년 9월 9일에 확인되었습니다. 가격 및 가용성은 변경될 수 있으므로, 추정치나 프로덕션 경로를 하드코딩하기 전에 라이브 모델 페이지를 다시 확인하세요.
| 모델 ID | 최적 용도 | 전체 / 활성 파라미터 | 모달리티 | 컨텍스트 / 최대 출력 | 현재 1M 토큰당 가격 |
|---|---|---|---|---|---|
inclusionai/ling-3.0-flash |
일반 에이전트 추론, 추론 및 도구 사용 | 124B / ~5.1B | 텍스트 → 텍스트 | 262,144 / 32,768 | 입력 $0.06; 출력 $0.18 |
inclusionai/ling-3.0-flash-fin |
금융 특화 추론 및 다단계 워크플로 | 124B / ~5.1B | 텍스트 → 텍스트 | 262,144 / 32,768 | 입력 $0; 출력 $0 |
inclusionai/ling-3.0-flash-sante |
건강 및 의료 추론 + 일반 기능 | 124B / ~5.1B | 텍스트 → 텍스트 | 262,144 / 32,768 | 입력 $0; 출력 $0 |
inclusionai/ling-3.0-flash-vl |
스크린샷, 차트, 문서, 비디오 및 시각적 에이전트 | 124B / ~5.5B | 텍스트 + 이미지 + 비디오 → 텍스트 | 262,144 / 32,768 | 입력 $0; 출력 $0 |
카탈로그에는 모든 모델에 대해 서버리스 액세스, 추론 및 함수 호출도 나열되어 있습니다. ling-3.0-flash-vl과 ling-3.0-flash-sante는 추가로 Anthropic 호환 엔드포인트를 제공하며, 나머지 두 모델은 chat/completions를 제공합니다.
변종들의 공통점
모든 모델은 Ling-3.0-flash를 기반으로 구축되었습니다. Novita의 카탈로그와 공식 Flash 모델 카드는 기본 Flash 경로를 약 5.1B 활성 파라미터(토큰당)를 가진 124B 파라미터 MoE로 설명합니다. Flash-VL도 124B이지만 약 5.5B를 활성화합니다. 즉, Flash 변종 간 선택은 주로 도메인 강조, 입력 모달리티, 가격 상태 및 지연 시간 동작에 관한 것이지 전체 아키텍처 규모의 차이가 아닙니다.
네 모델 모두 현재 Novita의 동일한 컨텍스트 및 출력 상한을 보여줍니다: 입력 262,144 토큰, 출력 32,768 토큰. 이러한 동일성은 컨텍스트를 좋은 첫 번째 필터로 만들지 못합니다. 적합성, 모달리티, 비용 및 측정된 지연 시간이 벤치마킹 전에 라인업을 좁히는 더 좋은 방법입니다.
일반 기준으로 Ling-3.0-flash 선택
워크로드가 텍스트 전용이고 아직 명확한 수직 특화가 없는 경우 Ling-3.0-flash를 사용하세요. 채팅, 문서 분석, 다단계 에이전트, 추론 제어 및 도구 호출을 위한 자연스러운 첫 번째 테스트입니다. 퀵 스타트는 OpenAI 호환 요청 흐름을 보여줍니다.
또한 비교를 위한 공정한 제어 모델입니다. Fin 또는 Sante가 작업별 트레이스를 개선하지 않는다면, 추가 모델 ID 대신 일반 경로를 유지하는 근거가 됩니다.
금융 워크플로를 위해 Ling-3.0-flash-fin 선택
작업이 금융 어휘와 다단계 금융 추론에 의존하는 경우 Ling-3.0-flash-fin을 사용하세요. Novita의 설명은 이 모델이 금융 강화 모델이며 실제 투자 워크플로, 장기 계획 및 실행에 적합하면서도 추론, 코딩 및 수학 능력을 유지한다고 설명합니다.
이는 규정 준수 시스템이나 데이터 통제를 대체하는 것이 아닙니다. 애플리케이션에 인용, 원본 문서, 계산 및 승인 단계를 유지하세요. 포트폴리오 분석, 실적 검토, 연구 종합 또는 투자 프로세스 초안 작성의 경우, 실제 도메인 예제에서 Fin과 일반 Flash 모델을 비교하세요.
건강 및 의료 작업을 위해 Ling-3.0-flash-sante 선택
요청에 의학 지식 추론, 임상 안전 언어, 증거 검색 또는 장기 의료 워크플로가 포함된 경우 Ling-3.0-flash-sante를 사용하세요. Novita는 Sante가 Ling-3.0-flash를 기반으로 하며 총 124B 파라미터, 약 5.1B 활성 파라미터를 가진다고 설명합니다. 채팅 완료 퀵 스타트도 제공됩니다.
의료 사용은 모델 선택 이상의 요구 사항을 추가합니다: 개인정보 처리, 인간 검토, 에스컬레이션 경로, 출처 및 현지 규제 규칙. Sante는 의학적 표현 및 추론을 위해 평가할 제품군 멤버이지만, 임상적으로 중요한 조치를 취하기 전에 출력을 검증해야 합니다.
이미지 및 비디오 요청을 위해 Ling-3.0-flash-vl 선택
모델이 무언가를 ‘봐야’ 하는 경우(스크린샷, 차트, 양식, 문서, 제품 이미지 또는 짧은 비디오) Ling-3.0-flash-VL을 사용하세요. 현재 Novita 목록에서 이미지 및 비디오 입력을 텍스트 출력과 함께 허용하는 유일한 변종입니다.
유용한 테스트는 시각적 증거가 시스템이 취하는 행동을 변경하는지 여부입니다. 브라우저 에이전트는 화면을 읽고, 컨트롤을 선택하고, 도구를 호출하고, 결과를 확인할 수 있습니다. 보고 지원 어시스턴트는 차트에서 시리즈를 추출할 수 있습니다. 텍스트 전용 프롬프트의 경우, 테스트에서 VL을 사용할 이유가 없다면 요청을 기본 Flash 모델로 보내세요.
실용적인 라우팅 규칙
코드 전체에 모델 ID를 흩뿌리는 대신 작은 구성을 사용하세요:
model_routes = {
"general_text_agent": "inclusionai/ling-3.0-flash",
"finance_workflow": "inclusionai/ling-3.0-flash-fin",
"medical_workflow": "inclusionai/ling-3.0-flash-sante",
"image_or_video": "inclusionai/ling-3.0-flash-vl",
}
그런 다음 워크로드 메타데이터가 경로를 선택하도록 하세요. 텍스트 전용 에이전트 작업에는 일반 Flash로 시작하고, 이미지나 비디오 콘텐츠가 있을 때는 VL을 사용하세요. 도메인 트레이스에서 특화 경로가 추가 평가 및 운영 오버헤드만큼 가치가 있음을 보여줄 때만 Fin 또는 Sante를 추가하세요.
가격 결정, 이름이 아닌
현재 카탈로그 가격은 두 가지 패턴으로 나뉩니다. 일반 Flash 모델은 입력 토큰 100만 개당 $0.06, 출력 토큰 100만 개당 $0.18입니다. Fin, Sante, VL은 둘 다 $0입니다. 이 무료 가격은 라이브 프로모션 스냅샷이지 영구적인 보장이 아닙니다.
실제 프로덕션 추정을 위해서는 프롬프트 크기, 응답 크기, 캐시 동작, 재시도, 도구 호출 빈도 및 사용자 작업당 모델 턴 수를 기록하세요. 더 높은 정가의 경로가 더 적은 턴이나 재작업으로 작업을 해결한다면 더 저렴할 수 있습니다. 무료 목록이 테스트, 운영 또는 품질 검토 비용을 없애지는 않습니다.
FAQ
Novita AI는 몇 개의 Ling-3.0 모델을 제공하나요?
확인된 카탈로그에는 ling-3.0-flash, ling-3.0-flash-fin, ling-3.0-flash-sante, ling-3.0-flash-vl의 네 가지가 있습니다.
네 모델 모두 동일한 컨텍스트 창을 가지고 있나요?
네. Novita의 현재 목록은 모든 모델에 대해 262,144 토큰 컨텍스트와 32,768 토큰 최대 출력을 보여줍니다.
스크린샷이나 비디오에는 어떤 Ling-3.0 모델을 사용해야 하나요?
inclusionai/ling-3.0-flash-vl을 사용하세요. 현재 Novita에서 텍스트, 이미지, 비디오 입력을 지원하는 제품군 멤버입니다.
무료 Ling-3.0 가격은 영구적인가요?
아니요. Fin, Sante, VL은 현재 입력 $0, 출력 $0으로 나열되어 있지만 가격은 라이브 카탈로그 값입니다. 프로덕션 사용 전에 다시 확인하세요.
