Novita AI의 Ling-3.0-flash-fast: Ling-3.0-flash의 저지연 형제
Novita AI의 Ling-3.0-flash-fast: 검증된 모델 ID, 현재 가격, 256K 컨텍스트, 그리고 공개 문서가 기본 Ling-3.0-flash와 비교하여 알려주는 것과 알려주지 않는 것.
Novita AI의 Ling-3.0-flash-fast: 검증된 모델 ID, 현재 가격, 256K 컨텍스트, 그리고 공개 문서가 기본 Ling-3.0-flash와 비교하여 알려주는 것과 알려주지 않는 것.
DeepSeek V4 Pro 0813은 DSpark, MIT 라이선스, 1M 컨텍스트, 업데이트된 가격을 갖춘 Novita AI의 GA 릴리스입니다.
Novita AI의 Ling-3.0 Tiny: 검증된 모델 ID, 7.9B MoE 아키텍처, 256K 컨텍스트, 함수 호출, 현재 출시 가격.
Macaron V1 Tall을 Novita AI에서 262K 컨텍스트, 추론, 함수 호출, 그리고 코딩 및 에이전트 워크플로우를 위한 기간 한정 무료 API로 사용해보세요.
Macaron V1 Venti는 코딩, 에이전트 및 GenUI를 위한 748B Mixture-of-LoRA 플래그십입니다. 사양, Novita AI 가용성, 가격 및 최적 사용 사례를 확인하세요.
GLM 5.2가 Novita AI에서 1M 컨텍스트, 128K 최대 출력, 함수 호출, 구조화된 출력, 서버리스 API 액세스와 함께 제공됩니다.
Kimi K2.7 Code가 Novita AI에서 OpenAI 호환 채팅 API, 256K 컨텍스트, 도구 호출, 멀티모달 입력과 함께 제공됩니다.
Nemotron 3 Nano 30B A3B는 Novita AI에서 Serverless LLM으로 제공되며, OpenAI 호환 채팅 완료, 256K 컨텍스트, 사용량 기반 토큰 가격 책정을 지원합니다.
CoBuddy가 코드 생성, 코딩 어시스턴트 및 AI 에이전트 워크플로우를 위한 코딩 중심 LLM API로 Novita AI에서 제공됩니다.
코딩, 에이전틱 워크플로우, 1M-토큰 컨텍스트, 멀티모달 입력을 위한 Novita AI의 MiniMax M3를 OpenAI 호환 API로 활용하세요.
Qwen3.7-Max가 Novita AI에서 에이전틱 코딩 및 장기 컨텍스트 워크플로우를 위해 제공됩니다. API 액세스, 가격, 제한 사항 및 사용 사례를 확인하세요.
PegaFlow 외부 KV 캐시는 vLLM 서빙 팀이 재시작, 인스턴스, RDMA 노드 간에 KV 캐시를 보존하고 공유할 수 있도록 돕습니다.
DeepSeek-V4-Pro는 1.6T 매개변수의 오픈소스 MoE 모델로, LiveCodeBench 점수(93.5)와 1M 토큰 컨텍스트를 제공합니다. 지금 Novita AI에서 이용 가능합니다.
DeepSeek-V4-Flash는 2026년 7월 31일 업데이트를 반영하여 Novita AI에서 사용 가능합니다. 동일한 284B/13B MoE 설계, 1M 컨텍스트, $0.14/$0.28 요금제를 유지합니다.