Novita AI의 Qwen3.8 2.4T A95B: 오픈 웨이트 1M 컨텍스트 API

Novita AI의 Qwen3.8 2.4T A95B: 오픈 웨이트 1M 컨텍스트 API

Qwen3.8 2.4T A95B는 Novita AI의 서버리스 API를 통해 사용할 수 있는 오픈 웨이트, 텍스트 전용 Qwen3.8 모델입니다. 장기 컨텍스트 코딩, 연구, 복잡한 추론 또는 에이전트 워크플로가 필요하면서 오픈 웨이트 서빙 옵션을 유지하려는 개발자를 대상으로 합니다. Novita는 모델 ID를 qwen/qwen3.8-2.4t-a95b, 1,000,000 토큰 컨텍스트 윈도우, 최대 131,072 출력 토큰, 그리고 1M 입력 토큰당 $2, 1M 캐시 읽기 토큰당 $0.25, 1M 출력 토큰당 $6 가격을 명시합니다.

주요 요점

  • Qwen3.8 2.4T A95B는 총 2.4T 파라미터와 95B 활성 파라미터를 갖춘 오픈 웨이트 희소 MoE 모델입니다.
  • Novita는 이를 함수 호출, 구조화된 출력, 추론 지원을 갖춘 텍스트 전용 서버리스 모델로 제공합니다.
  • Novita는 1,000,000 토큰 컨텍스트 윈도우와 131,072 토큰 최대 출력을 명시합니다.
  • 이 모델은 비전 입력이나 턴키 관리형 제품 레이어가 필요한 워크로드보다는 오픈 웨이트 이식성과 텍스트 우선 워크플로를 중시하는 팀에 더 적합합니다.

Qwen3.8 2.4T A95B 사양 및 가격

필드 Novita 값
표시 이름 Qwen3.8 2.4T A95B
모델 ID qwen/qwen3.8-2.4t-a95b
모델 유형 오픈 웨이트 희소 MoE
총 파라미터 2.4T
활성 파라미터 95B
컨텍스트 윈도우 1,000,000 토큰
최대 출력 토큰 131,072
입력 모달리티 텍스트
출력 모달리티 텍스트
엔드포인트 chat/completions, responses
기능 서버리스, 함수 호출, 구조화된 출력, 추론
입력 가격 $2 / 1M 토큰
캐시 읽기 가격 $0.25 / 1M 토큰
출력 가격 $6 / 1M 토큰
표시된 요금 등급 T1: 30 RPM / 50,000,000 TPM
확인 날짜 2026년 9월 2일

가격과 한도는 변경될 수 있습니다. 프로덕션 비용을 확정하기 전에 Novita AI 모델 페이지Novita AI 가격 페이지를 확인하세요.

Qwen3.8 2.4T A95B로 할 수 있는 일

Qwen3.8 2.4T A95B는 큰 컨텍스트 윈도우와 강력한 추론 능력의 이점을 누리는 텍스트 우선 워크로드를 위해 설계되었습니다. 오픈 웨이트 포지셔닝은 또한 팀이 관리형 엔드포인트를 유일한 옵션으로 취급하지 않고 자체 서빙 및 배포 요구사항에 따라 모델을 평가할 수 있는 경로를 제공합니다.

이 모델은 리포지토리 규모의 코드 리뷰, 다중 문서 연구, 복잡한 텍스트 추론, 구조화된 생성, 그리고 도구 추적이나 중간 상태를 유지하는 에이전트 루프에 적합합니다. Qwen 모델 카드는 모델 가중치와 구성 파일을 문서화하고 vLLM 및 SGLang과 같은 서빙 스택과의 호환성을 명시합니다.

Qwen3.8 2.4T A95B가 적합한 경우

다음이 필요할 때 이 모델을 선택하세요:

  • 오픈 웨이트 이식성과 서빙 레이어에 대한 제어
  • 장기 컨텍스트 코딩, 코드 리뷰 또는 리포지토리 분석
  • 텍스트 전용 연구 및 다중 문서 추론
  • 함수 호출, 구조화된 출력 또는 추론을 사용하는 에이전트 워크플로
  • 더 깊은 인프라 작업 전 평가를 위한 호스팅된 Novita 엔드포인트

오픈 웨이트 구분은 팀이 나중에 자체 호스팅하거나 서빙 인프라를 변경하거나 환경 전반에 걸쳐 일관된 모델 아티팩트를 유지할 수 있을 때 중요합니다. Novita AI의 관리형 Qwen3.8-Max 모델과 그 제품 수준 액세스 경로에 대해서는 Novita AI의 Qwen3.8-Max를 참조하세요.

Qwen3.8 2.4T A95B가 최선의 기본값이 아닌 경우

이 모델은 Novita가 입력 모달리티를 텍스트로 명시하므로 이미지 또는 비전 입력을 위한 최선의 기본값이 아닙니다. 또한 짧은 분류, 경량 추출 또는 더 작은 모델이 더 낮은 비용으로 품질 요구사항을 충족할 수 있는 대용량 프롬프트에는 과할 수 있습니다.

비전 입력이나 보다 턴키 관리형 워크플로를 포함한 추가 제품 레이어가 필요하면 대신 관리형 Qwen3.8-Max 경로를 선택하세요. 주된 질문이 첫 요청을 보내는 방법이라면 이 출시 및 의사 결정 페이지보다 Qwen3.8-Max API 빠른 시작을 사용하세요.

Novita AI에서의 Qwen3.8 2.4T A95B API 액세스

Novita의 모델 페이지는 API 모델 ID를 qwen/qwen3.8-2.4t-a95b로 명시하고 chat/completionsresponses 엔드포인트 제품군을 지원합니다. Novita OpenAI 호환 API 진입점은 https://api.novita.ai/openai입니다.

이 섹션은 의도적으로 액세스 정보만 제공합니다. 첫 요청 워크스루, 전체 요청 파라미터 또는 문제 해결 단계는 포함하지 않습니다. 이는 4.4 빠른 시작 또는 기능 가이드에 속합니다.

FAQ

Novita 모델 ID는 무엇인가요?

qwen/qwen3.8-2.4t-a95b를 사용하세요.

Qwen3.8 2.4T A95B는 오픈 웨이트인가요?

예. Qwen 모델 카드는 사후 학습된 모델의 모델 가중치와 구성 파일을 제공합니다. 오픈 웨이트 가용성이 모든 배포가 동일한 하드웨어, 서빙 또는 성능 프로필을 갖는다는 의미는 아닙니다.

Novita는 어떤 컨텍스트 및 출력 한도를 명시하나요?

Novita는 1,000,000 토큰 컨텍스트 윈도우와 131,072 토큰 최대 출력을 명시합니다.

Novita AI에서 비용은 얼마인가요?

Novita는 2026년 9월 2일 확인 기준으로 1M 입력 토큰당 $2, 1M 캐시 읽기 토큰당 $0.25, 1M 출력 토큰당 $6을 명시합니다.

이것은 Qwen3.8-Max와 같은가요?

그것은 오픈 웨이트 Qwen3.8 2.4T A95B 모델이며, Qwen3.8-Max는 별도의 관리형 서비스 경로입니다. 둘 중 하나를 선택하기 전에 워크로드에 대해 검증된 기능과 액세스 요구사항을 비교하세요.

출처

추천 문서