Qwen3.8 2.4T A95B는 Novita AI의 서버리스 API를 통해 제공되는 오픈 가중치(open-weight), 텍스트 전용 Qwen3.8 모델입니다. 오픈 가중치 서빙 옵션을 유지하면서 긴 컨텍스트 코딩, 리서치, 복잡한 추론 또는 에이전틱 워크플로가 필요한 개발자를 대상으로 합니다. Novita는 모델 ID qwen/qwen3.8-2.4t-a95b, 1,000,000 토큰 컨텍스트 윈도우, 최대 출력 토큰 131,072를 명시하며, 가격은 입력 토큰 100만 개당 $2, 캐시 읽기 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $6입니다.
핵심 요약
- Qwen3.8 2.4T A95B는 총 2.4T 파라미터와 95B 활성 파라미터를 가진 오픈 가중치 희소 MoE 모델입니다.
- Novita는 이 모델을 함수 호출, 구조화된 출력, 추론을 지원하는 텍스트 전용 서버리스 모델로 제공합니다.
- Novita는 1,000,000 토큰 컨텍스트 윈도우와 131,072 토큰 최대 출력을 명시합니다.
- 이 모델은 비전 입력이나 턴키 관리형 제품 계층이 필요한 워크로드보다 오픈 가중치 이식성과 텍스트 우선 워크플로를 중시하는 팀에 더 적합합니다.
Qwen3.8 2.4T A95B 사양 및 가격
| 필드 | Novita 값 |
|---|---|
| 표시 이름 | Qwen3.8 2.4T A95B |
| 모델 ID | qwen/qwen3.8-2.4t-a95b |
| 모델 유형 | 오픈 가중치 희소 MoE |
| 총 파라미터 | 2.4T |
| 활성 파라미터 | 95B |
| 컨텍스트 윈도우 | 1,000,000 토큰 |
| 최대 출력 토큰 | 131,072 |
| 입력 모달리티 | 텍스트 |
| 출력 모달리티 | 텍스트 |
| 엔드포인트 | chat/completions, responses |
| 기능 | 서버리스, 함수 호출, 구조화된 출력, 추론 |
| 입력 가격 | $2 / 100만 토큰 |
| 캐시 읽기 가격 | $0.25 / 100만 토큰 |
| 출력 가격 | $6 / 100만 토큰 |
| 표시된 Rate Tier | T1: 30 RPM / 50,000,000 TPM |
| 확인 날짜 | 2026년 9월 2일 |
가격과 한도는 변경될 수 있습니다. 프로덕션 비용을 확정하기 전에 Novita AI 모델 페이지 및 Novita AI 가격 페이지를 확인하세요.
Qwen3.8 2.4T A95B가 할 수 있는 작업
Qwen3.8 2.4T A95B는 큰 컨텍스트 윈도우와 강력한 추론 역량이 필요한 텍스트 우선 워크로드를 위해 설계되었습니다. 오픈 가중치 포지셔닝은 관리형 엔드포인트를 유일한 옵션으로 취급하는 대신, 팀이 자체 서빙 및 배포 요구 사항에 맞춰 모델을 평가할 수 있는 경로를 제공합니다.
이 모델은 리포지토리 규모 코드 리뷰, 다중 문서 리서치, 복잡한 텍스트 추론, 구조화된 생성, 그리고 도구 추적 또는 중간 상태를 유지하는 에이전트 루프에 적합합니다. Qwen 모델 카드는 모델 가중치와 구성 파일을 문서화하고 vLLM 및 SGLang과 같은 서빙 스택과의 호환성을 안내합니다.
Qwen3.8 2.4T A95B가 적합한 경우
다음과 같은 요구 사항이 있다면 이 모델을 선택하세요.
- 오픈 가중치 이식성과 서빙 레이어에 대한 제어
- 긴 컨텍스트 코딩, 코드 리뷰 또는 리포지토리 분석
- 텍스트 전용 리서치 및 다중 문서 추론
- 함수 호출, 구조화된 출력 또는 추론을 사용하는 에이전틱 워크플로
- 본격적인 인프라 작업 전 평가에 사용할 호스팅형 Novita 엔드포인트
팀이 추후 자체 호스팅을 하거나, 서빙 인프라를 변경하거나, 여러 환경에서 일관된 모델 아티팩트를 유지할 가능성이 있다면 오픈 가중치의 차별점이 중요합니다. 관리형 Novita AI의 Qwen3.8-Max 모델 및 제품 수준 액세스 경로에 대해서는 Novita AI의 Qwen3.8-Max를 참조하세요.
Qwen3.8 2.4T A95B가 최선의 기본값이 아닌 경우
Novita는 입력 모달리티를 텍스트로 명시하므로, 이 모델은 이미지 또는 비전 입력에는 최선의 기본값이 아닙니다. 또한 더 작은 모델이 더 낮은 비용으로 품질 요구 사항을 충족할 수 있는 짧은 분류, 가벼운 추출 또는 대량 프롬프트 워크로드에는 과한 모델일 수 있습니다.
비전 입력이나 보다 턴키 방식의 관리형 워크플로 등 추가 제품 계층이 필요하다면 관리형 Qwen3.8-Max 경로를 대신 선택하세요. 첫 요청 전송 방법이 주된 관심사라면 이 출시 및 결정 페이지 대신 Qwen3.8-Max API 빠른 시작을 참조하세요.
Novita AI에서 Qwen3.8 2.4T A95B API 액세스
Novita의 모델 페이지는 API 모델 ID를 qwen/qwen3.8-2.4t-a95b로 명시하고 chat/completions 및 responses 엔드포인트 제품군을 지원합니다. Novita의 OpenAI 호환 API 엔트리 포인트는 https://api.novita.ai/openai입니다.
이 섹션은 의도적으로 액세스 정보만 제공합니다. 첫 요청 워크스루, 전체 요청 파라미터 또는 문제 해결 단계는 포함하지 않으며, 이러한 내용은 4.4 빠른 시작 또는 기능 가이드에 속합니다.
자주 묻는 질문
Novita 모델 ID는 무엇인가요?
qwen/qwen3.8-2.4t-a95b를 사용하세요.
Qwen3.8 2.4T A95B는 오픈 가중치 모델인가요?
네. Qwen 모델 카드는 포스트 트레이닝(post-trained)된 모델의 가중치와 구성 파일을 제공합니다. 오픈 가중치로 제공된다고 해서 모든 배포 환경이 동일한 하드웨어, 서빙 또는 성능 프로필을 갖는 것은 아닙니다.
Novita가 명시하는 컨텍스트 및 출력 제한은 무엇인가요?
Novita는 1,000,000 토큰 컨텍스트 윈도우와 131,072 토큰 최대 출력을 명시합니다.
Novita AI에서 사용 비용은 얼마인가요?
2026년 9월 2일 확인 기준, Novita는 입력 토큰 100만 개당 $2, 캐시 읽기 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $6을 명시합니다.
Qwen3.8-Max와 동일한 모델인가요?
이 모델은 오픈 가중치 Qwen3.8 2.4T A95B 모델이며, Qwen3.8-Max는 별도의 관리형 서비스 경로입니다. 둘 중 하나를 선택하기 전에 워크로드에 대한 검증된 기능과 액세스 요구 사항을 비교하세요.
출처
- Novita 모델 페이지: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (2026-09-02 확인)
- Novita 가격 페이지: https://novita.ai/pricing (2026-09-02 확인)
- Qwen 모델 카드: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (2026-09-02 확인)
- Qwen3.8-Max 출시 가이드: /qwen3-8-max-on-novita-ai-launch-pricing/
- Qwen3.8-Max 빠른 시작: /qwen3-8-max-api-quick-start/
