Qwen3.8 2.4T A95B는 Novita AI의 서버리스 API를 통해 제공되는 오픈 가중치, 텍스트 전용 Qwen3.8 모델입니다. 긴 컨텍스트 코딩, 연구, 복잡한 추론 또는 에이전트 워크플로가 필요하면서도 오픈 가중치 서빙 옵션을 유지하려는 개발자를 대상으로 합니다. Novita는 모델 ID를 qwen/qwen3.8-2.4t-a95b로 표시하며, 1,000,000 토큰 컨텍스트 윈도우, 최대 131,072 출력 토큰, 가격은 입력 100만 토큰당 $2, 캐시 읽기 100만 토큰당 $0.25, 출력 100만 토큰당 $6입니다.
주요 내용
- Qwen3.8 2.4T A95B는 총 2.4T 파라미터와 95B 활성 파라미터를 가진 오픈 가중치 희소 MoE 모델입니다.
- Novita는 함수 호출, 구조화된 출력, 추론을 지원하는 텍스트 전용 서버리스 모델로 제공합니다.
- Novita는 1,000,000 토큰 컨텍스트 윈도우와 최대 131,072 토큰 출력을 명시합니다.
- 이 모델은 비전 입력이나 턴키 방식의 관리형 제품 레이어가 필요한 워크로드보다는, 오픈 가중치의 이식성과 텍스트 중심 워크플로를 중시하는 팀에 더 적합합니다.
Qwen3.8 2.4T A95B 사양 및 가격
| 필드 | Novita 값 |
|---|---|
| 표시 이름 | Qwen3.8 2.4T A95B |
| 모델 ID | qwen/qwen3.8-2.4t-a95b |
| 모델 유형 | 오픈 가중치 희소 MoE |
| 총 파라미터 | 2.4T |
| 활성 파라미터 | 95B |
| 컨텍스트 윈도우 | 1,000,000 토큰 |
| 최대 출력 토큰 | 131,072 |
| 입력 모달리티 | 텍스트 |
| 출력 모달리티 | 텍스트 |
| 엔드포인트 | chat/completions, responses |
| 기능 | 서버리스, 함수 호출, 구조화된 출력, 추론 |
| 입력 가격 | 100만 토큰당 $2 |
| 캐시 읽기 가격 | 100만 토큰당 $0.25 |
| 출력 가격 | 100만 토큰당 $6 |
| 표시된 요금 등급 | T1: 분당 30회 요청 / 분당 50,000,000 TPM |
| 확인 날짜 | 2026년 9월 2일 |
가격과 제한 사항은 변경될 수 있습니다. 프로덕션 비용을 확정하기 전에 Novita AI 모델 페이지와 Novita AI 가격 페이지를 확인하세요.
Qwen3.8 2.4T A95B가 할 수 있는 작업
Qwen3.8 2.4T A95B는 대규모 컨텍스트 윈도우와 강력한 추론 능력의 이점을 활용하는 텍스트 중심 워크로드를 위해 설계되었습니다. 오픈 가중치 포지셔닝은 또한 팀이 관리형 엔드포인트를 유일한 옵션으로 간주하기보다는 자체 서빙 및 배포 요구사항에 맞게 모델을 평가할 수 있는 경로를 제공합니다.
이 모델은 저장소 규모의 코드 리뷰, 다중 문서 연구, 복잡한 텍스트 추론, 구조화된 생성, 그리고 도구 추적이나 중간 상태를 유지하는 에이전트 루프에 적합합니다. Qwen 모델 카드는 모델 가중치와 설정 파일을 문서화하고 vLLM 및 SGLang과 같은 서빙 스택과의 호환성을 명시합니다.
Qwen3.8 2.4T A95B가 적합한 경우
다음이 필요할 때 이 모델을 선택하세요:
- 오픈 가중치 이식성과 서빙 레이어에 대한 제어
- 긴 컨텍스트 코딩, 코드 리뷰 또는 저장소 분석
- 텍스트 전용 연구 및 다중 문서 추론
- 함수 호출, 구조화된 출력 또는 추론을 사용한 에이전트 워크플로
- 심층적인 인프라 작업 전 평가를 위한 호스팅된 Novita 엔드포인트
오픈 가중치의 차별점은 팀이 나중에 자체 호스팅하거나, 서빙 인프라를 변경하거나, 여러 환경에서 일관된 모델 아티팩트를 유지해야 할 때 중요합니다. Novita AI의 관리형 Qwen3.8-Max 모델과 그 제품 수준 접근 경로에 대해서는 Novita AI의 Qwen3.8-Max를 참조하세요.
Qwen3.8 2.4T A95B가 기본 선택으로 적합하지 않은 경우
이 모델은 Novita가 입력 모달리티를 텍스트로 명시하므로 이미지나 비전 입력에는 적합하지 않습니다. 또한 짧은 분류, 가벼운 추출, 또는 더 작은 모델이 더 낮은 비용으로 품질 요구사항을 충족할 수 있는 대량 프롬프트에는 과도할 수 있습니다.
비전 입력이나 더 턴키 방식의 관리형 워크플로를 포함한 추가 제품 레이어가 필요하다면 관리형 Qwen3.8-Max 경로를 대신 선택하세요. 첫 번째 요청을 보내는 방법이 주요 질문이라면, 이 시작 및 결정 페이지 대신 Qwen3.8-Max API 퀵 스타트를 사용하세요.
Novita AI의 Qwen3.8 2.4T A95B API 액세스
Novita의 모델 페이지는 API 모델 ID를 qwen/qwen3.8-2.4t-a95b로 표시하며 chat/completions 및 responses 엔드포인트 제품군을 지원합니다. Novita의 OpenAI 호환 API 엔트리 포인트는 https://api.novita.ai/openai입니다.
이 섹션은 의도적으로 액세스 정보만 제공합니다. 첫 번째 요청 워크스루, 전체 요청 파라미터 또는 문제 해결 단계는 포함하지 않습니다. 이러한 내용은 4.4 퀵 스타트 또는 기능 가이드에 속합니다.
FAQ
Novita 모델 ID는 무엇인가요?
qwen/qwen3.8-2.4t-a95b를 사용하세요.
Qwen3.8 2.4T A95B는 오픈 가중치인가요?
네. Qwen 모델 카드는 사후 훈련된 모델의 가중치와 설정 파일을 제공합니다. 오픈 가중치 사용 가능성이 모든 배포에서 동일한 하드웨어, 서빙 또는 성능 프로필을 의미하지는 않습니다.
Novita가 명시하는 컨텍스트 및 출력 제한은 무엇인가요?
Novita는 1,000,000 토큰 컨텍스트 윈도우와 최대 131,072 토큰 출력을 명시합니다.
Novita AI에서 비용은 얼마인가요?
2026년 9월 2일 기준으로 Novita는 입력 100만 토큰당 $2, 캐시 읽기 100만 토큰당 $0.25, 출력 100만 토큰당 $6을 명시합니다.
Qwen3.8-Max와 동일한 모델인가요?
이는 오픈 가중치 Qwen3.8 2.4T A95B 모델이며, Qwen3.8-Max는 별도의 관리형 서비스 경로입니다. 둘 중에서 선택하기 전에 검증된 기능과 워크로드에 대한 액세스 요구사항을 비교하세요.
출처
- Novita 모델 페이지: https://novita.ai/models/model-detail/qwen-qwen3.8-2.4t-a95b (2026-09-02 확인)
- Novita 가격 페이지: https://novita.ai/pricing (2026-09-02 확인)
- Qwen 모델 카드: https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B (2026-09-02 확인)
- Qwen3.8-Max 시작 가이드: /qwen3-8-max-on-novita-ai-launch-pricing/
- Qwen3.8-Max 퀵 스타트: /qwen3-8-max-api-quick-start/
