Macaron V1 Venti는 코딩, 에이전트 또는 GenUI를 위해 1M 컨텍스트 워크플로가 필요할 때 Novita의 플래그십 Macaron 모델에 가장 빠르게 접근할 수 있는 방법입니다. 작은 텍스트 전용 요청으로 시작한 후, 엔드포인트와 인증이 작동하는 것을 확인한 다음 규모를 확장하세요.
전체 모델 개요는 Novita AI의 Macaron V1 Venti를 참조하세요.
이 빠른 시작 가이드를 사용해야 하는 경우
워크로드에 긴 컨텍스트, 도구 사용 또는 짧은 채팅 응답 대신 코드 기반 UI 생성이 필요할 때 이 가이드를 사용하세요. Macaron V1 Venti의 Novita 모델 페이지에는 서버리스 액세스, 함수 호출 및 추론 기능이 있으며, 텍스트 입력 및 텍스트 출력을 지원합니다.
1단계: Novita API 키 받기
Novita API 키를 생성하고 서버 측에 안전하게 보관하세요.
export NOVITA_API_KEY="your_api_key_here"
2단계: 모델 ID 및 엔드포인트 확인
| 필드 | 값 |
|---|---|
| 모델 ID | mindai/macaron-v1-venti |
| 기본 URL | https://api.novita.ai/openai/v1 |
| 채팅 완료 엔드포인트 | https://api.novita.ai/openai/v1/chat/completions |
| 컨텍스트 윈도우 | 1,048,576 토큰 |
| 최대 출력 토큰 | 131,072 |
| 입력 | 텍스트 |
| 출력 | 텍스트 |
| 기능 | 서버리스 API, 함수 호출, 추론 |
| 속도 제한 등급 | T1: 30 RPM, 50,000,000 TPM |
**2026년 7월 28일 ** 기준으로 Novita는 Macaron V1 Venti를 ** 시간 제한 무료 **로 표시하며 **$0 입력 ** 및 $0 출력 가격을 제공합니다. 프로덕션 사용을 예산에 반영하기 전에 실제 모델 페이지를 확인하세요.
3단계: 첫 번째 요청 보내기
인증, 라우팅 및 파싱을 확인하기 위해 짧은 텍스트 전용 프롬프트로 시작하세요.
리포지토리 전체 리팩터링의 주요 위험을 5가지 요점으로 요약해 주세요.
4단계: 응답 읽기
표준 채팅 완료의 경우 choices[0].message.content에서 답변을 읽으세요. 요청 메타데이터, 토큰 사용량 및 HTTP 상태를 로그에 기록하여 나중에 느리거나 비용이 많이 드는 호출을 추적할 수 있도록 하세요.
5단계: 가격, 제한 사항 및 일반적인 오류 확인
현재 목록이 오래된 블로그 게시물보다 중요합니다. 무료 가격, 특정 속도 등급 또는 전체 1M 컨텍스트 윈도우에 의존하는 경우 출시 전에 모델 페이지를 다시 확인하세요.
일반적인 설정 실수는 다음과 같습니다.
- 표시 이름 대신
mindai/macaron-v1-venti를 사용하지 않는 경우 - SDK를 잘못된 기본 URL로 지정하는 경우
- 기본 연결을 확인하기 전에 큰 프롬프트를 보내는 경우
- 모든 긴 컨텍스트 요청이 최대 출력 한도를 사용해야 한다고 가정하는 경우
Python 예제
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["NOVITA_API_KEY"],
base_url="https://api.novita.ai/openai/v1",
)
response = client.chat.completions.create(
model="mindai/macaron-v1-venti",
messages=[
{"role": "system", "content": "You are a concise coding assistant."},
{"role": "user", "content": "List the safest first steps for refactoring a large monorepo."},
],
temperature=0.2,
max_tokens=400,
)
print(response.choices[0].message.content)
cURL 예제
curl "https://api.novita.ai/openai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ${NOVITA_API_KEY}" \
-d '{
"model": "mindai/macaron-v1-venti",
"messages": [
{
"role": "system",
"content": "You are a concise coding assistant."
},
{
"role": "user",
"content": "List the safest first steps for refactoring a large monorepo."
}
],
"temperature": 0.2,
"max_tokens": 400
}'
주요 매개변수
| 매개변수 | 시작 값 | 중요한 이유 |
|---|---|---|
model |
mindai/macaron-v1-venti |
호스팅된 모델 선택 |
messages |
짧은 시스템 + 사용자 프롬프트 | API 경로를 빠르게 확인 |
temperature |
0.2 |
테스트 출력을 안정적으로 유지 |
max_tokens |
400 |
과도하게 큰 첫 응답 방지 |
tools |
한 번에 하나의 함수 | 에이전트 및 워크플로에 유용 |
response_format |
파서가 준비된 경우에만 사용 | 배포 전에 JSON 검증 |
코딩, 에이전트 및 GenUI 프롬프트
코딩
주변 컨텍스트가 중요할 때 리포지토리 인식 리팩터링, 마이그레이션 계획 또는 코드 리뷰 요약에 Macaron V1 Venti를 사용하세요.
이 모듈의 마이그레이션 위험을 검토하고, 변경 사항을 식별하며, 가장 안전한 최소 패치 계획을 제안해 주세요.
에이전트
모델이 직접 답변하는 대신 도구를 선택해야 할 때 함수 호출을 사용하세요.
사용자가 기존 이슈 ID를 언급하는 경우에만 티켓 조회 도구를 호출하세요. 그렇지 않으면 짧은 계획으로 답변하세요.
GenUI
제품 브리프에서 구조화된 UI 아이디어를 얻고자 할 때 인터페이스 생성을 위해 사용하세요.
이 제품 브리프를 섹션, 액션, 빈 상태 및 유효성 검사 규칙이 포함된 깔끔한 대시보드 레이아웃으로 변환해 주세요.
문제 해결
API가 인증 오류를 반환하는 경우
요청을 보내는 동일한 셸 또는 런타임에 Bearer 토큰이 설정되어 있는지 확인하세요.
모델을 찾을 수 없는 경우
모델 ID를 다시 확인하세요: mindai/macaron-v1-venti.
요청이 너무 큰 경우
더 작게 시작한 다음 점진적으로 컨텍스트를 추가하세요. 1M 토큰 윈도우는 용량일 뿐, 모든 것을 한 번에 보내라는 신호가 아닙니다.
FAQ
Macaron V1 Venti를 Novita AI에서 사용할 수 있나요?
네. 실제 모델 페이지에 서버리스 모델로 나열되어 있습니다.
어떤 엔드포인트를 사용해야 하나요?
https://api.novita.ai/openai/v1/chat/completions를 사용하세요.
도구 사용을 지원하나요?
네. Novita는 함수 호출을 모델 기능으로 나열합니다.
현재 모델이 무료인가요?
2026년 7월 28일에 확인한 목록에는 $0 입력 및 $0 출력 가격이 표시되었으며, 시간 제한 무료로 표시되었습니다.
추천 문서
- Novita AI의 Macaron V1 Venti: 코딩, 에이전트 및 GenUI를 위한 748B Mixture-of-LoRA 플래그십
- Macaron V1 Tall 빠른 시작 가이드: 코딩, 에이전트 및 GenUI
- Novita AI 모델과 Codex 사용 방법: 전체 설정 가이드
2026년 7월 28일 확인된 출처: Macaron V1 Venti 모델 페이지, Novita 채팅 완료 API 참조
