이 모델은 더 이상 권장되지 않습니다. 기본 입력 토큰 1만 개 워크로드에 대해서만 성능 벤치마킹을 계속합니다. 다른 워크로드의 결과는 과거 데이터이며 더 이상 업데이트되지 않습니다.
Alibaba에서 새 버전인 Qwen3 Max을 출시했습니다. 이 버전 사용을 고려해 보세요.
Qwen3 Max (Preview) 지능, 성능 및 가격 분석
가격이 비슷한 다른 비추론 모델과 비교하면 Qwen3 Max (Preview)의 지능은 평균보다 낮지만, 가격은 합리적인 수준입니다. 이 모델의 지원 입력은 텍스트, 출력은 텍스트이며, 컨텍스트 창은 262k토큰입니다.
Qwen3 Max (Preview)의 Artificial Analysis Intelligence Index 점수는 13점으로, 비교 가능한 모델 중 평균 이하입니다(중앙값: 15).
Qwen3 Max (Preview)의 입력 토큰 100만 개당 가격은 $1.20(보통 수준의 가격, 중앙값: $1.75)이며, 출력 토큰 100만 개당 가격은 $6.00(보통 수준의 가격, 중앙값: $9.00)입니다.
Qwen3 Max (Preview)의 속도는 초당 56토큰으로 평균보다 느립니다(69).
| 추론 | 아니요 이 페이지에는 모델의 비추론 버전이 표시됩니다. 추론 버전도 있을 수 있습니다. |
|---|---|
| 입력 모달리티 | 지원: 텍스트 |
| 출력 모달리티 | 지원: 텍스트 |
| 컨텍스트 창 | 262k Arial 12포인트 기준 A4 약 393페이지 |
동일한 등급의 모델과 지표를 비교합니다.
- 비추론 모델 → 다른 비추론 모델과만 비교
- 추론 모델 → 추론 및 비추론 모델 모두와 비교
- 오픈 웨이트 모델 → 같은 크기 등급의 다른 오픈 웨이트 모델과만 비교:
- 초소형: 파라미터 ≤4B
- 소형: 파라미터 4B~40B
- 중형: 파라미터 40B~150B
- 대형: 파라미터 >150B
- 독점 모델 → 입력/출력 가격을 3:1로 혼합해 같은 가격대의 독점 모델 및 오픈 웨이트 모델과 비교:
- 100만 토큰당 <$0.15
- 100만 토큰당 $0.15~$1
- 100만 토큰당 >$1
지능Updated
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index: 오픈 웨이트와 독점 모델
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Agentic scientific research workflows in a terminal
Quantitative analysis on spreadsheets & documents
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
AA-Omniscience
AA-Omniscience Index
Intelligence Index 비교
Intelligence Index와 작업당 비용
비용
Intelligence Index 작업당 비용
Artificial Analysis Intelligence Index 실행 비용
가격: 캐시 적중, 입력 및 출력
컨텍스트 창
컨텍스트 창
속도
출력 속도(초당 토큰 수)로 측정
출력 속도
지능 지수 작업당 시간
지연 시간
첫 토큰까지 걸린 시간(초)으로 측정
지연 시간: 첫 답변 토큰까지 걸린 시간
종단 간 응답 시간
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
종단 간 응답 시간
자주 묻는 질문
Qwen3 Max (Preview)에 관한 일반적인 질문
Qwen3 Max (Preview) 모델은 2025년 9월 5일에 출시되었습니다.
Qwen3 Max (Preview) 모델은 Alibaba에서 개발했습니다.
Qwen3 Max (Preview)의 Artificial Analysis Intelligence Index 추정 점수는 13점으로, 가격대가 비슷한 다른 비추론 모델 중 평균 이하입니다(중앙값: 15).
Qwen3 Max (Preview) 모델은 초당 55.8개의 출력 토큰을 생성하며(Alibaba API 기준), 가격대가 비슷한 다른 비추론 모델과 비교하면 평균보다 낮습니다(중앙값: 68.9 t/s).
Qwen3 Max (Preview)의 첫 토큰까지 걸린 시간(TTFT)은 3.97초이며(Alibaba API 기준), 가격대가 비슷한 다른 비추론 모델과 비교하면 상위 구간입니다(중앙값: 1.07초).
Qwen3 Max (Preview)의 입력 토큰 100만 개당 가격은 $1.20(평균보다 낮음, 중앙값: $1.75)이며, 출력 토큰 100만 개당 가격은 $6.00(평균보다 낮음, 중앙값: $9.00)입니다(Alibaba API 기준).
Qwen3 Max (Preview)의 입력 토큰 100만 개당 가격은 $1.20, 출력 토큰 100만 개당 가격은 $6.00입니다(Alibaba API 기준). 캐시 적중/입력/출력 비율을 7:2:1로 가정한 혼합 가격은 100만 토큰당 $1.01입니다. 가격은 제공업체마다 다를 수 있습니다. 제공업체 가격 비교
아니요. Qwen3 Max (Preview) 모델은 추론 모델이 아닙니다. 확장된 연쇄적 사고 추론 없이 바로 답변합니다.
Qwen3 Max (Preview) 모델은 텍스트 입력을 지원합니다.
Qwen3 Max (Preview) 모델은 텍스트 출력을 지원합니다.
아니요. Qwen3 Max (Preview) 모델은 이미지 입력을 지원하지 않으며 텍스트만 처리할 수 있습니다.
아니요. Qwen3 Max (Preview) 모델은 멀티모달 모델이 아니며 텍스트 입력만 지원합니다.
Qwen3 Max (Preview)의 컨텍스트 창은 260k토큰입니다. 모델이 단일 요청에서 처리할 수 있는 텍스트와 대화 기록의 양을 결정합니다.
아니요. Qwen3 Max (Preview) 모델은 독점 모델이며 모델 웨이트가 공개되어 있지 않습니다.
Qwen3 Max (Preview) 모델은 독점 모델이며 Alibaba에서 모델 크기나 파라미터 수를 공개하지 않았습니다.
Qwen3 Max (Preview)의 Artificial Analysis Intelligence Index 점수는 13점입니다. 이 종합 벤치마크는 추론, 지식, 수학, 코딩 전반에서 모델을 평가합니다.
예. Qwen3 Max (Preview) 모델은 API 제공업체 1곳을 통해 제공됩니다. API 제공업체 비교
Qwen3 Max (Preview) 모델은 API 제공업체 1곳을 통해 제공됩니다. 제공업체 비교