This model is deprecated. We only continue performance benchmarking for the default 10k input token workload. Results for other workloads are historical and no longer updated.
Alibaba has launched a newer model, Qwen3 Max Thinking. We suggest considering it instead.
For more information, see comparison of Qwen3 Max Thinking to other models and API provider benchmarks for Qwen3 Max Thinking.
Qwen3 Max Thinking (Preview) 지능, 성능 및 가격 분석
모델 요약
지능
속도
입력 가격
출력 가격
장황성
가격이 비슷한 다른 모델과 비교하면 Qwen3 Max Thinking (Preview)의 지능은 평균보다 낮지만, 가격은 합리적인 수준입니다. 이 모델의 지원 입력은 텍스트, 출력은 텍스트이며, 컨텍스트 창은 262k토큰입니다.
Qwen3 Max Thinking (Preview)의 Artificial Analysis Intelligence Index 점수는 25점으로, 비교 가능한 모델 중 평균 이하입니다(중앙값: 32).
Qwen3 Max Thinking (Preview)의 입력 토큰 100만 개당 가격은 $1.20(보통 수준의 가격, 중앙값: $1.75)이며, 출력 토큰 100만 개당 가격은 $6.00(보통 수준의 가격, 중앙값: $10.00)입니다.
Qwen3 Max Thinking (Preview)의 속도는 초당 62토큰으로 평균보다 느립니다(72).
| 추론 | 예 이 페이지에는 모델의 추론 버전이 표시됩니다. 비추론 버전도 있을 수 있습니다. |
|---|---|
| 입력 모달리티 | 지원: 텍스트 |
| 출력 모달리티 | 지원: 텍스트 |
| 컨텍스트 창 | 262k Arial 12포인트 기준 A4 약 393페이지 |
동일한 등급의 모델과 지표를 비교합니다.
- 비추론 모델 → 다른 비추론 모델과만 비교
- 추론 모델 → 추론 및 비추론 모델 모두와 비교
- 오픈 웨이트 모델 → 같은 크기 등급의 다른 오픈 웨이트 모델과만 비교:
- 초소형: 파라미터 ≤4B
- 소형: 파라미터 4B~40B
- 중형: 파라미터 40B~150B
- 대형: 파라미터 >150B
- 독점 모델 → 입력/출력 가격을 3:1로 혼합해 같은 가격대의 독점 모델 및 오픈 웨이트 모델과 비교:
- 100만 토큰당 <$0.15
- 100만 토큰당 $0.15~$1
- 100만 토큰당 >$1
주요 내용
지능
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Intelligence Evaluations
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Scientific reasoning
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic knowledge work, Elo
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
AA-Omniscience
AA-Omniscience Index
Intelligence Index 비교
Intelligence Index vs. Cost per Intelligence Index Task
비용
Cost per Intelligence Index Task
Cost to Run Artificial Analysis Intelligence Index
Pricing: Cache Hit, Input, and Output
컨텍스트 창
Context Window
속도
출력 속도(초당 토큰 수)로 측정
Output Speed
Time per Intelligence Index Task
지연 시간
첫 토큰까지 걸린 시간(초)으로 측정
Latency: Time To First Answer Token
종단 간 응답 시간
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
End-to-End Response Time
자주 묻는 질문
Qwen3 Max Thinking (Preview)에 관한 일반적인 질문
Qwen3 Max Thinking (Preview) 모델은 2025년 11월 3일에 출시되었습니다.
Qwen3 Max Thinking (Preview) 모델은 Alibaba에서 개발했습니다.
Qwen3 Max Thinking (Preview)의 Artificial Analysis Intelligence Index 추정 점수는 25점으로, 가격대가 비슷한 다른 추론 모델 중 평균 이하입니다(중앙값: 32).
Qwen3 Max Thinking (Preview) 모델은 초당 62.0개의 출력 토큰을 생성하며(Alibaba API 기준), 가격대가 비슷한 다른 추론 모델과 비교하면 평균보다 낮습니다(중앙값: 72.2 t/s).
Qwen3 Max Thinking (Preview)의 첫 토큰까지 걸린 시간(TTFT)은 4.03초이며(Alibaba API 기준), 가격대가 비슷한 다른 추론 모델과 비교하면 평균보다 다소 높습니다(중앙값: 2.83초).
Qwen3 Max Thinking (Preview)의 입력 토큰 100만 개당 가격은 $1.20(평균보다 낮음, 중앙값: $1.75)이며, 출력 토큰 100만 개당 가격은 $6.00(평균보다 낮음, 중앙값: $10.00)입니다(Alibaba API 기준).
Qwen3 Max Thinking (Preview)의 입력 토큰 100만 개당 가격은 $1.20, 출력 토큰 100만 개당 가격은 $6.00입니다(Alibaba API 기준). 캐시 적중/입력/출력 비율을 7:2:1로 가정한 혼합 가격은 100만 토큰당 $1.68입니다. 가격은 제공업체마다 다를 수 있습니다. 제공업체 가격 비교
예. Qwen3 Max Thinking (Preview) 모델은 추론 모델입니다. 답변하기 전에 확장 사고 또는 연쇄적 사고 추론으로 복잡한 문제를 해결합니다.
Qwen3 Max Thinking (Preview) 모델은 텍스트 입력을 지원합니다.
Qwen3 Max Thinking (Preview) 모델은 텍스트 출력을 지원합니다.
아니요. Qwen3 Max Thinking (Preview) 모델은 이미지 입력을 지원하지 않으며 텍스트만 처리할 수 있습니다.
아니요. Qwen3 Max Thinking (Preview) 모델은 멀티모달 모델이 아니며 텍스트 입력만 지원합니다.
Qwen3 Max Thinking (Preview)의 컨텍스트 창은 260k토큰입니다. 모델이 단일 요청에서 처리할 수 있는 텍스트와 대화 기록의 양을 결정합니다.
아니요. Qwen3 Max Thinking (Preview) 모델은 독점 모델이며 모델 웨이트가 공개되어 있지 않습니다.
Qwen3 Max Thinking (Preview) 모델은 독점 모델이며 Alibaba에서 모델 크기나 파라미터 수를 공개하지 않았습니다.
Qwen3 Max Thinking (Preview)의 Artificial Analysis Intelligence Index 점수는 25점입니다. 이 종합 벤치마크는 추론, 지식, 수학, 코딩 전반에서 모델을 평가합니다.
예. Qwen3 Max Thinking (Preview) 모델은 API 제공업체 1곳을 통해 제공됩니다. API 제공업체 비교
Qwen3 Max Thinking (Preview) 모델은 API 제공업체 1곳을 통해 제공됩니다. 제공업체 비교