Alibaba Models: Intelligence, Performance & Price
Artificial Analysis Intelligence Index
Output speed
Per Intelligence Index Task
Artificial Analysis has benchmarked 89 models from Alibaba. Below is a comparison of the key metrics across these models.
- For intelligence, the top model from Alibaba is Qwen3.8 Max (0902) at 45.
- For output speed, the fastest model is Qwen3.5 Omni Flash at 242 t/s.
- For latency, Qwen3.5 9B (Non-reasoning) at 0.79s offers the lowest time to first answer token.
- For pricing, Qwen3.7 Plus at $0.22 offers the lowest cost per task. Prices vary up to 25x across models.
Intelligence
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Cost
Cost per Intelligence Index Task
Speed & Latency
Output Speed
Capability Scores
Capability Indexes
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
All Alibaba Releases
Qwen3.8 Max (0902)
1 model
45
Highest Intelligence
Qwen3.8-Flash-Next
1 model
40
Highest Intelligence
Qwen3.8 27B
4 models
34
Highest Intelligence
Qwen3.8 2.4T A95B
1 model
40
Highest Intelligence
Qwen3.8 Max
1 model
40
Highest Intelligence
Qwen3.7 Plus
1 model
25
Highest Intelligence
Qwen3.7 Max
1 model
29
Highest Intelligence
Qwen3.6 27B
2 models
21
Highest Intelligence
Qwen3.6 Max Preview
1 model
28
Highest Intelligence
Qwen3.6 35B A3B
2 models
18
Highest Intelligence
Qwen3.6 Plus
1 model
27
Highest Intelligence
Qwen3.5 Omni Flash
1 model
12
Highest Intelligence
Qwen3.5 Omni Plus
1 model
20
Highest Intelligence
Qwen3.5 0.8B
2 models
6
Highest Intelligence
Qwen3.5 2B
2 models
7
Highest Intelligence
Qwen3.5 4B
2 models
13
Highest Intelligence
Qwen3.5 9B
2 models
14
Highest Intelligence
Qwen3.5 122B A10B
2 models
18
Highest Intelligence
Qwen3.5 27B
2 models
23
Highest Intelligence
Qwen3.5 35B A3B
2 models
19
Highest Intelligence
Qwen3.5 397B A17B
2 models
21
Highest Intelligence
Qwen3 Coder Next
1 model
9
Highest Intelligence
Qwen3 Max Thinking
1 model
21
Highest Intelligence
Qwen3 Max Thinking (Preview)
1 model
16
Highest Intelligence
Qwen3 VL 32B (Reasoning)
1 model
12
Highest Intelligence
Qwen3 VL 32B Instruct
1 model
8
Highest Intelligence
Qwen3 VL 4B (Reasoning)
1 model
7
Highest Intelligence
Qwen3 VL 4B Instruct
1 model
6
Highest Intelligence
Qwen3 VL 8B (Reasoning)
1 model
8
Highest Intelligence
Qwen3 VL 8B Instruct
1 model
7
Highest Intelligence
Qwen3 VL 30B A3B (Reasoning)
1 model
9
Highest Intelligence
Qwen3 VL 30B A3B Instruct
1 model
8
Highest Intelligence
Qwen3 Max
1 model
16
Highest Intelligence
Qwen3 VL 235B A22B (Reasoning)
1 model
13
Highest Intelligence
Qwen3 VL 235B A22B Instruct
1 model
10
Highest Intelligence
Qwen3 Omni 30B A3B (Reasoning)
1 model
8
Highest Intelligence
Qwen3 Omni 30B A3B Instruct
1 model
6
Highest Intelligence
Qwen3 Next 80B A3B (Reasoning)
1 model
11
Highest Intelligence
Qwen3 Next 80B A3B Instruct
1 model
10
Highest Intelligence
Qwen3 Max (Preview)
1 model
13
Highest Intelligence
Qwen3 4B 2507
1 model
7
Highest Intelligence
Qwen3 4B 2507 (Reasoning)
1 model
9
Highest Intelligence
Qwen3 Coder 30B A3B Instruct
1 model
10
Highest Intelligence
Qwen3 30B A3B 2507 (Reasoning)
1 model
10
Highest Intelligence
Qwen3 30B A3B 2507
1 model
8
Highest Intelligence
Qwen3 235B A22B 2507 (Reasoning)
1 model
13
Highest Intelligence
Qwen3 Coder 480B A35B Instruct
1 model
12
Highest Intelligence
Qwen3 235B A22B 2507
1 model
12
Highest Intelligence
Qwen3 0.6B
2 models
5
Highest Intelligence
Qwen3 1.7B
2 models
5
Highest Intelligence
Qwen3 14B
2 models
8
Highest Intelligence
Qwen3 235B A22B
2 models
9
Highest Intelligence
Qwen3 30B A3B
2 models
8
Highest Intelligence
Qwen3 32B
2 models
9
Highest Intelligence
Qwen3 4B
2 models
7
Highest Intelligence
Qwen3 8B
2 models
7
Highest Intelligence
QwQ 32B
1 model
9
Highest Intelligence
Qwen2.5 Max
1 model
8
Highest Intelligence
QwQ 32B-Preview
1 model
8
Highest Intelligence
Qwen2.5 Turbo
1 model
6
Highest Intelligence
Qwen2.5 Coder Instruct 32B
1 model
7
Highest Intelligence
Qwen2.5 Instruct 72B
1 model
8
Highest Intelligence
Qwen2.5 Coder Instruct 7B
1 model
6
Highest Intelligence
Qwen2.5 Instruct 32B
1 model
7
Highest Intelligence
Qwen2 Instruct 72B
1 model
6
Highest Intelligence
Qwen1.5 Chat 110B
1 model
6
Highest Intelligence
Qwen Chat 72B
1 model
5
Highest Intelligence
Qwen Chat 14B
1 model
5
Highest Intelligence
Further details
Weights | Provider Benchmarks | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.8 Max (0902) | 45 | - | 984k | $1.2 | 39 | Not available | |||
| Qwen3.8 Max | 40 | - | 1M | $1.2 | 38 | Not available | |||
| Qwen3.8 2.4T A95B | 40 | 2.4T 95B active at inference time | 984k | $1.2 | 38 | +4 | |||
| Qwen3.8-Flash-Next | 40 | 180B 6B active at inference time | 256k | $0.1 | 57 | ||||
| Qwen3.8 27B (xhigh) | 34 | 27B | 256k | $0.5 | 47 | +4 | |||
| Qwen3.7 Max | 29 | - | 1M | $1.6 | 207 | Not available | |||
| Qwen3.6 Max Preview | 28 | - | 256k | $1.1 | 75 | Not available | |||
| Qwen3.8 27B (medium) | 28 | 27B | 256k | $0.5 | 54 | ||||
| Qwen3.6 Plus | 27 | - | 1M | $0.4 | 57 | Not available | |||
| Qwen3.8 27B (low) | 26 | 27B | 256k | $0.5 | 57 | ||||
| Qwen3.7 Plus | 25 | - | 1M | $0.3 | 71 | Not available | |||
| Qwen3.5 27B (Reasoning) | 23 | 27.8B | 262k | $0.5 | 79 | +2 | |||
| Qwen3.5 397B A17B (Non-reasoning) | 21 | 397B 17B active at inference time | 262k | $0.9 | 93 | +2 | |||
| Qwen3.6 27B (Reasoning) | 21 | 27.8B | 262k | $0.9 | 59 | +2 | |||
| Qwen3 Max Thinking | 21 | - | 256k | - | - | Not available | - | ||
| Qwen3.5 Omni Plus | 20 | - | 256k | $0.8 | 104 | Not available | |||
| Qwen3.8 27B (Non-reasoning) | 20 | 27B | 256k | $0.5 | 54 | ||||
| Qwen3.6 27B (Non-reasoning) | 20 | 27.8B | 262k | $0.9 | 62 | ||||
| Qwen3.5 27B (Non-reasoning) | 19 | 27.8B | 262k | $0.5 | 86 | ||||
| Qwen3.5 35B A3B (Reasoning) | 19 | 36B 3B active at inference time | 262k | $0.4 | 142 | +3 | |||
| Qwen3.5 397B A17B (Reasoning) | 18 | 397B 17B active at inference time | 262k | $0.9 | 94 | +4 | |||
| Qwen3.6 35B A3B (Reasoning) | 18 | 36B 3B active at inference time | 262k | $0.6 | 131 | +5 | |||
| Qwen3.5 122B A10B (Non-reasoning) | 18 | 125B 10B active at inference time | 262k | $0.7 | 146 | ||||
| Qwen3 Max Thinking (Preview) | 16 | - | 262k | $1.0 | 64 | Not available | |||
| Qwen3 Max | 16 | - | 262k | $1.7 | 56 | Not available | |||
| Qwen3.5 122B A10B (Reasoning) | 16 | 125B 10B active at inference time | 262k | $0.7 | 133 | +2 | |||
| Qwen3.6 35B A3B (Non-reasoning) | 15 | 36B 3B active at inference time | 262k | $0.6 | 142 | +4 | |||
| Qwen3.5 35B A3B (Non-reasoning) | 15 | 36B 3B active at inference time | 262k | $0.4 | 165 | ||||
| Qwen3.5 9B (Reasoning) | 14 | 9.7B | 262k | $0.1 | 44 | ||||
| Qwen3 VL 235B A22B (Reasoning) | 13 | 235B 22B active at inference time | 262k | $0.8 | 57 | ||||
| Qwen3.5 9B (Non-reasoning) | 13 | 9.7B | 262k | $0.2 | 80 | ||||
| Qwen3.5 4B (Reasoning) | 13 | 4.7B | 262k | $0.0 | 24 | ||||
| Qwen3 235B A22B 2507 (Reasoning) | 13 | 235B 22B active at inference time | 256k | $0.4 | 53 | ||||
| Qwen3 Max (Preview) | 13 | - | 262k | $1.0 | 57 | Not available | |||
| Qwen3.5 Omni Flash | 12 | - | 256k | $0.2 | 242 | Not available | |||
| Qwen3 235B A22B 2507 Instruct | 12 | 235B 22B active at inference time | 256k | $0.3 | 60 | +6 | |||
| Qwen3 Coder 480B A35B Instruct | 12 | 480B 35B active at inference time | 262k | $2.1 | 52 | +2 | |||
| Qwen3 VL 32B (Reasoning) | 12 | 33.4B | 256k | $0.2 | 90 | ||||
| Qwen3 Next 80B A3B (Reasoning) | 11 | 80B 3B active at inference time | 262k | $0.3 | 191 | ||||
| Qwen3.5 4B (Non-reasoning) | 11 | 4.7B | 262k | $0.0 | 23 | ||||
| Qwen3 VL 235B A22B Instruct | 10 | 235B 22B active at inference time | 262k | $0.5 | 52 | ||||
| Qwen3 30B A3B 2507 (Reasoning) | 10 | 30.5B 3.3B active at inference time | 262k | $0.4 | 146 | ||||
| Qwen3 Next 80B A3B Instruct | 10 | 80B 3B active at inference time | 262k | $0.3 | 183 | +5 | |||
| Qwen3 Coder 30B A3B Instruct | 10 | 30.5B 3.3B active at inference time | 262k | $0.6 | 92 | ||||
| Qwen3 235B A22B (Reasoning) | 9 | 235B 22B active at inference time | 33k | $1.5 | 60 | ||||
| QwQ 32B | 9 | 32.8B | 131k | $0.7 | - | ||||
| Qwen3 VL 30B A3B (Reasoning) | 9 | 30B 3B active at inference time | 256k | $0.4 | 113 | ||||
| Qwen3 Coder Next | 9 | 79.7B 3B active at inference time | 256k | $0.4 | 131 | ||||
| Qwen3 4B 2507 (Reasoning) | 9 | 4.0B | 262k | - | - | - | |||
| Qwen3 32B (Reasoning) | 9 | 32.8B | 33k | $0.2 | 106 | ||||
| Qwen3 VL 32B Instruct | 8 | 33.4B | 256k | $0.2 | 72 | ||||
| Qwen3 235B A22B (Non-reasoning) | 8 | 235B 22B active at inference time | 33k | $0.9 | 61 | ||||
| Qwen3 VL 8B (Reasoning) | 8 | 8.8B | 256k | $0.4 | 114 | ||||
| Qwen3 14B (Reasoning) | 8 | 14.8B | 33k | $0.7 | 63 | ||||
| Qwen2.5 Max | 8 | - | 32k | - | - | Not available | - | ||
| Qwen3 VL 30B A3B Instruct | 8 | 30B 3B active at inference time | 256k | $0.3 | 112 | ||||
| Qwen3 Omni 30B A3B (Reasoning) | 8 | 35.3B 3B active at inference time | 66k | $0.3 | 101 | ||||
| Qwen2.5 Instruct 72B | 8 | 72B | 131k | $0.4 | - | ||||
| Qwen3 30B A3B (Reasoning) | 8 | 30.5B 3.3B active at inference time | 33k | $0.4 | 108 | ||||
| QwQ 32B-Preview | 8 | 32.8B | 33k | - | - | - | |||
| Qwen3 30B A3B 2507 Instruct | 8 | 30.5B 3.3B active at inference time | 262k | $0.3 | 144 | ||||
| Qwen3 32B (Non-reasoning) | 7 | 32.8B | 33k | $0.2 | 105 | ||||
| Qwen3 8B (Reasoning) | 7 | 8.2B | 131k | $0.4 | 41 | ||||
| Qwen3 VL 8B Instruct | 7 | 8.8B | 256k | $0.2 | 116 | ||||
| Qwen3 4B (Reasoning) | 7 | 4.0B | 32k | - | - | - | |||
| Qwen3 VL 4B (Reasoning) | 7 | 4.4B | 256k | - | - | - | |||
| Qwen3.5 2B (Reasoning) | 7 | 2.3B | 262k | - | - | - | |||
| Qwen2.5 Instruct 32B | 7 | 32B | 128k | - | - | - | |||
| Qwen3 4B 2507 Instruct | 7 | 4.0B | 262k | - | - | - | |||
| Qwen2.5 Coder Instruct 32B | 7 | 32B | 131k | - | - | - | |||
| Qwen3 14B (Non-reasoning) | 7 | 14.8B | 33k | $0.5 | 63 | ||||
| Qwen3 30B A3B (Non-reasoning) | 7 | 30.5B 3.3B active at inference time | 33k | $0.3 | 106 | ||||
| Qwen3 4B (Non-reasoning) | 7 | 4.0B | 32k | - | - | - | |||
| Qwen2.5 Turbo | 6 | - | 1M | $0.0 | 108 | Not available | |||
| Qwen2 Instruct 72B | 6 | 72B | 131k | - | - | - | |||
| Qwen3.5 2B (Non-reasoning) | 6 | 2.3B | 262k | - | - | - | |||
| Qwen3.5 0.8B (Reasoning) | 6 | 0.9B | 262k | - | - | - | |||
| Qwen3 Omni 30B A3B Instruct | 6 | 35.3B 3B active at inference time | 66k | $0.3 | 96 | ||||
| Qwen3 8B (Non-reasoning) | 6 | 8.2B | 33k | $0.2 | 42 | ||||
| Qwen2.5 Coder Instruct 7B | 6 | 7.6B | 131k | - | - | - | |||
| Qwen3 VL 4B Instruct | 6 | 4.4B | 256k | - | - | - | |||
| Qwen1.5 Chat 110B | 6 | 110B | 32k | - | - | - | |||
| Qwen Chat 72B | 5 | 72B | 34k | - | - | - | |||
| Qwen3.5 0.8B (Non-reasoning) | 5 | 0.9B | 262k | - | - | - | |||
| Qwen3 1.7B (Reasoning) | 5 | 2.0B | 32k | - | - | - | |||
| Qwen Chat 14B | 5 | 14B | 8k | - | - | - | |||
| Qwen3 1.7B (Non-reasoning) | 5 | 2.0B | 32k | - | - | - | |||
| Qwen3 0.6B (Non-reasoning) | 5 | 0.8B | 32k | - | - | - | |||
| Qwen3 0.6B (Reasoning) | 5 | 0.8B | 32k | - | - | - |