Alibaba Cloud: Models Intelligence, Performance & Price

Alibaba Cloud
Alibaba Cloud

This analysis is intended to support you in choosing the best model provided by Alibaba Cloud for your use-case.

Most Intelligent

Updated
#1
Qwen3.8 Max (0902)Qwen3.8 Max (0902)
45
#2
Qwen3.8 MaxQwen3.8 Max
40
#3
Qwen3.8 2.4T A95BQwen3.8 2.4T A95B
40
#4
Qwen3.8-Flash-NextQwen3.8-Flash-Next
40
#5
Qwen3.8 27B (xhigh)Qwen3.8 27B (xhigh)
34

Intelligence index

Total 58 models

Fastest

#1
Qwen3.5 Omni FlashQwen3.5 Omni Flash
228 t/s
#2
Qwen3.7 MaxQwen3.7 Max
201 t/s
#3
Qwen3 Next 80B A3BQwen3 Next 80B A3B
195 t/s
#4
Qwen3 Next 80B A3BQwen3 Next 80B A3B
180 t/s
#5
Qwen3.5 35B A3B (non-reasoning)Qwen3.5 35B A3B (non-reasoning)
160 t/s

Output speed

Total 58 models

Lowest Price

#1
Qwen2.5 TurboQwen2.5 Turbo
$0.04
#2
Qwen3.8-Flash-NextQwen3.8-Flash-Next
$0.09
#3
Qwen3.5 Omni FlashQwen3.5 Omni Flash
$0.17
#4
Qwen3 VL 32BQwen3 VL 32B
$0.21
#5
Qwen3 32BQwen3 32B
$0.21

Blended price (per 1M tokens)

Total 58 models

Alibaba Cloud offers 58 models, each with different intelligence, performance, and pricing characteristics. Below is a comparison of the key metrics across models.

  • For intelligence, the top models on Alibaba Cloud are Qwen3.8 Max (0902) (45), Qwen3.8 Max (40), and Qwen3.8 2.4T A95B (40).
  • For output speed, the fastest models are Qwen3.5 Omni Flash (228 t/s), Qwen3.7 Max (201 t/s), and Qwen3 Next 80B A3B (195 t/s).
  • For latency, Qwen3.5 Omni Flash (1.81s), Qwen3 30B A3B 2507 (non-reasoning) (1.88s), and Qwen3 Omni 30B A3B (1.89s) offer the lowest time to first answer token.
  • For pricing, Qwen2.5 Turbo ($0.04), Qwen3.8-Flash-Next ($0.09), and Qwen3.5 Omni Flash ($0.17) offer the lowest blended prices per 1M tokens. Prices vary up to 5.6x across models.
  • For context window size, Qwen3.8 Max (1M), Qwen3.8-Flash-Next (1M), and Qwen3.8 27B (xhigh) (1M) support the largest context windows on Alibaba Cloud.
Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Intelligence Evaluations

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
See more

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

Quantitative analysis on spreadsheets & documents

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Context Window

Context Window

Context window: tokens limit · Higher is better

Pricing

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Performance Summary

Output Speed vs. Price

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Speed

Measured by Output Speed (tokens per second)

Output Speed

Output tokens per second · Higher is better

Latency

Measured by Time (seconds) to First Token

Latency: Time To First Answer Token

Seconds to first answer token received · Accounts for reasoning model 'thinking' time

Cache Behaviour

Cache Hit Rate

Share of cacheable input tokens served from cache · Median of the last four weeks, updated Sep 26, 2026

Cost per Task vs. Cache Hit Rate

Weighted average cost (USD) per Intelligence Index task · Cache hit rate: median of the last four weeks, updated Sep 26, 2026
Most attractive quadrant
Pareto line

End-to-End Response Time

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

End-to-End Response Time vs. Price

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Further Analysis
Alibaba logo
Qwen3.8 Max (0902)
984k
Proprietary
45
$5.41
38
2.69
68.67
52.79
Alibaba logo
Qwen3.8 Max
1M
Proprietary
40
$2.67
38
2.54
67.81
52.21
Alibaba logo
Qwen3.8 2.4T A95B
262k
Open
40
$2.16
40
2.76
65.92
50.53
Alibaba logo
Qwen3.8-Flash-Next
1M
Open
40
$0.37
55
2.46
47.63
36.14
Alibaba logo
Qwen3.8 27B (xhigh)
1M
Open
34
$1.01
47
3.80
56.63
42.27
Alibaba logo
Qwen3.7 Max
991k
Proprietary
29
$1.15
201
2.26
16.76
12.01
Alibaba logo
Qwen3.6 Max Preview
256k
Proprietary
28*
--
73
3.02
37.31
27.44
Alibaba logo
Qwen3.8 27B (medium)
1M
Open
28
$1.13
54
3.82
50.44
37.30
Alibaba logo
Qwen3.6 Plus
1M
Proprietary
27*
--
55
2.18
111.66
100.44
Alibaba logo
Qwen3.8 27B (low)
1M
Open
26
$1.05
52
3.84
51.94
38.48
Alibaba logo
Qwen3.7 Plus
1M
Proprietary
25
$0.22
55
2.26
47.36
36.08
Alibaba logo
Qwen3.5 27B
262k
Open
23*
--
77
5.67
38.08
25.93
Alibaba logo
Qwen3.5 397B A17B (non-reasoning)
262k
Open
21*
--
87
2.30
8.02
--
Alibaba logo
Qwen3.6 27B
262k
Open
21
$0.62
56
3.69
114.06
101.43
Alibaba logo
Qwen3.5 Omni Plus
256k
Proprietary
20*
--
114
2.06
6.46
--
Alibaba logo
Qwen3.8 27B (non-reasoning)
1M
Open
20
$2.49
54
3.74
13.05
--
Alibaba logo
Qwen3.6 27B (non-reasoning)
262k
Open
20*
--
58
3.67
12.33
--
Alibaba logo
Qwen3.5 27B (non-reasoning)
262k
Open
19*
--
80
5.64
11.91
--
Alibaba logo
Qwen3.5 35B A3B
262k
Open
19*
--
149
2.13
18.93
13.44
Alibaba logo
Qwen3.5 397B A17B
262k
Open
18
$0.47
90
2.28
43.30
35.46
Alibaba logo
Qwen3.6 35B A3B
229k
Open
18
$0.48
135
2.11
45.67
39.87
Alibaba logo
Qwen3.5 122B A10B (non-reasoning)
262k
Open
18*
--
142
2.36
5.87
--
Alibaba logo
Qwen3 Max Thinking (Preview)
262k
Proprietary
16*
--
61
4.06
45.14
32.86
Alibaba logo
Qwen3 Max
258k
Proprietary
16*
--
64
2.24
10.02
--
Alibaba logo
Qwen3.5 122B A10B
262k
Open
16
$0.32
129
2.34
21.68
15.47
Alibaba logo
Qwen3.6 35B A3B (non-reasoning)
262k
Open
15*
--
145
2.07
5.51
--
Alibaba logo
Qwen3.5 35B A3B (non-reasoning)
262k
Open
15*
--
160
2.11
5.24
--
Alibaba logo
Qwen3 VL 235B A22B
131k
Open
13*
--
56
2.89
47.16
35.41
Alibaba logo
Qwen3 235B A22B 2507
131k
Open
13
$0.08
62
2.82
42.87
32.05
Alibaba logo
Qwen3 Max (Preview)
262k
Proprietary
13*
--
58
3.97
12.57
--
Alibaba logo
Qwen3.5 Omni Flash
256k
Proprietary
12*
--
228
1.81
3.99
--
Alibaba logo
Qwen3 235B 2507
131k
Open
12*
--
59
2.45
10.87
--
Alibaba logo
Qwen3 Coder 480B
262k
Open
12*
--
59
3.00
11.47
--
Alibaba logo
Qwen3 VL 32B
131k
Open
12*
--
90
2.59
30.33
22.19
Alibaba logo
Qwen3 Next 80B A3B
262k
Open
11*
--
195
2.34
15.17
10.27
Alibaba logo
Qwen3 VL 235B A22B
131k
Open
10*
--
53
2.70
12.19
--
Alibaba logo
Qwen3 30B A3B 2507
262k
Open
10
$0.08
159
2.34
18.06
12.57
Alibaba logo
Qwen3 Next 80B A3B
131k
Open
10*
--
180
2.17
4.95
--
Alibaba logo
Qwen3 Coder 30B A3B
262k
Open
10*
--
87
2.64
8.37
--
Alibaba logo
Qwen3 235B
98.3k
Open
9*
--
64
2.74
41.56
31.06
Alibaba logo
Qwen3 VL 30B A3B
131k
Open
9*
--
113
2.15
24.37
17.77
Alibaba logo
Qwen3 32B
98.3k
Open
9*
--
106
2.50
26.05
18.84
Alibaba logo
Qwen3 VL 32B
131k
Open
8*
--
67
2.63
10.05
--
Alibaba logo
Qwen3 235B (non-reasoning)
131k
Open
8*
--
63
2.77
10.68
--
Alibaba logo
Qwen3 VL 8B
131k
Open
8*
--
112
2.32
24.68
17.88
Alibaba logo
Qwen3 14B
98.3k
Open
8*
--
58
2.74
45.60
34.29
Alibaba logo
Qwen3 VL 30B A3B
131k
Open
8*
--
113
2.21
6.63
--
Alibaba logo
Qwen3 Omni 30B A3B
65.5k
Open
8*
--
102
1.87
26.49
19.70
Alibaba logo
Qwen3 30B
98.3k
Open
8*
--
109
2.17
25.14
18.38
Alibaba logo
Qwen3 30B A3B 2507 (non-reasoning)
262k
Open
8*
--
145
1.88
5.33
--
Alibaba logo
Qwen3 32B (non-reasoning)
131k
Open
7*
--
106
2.57
7.28
--
Alibaba logo
Qwen3 8B
98.3k
Open
7*
--
40
3.70
65.84
49.71
Alibaba logo
Qwen3 VL 8B
131k
Open
7*
--
116
2.29
6.60
--
Alibaba logo
Qwen3 14B (non-reasoning)
131k
Open
7*
--
59
2.69
11.11
--
Alibaba logo
Qwen3 30B (non-reasoning)
131k
Open
7*
--
108
2.18
6.81
--
Alibaba logo
Qwen2.5 Turbo
1M
Proprietary
6*
--
108
2.28
6.90
--
Alibaba logo
Qwen3 Omni 30B A3B
65.5k
Open
6*
--
96
1.89
7.10
--
Alibaba logo
Qwen3 8B (non-reasoning)
131k
Open
6*
--
42
3.65
15.48
--

Key definitions

Frequently Asked Questions

Common questions about Alibaba Cloud