All Releases•

23 models

Z AI Models: Intelligence, Performance & Price

Artificial Analysis has benchmarked 23 models from Z AI. Below is a comparison of the key metrics across these models.

  • For intelligence, the top model from Z AI is GLM-5.3 (max) at 45.
  • For output speed, the fastest model is GLM-5.3 (max) at 91 t/s.
  • For latency, GLM-5.3 (max) at 24.65s offers the lowest time to first answer token.
  • For pricing, GLM 5.3 Flash at $0.25 offers the lowest cost per task. Prices vary up to 7.9x across models.

Intelligence

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1

Intelligence Index vs. Cost per Intelligence Index Task

Artificial Analysis Intelligence Index · Weighted average cost (USD) per Artificial Analysis Intelligence Index task
Most attractive quadrant
Pareto line

Cost

Cost per Intelligence Index Task

Weighted average cost (USD) per Artificial Analysis Intelligence Index task, segmented by token type. Lower is better

Speed & Latency

Output Speed

Output tokens per second · Higher is better

Capability Scores

Capability Indexes

Measures the performance of models on specific capabilities and industries
Finance & Accounting Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Strategy & Ops Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Legal Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better

Healthcare & Medical Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better

Engineering Index

Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better

Economics Index

Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better

All Z AI Releases

Further details

Weights
Provider Benchmarks
GLM-5.3 (max)
Z AI logoZ AI
45
753B
40B active at inference time
1M
$0.9
91
ModalZaiFireworks
+17
GLM 5.3 Flash
Z AI logoZ AI
42
320B
18B active at inference time
1M
$0.1
54
ModalZaiBaseten
+16
GLM-5.3 (low)
Z AI logoZ AI
34
753B
40B active at inference time
1M
$0.9
86
Zai
GLM-5.2 (max)
Z AI logoZ AI
34
753B
40B active at inference time
1M
$0.9
84
FriendliAIBasetenNovita
+15
GLM-5 (Reasoning)
Z AI logoZ AI
28
744B
40B active at inference time
200k
$0.7
85
DeepInfraSiliconFlowFireworks
+3
GLM-5-Turbo
Z AI logoZ AI
27
-
200k
-
-
Not available
-
GLM-5.1 (Reasoning)
Z AI logoZ AI
26
744B
40B active at inference time
200k
$0.8
77
GMIDeepInfraNovita
+3
GLM-5.1 (Non-reasoning)
Z AI logoZ AI
24
744B
40B active at inference time
200k
$0.9
71
DeepInfraNovitaFriendliAI
+2
GLM 5V Turbo (Reasoning)
Z AI logoZ AI
23
-
200k
-
-
Not available
-
GLM-5.2 (Non-reasoning)
Z AI logoZ AI
22
753B
40B active at inference time
1M
$0.9
172
BasetenNebiusScaleway
+4
GLM-4.7 (Reasoning)
Z AI logoZ AI
22
357B
32B active at inference time
200k
$0.7
100
NovitaBasetenDeepInfra
+3
GLM-5 (Non-reasoning)
Z AI logoZ AI
22
744B
40B active at inference time
200k
$0.7
79
NovitaFireworksSiliconFlowDeepInfra
GLM-4.6 (Reasoning)
Z AI logoZ AI
19
357B
32B active at inference time
200k
$0.4
36
DeepInfraTogether AINovita
GLM-4.7 (Non-reasoning)
Z AI logoZ AI
17
357B
32B active at inference time
200k
$0.5
98
NovitaBasetenAmazon Bedrock
+3
GLM-4.6 (Non-reasoning)
Z AI logoZ AI
15
357B
32B active at inference time
200k
$0.6
36
Together AINovita
GLM-4.7-Flash (Reasoning)
Z AI logoZ AI
15
31.2B
3B active at inference time
200k
$0.1
73
NovitaDeepInfraAmazon Bedrock
GLM-4.5 (Reasoning)
Z AI logoZ AI
13
355B
32B active at inference time
128k
-
-
-
GLM-4.6V (Reasoning)
Z AI logoZ AI
11
108B
12B active at inference time
128k
$0.3
82
NovitaSiliconFlow
GLM-4.5-Air
Z AI logoZ AI
11
106B
12B active at inference time
128k
$0.3
74
Together AISiliconFlow
GLM-4.7-Flash (Non-reasoning)
Z AI logoZ AI
11
31.2B
3B active at inference time
200k
$0.1
104
Amazon BedrockNovita
GLM-4.6V (Non-reasoning)
Z AI logoZ AI
8
108B
12B active at inference time
128k
$0.3
79
SiliconFlowNovita
GLM-4.5V (Reasoning)
Z AI logoZ AI
8
108B
12B active at inference time
64k
$0.4
46
Novita
GLM-4.5V (Non-reasoning)
Z AI logoZ AI
7
108B
12B active at inference time
64k
$0.4
46
Novita