所有发布•

23 个模型

Z AI 模型:智能、性能与价格

Artificial Analysis 已对 Z AI 的 23 个模型进行基准测试。下方对这些模型的关键指标进行了比较。

  • 智能方面,Z AI 得分最高的模型是 GLM-5.3 (max)(45)。
  • 输出速度方面,最快的模型是 GLM-5.3 (max)(91 token/秒)。
  • 延迟方面,GLM-5.3 (max)(24.65 秒) 的首个答案 token 等待时间最短。
  • 价格方面,GLM 5.3 Flash($0.25) 的单任务成本最低。不同模型的价格差异最高可达 7.9 倍。

智能

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1

Intelligence Index vs. Cost per Intelligence Index Task

Artificial Analysis Intelligence Index · Weighted average cost (USD) per Artificial Analysis Intelligence Index task
Most attractive quadrant
Pareto line

成本

Cost per Intelligence Index Task

Weighted average cost (USD) per Artificial Analysis Intelligence Index task, segmented by token type. Lower is better

速度与延迟

Output Speed

Output tokens per second · Higher is better

能力得分

能力指数

衡量模型在特定能力与行业中的表现
Finance & Accounting Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Strategy & Ops Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Legal Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better

Healthcare & Medical Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better

Engineering Index

Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better

Economics Index

Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better

Z AI 的所有发布

更多详情

权重
服务商基准测试
GLM-5.3 (max)
Z AI 标志Z AI
45
753B
推理时启用 40B 个参数
1M
US$0.9
91
ModalZaiFireworks
+17
GLM 5.3 Flash
Z AI 标志Z AI
42
320B
推理时启用 18B 个参数
1M
US$0.1
54
ModalZaiBaseten
+16
GLM-5.3 (low)
Z AI 标志Z AI
34
753B
推理时启用 40B 个参数
1M
US$0.9
86
Zai
GLM-5.2 (max)
Z AI 标志Z AI
34
753B
推理时启用 40B 个参数
1M
US$0.9
84
FriendliAIBasetenNovita
+15
GLM-5 (Reasoning)
Z AI 标志Z AI
28
744B
推理时启用 40B 个参数
200k
US$0.7
85
DeepInfraSiliconFlowFireworks
+3
GLM-5-Turbo
Z AI 标志Z AI
27
-
200k
-
-
不可用
-
GLM-5.1 (Reasoning)
Z AI 标志Z AI
26
744B
推理时启用 40B 个参数
200k
US$0.8
77
GMIDeepInfraNovita
+3
GLM-5.1 (Non-reasoning)
Z AI 标志Z AI
24
744B
推理时启用 40B 个参数
200k
US$0.9
71
DeepInfraNovitaFriendliAI
+2
GLM 5V Turbo (Reasoning)
Z AI 标志Z AI
23
-
200k
-
-
不可用
-
GLM-5.2 (Non-reasoning)
Z AI 标志Z AI
22
753B
推理时启用 40B 个参数
1M
US$0.9
172
BasetenNebiusScaleway
+4
GLM-4.7 (Reasoning)
Z AI 标志Z AI
22
357B
推理时启用 32B 个参数
200k
US$0.7
100
NovitaBasetenDeepInfra
+3
GLM-5 (Non-reasoning)
Z AI 标志Z AI
22
744B
推理时启用 40B 个参数
200k
US$0.7
79
NovitaFireworksSiliconFlowDeepInfra
GLM-4.6 (Reasoning)
Z AI 标志Z AI
19
357B
推理时启用 32B 个参数
200k
US$0.4
36
DeepInfraTogether AINovita
GLM-4.7 (Non-reasoning)
Z AI 标志Z AI
17
357B
推理时启用 32B 个参数
200k
US$0.5
98
NovitaBasetenAmazon Bedrock
+3
GLM-4.6 (Non-reasoning)
Z AI 标志Z AI
15
357B
推理时启用 32B 个参数
200k
US$0.6
36
Together AINovita
GLM-4.7-Flash (Reasoning)
Z AI 标志Z AI
15
31.2B
推理时启用 3B 个参数
200k
US$0.1
73
NovitaDeepInfraAmazon Bedrock
GLM-4.5 (Reasoning)
Z AI 标志Z AI
13
355B
推理时启用 32B 个参数
128k
-
-
-
GLM-4.6V (Reasoning)
Z AI 标志Z AI
11
108B
推理时启用 12B 个参数
128k
US$0.3
82
NovitaSiliconFlow
GLM-4.5-Air
Z AI 标志Z AI
11
106B
推理时启用 12B 个参数
128k
US$0.3
74
Together AISiliconFlow
GLM-4.7-Flash (Non-reasoning)
Z AI 标志Z AI
11
31.2B
推理时启用 3B 个参数
200k
US$0.1
104
Amazon BedrockNovita
GLM-4.6V (Non-reasoning)
Z AI 标志Z AI
8
108B
推理时启用 12B 个参数
128k
US$0.3
79
SiliconFlowNovita
GLM-4.5V (Reasoning)
Z AI 标志Z AI
8
108B
推理时启用 12B 个参数
64k
US$0.4
46
Novita
GLM-4.5V (Non-reasoning)
Z AI 标志Z AI
7
108B
推理时启用 12B 个参数
64k
US$0.4
46
Novita