Modelos de Z AI: inteligência, desempenho e preço
Velocidade de saída
A Artificial Analysis avaliou 23 modelos de Z AI. Abaixo, comparamos as principais métricas desses modelos.
- Em inteligência, o principal modelo de Z AI é GLM-5.3 (max), com 45.
- Em velocidade de saída, o modelo mais rápido é GLM-5.3 (max), com 91 tokens/s.
- Em latência, GLM-5.3 (max), com 24,65 s oferece o menor tempo até o primeiro token de resposta.
- Em termos de preço, GLM 5.3 Flash, com $0.25 oferece o menor custo por tarefa. Os preços variam em até 7,9 vezes entre os modelos.
Inteligência
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Custo
Cost per Intelligence Index Task
Velocidade e latência
Output Speed
Pontuações de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Todos os lançamentos de Z AI
GLM 5.3 Flash
1 modelo
42
Maior inteligência
GLM-5.3
2 modelos
45
Maior inteligência
GLM-5.2
2 modelos
34
Maior inteligência
GLM-5.1
2 modelos
26
Maior inteligência
GLM 5V Turbo
1 modelo
23
Maior inteligência
GLM-5-Turbo
1 modelo
27
Maior inteligência
GLM-5
2 modelos
28
Maior inteligência
GLM-4.7-Flash
2 modelos
15
Maior inteligência
GLM-4.7
2 modelos
22
Maior inteligência
GLM-4.6V
2 modelos
11
Maior inteligência
GLM-4.6
2 modelos
19
Maior inteligência
GLM-4.5V
2 modelos
8
Maior inteligência
GLM-4.5
1 modelo
13
Maior inteligência
GLM-4.5-Air
1 modelo
11
Maior inteligência
Mais detalhes
Pesos | Benchmarks de provedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| GLM-5.3 (max) | 45 | 753B 40B ativos durante a inferência | 1M | US$ 0,9 | 91 | +17 | |||
| GLM 5.3 Flash | 42 | 320B 18B ativos durante a inferência | 1M | US$ 0,1 | 54 | +16 | |||
| GLM-5.3 (low) | 34 | 753B 40B ativos durante a inferência | 1M | US$ 0,9 | 86 | ||||
| GLM-5.2 (max) | 34 | 753B 40B ativos durante a inferência | 1M | US$ 0,9 | 84 | +15 | |||
| GLM-5 (Reasoning) | 28 | 744B 40B ativos durante a inferência | 200k | US$ 0,7 | 85 | +3 | |||
| GLM-5-Turbo | 27 | - | 200k | - | - | Não disponível | - | ||
| GLM-5.1 (Reasoning) | 26 | 744B 40B ativos durante a inferência | 200k | US$ 0,8 | 77 | +3 | |||
| GLM-5.1 (Non-reasoning) | 24 | 744B 40B ativos durante a inferência | 200k | US$ 0,9 | 71 | +2 | |||
| GLM 5V Turbo (Reasoning) | 23 | - | 200k | - | - | Não disponível | - | ||
| GLM-5.2 (Non-reasoning) | 22 | 753B 40B ativos durante a inferência | 1M | US$ 0,9 | 172 | +4 | |||
| GLM-4.7 (Reasoning) | 22 | 357B 32B ativos durante a inferência | 200k | US$ 0,7 | 100 | +3 | |||
| GLM-5 (Non-reasoning) | 22 | 744B 40B ativos durante a inferência | 200k | US$ 0,7 | 79 | ||||
| GLM-4.6 (Reasoning) | 19 | 357B 32B ativos durante a inferência | 200k | US$ 0,4 | 36 | ||||
| GLM-4.7 (Non-reasoning) | 17 | 357B 32B ativos durante a inferência | 200k | US$ 0,5 | 98 | +3 | |||
| GLM-4.6 (Non-reasoning) | 15 | 357B 32B ativos durante a inferência | 200k | US$ 0,6 | 36 | ||||
| GLM-4.7-Flash (Reasoning) | 15 | 31.2B 3B ativos durante a inferência | 200k | US$ 0,1 | 73 | ||||
| GLM-4.5 (Reasoning) | 13 | 355B 32B ativos durante a inferência | 128k | - | - | - | |||
| GLM-4.6V (Reasoning) | 11 | 108B 12B ativos durante a inferência | 128k | US$ 0,3 | 82 | ||||
| GLM-4.5-Air | 11 | 106B 12B ativos durante a inferência | 128k | US$ 0,3 | 74 | ||||
| GLM-4.7-Flash (Non-reasoning) | 11 | 31.2B 3B ativos durante a inferência | 200k | US$ 0,1 | 104 | ||||
| GLM-4.6V (Non-reasoning) | 8 | 108B 12B ativos durante a inferência | 128k | US$ 0,3 | 79 | ||||
| GLM-4.5V (Reasoning) | 8 | 108B 12B ativos durante a inferência | 64k | US$ 0,4 | 46 | ||||
| GLM-4.5V (Non-reasoning) | 7 | 108B 12B ativos durante a inferência | 64k | US$ 0,4 | 46 |