GLM-5: inteligência, desempenho e preço do lançamento
O lançamento GLM-5 oferece 2 modelos, cada um com diferentes características de inteligência, desempenho e preço. Abaixo, comparamos as principais métricas dos 2 modelos.
- Em inteligência, o principal modelo do GLM-5 é GLM-5 (Reasoning), com 28.
- Em velocidade de saída, o modelo mais rápido é GLM-5 (Reasoning), com 78 tokens/s.
- Em latência, GLM-5 (Non-reasoning), com 1,56 s oferece o menor tempo até o primeiro token de resposta.
| Modalidade de entrada | Compatível com: texto |
|---|---|
| Modalidade de saída | Compatível com: texto |
| Janela de contexto | 200k ~300 páginas A4 em fonte Arial tamanho 12 |
| Parâmetros totais | 744B |
| Parâmetros ativos | 40B Número de parâmetros ativos por token durante a inferência |
| Licença | MIT |
| Pesos do modelo | Hugging Face |
Inteligência
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Custo
Cost per Intelligence Index Task
Velocidade e latência
Output Speed
Pontuações de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2, AA-Briefcase, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2, AA-Briefcase, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2, AA-Briefcase, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2, AA-Briefcase, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2, AA-Briefcase, Terminal-Bench v4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2, AA-Briefcase, AA-LCR v1.1 · Higher is better
Mais lançamentos de Z AI
Mais detalhes
Pesos | Benchmarks de provedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| GLM-5 (Reasoning) | 28 | 744B 40B ativos durante a inferência | 200k | US$ 0,7 | 78 | +3 | |||
| GLM-5 (Non-reasoning) | 22 | 744B 40B ativos durante a inferência | 200k | US$ 0,7 | 65 |