GLM-5.3 vs. Hermes 4 - Llama-3.1 405B: comparación de lanzamientos
Comparación de los lanzamientos GLM-5.3 y Hermes 4 - Llama-3.1 405B: 2 y 2 modelos respectivamente, cada uno con distintas características de inteligencia, rendimiento y precio. A continuación se comparan las métricas clave de los 4 modelos.
- En inteligencia, GLM-5.3 obtiene la puntuación más alta: GLM-5.3 (max), con 45, frente a Hermes 4 - Llama-3.1 405B (Reasoning), con 7 de Hermes 4 - Llama-3.1 405B.
- En velocidad de salida, GLM-5.3 es el más rápido: GLM-5.3 (low), con 74 tokens/s, frente a Hermes 4 - Llama-3.1 405B (Non-reasoning), con 42 tokens/s de Hermes 4 - Llama-3.1 405B.
Inteligencia
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Cost per Task (USD, Log Scale)
Costo
Cost per Intelligence Index Task
Velocidad y latencia
Output Speed
Puntuaciones de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Más detalles
Modalidad de entrada | Modalidad de salida | Pesos | Benchmarks de proveedores | ||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| GLM-5.3 (max) | 45 | 45 | 48 | 42 | 47 | 47 | 51 | $2.01 | 0,9 US$ | $1.40 | $4.40 | $0.26 | 2503 US$ | 71k | 49k | 209M | 60 | 3.57s | 36.89s | 45.22s | 865.63s | 753B 40B activos en inferencia | 1M | ago 2026 | - | Sí | Admite: texto | Admite: texto | +17 | ||||
| GLM-5.3 (low) | 34 | 35 | 39 | 33 | - | 38 | 41 | $3.66 | 1,7 US$ | $1.40 | $4.40 | - | 3294 US$ | 30k | 21k | 88M | 74 | 3.00s | 30.18s | 36.97s | 404.33s | 753B 40B activos en inferencia | 1M | ago 2026 | - | Sí | Admite: texto | Admite: texto | |||||
| Hermes 4 - Llama-3.1 405B (Reasoning) | 7 | - | - | - | - | - | - | - | 1,2 US$ | $1.00 | $3.00 | - | - | - | - | - | 42 | 2.38s | 50.56s | 62.60s | - | 406B | 128k | ago 2025 | - | Sí | Admite: texto | Admite: texto | |||||
| Hermes 4 - Llama-3.1 405B (Non-reasoning) | 7 | - | - | - | - | - | - | - | 1,2 US$ | $1.00 | $3.00 | - | - | - | - | - | 42 | 2.40s | 2.40s | 14.42s | - | 406B | 128k | ago 2025 | - | No | Admite: texto | Admite: texto | |||||