Claude Haiku 5.5 vs. Mistral Small 4: comparación de lanzamientos
Comparación de los lanzamientos Claude Haiku 5.5 y Mistral Small 4: 5 y 2 modelos respectivamente, cada uno con distintas características de inteligencia, rendimiento y precio. A continuación se comparan las métricas clave de los 7 modelos.
- En inteligencia, Claude Haiku 5.5 obtiene la puntuación más alta: Claude Haiku 5.5 (Max, Default Fallback), con 43, frente a Mistral Small 4 (Reasoning), con 11 de Mistral Small 4.
- En velocidad de salida, Claude Haiku 5.5 es el más rápido: Claude Haiku 5.5 (Max, Default Fallback), con 243 tokens/s, frente a Mistral Small 4 (Reasoning), con 160 tokens/s de Mistral Small 4.
- En costo por tarea, Claude Haiku 5.5 y Mistral Small 4 empatan en $0.02 (Claude Haiku 5.5 (Low, Default Fallback) y Mistral Small 4 (Reasoning)).
| Claude Haiku 5.5 (max with fallback) | Claude Haiku 5.5 (xhigh with fallback) | Claude Haiku 5.5 (high with fallback) | Claude Haiku 5.5 (medium with fallback) | Claude Haiku 5.5 (low with fallback) | Mistral Small 4 | Mistral Small 4 (non-reasoning) | |
|---|---|---|---|---|---|---|---|
| Índice de Inteligencia | 43 | 41 | 38 | 34 | 29 | 11 | 9* |
| Finanzas y contabilidad | 44 | 41 | 38 | 35 | 29 | 10 | -- |
| Estrategia y operaciones | 40 | 39 | 37 | 34 | 28 | 7 | -- |
| Jurídico | 42 | 40 | 38 | 36 | 31 | 13 | -- |
| Salud y medicina | -- | -- | -- | -- | -- | -- | -- |
| Costo por tareaUSD | $0.21 | $0.12 | $0.08 | $0.05 | $0.02 | $0.02 | -- |
| Velocidad de salidaTokens/s | 243 | 188 | 137 | 137 | 181 | 160 | 159 |
| Tiempo hasta el primer tokens | 415,30 | 87,15 | 26,15 | 12,63 | 6,28 | 0,72 | 0,73 |
| Ventana de contexto | 1M | 1M | 1M | 1M | 1M | 256k | 256k |
| Creador | |||||||
| Licencia | Propietario | Propietario | Propietario | Propietario | Propietario | Abierto | Abierto |
| Modalidad de entrada | Admite: texto e imágenes | Admite: texto e imágenes | Admite: texto e imágenes | Admite: texto e imágenes | Admite: texto e imágenes | Admite: texto e imágenes | Admite: texto e imágenes |
| Modalidad de salida | Admite: texto | Admite: texto | Admite: texto | Admite: texto | Admite: texto | Admite: texto | Admite: texto |
| Proveedores | |||||||
* Estimado
Inteligencia
Índice de inteligencia de Artificial Analysis
Índice de Inteligencia vs. costo por tarea del Índice de Inteligencia
Costo por tarea (USD, escala logarítmica)
Costo
Costo por tarea del Índice de Inteligencia
Velocidad y latencia
Velocidad de salida
Puntuaciones de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better