Modelos de Microsoft: inteligencia, rendimiento y precio
Índice de inteligencia de Artificial Analysis
* Estimado
Artificial Analysis ha evaluado 4 modelos de Microsoft. A continuación se comparan las métricas clave de estos modelos.
- En inteligencia, el modelo líder de Microsoft es Phi-4 Mini Instruct, con 6 (estimado).
- En velocidad de salida, el modelo más rápido es Phi-4 Mini Instruct, con 45 tokens/s.
- En latencia, Phi-4 Multimodal Instruct, con 0,79 s ofrece el menor tiempo hasta el primer token de respuesta.
Inteligencia
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Costo
Cost per Intelligence Index Task
Velocidad y latencia
Output Speed
Puntuaciones de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Todos los lanzamientos de Microsoft
Más detalles
Pesos | Benchmarks de proveedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Phi-4 Mini Instruct | 6 | 3.8B | 128k | 0,0 US$ | 45 | ||||
| Phi-4 | 6 | 14B | 16k | 0,2 US$ | 40 | ||||
| Phi-3 Mini Instruct 3.8B | 6 | 3.8B | 4k | - | - | - | |||
| Phi-4 Multimodal Instruct | 6 | 5.6B | 128k | 0,0 US$ | 17 |