Grok 4.7 vs. gpt-oss-20b: comparación de lanzamientos
Comparación de los lanzamientos Grok 4.7 y gpt-oss-20b: 3 y 2 modelos respectivamente, cada uno con distintas características de inteligencia, rendimiento y precio. A continuación se comparan las métricas clave de los 5 modelos.
- En inteligencia, Grok 4.7 obtiene la puntuación más alta: Grok 4.7 (Xhigh), con 46, frente a gpt-oss-20b (Low), con 10 de gpt-oss-20b.
- En velocidad de salida, gpt-oss-20b es el más rápido: gpt-oss-20b (Low), con 279 tokens/s, frente a Grok 4.7 (Xhigh), con 83 tokens/s de Grok 4.7.
- En costo por tarea, gpt-oss-20b es el más económico: gpt-oss-20b (High), con $0.01, frente a Grok 4.7 (Low), con $1.25 de Grok 4.7.
| Grok 4.7 (xhigh) | Grok 4.7 (high) | Grok 4.7 (low) | gpt-oss-20b (low) | gpt-oss-20b (high) | |
|---|---|---|---|---|---|
| Intelligence Index | 46 | 46 | 42 | 10* | 9 |
| Finanzas y contabilidad | 52 | 52 | 48 | -- | 7 |
| Estrategia y operaciones | 54 | 54 | 51 | -- | 5 |
| Jurídico | 54 | 54 | 51 | -- | 7 |
| Salud y medicina | 47 | -- | -- | -- | 7 |
| Costo por tareaUSD | $3.74 | $2.73 | $1.25 | -- | $0.01 |
| Velocidad de salidaTokens/s | 83 | 79 | 77 | 279 | 222 |
| Tiempo hasta el primer tokens | 88,14 | 46,44 | 5,93 | 0,75 | 0,69 |
| Ventana de contexto | 500k | 500k | 500k | 131k | 131k |
| Creador | |||||
| Licencia | Propietario | Propietario | Propietario | Abierto | Abierto |
| Modalidad de entrada | Admite: texto e imágenes | Admite: texto e imágenes | Admite: texto e imágenes | Admite: texto | Admite: texto |
| Modalidad de salida | Admite: texto | Admite: texto | Admite: texto | Admite: texto | Admite: texto |
| Proveedores | |||||
* Estimado
Inteligencia
Artificial Analysis Intelligence Index
Intelligence Index vs. costo por tarea del Intelligence Index
Costo por tarea (USD, escala logarítmica)
Costo
Costo por tarea del Intelligence Index
Velocidad y latencia
Velocidad de salida
Puntuaciones de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: GDPval-AA v2.1, AA-Briefcase v1.1, AA-Omniscience, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better