Grok 4.7 vs. Gemini 3.8 Flash: comparación de lanzamientos
Comparación de los lanzamientos Grok 4.7 y Gemini 3.8 Flash: 3 y 3 modelos respectivamente, cada uno con distintas características de inteligencia, rendimiento y precio. A continuación se comparan las métricas clave de los 6 modelos.
- En inteligencia, Grok 4.7 obtiene la puntuación más alta: Grok 4.7 (Xhigh), con 46, frente a Gemini 3.8 Flash (High), con 41 de Gemini 3.8 Flash.
- En velocidad de salida, Gemini 3.8 Flash es el más rápido: Gemini 3.8 Flash (High), con 128 tokens/s, frente a Grok 4.7 (Xhigh), con 81 tokens/s de Grok 4.7.
- En costo por tarea, Gemini 3.8 Flash es el más económico: Gemini 3.8 Flash (Medium), con $0.93, frente a Grok 4.7 (Low), con $1.25 de Grok 4.7.
| Grok 4.7 (xhigh) | Grok 4.7 (high) | Grok 4.7 (low) | Gemini 3.8 Flash (high) | Gemini 3.8 Flash (medium) | Gemini 3.8 Flash (low) | |
|---|---|---|---|---|---|---|
| Intelligence Index | 46 | 46 | 42 | 41 | 40 | 33 |
| Finanzas y contabilidad | 52 | 52 | 48 | 47 | 45 | 39 |
| Estrategia y operaciones | 54 | 54 | 51 | 48 | 48 | 39 |
| Jurídico | 54 | 54 | 51 | 52 | 51 | 45 |
| Salud y medicina | 47 | -- | -- | 42 | -- | -- |
| Costo por tareaUSD | $3.74 | $2.73 | $1.25 | $1.24 | $0.93 | -- |
| Velocidad de salidaTokens/s | 81 | 73 | 72 | 128 | -- | -- |
| Tiempo hasta el primer tokens | 98,05 | 46,44 | 5,48 | 23,70 | -- | -- |
| Ventana de contexto | 500k | 500k | 500k | 1M | 1M | 1M |
| Creador | ||||||
| Licencia | Propietario | Propietario | Propietario | Propietario | Propietario | Propietario |
| Modalidad de entrada | Admite: texto e imágenes | Admite: texto e imágenes | Admite: texto e imágenes | Admite: texto, imágenes, voz y video | Admite: texto, imágenes, voz y video | Admite: texto, imágenes, voz y video |
| Modalidad de salida | Admite: texto | Admite: texto | Admite: texto | Admite: texto | Admite: texto | Admite: texto |
| Proveedores | ||||||
Inteligencia
Artificial Analysis Intelligence Index
Intelligence Index vs. costo por tarea del Intelligence Index
Costo por tarea (USD, escala logarítmica)
Costo
Costo por tarea del Intelligence Index
Velocidad y latencia
Velocidad de salida
Puntuaciones de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: GDPval-AA v2.1, AA-Briefcase v1.1, AA-Omniscience, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better