This model is deprecated. We only continue performance benchmarking for the default 10k input token workload. Results for other workloads are historical and no longer updated.
Google has launched a newer model, Gemma 3n E4B. We suggest considering it instead.
For more information, see comparison of Gemma 3n E4B to other models and API provider benchmarks for Gemma 3n E4B.
Gemma 3n E4B Instruct Preview (May '25) Benchmarks y análisis de proveedores de API
Este análisis está pensado para ayudarte a elegir el mejor proveedor de API de Gemma 3n E4B Instruct Preview (May '25) para tu caso de uso.
Más rápido
Velocidad de salida
0 proveedores en total
Menor latencia
Tiempo hasta el primer token
0 proveedores en total
Menor precio
Precio combinado (por 1M de tokens)
0 proveedores en total
Actualmente no hay proveedores de API disponibles para Gemma 3n E4B (May).
Consulta la página del modelo Gemma 3n E4B Instruct Preview (May '25) para ver detalles del modelo y cómo se compara su inteligencia con otros modelos.
Aspectos destacados
Precios
Pricing: Cache Hit, Input, and Output
Pricing: Blended Price
Output Speed vs. Price
Velocidad
Medida por la velocidad de salida (tokens por segundo)
Output Speed: Gemma 3n E4B Instruct Preview (May '25)
Latency vs. Output Speed
Latencia
Medida por el tiempo (segundos) hasta el primer token
Tiempo hasta el primer token
Tiempo de respuesta de extremo a extremo
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
Tiempo de respuesta de extremo a extremo
Métricas clave de comparación y funciones de API
| No results. | |||||||||
Preguntas frecuentes
Preguntas comunes sobre los proveedores de Gemma 3n E4B Instruct Preview (May '25)
Gemma 3n E4B Instruct Preview (May '25) no está disponible actualmente a través de ningún proveedor de API que midamos. Como modelo de pesos abiertos, puede alojarse por cuenta propia.