This model is deprecated. We only continue performance benchmarking for the default 10k input token workload. Results for other workloads are historical and no longer updated.
Sarvam has launched a newer model, Sarvam 30B (high). We suggest considering it instead.
For more information, see comparison of Sarvam 30B (high) to other models and API provider benchmarks for Sarvam 30B (high).
Sarvam M (Reasoning, based on Mistral Small 3.1) Benchmarks y análisis de proveedores de API
Este análisis está pensado para ayudarte a elegir el mejor proveedor de API de Sarvam M (Reasoning, based on Mistral Small 3.1) para tu caso de uso.
Más rápido
Velocidad de salida
1 proveedor en total
Menor latencia
Tiempo hasta el primer token de respuesta
1 proveedor en total
Menor precio
Precio combinado (por 1M de tokens)
1 proveedor en total
Sarvam M está disponible a través de Sarvam.
Consulta la página del modelo Sarvam M (Reasoning, based on Mistral Small 3.1) para ver detalles del modelo y cómo se compara su inteligencia con otros modelos.
Aspectos destacados
Precios
Pricing: Cache Hit, Input, and Output
Pricing: Blended Price
Output Speed vs. Price
Velocidad
Medida por la velocidad de salida (tokens por segundo)
Output Speed: Sarvam M (Reasoning, based on Mistral Small 3.1)
Latency vs. Output Speed
Latencia
Medida por el tiempo (segundos) hasta el primer token
Tiempo hasta el primer token de respuesta
Tiempo de respuesta de extremo a extremo
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
Tiempo de respuesta de extremo a extremo
Métricas clave de comparación y funciones de API
8.19k | Abierto | -- | -- | -- | -- | -- | |||
Preguntas frecuentes
Preguntas comunes sobre los proveedores de Sarvam M (Reasoning, based on Mistral Small 3.1)
Sarvam M (Reasoning, based on Mistral Small 3.1) está disponible a través de 1 proveedor de API: Sarvam. Cada proveedor ofrece distintas características de rendimiento y precios.
Sarvam M (Reasoning, based on Mistral Small 3.1) está disponible actualmente a través de 1 proveedor de API que medimos y monitoreamos.
El proveedor más económico para Sarvam M (Reasoning, based on Mistral Small 3.1) por precio combinado es Sarvam ($0.00 por 1M de tokens). El precio combinado usa una proporción 7:2:1 de aciertos de caché/entrada/salida.
El proveedor con el menor precio de tokens de entrada para Sarvam M (Reasoning, based on Mistral Small 3.1) es Sarvam ($0.00 por 1M de tokens de entrada).
El proveedor con el menor precio de tokens de salida para Sarvam M (Reasoning, based on Mistral Small 3.1) es Sarvam ($0.00 por 1M de tokens de salida).
El único proveedor de Sarvam M (Reasoning, based on Mistral Small 3.1) admite el modo JSON para salida estructurada.
Al elegir un proveedor para Sarvam M (Reasoning, based on Mistral Small 3.1), considera: velocidad de salida (para tareas intensivas en rendimiento), latencia (para aplicaciones interactivas que requieren primeras respuestas rápidas), precios (para cargas de trabajo sensibles al costo) y funciones de API como el modo JSON o las llamadas a funciones.
Sí, el rendimiento de un proveedor puede variar con el tiempo debido a cambios de infraestructura, balanceo de carga y actualizaciones. Medimos continuamente a todos los proveedores y mostramos las tendencias históricas de rendimiento en los gráficos "a lo largo del tiempo".
Para información sobre la inteligencia, las capacidades, las modalidades de Sarvam M (Reasoning, based on Mistral Small 3.1) y cómo se compara con otros modelos, consulta la página de resumen del modelo. Ver resumen del modelo