PrimaLabs: inteligencia, rendimiento y precio de sus modelos

PrimaLabs
PrimaLabs

Este análisis está pensado para ayudarte a elegir el mejor modelo ofrecido por PrimaLabs para tu caso de uso.

Más inteligente

Updated
#1
MiMo-V2.6-ProMiMo-V2.6-Pro
46
#2
GLM-5.3-FlashGLM-5.3-Flash
42
#3
DeepSeek V4 Flash 0731 (max)DeepSeek V4 Flash 0731 (max)
34

Índice de inteligencia

3 modelos en total

Más rápido

#1
DeepSeek V4 Flash 0731 (max)DeepSeek V4 Flash 0731 (max)
333 t/s
#2
GLM-5.3-FlashGLM-5.3-Flash
276 t/s
#3
MiMo-V2.6-ProMiMo-V2.6-Pro
226 t/s

Velocidad de salida

3 modelos en total

Menor precio

#1
DeepSeek V4 Flash 0731 (max)DeepSeek V4 Flash 0731 (max)
$0.06
#2
GLM-5.3-FlashGLM-5.3-Flash
$0.10
#3
MiMo-V2.6-ProMiMo-V2.6-Pro
$0.18

Precio combinado (por 1M de tokens)

3 modelos en total

PrimaLabs ofrece 3 modelos, cada uno con distintas características de inteligencia, rendimiento y precio. A continuación se comparan las métricas clave entre modelos.

  • En inteligencia, los mejores modelos en PrimaLabs son MiMo-V2.6-Pro (46), GLM-5.3-Flash (42) y DeepSeek V4 Flash 0731 (max) (34).
  • En velocidad de salida, los modelos más rápidos son DeepSeek V4 Flash 0731 (max) (333 t/s), GLM-5.3-Flash (276 t/s) y MiMo-V2.6-Pro (226 t/s).
  • En latencia, DeepSeek V4 Flash 0731 (max) (6.61s), GLM-5.3-Flash (8.26s) y MiMo-V2.6-Pro (9.60s) ofrecen el menor tiempo hasta el primer token de respuesta.
  • En precios, DeepSeek V4 Flash 0731 (max) ($0.06), GLM-5.3-Flash ($0.10) y MiMo-V2.6-Pro ($0.18) ofrecen los menores precios combinados por 1M de tokens.
  • En tamaño de ventana de contexto, MiMo-V2.6-Pro (1M), GLM-5.3-Flash (1M) y DeepSeek V4 Flash 0731 (max) (1M) admiten las ventanas de contexto más grandes en PrimaLabs.
  • DeepSeek V4 Flash 0731 (max) ofrece la salida más rápida y los mejores precios, lo que lo hace atractivo para aplicaciones sensibles al rendimiento y al costo. MiMo-V2.6-Pro lidera en inteligencia para tareas que requieren la máxima calidad.
Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Evaluaciones de inteligencia

Índice de inteligencia de Artificial Analysis

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
Ver más

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

No data available

Agentic business operations

Agentic scientific research workflows in a terminal

Quantitative analysis on spreadsheets & documents

No data available

Kubernetes incident root-cause analysis

Visual reasoning

No data available

Medical long context reasoning

Índice de inteligencia vs. precio

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Ventana de contexto

Ventana de contexto

Context window: tokens limit · Higher is better

Precios

Índice de inteligencia vs. precio

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Resumen de rendimiento

Velocidad de salida vs. precio

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant

Velocidad

Medida por la velocidad de salida (tokens por segundo)

Velocidad de salida

Output tokens per second · Higher is better

Latencia

Medida por el tiempo (segundos) hasta el primer token

Latencia: Tiempo hasta el primer token de respuesta

Segundos hasta recibir el primer token de respuesta · Incluye el tiempo de «pensamiento» de los modelos de razonamiento

Comportamiento de caché

Tasa de aciertos de caché

Proporción de tokens de entrada aptos para caché servidos desde la caché · Mediana de las últimas cuatro semanas, actualizada el 26 sept 2026

Costo por tarea vs. Tasa de aciertos de caché

Weighted average cost (USD) per Intelligence Index task · Cache hit rate: median of the last four weeks, updated Sep 26, 2026
Most attractive quadrant
Pareto line

Tiempo de respuesta de extremo a extremo

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

Tiempo de respuesta de extremo a extremo vs. precio

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant

Análisis adicional
Logo de Xiaomi
MiMo-V2.6-Pro
1.05M
Abierto
46
$0.14
226
0.75
11.81
8.84
Logo de Z AI
GLM-5.3-Flash
1.05M
Abierto
42
$0.44
277
1.01
10.04
7.22
Logo de DeepSeek
DeepSeek V4 Flash 0731 (max)
1.05M
Abierto
34
$0.06
333
0.58
8.09
6.01

Definiciones clave

Preguntas frecuentes

Preguntas comunes sobre PrimaLabs