DeepSeek V4.1 Flash (Max) vs. DeepSeek V4 Pro 0813 (Max)
Comparación entre DeepSeek V4.1 Flash (Max) y DeepSeek V4 Pro 0813 (Max) según inteligencia, precio, velocidad, ventana de contexto y más.
Para más detalles sobre nuestra metodología, consulta la página de metodología.
| Inteligencia | |||
|---|---|---|---|
| Índice de Inteligencia | 39 | 36 | |
| AA-Briefcase v1.1 | 1421 | 1256 | |
| GDPval-AA v2.1 | 1600 | 1455 | |
| AutomationBench-AA | 69% | 57% | |
| Terminal-Bench 4.0 | 27% | 14% | |
| SciCode | 52% | 51% | |
| Humanity's Last Exam | 39% | 41% | |
| GDP.pdf | 13% | 11% | |
| CritPt | 14% | 18% | |
| AA-Omniscience | −5 | 1 | |
| AA-LCR v1.1 | 84% | 80% | |
| Costo | |||
| Precio por millón de tokens | $0.1842 | $0.6908 | |
| Precio de entrada por 1M de tokens | $0.30 | $1.32 | |
| Precio de salida por 1M de tokens | $1.20 | $3.96 | |
| Precio de acierto de caché por 1M de tokens | $0.006 | $0.044 | |
| Costo por tarea | $0.27 | $0.67 | |
| Costo de ejecutar el Intelligence Index | 477 US$ | 1122 US$ | |
| Uso de tokens | |||
| Tokens de salida por tarea | 89k | 55k | |
| Tokens de razonamiento por tarea | 63k | 38k | |
| Tokens de salida para ejecutar el Intelligence Index | 253M | 163M | |
| Rendimiento | |||
| Velocidad de salida | 224 tokens/s | 109 tokens/s | |
| Tiempo hasta el primer token | 1.02s | 1.75s | |
| Tiempo hasta el primer token de respuesta | 9.97s | 20.08s | |
| Tiempo de respuesta de extremo a extremo | 12.21s | 24.66s | |
| Tiempo por tarea | 301.90s | 429.77s | |
| Especificaciones técnicas | |||
| Ventana de contexto | 1000k tokens~1500 páginas A4 con fuente Arial de tamaño 12 | 1000k tokens~1500 páginas A4 con fuente Arial de tamaño 12 | |
| Fecha de lanzamiento | septiembre de 2026 | agosto de 2026 | |
| Parámetros totales | 552B | 1.6T | |
| Parámetros activos | 16B | 49B | |
| Razonamiento | Sí | Sí | |
| Modalidad de entrada | Admite: texto e imágenes | Admite: texto | |
| Modalidad de salida | Admite: texto | Admite: texto | |
| Pesos abiertos | |||
| Licencia | |||
| La licencia permite el uso comercial sin restricciones | Sí | Sí | |
Aspectos destacados
InteligenciaUpdated
Índice de inteligencia de Artificial Analysis
Índice de Inteligencia de Artificial Analysis: pesos abiertos vs. propietarios
Miden el rendimiento de modelos en capacidades e industrias específicas
Artificial Analysis Índice de finanzas y contabilidad
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Agentic scientific research workflows in a terminal
Quantitative analysis on spreadsheets & documents
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
AA-Briefcase v1.1Updated
Elo de AA-Briefcase
AA-Omniscience
Índice AA-Omniscience
Índice de apertura
Artificial Analysis Openness Index: puntuación
Comparaciones del Índice de Inteligencia
Índice de Inteligencia vs. costo por tarea del Índice de Inteligencia
Costo por tarea (USD, escala logarítmica)
Uso de tokens
Tokens de salida por tarea del Índice de Inteligencia
Costo
Costo por tarea del Índice de Inteligencia
Costo de ejecutar el Índice de Inteligencia de Artificial Analysis
Precios: aciertos de caché, entrada y salida
Ventana de contexto
Ventana de contexto
Velocidad
Medida por la velocidad de salida (tokens por segundo)
Velocidad de salida
Tiempo por tarea del Índice de Inteligencia
Latencia
Medida por el tiempo (segundos) hasta el primer token
Latencia: Tiempo hasta el primer token de respuesta
Tiempo de respuesta de extremo a extremo
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
Tiempo de respuesta de extremo a extremo
Tamaño del modelo (solo modelos de pesos abiertos)
Tamaño del modelo: parámetros totales y activos
Preguntas frecuentes
DeepSeek V4.1 Flash (Max) es más inteligente. DeepSeek V4.1 Flash (Max) obtiene 39, frente a los 36 de DeepSeek V4 Pro 0813 (Max) en el Índice de Inteligencia de Artificial Analysis.
DeepSeek V4.1 Flash (Max) es más rápido. DeepSeek V4.1 Flash (Max) genera 223.5 tokens por segundo, frente a los 109.2 tokens por segundo de DeepSeek V4 Pro 0813 (Max).
DeepSeek V4.1 Flash (Max) es más económico. DeepSeek V4.1 Flash (Max) cuesta $0.18 por millón de tokens, frente a DeepSeek V4 Pro 0813 (Max), que cuesta $0.69 por millón de tokens (proporción 7:2:1 entre aciertos de caché, entrada y salida).
DeepSeek V4.1 Flash (Max) tiene menor latencia. El tiempo hasta el primer token de DeepSeek V4.1 Flash (Max) es de 1.02s, frente a los 1.75s de DeepSeek V4 Pro 0813 (Max).
Ambos modelos tienen una ventana de contexto de 1.0M tokens.