All Releases•

36 models

DeepSeek Models: Intelligence, Performance & Price

Artificial Analysis has benchmarked 36 models from DeepSeek. Below is a comparison of the key metrics across these models.

  • For intelligence, the top model from DeepSeek is DeepSeek V4.1 Flash (Reasoning, Max Effort) at 39.
  • For output speed, the fastest model is DeepSeek V4.1 Flash (Non-Reasoning) at 239 t/s.
  • For latency, DeepSeek V4.1 Flash (Non-Reasoning) at 1.12s offers the lowest time to first answer token.
  • For pricing, DeepSeek V4.1 Flash (Non-Reasoning) at $0.15 offers the lowest cost per task. Prices vary up to 4.6x across models.

Intelligence

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1

Intelligence Index vs. Cost per Intelligence Index Task

Artificial Analysis Intelligence Index · Weighted average cost (USD) per Artificial Analysis Intelligence Index task
Most attractive quadrant
Pareto line

Cost

Cost per Intelligence Index Task

Weighted average cost (USD) per Artificial Analysis Intelligence Index task, segmented by token type. Lower is better

Speed & Latency

Output Speed

Output tokens per second · Higher is better

Capability Scores

Capability Indexes

Measures the performance of models on specific capabilities and industries
Finance & Accounting Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Strategy & Ops Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Legal Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better

Healthcare & Medical Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better

Engineering Index

Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better

Economics Index

Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better

All DeepSeek Releases

Further details

Weights
Provider Benchmarks
DeepSeek V4.1 Flash (Reasoning, Max Effort)
DeepSeek logoDeepSeek
39
552B
16B active at inference time
1M
$0.2
221
LithosAICoreWeaveModal
+15
DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
DeepSeek logoDeepSeek
36
1.6T
49B active at inference time
1M
$0.7
104
DeepSeekGMISiliconFlow
+8
DeepSeek V4 Flash Vision (Reasoning, Max Effort)
DeepSeek logoDeepSeek
35
284B
13B active at inference time
1M
$0.2
223
Not available
DeepInfraDeepSeekFireworks
+2
DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
DeepSeek logoDeepSeek
34
284B
13B active at inference time
1M
$0.2
227
CoreWeaveWaferSystalyze
+14
DeepSeek V4 Pro 0424 (Reasoning, Max Effort)
DeepSeek logoDeepSeek
30
1.6T
49B active at inference time
1M
$0.2
111
DeepInfraMicrosoft AzureNovita
+7
DeepSeek V4 Pro 0424 (Reasoning, High Effort)
DeepSeek logoDeepSeek
30
1.6T
49B active at inference time
1M
$0.2
106
DeepInfraMicrosoft AzureDeepSeek
+5
DeepSeek V4 Flash 0420 (Reasoning, High Effort)
DeepSeek logoDeepSeek
26
284B
13B active at inference time
1M
$0.1
-
CoreWeaveDeepInfraGMI
+4
DeepSeek V4.1 Flash (Non-Reasoning)
DeepSeek logoDeepSeek
25
552B
16B active at inference time
1M
$0.2
239
DeepSeekLithosAI
DeepSeek V4 Flash 0420 (Reasoning, Max Effort)
DeepSeek logoDeepSeek
24
284B
13B active at inference time
1M
$0.1
-
GMIDeepInfraSiliconFlow
+2
DeepSeek V3.2 (Reasoning)
DeepSeek logoDeepSeek
21
685B
37B active at inference time
128k
$0.1
-
SambaNovaDeepInfraAmazon Bedrock
+5
DeepSeek V4 Pro 0424 (Non-reasoning)
DeepSeek logoDeepSeek
21
1.6T
49B active at inference time
1M
$0.2
99
Microsoft AzureBitdeer AINebius
+3
DeepSeek V4 Flash 0420 (Non-reasoning)
DeepSeek logoDeepSeek
19
284B
13B active at inference time
1M
$0.1
-
GMIMakoraCoreWeave
DeepSeek V3.2 Exp (Reasoning)
DeepSeek logoDeepSeek
17
685B
37B active at inference time
128k
$0.1
-
NovitaDeepSeek
DeepSeek V3.2 (Non-reasoning)
DeepSeek logoDeepSeek
16
685B
37B active at inference time
128k
$0.3
-
GMINovitaSambaNova
+8
DeepSeek V3.1 Terminus (Reasoning)
DeepSeek logoDeepSeek
15
685B
37B active at inference time
128k
$1.7
-
NovitaSambaNova
DeepSeek V3.2 Speciale
DeepSeek logoDeepSeek
14
685B
37B active at inference time
128k
-
-
-
DeepSeek V3.1 Terminus (Non-reasoning)
DeepSeek logoDeepSeek
14
685B
37B active at inference time
128k
$0.2
-
DeepInfraSambaNovaNovita
DeepSeek V3.2 Exp (Non-reasoning)
DeepSeek logoDeepSeek
14
685B
37B active at inference time
128k
$0.1
-
NovitaDeepSeek
DeepSeek V3.1 (Non-reasoning)
DeepSeek logoDeepSeek
14
685B
37B active at inference time
128k
$0.7
-
GoogleAmazon BedrockCoreWeave
+5
DeepSeek V3.1 (Reasoning)
DeepSeek logoDeepSeek
13
685B
37B active at inference time
128k
$0.7
-
Amazon BedrockGoogleSambaNovaNovita
DeepSeek R1 0528 (May '25)
DeepSeek logoDeepSeek
13
685B
37B active at inference time
128k
$1.5
-
Together AIHyperbolicGoogle
+2
DeepSeek R1 (Jan '25)
DeepSeek logoDeepSeek
11
685B
37B active at inference time
128k
$2.2
-
Amazon BedrockNovitaTogether AIHyperbolic
DeepSeek V3 0324
DeepSeek logoDeepSeek
10
671B
37B active at inference time
128k
$0.8
-
DeepInfraReplicate
DeepSeek V3 (Dec '24)
DeepSeek logoDeepSeek
8
671B
37B active at inference time
128k
$0.4
-
HyperbolicDeepInfraNovita
DeepSeek R1 Distill Qwen 32B
DeepSeek logoDeepSeek
8
32B
128k
-
-
-
DeepSeek R1 0528 Qwen3 8B
DeepSeek logoDeepSeek
8
8.2B
33k
-
-
-
DeepSeek R1 Distill Llama 70B
DeepSeek logoDeepSeek
8
70B
128k
$0.7
-
DeepInfraSambaNova
DeepSeek R1 Distill Qwen 14B
DeepSeek logoDeepSeek
8
14B
128k
-
-
-
DeepSeek-V2.5 (Dec '24)
DeepSeek logoDeepSeek
7
236B
21B active at inference time
128k
-
-
-
DeepSeek-V2.5
DeepSeek logoDeepSeek
7
236B
21B active at inference time
128k
-
-
-
DeepSeek R1 Distill Llama 8B
DeepSeek logoDeepSeek
6
8B
128k
-
-
-
DeepSeek-Coder-V2
DeepSeek logoDeepSeek
6
236B
21B active at inference time
128k
-
-
-
DeepSeek R1 Distill Qwen 1.5B
DeepSeek logoDeepSeek
6
1.5B
128k
-
-
-
DeepSeek-V2-Chat
DeepSeek logoDeepSeek
6
236B
21B active at inference time
128k
-
-
-
DeepSeek Coder V2 Lite Instruct
DeepSeek logoDeepSeek
5
16B
2.4B active at inference time
128k
-
-
-
DeepSeek LLM 67B Chat (V1)
DeepSeek logoDeepSeek
5
7B
4k
-
-
-