Novita: inteligencia, rendimiento y precio de sus modelos

Novita
Novita

Este análisis está pensado para ayudarte a elegir el mejor modelo ofrecido por Novita para tu caso de uso.

Más inteligente

Updated
#1
GLM-5.3 (max)GLM-5.3 (max)
45
#2
GLM-5.3-FlashGLM-5.3-Flash
42
#3
DeepSeek V4.1 Flash (max)DeepSeek V4.1 Flash (max)
39
#4
DeepSeek V4 Pro 0813 (max)DeepSeek V4 Pro 0813 (max)
36
#5
DeepSeek V4 Flash 0731 (max)DeepSeek V4 Flash 0731 (max)
34

Índice de inteligencia

87 modelos en total

Más rápido

#1
Nemotron 3 Nano (FP4)Nemotron 3 Nano (FP4)
303 t/s
#2
Nemotron 3 Nano (Non-reasoning) (FP4)Nemotron 3 Nano (Non-reasoning) (FP4)
295 t/s
#3
gpt-oss-120b (low)gpt-oss-120b (low)
212 t/s
#4
Qwen3 Next 80B A3BQwen3 Next 80B A3B
183 t/s
#5
gpt-oss-120b (high)gpt-oss-120b (high)
181 t/s

Velocidad de salida

87 modelos en total

Menor precio

#1
Llama 3.1 8BLlama 3.1 8B
$0.02
#2
gpt-oss-20b (low)gpt-oss-20b (low)
$0.05
#3
gpt-oss-20b (high)gpt-oss-20b (high)
$0.05
#4
GLM-4.7-FlashGLM-4.7-Flash
$0.06
#5
GLM-4.7-Flash (Non-reasoning)GLM-4.7-Flash (Non-reasoning)
$0.06

Precio combinado (por 1M de tokens)

87 modelos en total

Novita ofrece 87 modelos, cada uno con distintas características de inteligencia, rendimiento y precio. A continuación se comparan las métricas clave entre modelos.

  • En inteligencia, los mejores modelos en Novita son GLM-5.3 (max) (45), GLM-5.3-Flash (42) y DeepSeek V4.1 Flash (max) (39).
  • En velocidad de salida, los modelos más rápidos son Nemotron 3 Nano (FP4) (303 t/s), Nemotron 3 Nano (Non-reasoning) (FP4) (295 t/s) y gpt-oss-120b (low) (212 t/s). La velocidad varía significativamente entre modelos, con una diferencia del 67% entre el más rápido y el más lento.
  • En latencia, Llama 4 Maverick (FP8) (0.84s), Llama 3.1 8B (0.91s) y Nemotron 3 Nano (Non-reasoning) (FP4) (1.09s) ofrecen el menor tiempo hasta el primer token de respuesta.
  • En precios, Llama 3.1 8B ($0.02), gpt-oss-20b (low) ($0.05) y gpt-oss-20b (high) ($0.05) ofrecen los menores precios combinados por 1M de tokens. Los precios varían hasta 2.7x entre modelos.
  • En tamaño de ventana de contexto, GLM-5.3-Flash (1M), DeepSeek V4 Pro 0813 (max) (1M) y GLM-5.2 (max) (FP8) (1M) admiten las ventanas de contexto más grandes en Novita.

Aspectos destacados

Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Evaluaciones de inteligencia

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
See more

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

Quantitative analysis on spreadsheets & documents

Agentic tool use

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Ventana de contexto

Context Window

Context window: tokens limit · Higher is better

Precios

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Resumen de rendimiento

Output Speed vs. Price

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Velocidad

Medida por la velocidad de salida (tokens por segundo)

Output Speed

Output tokens per second · Higher is better

Latencia

Medida por el tiempo (segundos) hasta el primer token

Latency: Time To First Answer Token

Seconds to first answer token received · Accounts for reasoning model 'thinking' time

Tiempo de respuesta de extremo a extremo

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

End-to-End Response Time vs. Price

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Análisis adicional
Logo de Z AI
GLM-5.3 (max)
1M
Abierto
45
$2.00
126
2.53
22.38
15.88
Logo de Z AI
GLM-5.3-Flash
1.05M
Abierto
42
$0.29
58
2.33
45.49
34.53
Logo de DeepSeek
DeepSeek V4.1 Flash (max)
524k
Abierto
39
$0.24
143
2.11
19.61
14.00
Logo de DeepSeek
DeepSeek V4 Pro 0813 (max)
1.05M
Abierto
36
$0.70
88
2.17
30.62
22.76
Logo de DeepSeek
DeepSeek V4 Flash 0731 (max)
1.05M
Abierto
34
$0.26
160
1.45
17.10
12.52
Logo de Z AI
GLM-5.2 (max) (FP8)
1.05M
Abierto
34
$0.88
78
1.84
33.69
25.48
Logo de DeepSeek
DeepSeek V4 Pro (max)
1.05M
Abierto
30
$1.09
91
1.99
55.78
48.27
Logo de DeepSeek
DeepSeek V4 Pro (high)
1.05M
Abierto
30*
--
91
1.95
29.24
21.82
Logo de MiniMax
MiniMax-M3
1M
Abierto
29
$0.46
148
1.20
18.10
13.52
Logo de Z AI
GLM-5 FP8
203k
Abierto
28*
--
78
2.01
48.27
39.84
Logo de Kimi
Kimi K2.6
262k
Abierto
27
$0.67
65
1.84
78.50
68.91
Logo de Z AI
GLM-5.1 (FP8)
205k
Abierto
26
$1.07
69
2.06
64.63
55.27
Logo de DeepSeek
DeepSeek V4 Flash (high)
1.05M
Abierto
26*
--
162
1.52
12.26
7.65
Logo de Xiaomi
MiMo-V2.5-Pro
1.05M
Abierto
26
$0.07
35
2.00
72.65
56.52
Logo de Kimi
Kimi K2.7 Code
262k
Abierto
26
$0.55
87
3.88
35.42
25.77
Logo de Tencent
Hy3
262k
Abierto
25
$0.07
87
3.63
32.39
23.01
Logo de Xiaomi
MiMo-V2.5
1.05M
Abierto
25*
--
47
30.29
83.68
42.71
Logo de Z AI
GLM-5.1 (Non-reasoning) (FP8)
205k
Abierto
24*
--
61
3.22
11.47
--
Logo de DeepSeek
DeepSeek V4 Flash (max)
1.05M
Abierto
24
$0.13
166
1.71
38.63
33.91
Logo de Kimi
Kimi K2.6 (Non-reasoning)
262k
Abierto
24*
--
66
2.41
9.98
--
Logo de Kimi
Kimi K2.5
262k
Abierto
23*
--
53
1.95
66.93
55.62
Logo de Alibaba
Qwen3.5 27B
262k
Abierto
23*
--
60
5.80
47.40
33.28
Logo de MiniMax
MiniMax-M2.5
205k
Abierto
23*
--
92
1.70
28.88
21.74
Logo de MiniMax
MiniMax-M2.7 (FP8)
205k
Abierto
23
--
68
1.80
45.08
35.98
Logo de Z AI
GLM-4.7
205k
Abierto
22*
--
35
5.16
75.71
56.45
Logo de Kimi
Kimi K2 Thinking
262k
Abierto
22*
--
53
1.67
48.59
37.54
Logo de Z AI
GLM-5 (Non-reasoning) (FP8)
203k
Abierto
22*
--
82
1.83
7.90
--
Logo de DeepSeek
DeepSeek V3.2
164k
Abierto
21*
--
38
2.89
69.46
53.25
Logo de Alibaba
Qwen3.5 397B A17B (Non-reasoning)
262k
Abierto
21*
--
88
1.80
7.48
--
Logo de Alibaba
Qwen3.6 27B
262k
Abierto
21
$0.62
58
2.91
108.80
97.32
Logo de MiniMax
MiniMax-M2.1
205k
Abierto
21*
--
106
2.08
25.58
18.81
Logo de Alibaba
Qwen3.6 27B (Non-reasoning)
262k
Abierto
20*
--
58
2.94
11.60
--
Logo de Kimi
Kimi K2.5 (Non-reasoning)
262k
Abierto
19*
--
54
1.97
11.23
--
Logo de Alibaba
Qwen3.5 35B A3B
262k
Abierto
19*
--
95
1.69
28.08
21.11
Logo de Google
Gemma 4 31B
262k
Abierto
19*
--
15
3.99
148.71
112.36
Logo de MiniMax
MiniMax-M2
205k
Abierto
19*
--
95
1.99
28.38
21.11
Logo de Z AI
GLM-4.6
205k
Abierto
19*
--
36
4.54
73.17
54.90
Logo de Alibaba
Qwen3.5 397B A17B
262k
Abierto
18
$0.47
92
1.66
41.56
34.49
Logo de Xiaomi
MiMo-V2.5-Pro (Non-reasoning)
1.05M
Abierto
18*
--
34
2.15
17.00
--
Logo de Alibaba
Qwen3.6 35B A3B
205k
Abierto
18
$0.31
124
1.42
48.99
43.53
Logo de Z AI
GLM-4.7 (Non-reasoning)
205k
Abierto
17*
--
35
4.96
19.18
--
Logo de Google
Gemma 4 26B A4B
262k
Abierto
17*
--
44
1.43
58.41
45.59
Logo de DeepSeek
DeepSeek V3.2 Exp (FP8)
164k
Abierto
17*
--
38
2.84
69.12
53.02
Logo de DeepSeek
DeepSeek V3.2 (Non-reasoning)
164k
Abierto
16*
--
42
1.94
13.83
--
Logo de Alibaba
Qwen3 Max
262k
Propietario
16*
--
64
3.08
10.84
--
Logo de Alibaba
Qwen3.5 122B A10B
262k
Abierto
16
$0.32
110
1.92
24.57
18.13
Logo de Kimi
Kimi K2 0905
262k
Abierto
15*
--
54
1.25
10.55
--
Logo de Alibaba
Qwen3.6 35B A3B (Non-reasoning)
205k
Abierto
15*
--
140
1.54
5.11
--
Logo de Z AI
GLM-4.6 (Non-reasoning)
205k
Abierto
15*
--
34
4.68
19.24
--
Logo de Z AI
GLM-4.7-Flash
200k
Abierto
15*
--
73
2.85
36.97
27.29
Logo de DeepSeek
DeepSeek V3.1 Terminus (FP8)
131k
Abierto
15
--
38
3.07
69.13
52.85
Logo de DeepSeek
DeepSeek V3.1 Terminus (Non-reasoning) (FP8)
131k
Abierto
14*
--
38
3.26
16.56
--
Logo de Google
Gemma 4 31B (Non-reasoning)
262k
Abierto
14*
--
16
2.61
33.37
--
Logo de DeepSeek
DeepSeek V3.2 Exp (Non-reasoning) (FP8)
164k
Abierto
14*
--
37
2.94
16.33
--
Logo de DeepSeek
DeepSeek V3.1 (Non-reasoning)
164k
Abierto
14*
--
37
3.16
16.51
--
Logo de DeepSeek
DeepSeek V3.1
131k
Abierto
13*
--
39
3.25
67.84
51.67
Logo de Alibaba
Qwen3 VL 235B A22B (Reasoning)
131k
Abierto
13*
--
49
2.53
53.08
40.44
Logo de Google
Gemma 4 26B A4B (Non-reasoning)
262k
Abierto
13*
--
69
1.50
8.75
--
Logo de DeepSeek
DeepSeek R1 0528
164k
Abierto
13*
--
27
1.48
94.36
74.30
Logo de Kimi
Kimi K2
131k
Abierto
13*
--
53
1.49
10.87
--
Logo de Alibaba
Qwen3 235B A22B 2507
131k
Abierto
13
$0.11
70
2.21
37.67
28.37
Logo de Alibaba
Qwen3 235B 2507
131k
Abierto
12*
--
54
1.62
10.92
--
Logo de Alibaba
Qwen3 Coder 480B
262k
Abierto
12*
--
50
2.09
12.06
--
Logo de MiniMax
MiniMax M1 80k
1M
Abierto
12*
--
95
1.78
27.98
20.96
Logo de OpenAI
gpt-oss-120b (high)
131k
Abierto
12
$0.04
170
1.04
15.74
11.76
Logo de DeepSeek
DeepSeek R1 (Jan) Turbo
64k
Abierto
11
$0.11
21
1.98
137.76
111.93
Logo de DeepSeek
DeepSeek R1 (Jan)
64k
Abierto
11
$0.46
20
3.39
148.05
119.26
Logo de Z AI
GLM-4.6V
131k
Abierto
11*
--
84
3.27
32.97
23.76
Logo de Z AI
GLM-4.7-Flash (Non-reasoning)
200k
Abierto
11*
--
71
3.63
10.70
--
Logo de OpenAI
gpt-oss-120b (low)
131k
Abierto
10*
--
215
1.06
12.70
9.32
Logo de Meta
Llama 4 Maverick (FP8)
1.05M
Abierto
10*
--
94
0.78
6.10
--
Logo de OpenAI
gpt-oss-20b (low)
131k
Abierto
10*
--
140
1.21
19.12
14.33
Logo de Alibaba
Qwen3 VL 235B A22B
131k
Abierto
10*
--
58
2.07
10.69
--
Logo de Alibaba
Qwen3 Next 80B A3B
131k
Abierto
10*
--
188
1.69
4.35
--
Logo de Alibaba
Qwen3 Coder Next (FP8)
262k
Abierto
9
$0.33
170
2.83
5.77
--
Logo de OpenAI
gpt-oss-20b (high)
131k
Abierto
9
$0.01
142
1.23
18.89
14.13
Logo de NVIDIA
Nemotron 3 Nano (FP4)
262k
Abierto
9
$0.02
318
1.03
8.90
6.29
Logo de DeepSeek
DeepSeek V3 (Dec)
64k
Abierto
8
$0.05
40
2.36
14.95
--
Logo de Z AI
GLM-4.6V (Non-reasoning)
131k
Abierto
8*
--
76
3.27
9.84
--
Logo de Alibaba
Qwen3 235B (Non-reasoning) (FP8)
41k
Abierto
8*
--
18
2.46
29.94
--
Logo de Meta
Llama 4 Scout
131k
Abierto
8*
--
25
1.08
21.26
--
Logo de Alibaba
Qwen3 VL 30B A3B
131k
Abierto
8*
--
108
1.58
6.20
--
Logo de Meta
Llama 3.3 70B
131k
Abierto
8*
--
44
1.95
13.38
--
Logo de Z AI
GLM-4.5V
65.5k
Abierto
8*
--
43
2.83
61.18
46.68
Logo de Meta
Llama 3.1 8B
16.4k
Abierto
7*
--
148
0.91
4.28
--
Logo de NVIDIA
Nemotron 3 Nano (Non-reasoning) (FP4)
262k
Abierto
7*
--
310
1.12
2.73
--
Logo de Z AI
GLM-4.5V (Non-reasoning)
65.5k
Abierto
7*
--
50
2.75
12.83
--
Logo de Meta
Llama 3 70B
8.19k
Abierto
5*
--
--
--
--
--
Logo de Google
Gemma 3 27B
98.3k
Abierto
5
$0.24
32
1.95
17.34
--
Logo de Meta
Llama 3 8B
8.19k
Abierto
5*
--
--
--
--
--

Definiciones clave

Preguntas frecuentes

Preguntas comunes sobre Novita