Novita: inteligência, desempenho e preço dos modelos

Novita
Novita

Esta análise ajuda você a escolher o melhor modelo oferecido por Novita para seu caso de uso.

Mais inteligente

Updated
#1
GLM-5.3 (max)GLM-5.3 (max)
45
#2
GLM-5.3-FlashGLM-5.3-Flash
42
#3
DeepSeek V4 Pro 0813 (max)DeepSeek V4 Pro 0813 (max)
36
#4
DeepSeek V4 Flash 0731 (max)DeepSeek V4 Flash 0731 (max)
35
#5
GLM-5.2 (max) (FP8)GLM-5.2 (max) (FP8)
34

Intelligence Index

86 modelos no total

Mais rápido

#1
Nemotron 3 Nano (FP4)Nemotron 3 Nano (FP4)
289 t/s
#2
Nemotron 3 Nano (Non-reasoning) (FP4)Nemotron 3 Nano (Non-reasoning) (FP4)
288 t/s
#3
gpt-oss-20b (low)gpt-oss-20b (low)
208 t/s
#4
DeepSeek V4 Flash 0731 (max)DeepSeek V4 Flash 0731 (max)
206 t/s
#5
gpt-oss-20b (high)gpt-oss-20b (high)
202 t/s

Velocidade de saída

86 modelos no total

Menor preço

#1
Llama 3.1 8BLlama 3.1 8B
$0.02
#2
gpt-oss-20b (low)gpt-oss-20b (low)
$0.05
#3
gpt-oss-20b (high)gpt-oss-20b (high)
$0.05
#4
Nemotron 3 Nano (FP4)Nemotron 3 Nano (FP4)
$0.07
#5
Nemotron 3 Nano (Non-reasoning) (FP4)Nemotron 3 Nano (Non-reasoning) (FP4)
$0.07

Preço combinado (por 1M de tokens)

86 modelos no total

Novita oferece 86 modelos, cada um com características diferentes de inteligência, desempenho e preço. Veja abaixo uma comparação das principais métricas entre os modelos.

  • Em inteligência, os principais modelos oferecidos por Novita são GLM-5.3 (max) (45), GLM-5.3-Flash (42) e DeepSeek V4 Pro 0813 (max) (36).
  • Em velocidade de saída, os modelos mais rápidos são Nemotron 3 Nano (FP4) (289 t/s), Nemotron 3 Nano (Non-reasoning) (FP4) (288 t/s) e gpt-oss-20b (low) (208 t/s).
  • Em latência, Llama 4 Maverick (FP8) (0.78s), Llama 3.1 8B (0.85s) e Nemotron 3 Nano (Non-reasoning) (FP4) (0.99s) têm o menor tempo até o primeiro token da resposta final.
  • Em preço, Llama 3.1 8B ($0.02), gpt-oss-20b (low) ($0.05) e gpt-oss-20b (high) ($0.05) têm os menores preços combinados por 1M de tokens. Os preços variam em até 2.8x entre os modelos.
  • Em tamanho da janela de contexto, GLM-5.3-Flash (1M), DeepSeek V4 Pro 0813 (max) (1M) e GLM-5.2 (max) (FP8) (1M) aceitam as maiores janelas entre os modelos oferecidos por Novita.

Destaques

Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Avaliações de inteligência

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3 incorporates 10 evaluations: AA-Briefcase, GDPval-AA v2, AutomationBench-AA, Terminal-Bench v4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
See more

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Quantitative analysis on spreadsheets & documents

Instruction following

Agentic tool use

Long-horizon agentic tasks

Kubernetes incident root-cause analysis

Visual reasoning

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Janela de contexto

Context Window

Context window: tokens limit · Higher is better

Preços

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Resumo do desempenho

Output Speed vs. Price

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Velocidade

Medida pela velocidade de saída (tokens por segundo)

Output Speed

Output tokens per second · Higher is better

Latência

Medida pelo tempo (segundos) até o primeiro token

Latency: Time To First Answer Token

Seconds to first answer token received · Accounts for reasoning model 'thinking' time

Tempo de resposta de ponta a ponta

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

End-to-End Response Time vs. Price

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Análises adicionais
Logo: Z AI
GLM-5.3 (max)
1M
Aberto
45
$8.68
79
2.26
33.91
25.33
Logo: Z AI
GLM-5.3-Flash
1.05M
Aberto
42
$0.29
107
1.62
25.01
18.71
Logo: DeepSeek
DeepSeek V4 Pro 0813 (max)
1.05M
Aberto
36
$0.70
74
1.87
35.88
27.21
Logo: DeepSeek
DeepSeek V4 Flash 0731 (max)
1.05M
Aberto
35
$0.26
208
1.72
13.72
9.60
Logo: Z AI
GLM-5.2 (max) (FP8)
1.05M
Aberto
34
$0.88
77
1.78
34.16
25.90
Logo: DeepSeek
DeepSeek V4 Pro (max)
1.05M
Aberto
31
$1.09
81
1.86
62.19
54.14
Logo: DeepSeek
DeepSeek V4 Pro (high)
1.05M
Aberto
30*
--
84
1.75
31.28
23.60
Logo: MiniMax
MiniMax-M3
1M
Aberto
30
$0.46
157
1.06
16.99
12.74
Logo: Z AI
GLM-5 FP8
203k
Aberto
28*
--
71
1.58
52.33
43.72
Logo: Kimi
Kimi K2.6
262k
Aberto
27
$0.75
87
1.85
58.55
50.97
Logo: Z AI
GLM-5.1 (FP8)
205k
Aberto
26
$1.07
62
2.34
71.63
61.21
Logo: Xiaomi
MiMo-V2.5-Pro
1.05M
Aberto
26
$0.07
39
4.82
68.80
51.19
Logo: Kimi
Kimi K2.7 Code
262k
Aberto
26
$0.55
51
3.47
57.07
43.77
Logo: Tencent
Hy3
262k
Aberto
26
$0.07
87
2.23
31.11
23.11
Logo: DeepSeek
DeepSeek V4 Flash (high)
1.05M
Aberto
25
$0.12
118
1.66
16.46
10.55
Logo: DeepSeek
DeepSeek V4 Flash (max)
1.05M
Aberto
25
$0.10
119
1.71
53.22
47.29
Logo: Z AI
GLM-5.1 (Non-reasoning) (FP8)
205k
Aberto
24*
--
63
2.09
10.07
--
Logo: Kimi
Kimi K2.6 (Non-reasoning)
262k
Aberto
24*
--
62
2.27
10.28
--
Logo: Kimi
Kimi K2.5
262k
Aberto
23*
--
40
1.67
87.87
73.77
Logo: MiniMax
MiniMax-M2.7 (FP8)
205k
Aberto
23
$0.08
55
1.88
55.48
44.55
Logo: Alibaba
Qwen3.5 27B
262k
Aberto
23*
--
56
5.84
50.49
35.72
Logo: MiniMax
MiniMax-M2.5
205k
Aberto
23*
--
91
1.87
29.40
22.02
Logo: Xiaomi
MiMo-V2.5
1.05M
Aberto
22
$0.02
48
4.21
55.98
41.42
Logo: Z AI
GLM-4.7
205k
Aberto
22*
--
41
3.84
65.38
49.23
Logo: Kimi
Kimi K2 Thinking
262k
Aberto
22*
--
40
1.74
64.51
50.22
Logo: Alibaba
Qwen3.6 27B
262k
Aberto
22
$0.62
58
2.95
109.18
97.63
Logo: Z AI
GLM-5 (Non-reasoning) (FP8)
203k
Aberto
22*
--
69
1.61
8.83
--
Logo: DeepSeek
DeepSeek V3.2
164k
Aberto
21*
--
37
3.10
71.38
54.62
Logo: Alibaba
Qwen3.5 397B A17B (Non-reasoning)
262k
Aberto
21*
--
85
1.57
7.48
--
Logo: MiniMax
MiniMax-M2.1
205k
Aberto
21*
--
92
1.99
29.28
21.83
Logo: Alibaba
Qwen3.6 27B (Non-reasoning)
262k
Aberto
20*
--
61
3.04
11.25
--
Logo: Kimi
Kimi K2.5 (Non-reasoning)
262k
Aberto
19*
--
40
1.97
14.38
--
Logo: Alibaba
Qwen3.5 35B A3B
262k
Aberto
19*
--
95
1.53
27.83
21.04
Logo: Alibaba
Qwen3.5 397B A17B
262k
Aberto
19
$0.47
84
1.73
45.43
37.77
Logo: Alibaba
Qwen3.6 35B A3B
205k
Aberto
19
$0.31
124
1.33
48.69
43.34
Logo: MiniMax
MiniMax-M2
205k
Aberto
19*
--
91
2.14
29.55
21.93
Logo: Z AI
GLM-4.6
205k
Aberto
19*
--
39
3.98
67.76
51.03
Logo: Xiaomi
MiMo-V2.5-Pro (Non-reasoning)
1.05M
Aberto
18*
--
37
5.55
18.96
--
Logo: Z AI
GLM-4.7 (Non-reasoning)
205k
Aberto
17*
--
39
3.94
16.70
--
Logo: Google
Gemma 4 26B A4B
262k
Aberto
17*
--
96
1.68
27.74
20.85
Logo: DeepSeek
DeepSeek V3.2 Exp (FP8)
164k
Aberto
17*
--
37
2.70
70.48
54.22
Logo: Alibaba
Qwen3.5 122B A10B
262k
Aberto
16
$0.32
113
1.91
23.97
17.64
Logo: DeepSeek
DeepSeek V3.2 (Non-reasoning)
164k
Aberto
16*
--
39
3.25
16.23
--
Logo: Alibaba
Qwen3 Max
262k
Proprietário
16*
--
32
3.30
19.05
--
Logo: Google
Gemma 4 31B
262k
Aberto
15
$0.10
--
--
--
--
Logo: DeepSeek
DeepSeek V3.1 Terminus (FP8)
131k
Aberto
15
--
37
2.78
70.83
54.44
Logo: Kimi
Kimi K2 0905
262k
Aberto
15*
--
40
1.13
13.62
--
Logo: Alibaba
Qwen3.6 35B A3B (Non-reasoning)
205k
Aberto
15*
--
140
1.41
4.98
--
Logo: Z AI
GLM-4.6 (Non-reasoning)
205k
Aberto
15*
--
38
3.95
17.22
--
Logo: Z AI
GLM-4.7-Flash
200k
Aberto
15*
--
72
8.07
42.97
27.92
Logo: DeepSeek
DeepSeek V3.1 Terminus (Non-reasoning) (FP8)
131k
Aberto
14*
--
37
2.75
16.15
--
Logo: Google
Gemma 4 31B (Non-reasoning)
262k
Aberto
14*
--
18
1.89
29.52
--
Logo: DeepSeek
DeepSeek V3.2 Exp (Non-reasoning) (FP8)
164k
Aberto
14*
--
37
2.81
16.45
--
Logo: DeepSeek
DeepSeek V3.1 (Non-reasoning)
164k
Aberto
14*
--
38
3.28
16.53
--
Logo: DeepSeek
DeepSeek V3.1
131k
Aberto
13*
--
37
3.36
70.94
54.06
Logo: Alibaba
Qwen3 VL 235B A22B (Reasoning)
131k
Aberto
13*
--
49
2.59
53.66
40.85
Logo: Google
Gemma 4 26B A4B (Non-reasoning)
262k
Aberto
13*
--
37
1.19
14.61
--
Logo: DeepSeek
DeepSeek R1 0528
164k
Aberto
13*
--
25
1.22
102.03
80.65
Logo: Kimi
Kimi K2
131k
Aberto
13*
--
39
1.59
14.39
--
Logo: Alibaba
Qwen3 235B A22B 2507
131k
Aberto
13
$0.11
71
2.21
37.23
28.01
Logo: OpenAI
gpt-oss-120b (high)
131k
Aberto
12
$0.04
99
1.15
26.30
20.12
Logo: Alibaba
Qwen3 235B 2507 (Non-reasoning)
131k
Aberto
12*
--
48
1.67
12.18
--
Logo: Alibaba
Qwen3 Coder 480B
262k
Aberto
12*
--
52
2.14
11.71
--
Logo: MiniMax
MiniMax M1 80k
1M
Aberto
12*
--
92
1.78
29.05
21.82
Logo: DeepSeek
DeepSeek R1 (Jan) Turbo
64k
Aberto
11
$0.11
22
1.33
129.63
105.76
Logo: DeepSeek
DeepSeek R1 (Jan)
64k
Aberto
11
$0.46
23
1.30
127.48
104.02
Logo: Z AI
GLM-4.6V
131k
Aberto
11*
--
67
3.24
40.41
29.74
Logo: Z AI
GLM-4.7-Flash (Non-reasoning)
200k
Aberto
11*
--
70
14.13
21.32
--
Logo: OpenAI
gpt-oss-120b (low)
131k
Aberto
10*
--
90
1.01
28.68
22.14
Logo: Alibaba
Qwen3 Coder Next (FP8)
262k
Aberto
10
$0.33
166
2.49
5.50
--
Logo: OpenAI
gpt-oss-20b (low)
131k
Aberto
10*
--
208
1.16
13.21
9.64
Logo: Alibaba
Qwen3 VL 235B A22B
131k
Aberto
10*
--
39
2.13
15.04
--
Logo: Alibaba
Qwen3 Next 80B A3B
131k
Aberto
10*
--
187
1.78
4.45
--
Logo: Meta
Llama 4 Maverick (FP8)
1.05M
Aberto
9
$0.04
86
0.77
6.61
--
Logo: OpenAI
gpt-oss-20b (high)
131k
Aberto
9
$0.01
206
1.17
13.29
9.70
Logo: NVIDIA
Nemotron 3 Nano (FP4)
262k
Aberto
9
$0.02
305
0.99
9.19
6.56
Logo: DeepSeek
DeepSeek V3 (Dec)
64k
Aberto
8
$0.05
38
1.96
15.06
--
Logo: Z AI
GLM-4.6V (Non-reasoning)
131k
Aberto
8*
--
54
3.21
12.51
--
Logo: Alibaba
Qwen3 235B (Non-reasoning) (FP8)
41k
Aberto
8*
--
36
2.61
16.38
--
Logo: Alibaba
Qwen3 VL 30B A3B
131k
Aberto
8*
--
107
1.52
6.17
--
Logo: Meta
Llama 3.3 70B
131k
Aberto
8*
--
44
1.76
13.24
--
Logo: Z AI
GLM-4.5V
65.5k
Aberto
8*
--
38
2.69
69.02
53.06
Logo: Meta
Llama 3.1 8B
16.4k
Aberto
7*
--
156
0.85
4.05
--
Logo: NVIDIA
Nemotron 3 Nano (Non-reasoning) (FP4)
262k
Aberto
7*
--
295
1.01
2.70
--
Logo: Z AI
GLM-4.5V (Non-reasoning)
65.5k
Aberto
7*
--
39
2.82
15.63
--
Logo: Meta
Llama 4 Scout
131k
Aberto
6
$0.11
24
1.63
22.28
--
Logo: Meta
Llama 3 70B
8.19k
Aberto
5*
--
--
--
--
--
Logo: Google
Gemma 3 27B
98.3k
Aberto
5
$0.24
33
1.70
16.90
--
Logo: Meta
Llama 3 8B
8.19k
Aberto
5*
--
--
--
--
--

Principais definições

Perguntas frequentes

Perguntas comuns sobre Novita