Novita: Intelligenz, Leistung und Preise der Modelle

Novita
Novita

Diese Analyse soll Sie bei der Auswahl des besten von Novita angebotenen Modells für Ihren Anwendungsfall unterstützen.

Höchste Intelligenz

Updated
#1
GLM-5.3 (max)GLM-5.3 (max)
45
#2
GLM-5.3-FlashGLM-5.3-Flash
42
#3
DeepSeek V4 Pro 0813 (max)DeepSeek V4 Pro 0813 (max)
36
#4
DeepSeek V4 Flash 0731 (max)DeepSeek V4 Flash 0731 (max)
35
#5
GLM-5.2 (max) (FP8)GLM-5.2 (max) (FP8)
34

Intelligence Index

Insgesamt 86 Modelle

Am schnellsten

#1
Nemotron 3 Nano (FP4)Nemotron 3 Nano (FP4)
305 t/s
#2
Nemotron 3 Nano (Non-reasoning) (FP4)Nemotron 3 Nano (Non-reasoning) (FP4)
288 t/s
#3
gpt-oss-20b (low)gpt-oss-20b (low)
231 t/s
#4
gpt-oss-20b (high)gpt-oss-20b (high)
209 t/s
#5
DeepSeek V4 Flash 0731 (max)DeepSeek V4 Flash 0731 (max)
205 t/s

Ausgabegeschwindigkeit

Insgesamt 86 Modelle

Niedrigster Preis

#1
Llama 3.1 8BLlama 3.1 8B
$0.02
#2
gpt-oss-20b (low)gpt-oss-20b (low)
$0.05
#3
gpt-oss-20b (high)gpt-oss-20b (high)
$0.05
#4
Nemotron 3 Nano (FP4)Nemotron 3 Nano (FP4)
$0.07
#5
Nemotron 3 Nano (Non-reasoning) (FP4)Nemotron 3 Nano (Non-reasoning) (FP4)
$0.07

Mischpreis (pro 1 Mio. Tokens)

Insgesamt 86 Modelle

Novita bietet 86 Modelle mit jeweils unterschiedlichen Merkmalen bei Intelligenz, Leistung und Preis an. Nachfolgend werden die wichtigsten Metriken der Modelle verglichen.

  • Bei der Intelligenz sind GLM-5.3 (max) (45), GLM-5.3-Flash (42) und DeepSeek V4 Pro 0813 (max) (36) die führenden Modelle von Novita.
  • Bei der Ausgabegeschwindigkeit sind Nemotron 3 Nano (FP4) (305 t/s), Nemotron 3 Nano (Non-reasoning) (FP4) (288 t/s) und gpt-oss-20b (low) (231 t/s) am schnellsten.
  • Bei der Latenz bieten Llama 4 Maverick (FP8) (0.78 s), Llama 3.1 8B (0.84 s) und Nemotron 3 Nano (Non-reasoning) (FP4) (0.99 s) die kürzeste Zeit bis zum ersten Antworttoken.
  • Beim Preis bieten Llama 3.1 8B ($0.02), gpt-oss-20b (low) ($0.05) und gpt-oss-20b (high) ($0.05) die niedrigsten Mischpreise pro 1 Mio. Tokens. Die Preise unterscheiden sich zwischen den Modellen bis zum 2.8-Fachen.
  • Bei der Größe des Kontextfensters unterstützen GLM-5.3-Flash (1M), DeepSeek V4 Pro 0813 (max) (1M) und GLM-5.2 (max) (FP8) (1M) die größten Kontextfenster von Novita.

Wichtigste Ergebnisse

Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Intelligenzevaluationen

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3 incorporates 10 evaluations: AA-Briefcase, GDPval-AA v2, AutomationBench-AA, Terminal-Bench v4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
See more

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Quantitative analysis on spreadsheets & documents

Instruction following

Agentic tool use

Long-horizon agentic tasks

Kubernetes incident root-cause analysis

Visual reasoning

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Kontextfenster

Context Window

Context window: tokens limit · Higher is better

Preise

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Leistungsübersicht

Output Speed vs. Price

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Geschwindigkeit

Gemessen anhand der Ausgabegeschwindigkeit (Tokens pro Sekunde)

Output Speed

Output tokens per second · Higher is better

Latenz

Gemessen anhand der Zeit (Sekunden) bis zum ersten Token

Latency: Time To First Answer Token

Seconds to first answer token received · Accounts for reasoning model 'thinking' time

Ende-zu-Ende-Antwortzeit

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

End-to-End Response Time vs. Price

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Weitere Analyse
Logo von Z AI
GLM-5.3 (max)
1M
Offen
45
$8.68
79
2.26
34.05
25.43
Logo von Z AI
GLM-5.3-Flash
1.05M
Offen
42
$0.29
102
1.61
26.06
19.56
Logo von DeepSeek
DeepSeek V4 Pro 0813 (max)
1.05M
Offen
36
$0.70
72
1.87
36.72
27.88
Logo von DeepSeek
DeepSeek V4 Flash 0731 (max)
1.05M
Offen
35
$0.26
205
1.71
13.89
9.75
Logo von Z AI
GLM-5.2 (max) (FP8)
1.05M
Offen
34
$0.88
77
1.78
34.38
26.08
Logo von Kimi
Kimi K2.6
262k
Offen
31*
--
87
1.82
58.51
50.96
Logo von DeepSeek
DeepSeek V4 Pro (max)
1.05M
Offen
31
$1.09
77
1.86
64.80
56.48
Logo von DeepSeek
DeepSeek V4 Pro (high)
1.05M
Offen
30*
--
76
1.75
34.33
26.04
Logo von MiniMax
MiniMax-M3
1M
Offen
30
$0.46
147
1.13
18.14
13.61
Logo von Z AI
GLM-5 FP8
203k
Offen
28*
--
72
1.56
51.69
43.18
Logo von Z AI
GLM-5.1 (FP8)
205k
Offen
26
$1.07
60
2.57
74.06
63.16
Logo von Xiaomi
MiMo-V2.5-Pro
1.05M
Offen
26
$0.07
38
4.29
70.89
53.28
Logo von Kimi
Kimi K2.7 Code
262k
Offen
26
$0.55
53
3.74
55.69
42.43
Logo von Tencent
Hy3
262k
Offen
26
$0.07
88
2.23
30.61
22.70
Logo von DeepSeek
DeepSeek V4 Flash (high)
1.05M
Offen
25
$0.12
117
1.66
16.53
10.60
Logo von DeepSeek
DeepSeek V4 Flash (max)
1.05M
Offen
25
$0.10
119
1.67
53.17
47.29
Logo von Z AI
GLM-5.1 (Non-reasoning) (FP8)
205k
Offen
24*
--
63
2.42
10.40
--
Logo von Kimi
Kimi K2.6 (Non-reasoning)
262k
Offen
24*
--
65
2.02
9.74
--
Logo von Kimi
Kimi K2.5
262k
Offen
23*
--
40
1.92
88.06
73.72
Logo von MiniMax
MiniMax-M2.7 (FP8)
205k
Offen
23
$0.08
53
1.93
57.84
46.47
Logo von Alibaba
Qwen3.5 27B
262k
Offen
23*
--
53
5.81
52.98
37.73
Logo von MiniMax
MiniMax-M2.5
205k
Offen
23*
--
94
1.84
28.57
21.38
Logo von Xiaomi
MiMo-V2.5
1.05M
Offen
22
$0.02
46
4.34
58.59
43.40
Logo von Z AI
GLM-4.7
205k
Offen
22*
--
38
3.78
70.19
53.12
Logo von Kimi
Kimi K2 Thinking
262k
Offen
22*
--
40
1.74
64.39
50.13
Logo von Alibaba
Qwen3.6 27B
262k
Offen
22
$0.62
58
2.95
110.09
98.46
Logo von Z AI
GLM-5 (Non-reasoning) (FP8)
203k
Offen
22*
--
69
1.57
8.83
--
Logo von DeepSeek
DeepSeek V3.2
164k
Offen
21*
--
37
3.02
71.30
54.62
Logo von Alibaba
Qwen3.5 397B A17B (Non-reasoning)
262k
Offen
21*
--
84
1.57
7.55
--
Logo von MiniMax
MiniMax-M2.1
205k
Offen
21*
--
89
1.99
30.12
22.50
Logo von Alibaba
Qwen3.6 27B (Non-reasoning)
262k
Offen
20*
--
60
2.99
11.39
--
Logo von Kimi
Kimi K2.5 (Non-reasoning)
262k
Offen
19*
--
41
1.87
14.20
--
Logo von Alibaba
Qwen3.5 35B A3B
262k
Offen
19*
--
92
1.47
28.72
21.80
Logo von Alibaba
Qwen3.5 397B A17B
262k
Offen
19
$0.47
83
1.64
45.79
38.16
Logo von Alibaba
Qwen3.6 35B A3B
205k
Offen
19
$0.31
124
1.35
48.71
43.34
Logo von MiniMax
MiniMax-M2
205k
Offen
19*
--
92
2.09
29.24
21.72
Logo von Z AI
GLM-4.6
205k
Offen
19*
--
39
4.04
68.87
51.86
Logo von Xiaomi
MiMo-V2.5-Pro (Non-reasoning)
1.05M
Offen
18*
--
37
5.55
18.97
--
Logo von Z AI
GLM-4.7 (Non-reasoning)
205k
Offen
17*
--
39
3.94
16.61
--
Logo von Google
Gemma 4 26B A4B
262k
Offen
17*
--
107
1.57
24.97
18.71
Logo von DeepSeek
DeepSeek V3.2 Exp (FP8)
164k
Offen
17*
--
38
2.70
69.36
53.33
Logo von Alibaba
Qwen3.5 122B A10B
262k
Offen
16
$0.32
113
1.91
24.05
17.71
Logo von DeepSeek
DeepSeek V3.2 (Non-reasoning)
164k
Offen
16*
--
39
3.09
16.07
--
Logo von Alibaba
Qwen3 Max
262k
Proprietär
16*
--
32
3.52
19.03
--
Logo von Google
Gemma 4 31B
262k
Offen
15
$0.10
--
--
--
--
Logo von DeepSeek
DeepSeek V3.1 Terminus (FP8)
131k
Offen
15
--
37
2.80
69.73
53.54
Logo von Kimi
Kimi K2 0905
262k
Offen
15*
--
40
1.12
13.49
--
Logo von Alibaba
Qwen3.6 35B A3B (Non-reasoning)
205k
Offen
15*
--
140
1.39
4.96
--
Logo von Z AI
GLM-4.6 (Non-reasoning)
205k
Offen
15*
--
38
3.94
17.11
--
Logo von Z AI
GLM-4.7-Flash
200k
Offen
15*
--
71
10.23
45.36
28.11
Logo von DeepSeek
DeepSeek V3.1 Terminus (Non-reasoning) (FP8)
131k
Offen
14*
--
37
2.75
16.11
--
Logo von Google
Gemma 4 31B (Non-reasoning)
262k
Offen
14*
--
16
1.76
33.55
--
Logo von DeepSeek
DeepSeek V3.2 Exp (Non-reasoning) (FP8)
164k
Offen
14*
--
37
2.73
16.35
--
Logo von DeepSeek
DeepSeek V3.1 (Non-reasoning)
164k
Offen
14*
--
37
3.21
16.58
--
Logo von DeepSeek
DeepSeek V3.1
131k
Offen
13*
--
37
3.32
70.15
53.46
Logo von Alibaba
Qwen3 VL 235B A22B (Reasoning)
131k
Offen
13*
--
49
2.57
53.61
40.83
Logo von Google
Gemma 4 26B A4B (Non-reasoning)
262k
Offen
13*
--
37
1.26
14.89
--
Logo von DeepSeek
DeepSeek R1 0528
164k
Offen
13*
--
25
1.18
102.62
81.15
Logo von Kimi
Kimi K2
131k
Offen
13*
--
39
1.64
14.44
--
Logo von Alibaba
Qwen3 235B A22B 2507
131k
Offen
13
$0.11
77
2.19
34.80
26.08
Logo von OpenAI
gpt-oss-120b (high)
131k
Offen
12
$0.04
105
1.17
25.03
19.09
Logo von Alibaba
Qwen3 235B 2507 (Non-reasoning)
131k
Offen
12*
--
46
1.62
12.41
--
Logo von Alibaba
Qwen3 Coder 480B
262k
Offen
12*
--
52
2.12
11.74
--
Logo von MiniMax
MiniMax M1 80k
1M
Offen
12*
--
97
1.78
27.57
20.64
Logo von DeepSeek
DeepSeek R1 (Jan) Turbo
64k
Offen
11
$0.11
22
1.22
130.48
106.56
Logo von DeepSeek
DeepSeek R1 (Jan)
64k
Offen
11
$0.46
22
1.26
128.04
104.51
Logo von Z AI
GLM-4.6V
131k
Offen
11*
--
70
3.24
38.78
28.43
Logo von Z AI
GLM-4.7-Flash (Non-reasoning)
200k
Offen
11*
--
70
14.13
21.32
--
Logo von OpenAI
gpt-oss-120b (low)
131k
Offen
10*
--
102
0.98
25.49
19.61
Logo von Alibaba
Qwen3 Coder Next (FP8)
262k
Offen
10
$0.33
166
2.48
5.50
--
Logo von OpenAI
gpt-oss-20b (low)
131k
Offen
10*
--
231
1.13
11.93
8.64
Logo von Alibaba
Qwen3 VL 235B A22B
131k
Offen
10*
--
38
2.35
15.50
--
Logo von Alibaba
Qwen3 Next 80B A3B
131k
Offen
10*
--
187
1.75
4.43
--
Logo von Meta
Llama 4 Maverick (FP8)
1.05M
Offen
9
$0.04
84
0.78
6.75
--
Logo von OpenAI
gpt-oss-20b (high)
131k
Offen
9
$0.01
209
1.16
13.11
9.56
Logo von NVIDIA
Nemotron 3 Nano (FP4)
262k
Offen
9
$0.02
305
0.99
9.19
6.56
Logo von DeepSeek
DeepSeek V3 (Dec)
64k
Offen
8
$0.05
38
1.96
15.06
--
Logo von Z AI
GLM-4.6V (Non-reasoning)
131k
Offen
8*
--
54
3.21
12.46
--
Logo von Alibaba
Qwen3 235B (Non-reasoning) (FP8)
41k
Offen
8*
--
36
2.60
16.37
--
Logo von Alibaba
Qwen3 VL 30B A3B
131k
Offen
8*
--
107
1.52
6.17
--
Logo von Meta
Llama 3.3 70B
131k
Offen
8*
--
43
1.72
13.30
--
Logo von Z AI
GLM-4.5V
65.5k
Offen
8*
--
37
2.71
69.86
53.72
Logo von Meta
Llama 3.1 8B
16.4k
Offen
7*
--
156
0.84
4.04
--
Logo von NVIDIA
Nemotron 3 Nano (Non-reasoning) (FP4)
262k
Offen
7*
--
288
0.99
2.73
--
Logo von Z AI
GLM-4.5V (Non-reasoning)
65.5k
Offen
7*
--
41
2.76
14.99
--
Logo von Meta
Llama 4 Scout
131k
Offen
6
$0.11
22
1.63
24.87
--
Logo von Meta
Llama 3 70B
8.19k
Offen
5*
--
--
--
--
--
Logo von Google
Gemma 3 27B
98.3k
Offen
5
$0.24
31
1.74
17.66
--
Logo von Meta
Llama 3 8B
8.19k
Offen
5*
--
--
--
--
--

Wichtige Definitionen

Häufig gestellte Fragen

Häufige Fragen zu Novita