Parasail: Intelligenz, Leistung und Preise der Modelle

Parasail
Parasail

Diese Analyse soll Sie bei der Auswahl des besten von Parasail angebotenen Modells für Ihren Anwendungsfall unterstützen.

Höchste Intelligenz

Updated
#1
GLM-5.3 (max)GLM-5.3 (max)
45
#2
Kimi K3 (max)Kimi K3 (max)
44
#3
GLM-5.3-FlashGLM-5.3-Flash
42
#4
DeepSeek V4.1 Flash (max)DeepSeek V4.1 Flash (max)
39
#5
DeepSeek V4 Flash 0731 (max)DeepSeek V4 Flash 0731 (max)
34

Intelligence Index

Insgesamt 29 Modelle

Am schnellsten

#1
GLM-5.2 (max) (NVFP4)GLM-5.2 (max) (NVFP4)
238 t/s
#2
DeepSeek V4.1 Flash (max)DeepSeek V4.1 Flash (max)
237 t/s
#3
GLM-5.3-FlashGLM-5.3-Flash
236 t/s
#4
Gemma 3 4B (FP8)Gemma 3 4B (FP8)
190 t/s
#5
Kimi K2.6Kimi K2.6
174 t/s

Ausgabegeschwindigkeit

Insgesamt 29 Modelle

Niedrigster Preis

#1
Gemma 3 4B (FP8)Gemma 3 4B (FP8)
$0.05
#2
Gemma 3 27BGemma 3 27B
$0.09
#3
GLM-5.3-FlashGLM-5.3-Flash
$0.10
#4
Gemma 4 26B A4BGemma 4 26B A4B
$0.10
#5
Gemma 4 26B A4B (non-reasoning)Gemma 4 26B A4B (non-reasoning)
$0.10

Mischpreis (pro 1 Mio. Tokens)

Insgesamt 29 Modelle

Parasail bietet 29 Modelle mit jeweils unterschiedlichen Merkmalen bei Intelligenz, Leistung und Preis an. Nachfolgend werden die wichtigsten Metriken der Modelle verglichen.

  • Bei der Intelligenz sind GLM-5.3 (max) (45), Kimi K3 (max) (44) und GLM-5.3-Flash (42) die führenden Modelle von Parasail.
  • Bei der Ausgabegeschwindigkeit sind GLM-5.2 (max) (NVFP4) (238 t/s), DeepSeek V4.1 Flash (max) (237 t/s) und GLM-5.3-Flash (236 t/s) am schnellsten.
  • Bei der Latenz bieten Gemma 3 4B (FP8) (0.98 s), Qwen3.6 35B A3B (non-reasoning) (FP8) (1.00 s) und Qwen3 Coder Next (FP8) (1.05 s) die kürzeste Zeit bis zum ersten Antworttoken.
  • Beim Preis bieten Gemma 3 4B (FP8) ($0.05), Gemma 3 27B ($0.09) und GLM-5.3-Flash ($0.10) die niedrigsten Mischpreise pro 1 Mio. Tokens. Die Preise unterscheiden sich zwischen den Modellen bis zum 2.2-Fachen.
  • Bei der Größe des Kontextfensters unterstützen Kimi K3 (max) (1M), DeepSeek V4.1 Flash (max) (1M) und DeepSeek V4 Flash 0731 (max) (1M) die größten Kontextfenster von Parasail.
Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Intelligenzevaluationen

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
Mehr anzeigen

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

Quantitative analysis on spreadsheets & documents

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Intelligence Index vs. Preis

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Kontextfenster

Kontextfenster

Context window: tokens limit · Higher is better

Preise

Intelligence Index vs. Preis

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Leistungsübersicht

Ausgabegeschwindigkeit vs. Preis

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Geschwindigkeit

Gemessen anhand der Ausgabegeschwindigkeit (Tokens pro Sekunde)

Ausgabegeschwindigkeit

Output tokens per second · Higher is better

Latenz

Gemessen anhand der Zeit (Sekunden) bis zum ersten Token

Latenz: Zeit bis zum ersten Antworttoken

Sekunden bis zum ersten Antwort-Token · Berücksichtigt die „Denkzeit“ von Reasoning-Modellen

Ende-zu-Ende-Antwortzeit

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

Ende-zu-Ende-Antwortzeit vs. Preis

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant

Weitere Analyse
Logo von Z AI
GLM-5.3 (max)
1M
Offen
45
$1.97
167
1.02
16.00
11.98
Logo von Kimi
Kimi K3 (max)
1.05M
Offen
44
$4.14
146
1.32
18.41
13.67
Logo von Z AI
GLM-5.3-Flash
1M
Offen
42
$0.67
236
0.91
11.52
8.49
Logo von DeepSeek
DeepSeek V4.1 Flash (max)
1.05M
Offen
39
$0.90
237
0.75
11.29
8.43
Logo von DeepSeek
DeepSeek V4 Flash 0731 (max)
1.05M
Offen
34
--
131
1.17
20.32
15.32
Logo von Z AI
GLM-5.2 (max) (NVFP4)
1M
Offen
34
--
238
1.11
11.61
8.39
Logo von Alibaba
Qwen3.8 27B (xhigh) (FP8)
262k
Offen
34
$0.60
77
1.29
33.55
25.81
Logo von MiniMax
MiniMax-M3 (MXFP8)
1M
Offen
29
$0.46
160
1.16
16.81
12.52
Logo von Kimi
Kimi K2.6
262k
Offen
27
$0.68
163
1.29
31.60
27.25
Logo von DeepSeek
DeepSeek V4 Flash (high) (FP8)
1.05M
Offen
24
--
83
1.71
22.71
14.96
Logo von DeepSeek
DeepSeek V4 Flash (max) (FP8)
1.05M
Offen
24
--
78
1.63
79.84
71.81
Logo von Kimi
Kimi K2.6 (non-reasoning) (INT4)
262k
Offen
24*
--
166
1.26
4.27
--
Logo von Alibaba
Qwen3.5 397B A17B
262k
Offen
18
$0.29
49
1.32
76.03
64.58
Logo von Alibaba
Qwen3.6 35B A3B
262k
Offen
18
$0.12
84
1.01
71.58
64.59
Logo von Google
Gemma 4 26B A4B
256k
Offen
17*
--
61
1.69
42.36
32.53
Logo von Alibaba
Qwen3.6 35B A3B (non-reasoning) (FP8)
262k
Offen
15*
--
82
1.01
7.09
--
Logo von Google
Gemma 4 31B
262k
Offen
15
$0.07
53
2.23
44.73
33.00
Logo von Google
Gemma 4 31B (non-reasoning)
262k
Offen
14*
--
44
1.95
13.42
--
Logo von Google
Gemma 4 26B A4B (non-reasoning)
262k
Offen
13*
--
68
1.70
9.07
--
Logo von Alibaba
Qwen3 235B 2507
131k
Offen
12*
--
39
1.23
14.08
--
Logo von OpenAI
gpt-oss-120b (high)
131k
Offen
12
$0.06
165
0.80
15.99
12.15
Logo von OpenAI
gpt-oss-120b (low)
131k
Offen
10*
--
148
0.85
17.68
13.47
Logo von Meta
Llama 4 Maverick (FP8)
1.05M
Offen
10*
--
75
1.28
7.96
--
Logo von Alibaba
Qwen3 VL 235B A22B (FP8)
131k
Offen
10*
--
41
1.31
13.42
--
Logo von Alibaba
Qwen3 Next 80B A3B
262k
Offen
10*
--
159
1.12
4.27
--
Logo von Alibaba
Qwen3 Coder Next (FP8)
262k
Offen
9
$0.12
64
1.07
8.87
--
Logo von Meta
Llama 3.3 70B (FP8)
131k
Offen
8*
--
74
2.56
9.29
--
Logo von Allen Institute for AI
Olmo 3.1 32B Think
65.5k
Offen
7*
--
--
--
--
--
Logo von Allen Institute for AI
Olmo 3 7B
65.5k
Offen
5*
--
--
--
--
--
Logo von Google
Gemma 3 27B
131k
Offen
5
$0.10
38
2.33
15.35
--
Logo von Google
Gemma 3 4B (FP8)
131k
Offen
5*
--
173
0.98
3.87
--

Wichtige Definitionen

Häufig gestellte Fragen

Häufige Fragen zu Parasail