SiliconFlow: Intelligenz, Leistung und Preise der Modelle

SiliconFlow
SiliconFlow

Diese Analyse soll Sie bei der Auswahl des besten von SiliconFlow angebotenen Modells für Ihren Anwendungsfall unterstützen.

Höchste Intelligenz

Updated
#1
GLM-5.3-FlashGLM-5.3-Flash
42
#2
DeepSeek V4.1 Flash (max)DeepSeek V4.1 Flash (max)
39
#3
DeepSeek V4 Pro 0813 (max)DeepSeek V4 Pro 0813 (max)
36
#4
DeepSeek V4 Flash Vision (max)DeepSeek V4 Flash Vision (max)
35
#5
DeepSeek V4 Flash 0731 (max)DeepSeek V4 Flash 0731 (max)
34

Intelligence Index

Insgesamt 37 Modelle

Am schnellsten

#1
DeepSeek V4 Flash Vision (max)DeepSeek V4 Flash Vision (max)
215 t/s
#2
DeepSeek V4.1 Flash (max)DeepSeek V4.1 Flash (max)
172 t/s
#3
DeepSeek V4 Flash (high) (FP8)DeepSeek V4 Flash (high) (FP8)
121 t/s
#4
GLM-5.2 (max) (FP8)GLM-5.2 (max) (FP8)
118 t/s
#5
Gemma 4 12B (non-reasoning)Gemma 4 12B (non-reasoning)
116 t/s

Ausgabegeschwindigkeit

Insgesamt 37 Modelle

Niedrigster Preis

#1
DeepSeek V4 Flash (high) (FP8)DeepSeek V4 Flash (high) (FP8)
$0.07
#2
DeepSeek V4 Flash (max) (FP8)DeepSeek V4 Flash (max) (FP8)
$0.07
#3
DeepSeek V4.1 Flash (max)DeepSeek V4.1 Flash (max)
$0.09
#4
GLM-5.3-FlashGLM-5.3-Flash
$0.10
#5
Hy3 (FP8)Hy3 (FP8)
$0.10

Mischpreis (pro 1 Mio. Tokens)

Insgesamt 37 Modelle

SiliconFlow bietet 37 Modelle mit jeweils unterschiedlichen Merkmalen bei Intelligenz, Leistung und Preis an. Nachfolgend werden die wichtigsten Metriken der Modelle verglichen.

  • Bei der Intelligenz sind GLM-5.3-Flash (42), DeepSeek V4.1 Flash (max) (39) und DeepSeek V4 Pro 0813 (max) (36) die führenden Modelle von SiliconFlow.
  • Bei der Ausgabegeschwindigkeit sind DeepSeek V4 Flash Vision (max) (215 t/s), DeepSeek V4.1 Flash (max) (172 t/s) und DeepSeek V4 Flash (high) (FP8) (121 t/s) am schnellsten. Die Geschwindigkeit unterscheidet sich deutlich zwischen den Modellen; der Unterschied zwischen dem schnellsten und dem langsamsten beträgt 85 %.
  • Bei der Latenz bieten GLM-5.2 (non-reasoning) (FP8) (1.36 s), Kimi K2.6 (non-reasoning) (FP8) (1.55 s) und Gemma 4 26B A4B (non-reasoning) (FP8) (2.35 s) die kürzeste Zeit bis zum ersten Antworttoken.
  • Beim Preis bieten DeepSeek V4 Flash (high) (FP8) ($0.07), DeepSeek V4 Flash (max) (FP8) ($0.07) und DeepSeek V4.1 Flash (max) ($0.09) die niedrigsten Mischpreise pro 1 Mio. Tokens.
  • Bei der Größe des Kontextfensters unterstützen GLM-5.2 (max) (FP8) (1M), DeepSeek V4 Pro (max) (FP8) (1M) und DeepSeek V4 Pro (high) (FP8) (1M) die größten Kontextfenster von SiliconFlow.
Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Intelligenzevaluationen

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
Mehr anzeigen

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

Quantitative analysis on spreadsheets & documents

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Intelligence Index vs. Preis

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Kontextfenster

Kontextfenster

Context window: tokens limit · Higher is better

Preise

Intelligence Index vs. Preis

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Leistungsübersicht

Ausgabegeschwindigkeit vs. Preis

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Geschwindigkeit

Gemessen anhand der Ausgabegeschwindigkeit (Tokens pro Sekunde)

Ausgabegeschwindigkeit

Output tokens per second · Higher is better

Latenz

Gemessen anhand der Zeit (Sekunden) bis zum ersten Token

Latenz: Zeit bis zum ersten Antworttoken

Sekunden bis zum ersten Antwort-Token · Berücksichtigt die „Denkzeit“ von Reasoning-Modellen

Ende-zu-Ende-Antwortzeit

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

Ende-zu-Ende-Antwortzeit vs. Preis

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Weitere Analyse
Logo von Z AI
GLM-5.3-Flash
1M
Offen
42
$0.50
57
1.51
45.37
35.09
Logo von DeepSeek
DeepSeek V4.1 Flash (max)
1M
Offen
39
$0.86
172
2.05
16.61
11.65
Logo von DeepSeek
DeepSeek V4 Pro 0813 (max)
1.05M
Offen
36
$1.45
88
1.70
30.16
22.77
Logo von DeepSeek
DeepSeek V4 Flash Vision (max)
1M
Proprietär
35
$2.51
215
1.21
12.85
9.31
Logo von DeepSeek
DeepSeek V4 Flash 0731 (max)
1.05M
Offen
34
$0.15
43
2.09
60.83
47.00
Logo von Z AI
GLM-5.2 (max) (FP8)
1.05M
Offen
34
$0.85
114
1.27
23.18
17.53
Logo von DeepSeek
DeepSeek V4 Pro (max) (FP8)
1.05M
Offen
30
--
52
1.99
96.40
84.73
Logo von DeepSeek
DeepSeek V4 Pro (high) (FP8)
1.05M
Offen
30*
--
51
1.80
51.13
39.43
Logo von MiniMax
MiniMax-M3 (FP8)
1M
Offen
29
$0.45
86
2.54
31.68
23.31
Logo von Z AI
GLM-5 (FP8)
200k
Offen
28*
--
--
--
--
--
Logo von Kimi
Kimi K2.6 (FP8)
262k
Offen
27
$0.61
27
1.57
184.71
164.65
Logo von Z AI
GLM-5.1 (FP8)
205k
Offen
26
$1.55
31
2.27
141.97
123.42
Logo von Tencent
Hy3 (FP8)
256k
Offen
25
$0.07
89
3.00
31.17
22.53
Logo von DeepSeek
DeepSeek V4 Flash (high) (FP8)
1.05M
Offen
24
$0.12
123
1.36
15.51
10.08
Logo von Z AI
GLM-5.1 (non-reasoning) (FP8)
205k
Offen
24*
--
29
2.40
19.61
--
Logo von DeepSeek
DeepSeek V4 Flash (max) (FP8)
1.05M
Offen
24
$0.10
43
1.72
143.19
129.90
Logo von Kimi
Kimi K2.6 (non-reasoning) (FP8)
262k
Offen
24*
--
28
1.56
19.51
--
Logo von Kimi
Kimi K2.5 (FP8)
262k
Offen
23*
--
27
2.25
130.36
109.64
Logo von Alibaba
Qwen3.5 27B (FP8)
262k
Offen
23*
--
24
3.59
106.30
82.17
Logo von Z AI
GLM-5.2 (non-reasoning) (FP8)
1.05M
Offen
22*
--
95
1.35
6.61
--
Logo von Z AI
GLM-5 (non-reasoning) (FP8)
205k
Offen
22*
--
--
--
--
--
Logo von DeepSeek
DeepSeek V3.2 (FP8)
164k
Offen
21*
--
17
2.61
147.25
115.71
Logo von Alibaba
Qwen3.6 27B (FP8)
262k
Offen
21
$0.36
36
3.22
175.12
157.98
Logo von Alibaba
Qwen3.5 35B A3B (FP8)
262k
Offen
19*
--
47
2.00
55.75
43.00
Logo von LongCat
LongCat 2.0 (FP8)
262k
Offen
19
$0.15
72
2.42
37.30
27.91
Logo von Alibaba
Qwen3.6 35B A3B (FP8)
262k
Offen
18
$0.32
111
1.87
55.04
48.66
Logo von StepFun
Step 3.5 Flash (FP8)
262k
Offen
17*
--
66
1.73
39.43
30.16
Logo von DeepSeek
DeepSeek V3.2 (non-reasoning) (FP8)
164k
Offen
16*
--
15
3.80
36.08
--
Logo von Alibaba
Qwen3.5 122B A10B (FP8)
262k
Offen
16
$0.21
55
1.75
47.45
36.56
Logo von Google
Gemma 4 31B (FP8)
262k
Offen
15
$0.54
48
3.57
50.11
36.14
Logo von Google
Gemma 4 12B
262k
Offen
14*
--
113
2.39
24.48
17.67
Logo von Google
Gemma 4 31B (non-reasoning) (FP8)
262k
Offen
14*
--
45
3.56
14.62
--
Logo von Google
Gemma 4 26B A4B (non-reasoning) (FP8)
262k
Offen
13*
--
99
2.30
7.35
--
Logo von ByteDance Seed
Seed-OSS-36B-Instruct
262k
Offen
12*
--
41
2.89
63.76
48.70
Logo von Z AI
GLM-4.6V
128k
Offen
11*
--
--
--
--
--
Logo von Alibaba
Qwen3.5 9B (FP8)
262k
Offen
11
$0.16
39
2.37
66.09
50.97
Logo von Z AI
GLM-4.5-Air
98.3k
Offen
11*
--
73
2.43
36.57
27.31
Logo von Google
Gemma 4 12B (non-reasoning)
262k
Offen
9*
--
117
2.39
6.66
--
Logo von Z AI
GLM-4.6V (non-reasoning)
128k
Offen
8*
--
--
--
--
--
Logo von InclusionAI
Ling-flash-2.0
131k
Offen
8*
--
5
2.47
102.92
--
Logo von Alibaba
Qwen2.5 72B (FP8)
32k
Offen
8*
--
28
4.18
21.96
--
Logo von Baidu
ERNIE 4.5 300B A47B
131k
Offen
8*
--
--
--
--
--
Logo von InclusionAI
Ring-flash-2.0
131k
Offen
7*
--
--
--
--
--

Wichtige Definitionen

Häufig gestellte Fragen

Häufige Fragen zu SiliconFlow