Microsoft Azure: Intelligenz, Leistung und Preise der Modelle

Microsoft Azure
Microsoft Azure

Diese Analyse soll Sie bei der Auswahl des besten von Microsoft Azure angebotenen Modells für Ihren Anwendungsfall unterstützen.

Höchste Intelligenz

Updated
#1
GPT-6 Astra (max)GPT-6 Astra (max)
53
#2
Claude Fable 5 (with fallback)Claude Fable 5 (with fallback)
50
#3
GPT-6 Sol (max)GPT-6 Sol (max)
48
#4
GPT-5.6 Sol (max)GPT-5.6 Sol (max)
47
#5
GPT-6 Astra (low)GPT-6 Astra (low)
46

Intelligence Index

Insgesamt 82 Modelle

Am schnellsten

#1
Llama 4 Maverick (FP8)Llama 4 Maverick (FP8)
436 t/s
#2
gpt-oss-120b (low)gpt-oss-120b (low)
335 t/s
#3
GPT-5.4 mini (xhigh)GPT-5.4 mini (xhigh)
328 t/s
#4
gpt-oss-120b (high)gpt-oss-120b (high)
320 t/s
#5
GPT-4.1 nanoGPT-4.1 nano
287 t/s

Ausgabegeschwindigkeit

Insgesamt 82 Modelle

Niedrigster Preis

#1
GPT-5 nano (high)GPT-5 nano (high)
$0.05
#2
GPT-5 nano (medium)GPT-5 nano (medium)
$0.05
#3
GPT-6 Luna (max)GPT-6 Luna (max)
$0.08
#4
GPT-4.1 nanoGPT-4.1 nano
$0.08
#5
GPT-4o miniGPT-4o mini
$0.14

Mischpreis (pro 1 Mio. Tokens)

Insgesamt 82 Modelle

Azure bietet 82 Modelle mit jeweils unterschiedlichen Merkmalen bei Intelligenz, Leistung und Preis an. Nachfolgend werden die wichtigsten Metriken der Modelle verglichen.

  • Bei der Intelligenz sind GPT-6 Astra (max) (53), Claude Fable 5 (with fallback) (50) und GPT-6 Sol (max) (48) die führenden Modelle von Azure.
  • Bei der Ausgabegeschwindigkeit sind Llama 4 Maverick (FP8) (436 t/s), gpt-oss-120b (low) (335 t/s) und GPT-5.4 mini (xhigh) (328 t/s) am schnellsten. Die Geschwindigkeit unterscheidet sich deutlich zwischen den Modellen; der Unterschied zwischen dem schnellsten und dem langsamsten beträgt 52 %.
  • Bei der Latenz bieten Phi-4 Mini (0.83 s), Llama 4 Scout (0.84 s) und Claude 4.5 Haiku (non-reasoning) (0.93 s) die kürzeste Zeit bis zum ersten Antworttoken.
  • Beim Preis bieten GPT-5 nano (high) ($0.05), GPT-5 nano (medium) ($0.05) und GPT-6 Luna (max) ($0.08) die niedrigsten Mischpreise pro 1 Mio. Tokens. Die Preise unterscheiden sich zwischen den Modellen bis zum 2.7-Fachen.
  • Bei der Größe des Kontextfensters unterstützen GPT-6 Sol (max) (1M), GPT-5.4 (xhigh) (1M) und Claude Fable 5 (with fallback) (1M) die größten Kontextfenster von Azure.
Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Intelligenzevaluationen

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
Mehr anzeigen

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

Quantitative analysis on spreadsheets & documents

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Intelligence Index vs. Preis

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Kontextfenster

Kontextfenster

Context window: tokens limit · Higher is better

Preise

Intelligence Index vs. Preis

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Leistungsübersicht

Ausgabegeschwindigkeit vs. Preis

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Geschwindigkeit

Gemessen anhand der Ausgabegeschwindigkeit (Tokens pro Sekunde)

Ausgabegeschwindigkeit

Output tokens per second · Higher is better

Latenz

Gemessen anhand der Zeit (Sekunden) bis zum ersten Token

Latenz: Zeit bis zum ersten Antworttoken

Sekunden bis zum ersten Antwort-Token · Berücksichtigt die „Denkzeit“ von Reasoning-Modellen

Ende-zu-Ende-Antwortzeit

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

Ende-zu-Ende-Antwortzeit vs. Preis

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Weitere Analyse
Logo von OpenAI
GPT-6 Astra (max)
524k
Proprietär
53
$3.19
69
354.77
362.00
--
Logo von Anthropic
Claude Fable 5 (with fallback)
1M
Proprietär
50
$8.50
66
100.61
108.24
--
Logo von OpenAI
GPT-6 Sol (max)
1.05M
Proprietär
48
--
149
99.81
103.16
--
Logo von OpenAI
GPT-5.6 Sol (max)
524k
Proprietär
47
$1.95
103
127.37
132.24
--
Logo von OpenAI
GPT-6 Astra (low)
524k
Proprietär
46
$0.79
56
3.10
12.11
--
Logo von OpenAI
GPT-5.6 Sol (xhigh)
524k
Proprietär
44
$1.26
98
66.87
71.95
--
Logo von OpenAI
GPT-5.6 Sol (high)
524k
Proprietär
42
$0.85
88
17.16
22.86
--
Logo von Anthropic
Claude Opus 4.7 (max)
1M
Proprietär
41*
--
46
20.67
31.46
--
Logo von OpenAI
GPT-5.4 (xhigh)
1.05M
Proprietär
39*
--
100
181.33
186.34
--
Logo von Anthropic
Claude Sonnet 5 (max)
1M
Proprietär
38
$4.75
85
194.75
200.63
--
Logo von OpenAI
GPT-6 Luna (max)
524k
Proprietär
38
--
206
70.92
73.35
--
Logo von OpenAI
GPT-5.6 Terra (xhigh)
524k
Proprietär
38
$0.67
116
45.63
49.93
--
Logo von OpenAI
GPT-5.5 (high)
524k
Proprietär
37
$1.13
83
35.33
41.33
--
Logo von OpenAI
GPT-5.6 Luna (xhigh)
524k
Proprietär
35
$0.09
162
46.38
49.47
--
Logo von OpenAI
GPT-5.6 Terra (high)
524k
Proprietär
34
$0.35
109
3.09
7.67
--
Logo von OpenAI
GPT-5.6 Luna (high)
524k
Proprietär
32
$0.05
150
13.55
16.89
--
Logo von Anthropic
Claude Opus 4.6 (max)
1M
Proprietär
32*
--
41
24.77
37.10
--
Logo von DeepSeek
DeepSeek V4 Pro (max)
1M
Offen
30
$9.65
81
1.72
62.11
54.20
Logo von OpenAI
GPT-5.2 (xhigh)
400k
Proprietär
30*
--
89
110.20
115.85
--
Logo von DeepSeek
DeepSeek V4 Pro (high)
1M
Offen
30*
--
82
1.85
32.08
24.17
Logo von Anthropic
Claude Sonnet 4.6 (max)
200k
Proprietär
30
$2.70
56
130.59
139.48
--
Logo von Anthropic
Claude Opus 4.5
200k
Proprietär
29*
--
48
18.72
29.21
--
Logo von OpenAI
GPT-5.2 Codex (xhigh)
400k
Proprietär
29*
--
115
86.52
90.87
--
Logo von Kimi
Kimi K2.6
262k
Offen
27
$1.91
227
1.53
23.34
19.61
Logo von OpenAI
GPT-5.2 (medium)
400k
Proprietär
27*
--
88
5.18
10.87
--
Logo von Anthropic
Claude Opus 4.6 (non-reasoning, high)
1M
Proprietär
26*
--
38
1.88
15.12
--
Logo von SpaceXAI
Grok 4.20 0309 v2
262k
Proprietär
26*
--
216
10.56
12.87
--
Logo von OpenAI
GPT-5 Codex (high)
400k
Proprietär
25*
--
156
10.45
13.65
--
Logo von SpaceXAI
Grok 4.3 (high)
200k
Proprietär
25
$0.53
157
20.96
24.14
--
Logo von SpaceXAI
Grok 4.3 (medium)
200k
Proprietär
25*
--
157
14.72
17.91
--
Logo von OpenAI
GPT-5.1 (high)
272k
Proprietär
25*
--
115
41.64
45.99
--
Logo von Anthropic
Claude Sonnet 4.6 (non-reasoning, high)
200k
Proprietär
25*
--
43
1.63
13.15
--
Logo von SpaceXAI
Grok 4.3 (low)
200k
Proprietär
24*
--
139
6.02
9.61
--
Logo von OpenAI
GPT-5.4 mini (xhigh)
400k
Proprietär
24
$0.43
254
127.11
129.08
--
Logo von OpenAI
GPT-5.1 Codex (high)
400k
Proprietär
24*
--
120
9.35
13.50
--
Logo von Anthropic
Claude Opus 4.5 (non-reasoning)
200k
Proprietär
24*
--
47
1.51
12.13
--
Logo von Kimi
Kimi K2.6 (non-reasoning)
262k
Offen
24*
--
194
1.60
4.18
--
Logo von Kimi
Kimi K2.5
262k
Offen
23*
--
131
1.40
27.93
22.70
Logo von OpenAI
GPT-5 (high)
400k
Proprietär
23*
--
97
68.03
73.21
--
Logo von OpenAI
GPT-5 (medium)
400k
Proprietär
23*
--
91
35.09
40.55
--
Logo von Anthropic
Claude 4.1 Opus
200k
Proprietär
23*
--
--
--
--
--
Logo von SpaceXAI
Grok 4
256k
Proprietär
22*
--
71
10.93
17.93
--
Logo von Kimi
Kimi K2 Thinking
256k
Offen
22*
--
99
1.91
27.12
20.17
Logo von OpenAI
o3-pro
200k
Proprietär
22*
--
--
--
--
--
Logo von DeepSeek
DeepSeek V4 Pro (non-reasoning)
1M
Offen
21*
--
89
1.58
7.21
--
Logo von OpenAI
GPT-5 (low)
400k
Proprietär
21*
--
92
11.44
16.85
--
Logo von Anthropic
Claude 4.5 Sonnet
200k
Proprietär
21
$0.54
44
14.87
26.12
--
Logo von OpenAI
GPT-5 mini (medium)
400k
Proprietär
21*
--
132
10.36
14.15
--
Logo von OpenAI
GPT-5.1 Codex mini (high)
400k
Proprietär
20*
--
163
15.60
18.67
--
Logo von OpenAI
o3
200k
Proprietär
20*
--
97
24.29
29.43
--
Logo von OpenAI
GPT-5.4 mini (medium)
400k
Proprietär
20*
--
211
9.14
11.51
--
Logo von Kimi
Kimi K2.5 (non-reasoning)
262k
Offen
19*
--
122
1.35
5.46
--
Logo von Anthropic
Claude 4.5 Sonnet (non-reasoning)
200k
Proprietär
19*
--
42
1.46
13.31
--
Logo von Anthropic
Claude 4.1 Opus (non-reasoning)
200k
Proprietär
19*
--
--
--
--
--
Logo von SpaceXAI
Grok 4 Fast
2M
Proprietär
18*
--
--
--
--
--
Logo von OpenAI
GPT-5.2 (non-reasoning)
400k
Proprietär
17*
--
86
1.48
7.31
--
Logo von Anthropic
Claude 4.5 Haiku
200k
Proprietär
17
$0.22
98
15.36
20.47
--
Logo von OpenAI
GPT-5 mini (high)
400k
Proprietär
17
$0.05
131
53.20
57.02
--
Logo von OpenAI
o4-mini (high)
200k
Proprietär
17*
--
138
22.09
25.71
--
Logo von DeepSeek
DeepSeek V3.2 (non-reasoning)
128k
Offen
16*
--
166
1.90
4.91
--
Logo von Anthropic
Claude 4.5 Haiku (non-reasoning)
200k
Proprietär
15*
--
90
1.11
6.68
--
Logo von OpenAI
o1
200k
Proprietär
15*
--
--
--
--
--
Logo von SpaceXAI
Grok 3 mini Reasoning (high)
32k
Proprietär
15*
--
--
--
--
--
Logo von OpenAI
GPT-5.1 (non-reasoning)
400k
Proprietär
13*
--
110
1.24
5.80
--
Logo von OpenAI
GPT-5 nano (high)
400k
Proprietär
13*
--
203
69.34
71.80
--
Logo von OpenAI
GPT-4.1
1M
Proprietär
13*
--
114
1.64
6.02
--
Logo von OpenAI
GPT-5 nano (medium)
400k
Proprietär
12*
--
205
32.76
35.20
--
Logo von OpenAI
o3-mini
200k
Proprietär
12*
--
218
7.00
9.29
--
Logo von SpaceXAI
Grok 3
16k
Proprietär
12*
--
--
--
--
--
Logo von OpenAI
gpt-oss-120b (high)
131k
Offen
12
$0.11
315
0.72
8.65
6.34
Logo von OpenAI
GPT-5 (minimal)
400k
Proprietär
11*
--
93
1.78
7.14
--
Logo von OpenAI
o1-preview
128k
Proprietär
11*
--
--
--
--
--
Logo von OpenAI
GPT-5.4 mini (non-reasoning)
400k
Proprietär
11*
--
187
1.05
3.73
--
Logo von SpaceXAI
Grok 4 Fast (non-reasoning)
2M
Proprietär
11*
--
--
--
--
--
Logo von OpenAI
o3-mini (high)
200k
Proprietär
11
--
228
20.21
22.40
--
Logo von OpenAI
gpt-oss-120b (low)
131k
Offen
10*
--
334
0.84
8.32
5.99
Logo von OpenAI
GPT-4.1 mini
1M
Proprietär
10*
--
103
1.54
6.38
--
Logo von Meta
Llama 4 Maverick (FP8)
128k
Offen
10*
--
455
1.28
2.38
--
Logo von OpenAI
GPT-5 mini (minimal) East US 2 - Global Standard
400k
Proprietär
10*
--
--
--
--
--
Logo von Mistral
Mistral Large 3
256k
Offen
9
$0.10
56
1.86
10.78
--
Logo von Mistral
Mistral Medium 3
128k
Proprietär
9*
--
47
2.27
12.91
--
Logo von OpenAI
GPT-4o (Nov)
128k
Proprietär
8*
--
125
1.90
5.91
--
Logo von Meta
Llama 4 Scout
128k
Offen
8*
--
134
0.85
4.57
--
Logo von OpenAI
GPT-4.1 nano
1M
Proprietär
8*
--
276
1.47
3.27
--
Logo von OpenAI
GPT-4o (Aug)
128k
Proprietär
8*
--
141
1.38
4.93
--
Logo von Meta
Llama 3.3 70B
128k
Offen
8*
--
124
2.18
6.20
--
Logo von OpenAI
GPT-4o (May)
128k
Proprietär
7*
--
143
1.55
5.03
--
Logo von OpenAI
GPT-5 nano (minimal) East US 2 - Global Standard
400k
Proprietär
7*
--
--
--
--
--
Logo von OpenAI
GPT-4 Turbo
128k
Proprietär
7*
--
108
1.78
6.42
--
Logo von Cohere
Command A
256k
Offen
7*
--
42
3.04
14.82
--
Logo von OpenAI
GPT-4o mini
128k
Proprietär
7*
--
78
1.87
8.24
--
Logo von Microsoft
Phi-4 Mini
128k
Offen
6*
--
44
0.82
12.09
--
Logo von Microsoft
Phi-4
16.4k
Offen
6*
--
36
2.79
16.59
--
Logo von Microsoft
Phi-4 Multimodal
4.1k
Offen
6*
--
--
--
--
--

Wichtige Definitionen

Häufig gestellte Fragen

Häufige Fragen zu Microsoft Azure