Microsoft Azure: inteligência, desempenho e preço dos modelos

Microsoft Azure
Microsoft Azure

Esta análise ajuda você a escolher o melhor modelo oferecido por Microsoft Azure para seu caso de uso.

Mais inteligente

Updated
#1
Claude Opus 5.5 (max with fallback)Claude Opus 5.5 (max with fallback)
58
#2
Claude Sonnet 5.5 (max with fallback)Claude Sonnet 5.5 (max with fallback)
56
#3
GPT-6 Astra (max)GPT-6 Astra (max)
53
#4
GPT-6.1 Sol (max)GPT-6.1 Sol (max)
52
#5
Claude Fable 5 (with fallback)Claude Fable 5 (with fallback)
50

Intelligence Index

88 modelos no total

Mais rápido

#1
Llama 4 Maverick (FP8)Llama 4 Maverick (FP8)
462 t/s
#2
gpt-oss-120b (low)gpt-oss-120b (low)
375 t/s
#3
gpt-oss-120b (high)gpt-oss-120b (high)
335 t/s
#4
GPT-5.4 mini (xhigh)GPT-5.4 mini (xhigh)
298 t/s
#5
GPT-4.1 nanoGPT-4.1 nano
265 t/s

Velocidade de saída

88 modelos no total

Menor preço

#1
GPT-5 nano (high)GPT-5 nano (high)
$0.05
#2
GPT-5 nano (medium)GPT-5 nano (medium)
$0.05
#3
GPT-6 Luna (max)GPT-6 Luna (max)
$0.08
#4
GPT-6 Luna (non-reasoning)GPT-6 Luna (non-reasoning)
$0.08
#5
GPT-4.1 nanoGPT-4.1 nano
$0.08

Preço combinado (por 1M de tokens)

88 modelos no total

Azure oferece 88 modelos, cada um com características diferentes de inteligência, desempenho e preço. Veja abaixo uma comparação das principais métricas entre os modelos.

  • Em inteligência, os principais modelos oferecidos por Azure são Claude Opus 5.5 (max with fallback) (58), Claude Sonnet 5.5 (max with fallback) (56) e GPT-6 Astra (max) (53).
  • Em velocidade de saída, os modelos mais rápidos são Llama 4 Maverick (FP8) (462 t/s), gpt-oss-120b (low) (375 t/s) e gpt-oss-120b (high) (335 t/s). A velocidade varia significativamente entre os modelos, com uma diferença de 74% entre o mais rápido e o mais lento.
  • Em latência, Phi-4 Mini (0.84s), Llama 4 Scout (0.84s) e Claude 4.5 Haiku (non-reasoning) (0.93s) têm o menor tempo até o primeiro token da resposta final.
  • Em preço, GPT-5 nano (high) ($0.05), GPT-5 nano (medium) ($0.05) e GPT-6 Luna (max) ($0.08) têm os menores preços combinados por 1M de tokens.
  • Em tamanho da janela de contexto, GPT-6 Sol (max) (1M), GPT-5.4 (xhigh) (1M) e GPT-6.1 Sol (max) (1M) aceitam as maiores janelas entre os modelos oferecidos por Azure.
Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Avaliações de inteligência

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
Ver mais

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

Quantitative analysis on spreadsheets & documents

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Intelligence Index vs. preço

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Janela de contexto

Janela de contexto

Context window: tokens limit · Higher is better

Preços

Intelligence Index vs. preço

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Resumo do desempenho

Velocidade de saída vs. preço

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Velocidade

Medida pela velocidade de saída (tokens por segundo)

Velocidade de saída

Output tokens per second · Higher is better

Latência

Medida pelo tempo (segundos) até o primeiro token

Latência: Tempo até o primeiro token da resposta final

Segundos até receber o primeiro token de resposta · Inclui o tempo de “pensamento” dos modelos de raciocínio

Comportamento do cache

Taxa de acertos do cache

Proporção de tokens de entrada elegíveis para cache atendidos pelo cache · Mediana das últimas quatro semanas, atualizada em 26 de set. de 2026

Custo por tarefa vs. Taxa de acertos do cache

Weighted average cost (USD) per Intelligence Index task · Cache hit rate: median of the last four weeks, updated Sep 26, 2026
Most attractive quadrant
Pareto line

Tempo de resposta de ponta a ponta

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

Tempo de resposta de ponta a ponta vs. preço

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Análises adicionais
Logo: Anthropic
Claude Opus 5.5 (max with fallback)
1M
Proprietário
58
$6.70
97
954.11
959.24
--
Logo: Anthropic
Claude Sonnet 5.5 (max with fallback)
1M
Proprietário
56
$7.19
137
550.18
553.84
--
Logo: OpenAI
GPT-6 Astra (max)
524k
Proprietário
53
$3.19
69
399.83
407.05
--
Logo: OpenAI
GPT-6.1 Sol (max)
1.05M
Proprietário
52
$0.70
77
330.72
337.20
--
Logo: Anthropic
Claude Fable 5 (with fallback)
1M
Proprietário
50
$8.50
66
100.80
108.38
--
Logo: OpenAI
GPT-6 Sol (max)
1.05M
Proprietário
48
$1.02
161
83.25
86.36
--
Logo: OpenAI
GPT-5.6 Sol (max)
524k
Proprietário
47
$1.95
109
82.66
87.25
--
Logo: OpenAI
GPT-6 Astra (low)
524k
Proprietário
46
$0.79
59
2.79
11.31
--
Logo: OpenAI
GPT-5.6 Sol (xhigh)
524k
Proprietário
44
$1.26
116
51.08
55.38
--
Logo: OpenAI
GPT-5.6 Sol (high)
524k
Proprietário
42
$0.85
104
16.35
21.16
--
Logo: Anthropic
Claude Opus 5.5 (low with fallback)
1M
Proprietário
42
$0.59
83
7.41
13.45
--
Logo: Anthropic
Claude Opus 4.7 (max)
1M
Proprietário
41*
--
50
28.55
38.45
--
Logo: OpenAI
GPT-5.4 (xhigh)
1.05M
Proprietário
39*
--
125
139.50
143.51
--
Logo: Anthropic
Claude Sonnet 5 (max)
1M
Proprietário
38
$4.75
86
188.86
194.65
--
Logo: OpenAI
GPT-6 Luna (max)
524k
Proprietário
38
--
215
49.86
52.19
--
Logo: OpenAI
GPT-5.6 Terra (xhigh)
524k
Proprietário
38
$0.67
134
16.82
20.55
--
Logo: OpenAI
GPT-5.5 (high)
524k
Proprietário
37
$1.13
110
29.12
33.66
--
Logo: Anthropic
Claude Sonnet 5.5 (low with fallback)
1M
Proprietário
36
$0.40
116
1.33
5.63
--
Logo: OpenAI
GPT-5.6 Luna (xhigh)
524k
Proprietário
35
$0.09
210
35.49
37.87
--
Logo: OpenAI
GPT-5.6 Terra (high)
524k
Proprietário
34
$0.35
135
2.39
6.10
--
Logo: OpenAI
GPT-5.6 Luna (high)
524k
Proprietário
32
$0.05
203
9.62
12.08
--
Logo: Anthropic
Claude Opus 4.6 (max)
1M
Proprietário
32*
--
39
15.42
28.17
--
Logo: DeepSeek
DeepSeek V4 Pro (max)
1M
Aberto
30
$9.65
92
1.52
54.65
47.68
Logo: OpenAI
GPT-5.2 (xhigh)
400k
Proprietário
30*
--
97
103.12
108.26
--
Logo: DeepSeek
DeepSeek V4 Pro (high)
1M
Aberto
30*
--
86
1.50
30.64
23.29
Logo: Anthropic
Claude Sonnet 4.6 (max)
200k
Proprietário
30
$2.70
45
107.55
118.68
--
Logo: Anthropic
Claude Opus 4.5
200k
Proprietário
29*
--
53
16.71
26.08
--
Logo: OpenAI
GPT-5.2 Codex (xhigh)
400k
Proprietário
29*
--
128
93.79
97.70
--
Logo: Kimi
Kimi K2.6
262k
Aberto
27
$1.91
245
1.74
21.91
18.14
Logo: OpenAI
GPT-5.2 (medium)
400k
Proprietário
27*
--
91
5.56
11.05
--
Logo: Anthropic
Claude Opus 4.6 (non-reasoning, high)
1M
Proprietário
26*
--
42
2.06
14.00
--
Logo: SpaceXAI
Grok 4.20 0309 v2
262k
Proprietário
26*
--
224
11.18
13.41
--
Logo: OpenAI
GPT-5 Codex (high)
400k
Proprietário
25*
--
209
10.81
13.20
--
Logo: SpaceXAI
Grok 4.3 (high)
200k
Proprietário
25
$0.53
185
17.56
20.27
--
Logo: SpaceXAI
Grok 4.3 (medium)
200k
Proprietário
25*
--
153
10.19
13.46
--
Logo: OpenAI
GPT-5.1 (high)
400k
Proprietário
25*
--
122
50.88
54.97
--
Logo: Anthropic
Claude Sonnet 4.6 (non-reasoning, high)
200k
Proprietário
25*
--
46
1.30
12.06
--
Logo: SpaceXAI
Grok 4.3 (low)
200k
Proprietário
24*
--
149
4.84
8.19
--
Logo: OpenAI
GPT-5.4 mini (xhigh)
400k
Proprietário
24
$0.43
311
90.46
92.07
--
Logo: OpenAI
GPT-5.1 Codex (high)
400k
Proprietário
24*
--
127
8.21
12.15
--
Logo: Anthropic
Claude Opus 4.5 (non-reasoning)
200k
Proprietário
24*
--
49
1.45
11.72
--
Logo: Kimi
Kimi K2.6 (non-reasoning)
262k
Aberto
24*
--
219
2.26
4.54
--
Logo: Kimi
Kimi K2.5
262k
Aberto
23*
--
159
1.32
23.11
18.65
Logo: OpenAI
GPT-5 (high)
400k
Proprietário
23*
--
121
45.50
49.64
--
Logo: OpenAI
GPT-5 (medium)
400k
Proprietário
23*
--
112
29.04
33.49
--
Logo: Anthropic
Claude 4.1 Opus
200k
Proprietário
23*
--
--
--
--
--
Logo: SpaceXAI
Grok 4
256k
Proprietário
22*
--
76
11.13
17.73
--
Logo: Kimi
Kimi K2 Thinking
256k
Aberto
22*
--
168
1.28
16.17
11.91
Logo: OpenAI
o3-pro
200k
Proprietário
22*
--
--
--
--
--
Logo: DeepSeek
DeepSeek V4 Pro (non-reasoning)
1M
Aberto
21*
--
103
1.54
6.38
--
Logo: OpenAI
GPT-5 (low)
400k
Proprietário
21*
--
93
7.28
12.64
--
Logo: Anthropic
Claude 4.5 Sonnet
200k
Proprietário
21
$0.54
43
14.77
26.26
--
Logo: OpenAI
GPT-5 mini (medium)
400k
Proprietário
21*
--
150
10.57
13.91
--
Logo: OpenAI
GPT-5.1 Codex mini (high)
400k
Proprietário
20*
--
171
16.67
19.60
--
Logo: OpenAI
o3
200k
Proprietário
20*
--
122
24.09
28.19
--
Logo: OpenAI
GPT-5.4 mini (medium)
400k
Proprietário
20*
--
242
9.91
11.98
--
Logo: Kimi
Kimi K2.5 (non-reasoning)
262k
Aberto
19*
--
179
1.56
4.36
--
Logo: Anthropic
Claude 4.5 Sonnet (non-reasoning)
200k
Proprietário
19*
--
42
1.48
13.49
--
Logo: Anthropic
Claude 4.1 Opus (non-reasoning)
200k
Proprietário
19*
--
--
--
--
--
Logo: OpenAI
GPT-6 Luna (non-reasoning)
524k
Proprietário
18
$0.01
196
1.14
3.69
--
Logo: SpaceXAI
Grok 4 Fast
2M
Proprietário
18*
--
--
--
--
--
Logo: OpenAI
GPT-5.2 (non-reasoning)
400k
Proprietário
17*
--
92
1.51
6.95
--
Logo: Anthropic
Claude 4.5 Haiku
200k
Proprietário
17
$0.22
101
16.87
21.82
--
Logo: OpenAI
GPT-5 mini (high)
400k
Proprietário
17
$0.05
155
46.36
49.59
--
Logo: OpenAI
o4-mini (high)
200k
Proprietário
17*
--
149
18.92
22.29
--
Logo: DeepSeek
DeepSeek V3.2 (non-reasoning)
128k
Aberto
16*
--
162
1.91
4.99
--
Logo: Anthropic
Claude 4.5 Haiku (non-reasoning)
200k
Proprietário
15*
--
93
0.93
6.32
--
Logo: OpenAI
o1
200k
Proprietário
15*
--
--
--
--
--
Logo: SpaceXAI
Grok 3 mini Reasoning (high)
32k
Proprietário
15*
--
--
--
--
--
Logo: OpenAI
GPT-5.1 (non-reasoning)
400k
Proprietário
13*
--
129
1.03
4.91
--
Logo: OpenAI
GPT-5 nano (high)
400k
Proprietário
13*
--
224
56.31
58.55
--
Logo: OpenAI
GPT-4.1
1M
Proprietário
13*
--
119
1.46
5.66
--
Logo: OpenAI
GPT-5 nano (medium)
400k
Proprietário
12*
--
206
29.60
32.03
--
Logo: OpenAI
o3-mini
200k
Proprietário
12*
--
237
7.30
9.41
--
Logo: SpaceXAI
Grok 3
16k
Proprietário
12*
--
--
--
--
--
Logo: OpenAI
gpt-oss-120b (high)
131k
Aberto
12
$0.11
325
0.82
8.50
6.15
Logo: OpenAI
GPT-5 (minimal)
400k
Proprietário
11*
--
104
1.69
6.51
--
Logo: OpenAI
o1-preview
128k
Proprietário
11*
--
--
--
--
--
Logo: OpenAI
GPT-5.4 mini (non-reasoning)
400k
Proprietário
11*
--
240
1.09
3.18
--
Logo: SpaceXAI
Grok 4 Fast (non-reasoning)
2M
Proprietário
11*
--
--
--
--
--
Logo: OpenAI
o3-mini (high)
200k
Proprietário
11
--
264
17.21
19.10
--
Logo: OpenAI
gpt-oss-120b (low)
131k
Aberto
10*
--
366
0.72
7.55
5.46
Logo: OpenAI
GPT-4.1 mini
1M
Proprietário
10*
--
132
1.42
5.20
--
Logo: Meta
Llama 4 Maverick (FP8)
128k
Aberto
10*
--
456
1.40
2.50
--
Logo: OpenAI
GPT-5 mini (minimal) East US 2 - Global Standard
400k
Proprietário
10*
--
--
--
--
--
Logo: Mistral
Mistral Large 3
256k
Aberto
9
$0.10
93
1.55
6.93
--
Logo: Mistral
Mistral Medium 3
128k
Proprietário
9*
--
47
2.34
12.95
--
Logo: OpenAI
GPT-4o (Nov)
128k
Proprietário
8*
--
160
2.14
5.26
--
Logo: Meta
Llama 4 Scout
128k
Aberto
8*
--
130
0.84
4.68
--
Logo: OpenAI
GPT-4.1 nano
1M
Proprietário
8*
--
274
1.38
3.21
--
Logo: OpenAI
GPT-4o (Aug)
128k
Proprietário
8*
--
161
1.18
4.29
--
Logo: Meta
Llama 3.3 70B
128k
Aberto
8*
--
125
2.24
6.23
--
Logo: OpenAI
GPT-4o (May)
128k
Proprietário
7*
--
159
1.50
4.65
--
Logo: OpenAI
GPT-5 nano (minimal) East US 2 - Global Standard
400k
Proprietário
7*
--
--
--
--
--
Logo: OpenAI
GPT-4 Turbo
128k
Proprietário
7*
--
120
1.66
5.84
--
Logo: Cohere
Command A
256k
Aberto
7*
--
42
2.92
14.88
--
Logo: OpenAI
GPT-4o mini
128k
Proprietário
7*
--
76
1.81
8.35
--
Logo: Microsoft
Phi-4 Mini
128k
Aberto
6*
--
45
0.83
11.95
--
Logo: Microsoft
Phi-4
16.4k
Aberto
6*
--
40
2.58
15.22
--
Logo: Microsoft
Phi-4 Multimodal
4.1k
Aberto
6*
--
--
--
--
--

Principais definições

Perguntas frequentes

Perguntas comuns sobre Microsoft Azure