Microsoft Azure: inteligencia, rendimiento y precio de sus modelos

Microsoft Azure
Microsoft Azure

Este análisis está pensado para ayudarte a elegir el mejor modelo ofrecido por Microsoft Azure para tu caso de uso.

Más inteligente

Updated
#1
GPT-6 Astra (max)GPT-6 Astra (max)
53
#2
Claude Fable 5 (with fallback)Claude Fable 5 (with fallback)
50
#3
GPT-6 Sol (max)GPT-6 Sol (max)
48
#4
GPT-5.6 Sol (max)GPT-5.6 Sol (max)
47
#5
GPT-6 Astra (low)GPT-6 Astra (low)
46

Índice de inteligencia

82 modelos en total

Más rápido

#1
Llama 4 Maverick (FP8)Llama 4 Maverick (FP8)
411 t/s
#2
gpt-oss-120b (low)gpt-oss-120b (low)
319 t/s
#3
gpt-oss-120b (high)gpt-oss-120b (high)
310 t/s
#4
GPT-5.4 mini (xhigh)GPT-5.4 mini (xhigh)
276 t/s
#5
GPT-4.1 nanoGPT-4.1 nano
263 t/s

Velocidad de salida

82 modelos en total

Menor precio

#1
GPT-5 nano (high)GPT-5 nano (high)
$0.05
#2
GPT-5 nano (medium)GPT-5 nano (medium)
$0.05
#3
GPT-6 Luna (max)GPT-6 Luna (max)
$0.08
#4
GPT-4.1 nanoGPT-4.1 nano
$0.08
#5
GPT-4o miniGPT-4o mini
$0.14

Precio combinado (por 1M de tokens)

82 modelos en total

Azure ofrece 82 modelos, cada uno con distintas características de inteligencia, rendimiento y precio. A continuación se comparan las métricas clave entre modelos.

  • En inteligencia, los mejores modelos en Azure son GPT-6 Astra (max) (53), Claude Fable 5 (with fallback) (50) y GPT-6 Sol (max) (48).
  • En velocidad de salida, los modelos más rápidos son Llama 4 Maverick (FP8) (411 t/s), gpt-oss-120b (low) (319 t/s) y gpt-oss-120b (high) (310 t/s). La velocidad varía significativamente entre modelos, con una diferencia del 56% entre el más rápido y el más lento.
  • En latencia, Phi-4 Mini (0.82s), Llama 4 Scout (0.92s) y Claude 4.5 Haiku (Non-reasoning) (0.99s) ofrecen el menor tiempo hasta el primer token de respuesta.
  • En precios, GPT-5 nano (high) ($0.05), GPT-5 nano (medium) ($0.05) y GPT-6 Luna (max) ($0.08) ofrecen los menores precios combinados por 1M de tokens. Los precios varían hasta 2.7x entre modelos.
  • En tamaño de ventana de contexto, GPT-5.4 (xhigh) (1M), Claude Fable 5 (with fallback) (1M) y Claude Opus 4.7 (max) (1M) admiten las ventanas de contexto más grandes en Azure.

Aspectos destacados

Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Evaluaciones de inteligencia

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
See more

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

Quantitative analysis on spreadsheets & documents

Agentic tool use

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Ventana de contexto

Context Window

Context window: tokens limit · Higher is better

Precios

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Resumen de rendimiento

Output Speed vs. Price

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Velocidad

Medida por la velocidad de salida (tokens por segundo)

Output Speed

Output tokens per second · Higher is better

Latencia

Medida por el tiempo (segundos) hasta el primer token

Latency: Time To First Answer Token

Seconds to first answer token received · Accounts for reasoning model 'thinking' time

Tiempo de respuesta de extremo a extremo

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

End-to-End Response Time vs. Price

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Análisis adicional
Logo de OpenAI
GPT-6 Astra (max)
524k
Propietario
53
$3.19
71
312.81
319.82
--
Logo de Anthropic
Claude Fable 5 (with fallback)
1M
Propietario
50
$8.50
61
102.80
110.97
--
Logo de OpenAI
GPT-6 Sol (max)
524k
Propietario
48
--
157
71.14
74.32
--
Logo de OpenAI
GPT-5.6 Sol (max)
524k
Propietario
47
$1.95
106
64.56
69.27
--
Logo de OpenAI
GPT-6 Astra (low)
524k
Propietario
46
$0.79
63
2.53
10.42
--
Logo de OpenAI
GPT-5.6 Sol (xhigh)
524k
Propietario
44
$1.26
102
26.99
31.90
--
Logo de OpenAI
GPT-5.6 Sol (high)
524k
Propietario
42
$0.85
100
9.81
14.83
--
Logo de Anthropic
Claude Opus 4.7 (max)
1M
Propietario
41*
--
51
20.07
29.83
--
Logo de OpenAI
GPT-5.4 (xhigh)
1.05M
Propietario
39*
--
106
137.41
142.11
--
Logo de Anthropic
Claude Sonnet 5 (max)
1M
Propietario
38
$4.75
83
149.46
155.50
--
Logo de OpenAI
GPT-5.6 Terra (xhigh)
524k
Propietario
38
$0.67
117
12.44
16.71
--
Logo de OpenAI
GPT-6 Luna (max)
524k
Propietario
37
--
245
62.00
64.03
--
Logo de OpenAI
GPT-5.5 (high)
524k
Propietario
37
$1.13
113
11.01
15.45
--
Logo de OpenAI
GPT-5.6 Luna (xhigh)
524k
Propietario
35
$0.09
168
34.64
37.61
--
Logo de OpenAI
GPT-5.6 Terra (high)
524k
Propietario
34
$0.35
122
2.20
6.32
--
Logo de OpenAI
GPT-5.6 Luna (high)
524k
Propietario
32
$0.05
168
8.72
11.70
--
Logo de Anthropic
Claude Opus 4.6 (max)
1M
Propietario
32*
--
39
20.65
33.34
--
Logo de DeepSeek
DeepSeek V4 Pro (max)
1M
Abierto
30
$9.65
95
1.88
53.04
45.92
Logo de OpenAI
GPT-5.2 (xhigh)
400k
Propietario
30*
--
93
83.15
88.52
--
Logo de DeepSeek
DeepSeek V4 Pro (high)
1M
Abierto
30*
--
93
1.66
28.58
21.52
Logo de Anthropic
Claude Sonnet 4.6 (max)
200k
Propietario
30
$2.70
47
103.11
113.77
--
Logo de Anthropic
Claude Opus 4.5
200k
Propietario
29*
--
48
16.49
27.01
--
Logo de OpenAI
GPT-5.2 Codex (xhigh)
400k
Propietario
29*
--
124
98.39
102.43
--
Logo de Kimi
Kimi K2.6
262k
Abierto
27
$1.91
200
1.51
26.27
22.26
Logo de OpenAI
GPT-5.2 (medium)
400k
Propietario
27*
--
88
3.90
9.57
--
Logo de Anthropic
Claude Opus 4.6 (Non-reasoning, high)
1M
Propietario
26*
--
38
2.13
15.23
--
Logo de SpaceXAI
Grok 4.20 0309 v2
262k
Propietario
26*
--
220
10.45
12.73
--
Logo de OpenAI
GPT-5 Codex (high)
400k
Propietario
25*
--
157
7.53
10.71
--
Logo de SpaceXAI
Grok 4.3 (high)
200k
Propietario
25
$0.53
174
16.83
19.70
--
Logo de SpaceXAI
Grok 4.3 (medium)
200k
Propietario
25*
--
155
10.73
13.97
--
Logo de OpenAI
GPT-5.1 (high)
272k
Propietario
25*
--
138
31.50
35.12
--
Logo de Anthropic
Claude Sonnet 4.6 (Non-reasoning, high)
200k
Propietario
25*
--
42
1.76
13.61
--
Logo de SpaceXAI
Grok 4.3 (low)
200k
Propietario
24*
--
153
5.16
8.43
--
Logo de OpenAI
GPT-5.4 mini (xhigh)
400k
Propietario
24
$0.43
296
109.27
110.96
--
Logo de OpenAI
GPT-5.1 Codex (high)
400k
Propietario
24*
--
126
5.96
9.94
--
Logo de Anthropic
Claude Opus 4.5 (Non-reasoning)
200k
Propietario
24*
--
46
1.60
12.41
--
Logo de Kimi
Kimi K2.6 (Non-reasoning)
262k
Abierto
24*
--
204
1.55
4.00
--
Logo de Kimi
Kimi K2.5
262k
Abierto
23*
--
167
1.63
22.43
17.80
Logo de OpenAI
GPT-5 (high)
400k
Propietario
23*
--
99
49.71
54.74
--
Logo de OpenAI
GPT-5 (medium)
400k
Propietario
23*
--
93
19.94
25.30
--
Logo de Anthropic
Claude 4.1 Opus
200k
Propietario
23*
--
--
--
--
--
Logo de SpaceXAI
Grok 4
256k
Propietario
22*
--
75
11.15
17.84
--
Logo de Kimi
Kimi K2 Thinking
256k
Abierto
22*
--
173
1.29
15.74
11.56
Logo de OpenAI
o3-pro
200k
Propietario
22*
--
--
--
--
--
Logo de DeepSeek
DeepSeek V4 Pro (Non-reasoning)
1M
Abierto
21*
--
96
1.64
6.87
--
Logo de OpenAI
GPT-5 (low)
400k
Propietario
21*
--
93
4.82
10.17
--
Logo de Anthropic
Claude 4.5 Sonnet
200k
Propietario
21
$0.54
41
11.93
24.14
--
Logo de OpenAI
GPT-5 mini (medium)
400k
Propietario
21*
--
149
10.18
13.53
--
Logo de OpenAI
GPT-5.1 Codex mini (high)
400k
Propietario
20*
--
159
15.16
18.31
--
Logo de OpenAI
o3
200k
Propietario
20*
--
105
29.68
34.42
--
Logo de OpenAI
GPT-5.4 mini (medium)
400k
Propietario
20*
--
231
6.94
9.11
--
Logo de Kimi
Kimi K2.5 (Non-reasoning)
262k
Abierto
19*
--
196
1.24
3.79
--
Logo de Anthropic
Claude 4.5 Sonnet (Non-reasoning)
200k
Propietario
19*
--
39
1.63
14.51
--
Logo de Anthropic
Claude 4.1 Opus (Non-reasoning)
200k
Propietario
19*
--
--
--
--
--
Logo de SpaceXAI
Grok 4 Fast
2M
Propietario
18*
--
--
--
--
--
Logo de OpenAI
GPT-5.2 (Non-reasoning)
400k
Propietario
17*
--
89
1.56
7.19
--
Logo de Anthropic
Claude 4.5 Haiku
200k
Propietario
17
$0.22
88
14.78
20.47
--
Logo de OpenAI
GPT-5 mini (high)
400k
Propietario
17
$0.05
154
47.43
50.68
--
Logo de OpenAI
o4-mini (high)
200k
Propietario
17*
--
147
14.68
18.09
--
Logo de DeepSeek
DeepSeek V3.2 (Non-reasoning)
128k
Abierto
16*
--
159
1.63
4.77
--
Logo de Anthropic
Claude 4.5 Haiku (Non-reasoning)
200k
Propietario
15*
--
78
0.95
7.33
--
Logo de OpenAI
o1
200k
Propietario
15*
--
--
--
--
--
Logo de SpaceXAI
Grok 3 mini Reasoning (high)
32k
Propietario
15*
--
--
--
--
--
Logo de OpenAI
GPT-5.1 (Non-reasoning)
400k
Propietario
13*
--
124
1.24
5.27
--
Logo de OpenAI
GPT-5 nano (high)
400k
Propietario
13*
--
222
56.10
58.35
--
Logo de OpenAI
GPT-4.1
1M
Propietario
13*
--
125
1.61
5.60
--
Logo de OpenAI
GPT-5 nano (medium)
400k
Propietario
12*
--
217
32.52
34.82
--
Logo de OpenAI
o3-mini
200k
Propietario
12*
--
231
6.13
8.30
--
Logo de SpaceXAI
Grok 3
16k
Propietario
12*
--
--
--
--
--
Logo de OpenAI
gpt-oss-120b (high)
131k
Abierto
12
$0.11
310
0.73
8.80
6.46
Logo de OpenAI
GPT-5 (minimal)
400k
Propietario
11*
--
94
1.49
6.82
--
Logo de OpenAI
o1-preview
128k
Propietario
11*
--
--
--
--
--
Logo de OpenAI
GPT-5.4 mini (Non-reasoning)
400k
Propietario
11*
--
193
1.14
3.73
--
Logo de SpaceXAI
Grok 4 Fast (Non-reasoning)
2M
Propietario
11*
--
--
--
--
--
Logo de OpenAI
o3-mini (high)
200k
Propietario
11
--
241
19.81
21.88
--
Logo de OpenAI
gpt-oss-120b (low)
131k
Abierto
10*
--
319
0.80
8.62
6.26
Logo de OpenAI
GPT-4.1 mini
1M
Propietario
10*
--
145
1.26
4.71
--
Logo de Meta
Llama 4 Maverick (FP8)
128k
Abierto
10*
--
455
1.14
2.24
--
Logo de OpenAI
GPT-5 mini (minimal) East US 2 - Global Standard
400k
Propietario
10*
--
--
--
--
--
Logo de Mistral
Mistral Large 3
256k
Abierto
9
$0.10
78
1.48
7.87
--
Logo de Mistral
Mistral Medium 3
128k
Propietario
9*
--
47
1.98
12.59
--
Logo de OpenAI
GPT-4o (Nov)
128k
Propietario
8*
--
128
2.16
6.06
--
Logo de Meta
Llama 4 Scout
128k
Abierto
8*
--
135
0.85
4.57
--
Logo de OpenAI
GPT-4.1 nano
1M
Propietario
8*
--
271
1.09
2.93
--
Logo de OpenAI
GPT-4o (Aug)
128k
Propietario
8*
--
154
1.48
4.74
--
Logo de Meta
Llama 3.3 70B
128k
Abierto
8*
--
120
2.18
6.36
--
Logo de OpenAI
GPT-4o (May)
128k
Propietario
7*
--
162
1.50
4.59
--
Logo de OpenAI
GPT-5 nano (minimal) East US 2 - Global Standard
400k
Propietario
7*
--
--
--
--
--
Logo de OpenAI
GPT-4 Turbo
128k
Propietario
7*
--
136
1.68
5.36
--
Logo de Cohere
Command A
256k
Abierto
7*
--
43
3.02
14.69
--
Logo de OpenAI
GPT-4o mini
128k
Propietario
7*
--
96
1.78
6.99
--
Logo de Microsoft
Phi-4 Mini
128k
Abierto
6*
--
45
0.82
12.04
--
Logo de Microsoft
Phi-4
16.4k
Abierto
6*
--
40
2.50
14.94
--
Logo de Microsoft
Phi-4 Multimodal
4.1k
Abierto
6*
--
--
--
--
--

Definiciones clave

Preguntas frecuentes

Preguntas comunes sobre Microsoft Azure