Microsoft Azure:模型智能、性能与价格

Microsoft Azure
Microsoft Azure

本分析旨在帮助你根据使用场景,选择 Microsoft Azure 提供的最佳模型。

最智能

Updated
#1
GPT-6 Astra (max)GPT-6 Astra (max)
53
#2
Claude Fable 5 (with fallback)Claude Fable 5 (with fallback)
50
#3
GPT-6 Sol (max)GPT-6 Sol (max)
48
#4
GPT-5.6 Sol (max)GPT-5.6 Sol (max)
47
#5
GPT-6 Astra (low)GPT-6 Astra (low)
46

Intelligence Index

共 82 个模型

速度最快

#1
Llama 4 Maverick (FP8)Llama 4 Maverick (FP8)
443 t/s
#2
gpt-oss-120b (low)gpt-oss-120b (low)
330 t/s
#3
gpt-oss-120b (high)gpt-oss-120b (high)
320 t/s
#4
GPT-5.4 mini (xhigh)GPT-5.4 mini (xhigh)
311 t/s
#5
GPT-4.1 nanoGPT-4.1 nano
288 t/s

输出速度

共 82 个模型

价格最低

#1
GPT-5 nano (high)GPT-5 nano (high)
$0.05
#2
GPT-5 nano (medium)GPT-5 nano (medium)
$0.05
#3
GPT-6 Luna (max)GPT-6 Luna (max)
$0.08
#4
GPT-4.1 nanoGPT-4.1 nano
$0.08
#5
GPT-4o miniGPT-4o mini
$0.14

每 100 万 token 的混合价格

共 82 个模型

Azure 提供 82 个模型,每个模型的智能、性能和价格特征各不相同。 下方对比了各模型的关键指标。

  • 智能方面,Azure 上表现最好的模型是 GPT-6 Astra (max)(53)、Claude Fable 5 (with fallback)(50)和GPT-6 Sol (max)(48)。
  • 输出速度方面,最快的模型是 Llama 4 Maverick (FP8)(443 t/s)、gpt-oss-120b (low)(330 t/s)和gpt-oss-120b (high)(320 t/s)。 各模型之间的速度差异显著,最快与最慢相差 54%。
  • 延迟方面,Phi-4 Mini(0.83 秒)、Llama 4 Scout(0.84 秒)和Claude 4.5 Haiku (non-reasoning)(0.93 秒) 的首个答案 Token 延迟最低。
  • 价格方面,GPT-5 nano (high)($0.05)、GPT-5 nano (medium)($0.05)和GPT-6 Luna (max)($0.08) 每 100 万 token 的混合价格最低。 各模型价格最多相差 2.7 倍。
  • 上下文窗口方面,GPT-6 Sol (max)(1M)、GPT-5.4 (xhigh)(1M)和Claude Fable 5 (with fallback)(1M) 支持 Azure 上最大的上下文窗口。
Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

智能评测

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
查看更多

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

Quantitative analysis on spreadsheets & documents

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Intelligence Index 与价格

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

上下文窗口

上下文窗口

Context window: tokens limit · Higher is better

价格

Intelligence Index 与价格

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

性能摘要

输出速度与价格

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

速度

按输出速度(每秒 token 数)衡量

输出速度

Output tokens per second · Higher is better

延迟

按首 Token 延迟(秒)衡量

延迟: 首个答案 Token 延迟

收到首个回答 token 的秒数 · 包含推理模型的“思考”时间

端到端响应时间

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

端到端响应时间与价格

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

进一步分析
OpenAI 标志
GPT-6 Astra (max)
524k
专有
53
$3.19
69
354.77
362.00
--
Anthropic 标志
Claude Fable 5 (with fallback)
1M
专有
50
$8.50
66
100.61
108.24
--
OpenAI 标志
GPT-6 Sol (max)
1.05M
专有
48
--
149
99.81
103.16
--
OpenAI 标志
GPT-5.6 Sol (max)
524k
专有
47
$1.95
103
127.37
132.24
--
OpenAI 标志
GPT-6 Astra (low)
524k
专有
46
$0.79
56
3.10
12.11
--
OpenAI 标志
GPT-5.6 Sol (xhigh)
524k
专有
44
$1.26
98
66.87
71.95
--
OpenAI 标志
GPT-5.6 Sol (high)
524k
专有
42
$0.85
88
17.16
22.86
--
Anthropic 标志
Claude Opus 4.7 (max)
1M
专有
41*
--
46
20.67
31.46
--
OpenAI 标志
GPT-5.4 (xhigh)
1.05M
专有
39*
--
100
181.33
186.34
--
Anthropic 标志
Claude Sonnet 5 (max)
1M
专有
38
$4.75
85
194.75
200.63
--
OpenAI 标志
GPT-6 Luna (max)
524k
专有
38
--
206
70.92
73.35
--
OpenAI 标志
GPT-5.6 Terra (xhigh)
524k
专有
38
$0.67
116
45.63
49.93
--
OpenAI 标志
GPT-5.5 (high)
524k
专有
37
$1.13
83
35.33
41.33
--
OpenAI 标志
GPT-5.6 Luna (xhigh)
524k
专有
35
$0.09
162
46.38
49.47
--
OpenAI 标志
GPT-5.6 Terra (high)
524k
专有
34
$0.35
109
3.09
7.67
--
OpenAI 标志
GPT-5.6 Luna (high)
524k
专有
32
$0.05
150
13.55
16.89
--
Anthropic 标志
Claude Opus 4.6 (max)
1M
专有
32*
--
41
24.77
37.10
--
DeepSeek 标志
DeepSeek V4 Pro (max)
1M
开放
30
$9.65
81
1.72
62.11
54.20
OpenAI 标志
GPT-5.2 (xhigh)
400k
专有
30*
--
89
110.20
115.85
--
DeepSeek 标志
DeepSeek V4 Pro (high)
1M
开放
30*
--
82
1.85
32.08
24.17
Anthropic 标志
Claude Sonnet 4.6 (max)
200k
专有
30
$2.70
56
130.59
139.48
--
Anthropic 标志
Claude Opus 4.5
200k
专有
29*
--
48
18.72
29.21
--
OpenAI 标志
GPT-5.2 Codex (xhigh)
400k
专有
29*
--
115
86.52
90.87
--
Kimi 标志
Kimi K2.6
262k
开放
27
$1.91
227
1.53
23.34
19.61
OpenAI 标志
GPT-5.2 (medium)
400k
专有
27*
--
88
5.18
10.87
--
Anthropic 标志
Claude Opus 4.6 (non-reasoning, high)
1M
专有
26*
--
38
1.88
15.12
--
SpaceXAI 标志
Grok 4.20 0309 v2
262k
专有
26*
--
216
10.56
12.87
--
OpenAI 标志
GPT-5 Codex (high)
400k
专有
25*
--
156
10.45
13.65
--
SpaceXAI 标志
Grok 4.3 (high)
200k
专有
25
$0.53
157
20.96
24.14
--
SpaceXAI 标志
Grok 4.3 (medium)
200k
专有
25*
--
157
14.72
17.91
--
OpenAI 标志
GPT-5.1 (high)
272k
专有
25*
--
115
41.64
45.99
--
Anthropic 标志
Claude Sonnet 4.6 (non-reasoning, high)
200k
专有
25*
--
43
1.63
13.15
--
SpaceXAI 标志
Grok 4.3 (low)
200k
专有
24*
--
139
6.02
9.61
--
OpenAI 标志
GPT-5.4 mini (xhigh)
400k
专有
24
$0.43
254
127.11
129.08
--
OpenAI 标志
GPT-5.1 Codex (high)
400k
专有
24*
--
120
9.35
13.50
--
Anthropic 标志
Claude Opus 4.5 (non-reasoning)
200k
专有
24*
--
47
1.51
12.13
--
Kimi 标志
Kimi K2.6 (non-reasoning)
262k
开放
24*
--
194
1.60
4.18
--
Kimi 标志
Kimi K2.5
262k
开放
23*
--
131
1.40
27.93
22.70
OpenAI 标志
GPT-5 (high)
400k
专有
23*
--
97
68.03
73.21
--
OpenAI 标志
GPT-5 (medium)
400k
专有
23*
--
91
35.09
40.55
--
Anthropic 标志
Claude 4.1 Opus
200k
专有
23*
--
--
--
--
--
SpaceXAI 标志
Grok 4
256k
专有
22*
--
71
10.93
17.93
--
Kimi 标志
Kimi K2 Thinking
256k
开放
22*
--
99
1.91
27.12
20.17
OpenAI 标志
o3-pro
200k
专有
22*
--
--
--
--
--
DeepSeek 标志
DeepSeek V4 Pro (non-reasoning)
1M
开放
21*
--
89
1.58
7.21
--
OpenAI 标志
GPT-5 (low)
400k
专有
21*
--
92
11.44
16.85
--
Anthropic 标志
Claude 4.5 Sonnet
200k
专有
21
$0.54
44
14.87
26.12
--
OpenAI 标志
GPT-5 mini (medium)
400k
专有
21*
--
132
10.36
14.15
--
OpenAI 标志
GPT-5.1 Codex mini (high)
400k
专有
20*
--
163
15.60
18.67
--
OpenAI 标志
o3
200k
专有
20*
--
97
24.29
29.43
--
OpenAI 标志
GPT-5.4 mini (medium)
400k
专有
20*
--
211
9.14
11.51
--
Kimi 标志
Kimi K2.5 (non-reasoning)
262k
开放
19*
--
122
1.35
5.46
--
Anthropic 标志
Claude 4.5 Sonnet (non-reasoning)
200k
专有
19*
--
42
1.46
13.31
--
Anthropic 标志
Claude 4.1 Opus (non-reasoning)
200k
专有
19*
--
--
--
--
--
SpaceXAI 标志
Grok 4 Fast
2M
专有
18*
--
--
--
--
--
OpenAI 标志
GPT-5.2 (non-reasoning)
400k
专有
17*
--
86
1.48
7.31
--
Anthropic 标志
Claude 4.5 Haiku
200k
专有
17
$0.22
98
15.36
20.47
--
OpenAI 标志
GPT-5 mini (high)
400k
专有
17
$0.05
131
53.20
57.02
--
OpenAI 标志
o4-mini (high)
200k
专有
17*
--
138
22.09
25.71
--
DeepSeek 标志
DeepSeek V3.2 (non-reasoning)
128k
开放
16*
--
166
1.90
4.91
--
Anthropic 标志
Claude 4.5 Haiku (non-reasoning)
200k
专有
15*
--
90
1.11
6.68
--
OpenAI 标志
o1
200k
专有
15*
--
--
--
--
--
SpaceXAI 标志
Grok 3 mini Reasoning (high)
32k
专有
15*
--
--
--
--
--
OpenAI 标志
GPT-5.1 (non-reasoning)
400k
专有
13*
--
110
1.24
5.80
--
OpenAI 标志
GPT-5 nano (high)
400k
专有
13*
--
203
69.34
71.80
--
OpenAI 标志
GPT-4.1
1M
专有
13*
--
114
1.64
6.02
--
OpenAI 标志
GPT-5 nano (medium)
400k
专有
12*
--
205
32.76
35.20
--
OpenAI 标志
o3-mini
200k
专有
12*
--
218
7.00
9.29
--
SpaceXAI 标志
Grok 3
16k
专有
12*
--
--
--
--
--
OpenAI 标志
gpt-oss-120b (high)
131k
开放
12
$0.11
315
0.72
8.65
6.34
OpenAI 标志
GPT-5 (minimal)
400k
专有
11*
--
93
1.78
7.14
--
OpenAI 标志
o1-preview
128k
专有
11*
--
--
--
--
--
OpenAI 标志
GPT-5.4 mini (non-reasoning)
400k
专有
11*
--
187
1.05
3.73
--
SpaceXAI 标志
Grok 4 Fast (non-reasoning)
2M
专有
11*
--
--
--
--
--
OpenAI 标志
o3-mini (high)
200k
专有
11
--
228
20.21
22.40
--
OpenAI 标志
gpt-oss-120b (low)
131k
开放
10*
--
334
0.84
8.32
5.99
OpenAI 标志
GPT-4.1 mini
1M
专有
10*
--
103
1.54
6.38
--
Meta 标志
Llama 4 Maverick (FP8)
128k
开放
10*
--
455
1.28
2.38
--
OpenAI 标志
GPT-5 mini (minimal) East US 2 - Global Standard
400k
专有
10*
--
--
--
--
--
Mistral 标志
Mistral Large 3
256k
开放
9
$0.10
56
1.86
10.78
--
Mistral 标志
Mistral Medium 3
128k
专有
9*
--
47
2.27
12.91
--
OpenAI 标志
GPT-4o (Nov)
128k
专有
8*
--
125
1.90
5.91
--
Meta 标志
Llama 4 Scout
128k
开放
8*
--
134
0.85
4.57
--
OpenAI 标志
GPT-4.1 nano
1M
专有
8*
--
276
1.47
3.27
--
OpenAI 标志
GPT-4o (Aug)
128k
专有
8*
--
141
1.38
4.93
--
Meta 标志
Llama 3.3 70B
128k
开放
8*
--
124
2.18
6.20
--
OpenAI 标志
GPT-4o (May)
128k
专有
7*
--
143
1.55
5.03
--
OpenAI 标志
GPT-5 nano (minimal) East US 2 - Global Standard
400k
专有
7*
--
--
--
--
--
OpenAI 标志
GPT-4 Turbo
128k
专有
7*
--
108
1.78
6.42
--
Cohere 标志
Command A
256k
开放
7*
--
42
3.04
14.82
--
OpenAI 标志
GPT-4o mini
128k
专有
7*
--
78
1.87
8.24
--
Microsoft 标志
Phi-4 Mini
128k
开放
6*
--
44
0.82
12.09
--
Microsoft 标志
Phi-4
16.4k
开放
6*
--
36
2.79
16.59
--
Microsoft 标志
Phi-4 Multimodal
4.1k
开放
6*
--
--
--
--
--

关键定义

常见问题

关于 Microsoft Azure 的常见问题