Microsoft Azure:模型智能、性能与价格

Microsoft Azure
Microsoft Azure

本分析旨在帮助你根据使用场景,选择 Microsoft Azure 提供的最佳模型。

最智能

Updated
#1
Claude Fable 5 (with fallback)Claude Fable 5 (with fallback)
50
#2
GPT-5.6 Sol (max)GPT-5.6 Sol (max)
47
#3
GPT-5.6 Sol (xhigh)GPT-5.6 Sol (xhigh)
44
#4
GPT-5.6 Sol (high)GPT-5.6 Sol (high)
42
#5
Claude Opus 4.7 (max)Claude Opus 4.7 (max)
41

Intelligence Index

共 79 个模型

速度最快

#1
Llama 4 Maverick (FP8)Llama 4 Maverick (FP8)
393 t/s
#2
gpt-oss-120b (low)gpt-oss-120b (low)
334 t/s
#3
gpt-oss-120b (high)gpt-oss-120b (high)
313 t/s
#4
GPT-5.4 mini (xhigh)GPT-5.4 mini (xhigh)
267 t/s
#5
o3-minio3-mini
263 t/s

输出速度

共 79 个模型

价格最低

#1
GPT-5 nano (high)GPT-5 nano (high)
$0.05
#2
GPT-5 nano (medium)GPT-5 nano (medium)
$0.05
#3
GPT-4.1 nanoGPT-4.1 nano
$0.08
#4
GPT-4o miniGPT-4o mini
$0.14
#5
Phi-4Phi-4
$0.16

每 100 万 token 的混合价格

共 79 个模型

Azure 提供 79 个模型,每个模型的智能、性能和价格特征各不相同。 下方对比了各模型的关键指标。

  • 智能方面,Azure 上表现最好的模型是 Claude Fable 5 (with fallback)(50)、GPT-5.6 Sol (max)(47)和GPT-5.6 Sol (xhigh)(44)。
  • 输出速度方面,最快的模型是 Llama 4 Maverick (FP8)(393 t/s)、gpt-oss-120b (low)(334 t/s)和gpt-oss-120b (high)(313 t/s)。
  • 延迟方面,Phi-4 Mini(0.86 秒)、Llama 4 Scout(0.87 秒)和Phi-4 Multimodal(0.87 秒) 的首个答案 Token 延迟最低。
  • 价格方面,GPT-5 nano (high)($0.05)、GPT-5 nano (medium)($0.05)和GPT-4.1 nano($0.08) 每 100 万 token 的混合价格最低。 各模型价格最多相差 3.0 倍。
  • 上下文窗口方面,GPT-5.4 (xhigh)(1M)、Claude Fable 5 (with fallback)(1M)和Claude Opus 4.7 (max)(1M) 支持 Azure 上最大的上下文窗口。

亮点

Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

智能评测

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3 incorporates 10 evaluations: AA-Briefcase, GDPval-AA v2, AutomationBench-AA, Terminal-Bench v4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
See more

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Quantitative analysis on spreadsheets & documents

Instruction following

Agentic tool use

Long-horizon agentic tasks

Kubernetes incident root-cause analysis

Visual reasoning

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

上下文窗口

Context Window

Context window: tokens limit · Higher is better

价格

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

性能摘要

Output Speed vs. Price

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

速度

按输出速度(每秒 token 数)衡量

Output Speed

Output tokens per second · Higher is better

延迟

按首 Token 延迟(秒)衡量

Latency: Time To First Answer Token

Seconds to first answer token received · Accounts for reasoning model 'thinking' time

端到端响应时间

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

End-to-End Response Time vs. Price

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

进一步分析
Anthropic 标志
Claude Fable 5 (with fallback)
1M
专有
50
$43.25
57
76.76
85.47
--
OpenAI 标志
GPT-5.6 Sol (max)
524k
专有
47
--
100
91.90
96.91
--
OpenAI 标志
GPT-5.6 Sol (xhigh)
524k
专有
44
$1.26
97
29.85
35.01
--
OpenAI 标志
GPT-5.6 Sol (high)
524k
专有
42
$0.85
97
8.26
13.40
--
Anthropic 标志
Claude Opus 4.7 (max)
1M
专有
41*
--
49
17.55
27.85
--
OpenAI 标志
GPT-5.4 (xhigh)
1.05M
专有
39*
--
116
131.39
135.71
--
Anthropic 标志
Claude Sonnet 5 (max)
1M
专有
38
$4.75
75
180.61
187.32
--
OpenAI 标志
GPT-5.6 Terra (xhigh)
524k
专有
38
$0.67
109
15.51
20.09
--
OpenAI 标志
GPT-5.5 (high)
524k
专有
37
$1.13
101
19.53
24.47
--
OpenAI 标志
GPT-5.6 Luna (xhigh)
524k
专有
35
$0.09
128
50.36
54.28
--
OpenAI 标志
GPT-5.6 Terra (high)
524k
专有
34
$0.35
108
2.65
7.30
--
OpenAI 标志
GPT-5.6 Luna (high)
524k
专有
32
$0.05
119
12.26
16.47
--
Anthropic 标志
Claude Opus 4.6 (max)
1M
专有
32*
--
40
9.09
21.57
--
DeepSeek 标志
DeepSeek V4 Pro (max)
1M
开放
31
$9.65
93
1.69
53.99
46.93
Anthropic 标志
Claude Sonnet 4.6 (max)
200k
专有
30
$2.70
51
130.33
140.06
--
OpenAI 标志
GPT-5.2 (xhigh)
400k
专有
30*
--
85
97.46
103.32
--
DeepSeek 标志
DeepSeek V4 Pro (high)
1M
开放
30*
--
88
1.63
29.83
22.54
Anthropic 标志
Claude Opus 4.5
200k
专有
29*
--
45
10.90
21.97
--
OpenAI 标志
GPT-5.2 Codex (xhigh)
400k
专有
29*
--
94
105.53
110.85
--
Kimi 标志
Kimi K2.6
262k
开放
27
$1.91
226
1.38
23.29
19.69
OpenAI 标志
GPT-5.2 (medium)
400k
专有
27*
--
84
4.84
10.78
--
Anthropic 标志
Claude Opus 4.6 (Non-reasoning, high)
1M
专有
26*
--
38
1.94
15.26
--
SpaceXAI 标志
Grok 4.20 0309 v2
262k
专有
26*
--
225
9.18
11.41
--
SpaceXAI 标志
Grok 4.3 (high)
200k
专有
25
$0.53
168
15.04
18.01
--
OpenAI 标志
GPT-5 Codex (high)
400k
专有
25*
--
186
7.22
9.91
--
SpaceXAI 标志
Grok 4.3 (medium)
200k
专有
25*
--
172
9.43
12.34
--
OpenAI 标志
GPT-5.1 (high)
272k
专有
25*
--
132
30.57
34.37
--
Anthropic 标志
Claude Sonnet 4.6 (Non-reasoning, high)
200k
专有
25*
--
42
2.20
14.04
--
OpenAI 标志
GPT-5.4 mini (xhigh)
400k
专有
25
$0.48
267
126.80
128.67
--
SpaceXAI 标志
Grok 4.3 (low)
200k
专有
24*
--
157
4.71
7.89
--
OpenAI 标志
GPT-5.1 Codex (high)
400k
专有
24*
--
123
7.62
11.69
--
Anthropic 标志
Claude Opus 4.5 (Non-reasoning)
200k
专有
24*
--
44
1.92
13.17
--
Kimi 标志
Kimi K2.6 (Non-reasoning)
262k
开放
24*
--
185
1.48
4.18
--
Kimi 标志
Kimi K2.5
262k
开放
23*
--
161
1.54
23.06
18.41
OpenAI 标志
GPT-5 (high)
400k
专有
23*
--
97
50.82
55.95
--
OpenAI 标志
GPT-5 (medium)
400k
专有
23*
--
107
21.62
26.29
--
Anthropic 标志
Claude 4.1 Opus
200k
专有
23*
--
--
--
--
--
SpaceXAI 标志
Grok 4
256k
专有
22*
--
80
8.50
14.77
--
Kimi 标志
Kimi K2 Thinking
256k
开放
22*
--
154
1.58
17.85
13.02
OpenAI 标志
o3-pro
200k
专有
22*
--
--
--
--
--
Anthropic 标志
Claude 4.5 Sonnet
200k
专有
21
$1.78
40
10.69
23.20
--
DeepSeek 标志
DeepSeek V4 Pro (Non-reasoning)
1M
开放
21*
--
84
1.86
7.78
--
OpenAI 标志
GPT-5 (low)
400k
专有
21*
--
92
5.64
11.06
--
OpenAI 标志
GPT-5 mini (medium)
400k
专有
21*
--
142
9.11
12.62
--
OpenAI 标志
GPT-5.1 Codex mini (high)
400k
专有
20*
--
156
12.53
15.74
--
OpenAI 标志
o3
200k
专有
20*
--
102
26.45
31.36
--
OpenAI 标志
GPT-5.4 mini (medium)
400k
专有
20*
--
218
3.92
6.21
--
Kimi 标志
Kimi K2.5 (Non-reasoning)
262k
开放
19*
--
176
1.34
4.19
--
Anthropic 标志
Claude 4.5 Sonnet (Non-reasoning)
200k
专有
19*
--
39
1.74
14.43
--
Anthropic 标志
Claude 4.1 Opus (Non-reasoning)
200k
专有
19*
--
--
--
--
--
SpaceXAI 标志
Grok 4 Fast
2M
专有
18*
--
--
--
--
--
Anthropic 标志
Claude 4.5 Haiku
200k
专有
18
$0.57
83
28.59
34.60
--
OpenAI 标志
GPT-5 mini (high)
400k
专有
17
$0.05
152
55.52
58.80
--
OpenAI 标志
GPT-5.2 (Non-reasoning)
400k
专有
17*
--
82
1.26
7.34
--
OpenAI 标志
o4-mini (high)
200k
专有
17*
--
152
17.90
21.20
--
DeepSeek 标志
DeepSeek V3.2 (Non-reasoning)
128k
开放
16*
--
164
1.59
4.64
--
Anthropic 标志
Claude 4.5 Haiku (Non-reasoning)
200k
专有
15*
--
79
1.27
7.64
--
OpenAI 标志
o1
200k
专有
15*
--
--
--
--
--
SpaceXAI 标志
Grok 3 mini Reasoning (high)
32k
专有
15*
--
--
--
--
--
OpenAI 标志
GPT-5.1 (Non-reasoning)
400k
专有
13*
--
111
1.24
5.74
--
OpenAI 标志
GPT-5 nano (high)
400k
专有
13*
--
224
56.72
58.95
--
OpenAI 标志
GPT-4.1
1M
专有
13*
--
135
1.70
5.41
--
OpenAI 标志
GPT-5 nano (medium)
400k
专有
12*
--
215
32.22
34.56
--
OpenAI 标志
o3-mini
200k
专有
12*
--
263
6.48
8.38
--
OpenAI 标志
gpt-oss-120b (high)
131k
开放
12
$0.11
313
0.75
8.73
6.38
SpaceXAI 标志
Grok 3
16k
专有
12*
--
--
--
--
--
OpenAI 标志
GPT-5 (minimal)
400k
专有
11*
--
94
1.65
6.97
--
OpenAI 标志
o1-preview
128k
专有
11*
--
--
--
--
--
OpenAI 标志
GPT-5.4 mini (Non-reasoning)
400k
专有
11*
--
190
1.01
3.65
--
SpaceXAI 标志
Grok 4 Fast (Non-reasoning)
2M
专有
11*
--
--
--
--
--
OpenAI 标志
o3-mini (high)
200k
专有
11
--
223
19.99
22.23
--
OpenAI 标志
gpt-oss-120b (low)
131k
开放
10*
--
334
0.81
8.31
5.99
OpenAI 标志
GPT-4.1 mini
1M
专有
10*
--
137
1.30
4.95
--
OpenAI 标志
GPT-5 mini (minimal) East US 2 - Global Standard
400k
专有
10*
--
--
--
--
--
Mistral 标志
Mistral Large 3
256k
开放
10
$0.10
97
1.43
6.59
--
Meta 标志
Llama 4 Maverick (FP8)
128k
开放
9
$0.04
393
1.21
2.48
--
Mistral 标志
Mistral Medium 3
128k
专有
9*
--
47
2.16
12.71
--
OpenAI 标志
GPT-4o (Nov)
128k
专有
8*
--
148
2.39
5.77
--
OpenAI 标志
GPT-4.1 nano
1M
专有
8*
--
249
1.59
3.60
--
OpenAI 标志
GPT-4o (Aug)
128k
专有
8*
--
149
1.32
4.67
--
Meta 标志
Llama 3.3 70B
128k
开放
8*
--
116
2.22
6.54
--
OpenAI 标志
GPT-4o (May)
128k
专有
7*
--
156
1.55
4.76
--
OpenAI 标志
GPT-5 nano (minimal) East US 2 - Global Standard
400k
专有
7*
--
--
--
--
--
OpenAI 标志
GPT-4 Turbo
128k
专有
7*
--
127
1.63
5.58
--
Cohere 标志
Command A
256k
开放
7*
--
42
3.01
14.87
--
OpenAI 标志
GPT-4o mini
128k
专有
7*
--
92
1.77
7.23
--
Meta 标志
Llama 4 Scout
128k
开放
6
$0.12
133
0.87
4.64
--
Microsoft 标志
Phi-4 Mini
128k
开放
6*
--
45
0.86
12.05
--
Microsoft 标志
Phi-4
16.4k
开放
6*
--
40
2.54
14.92
--
Microsoft 标志
Phi-4 Multimodal
128k
开放
6*
--
17
0.87
30.23
--

关键定义

常见问题

关于 Microsoft Azure 的常见问题