Microsoft Azure: 모델 지능, 성능 및 가격

Microsoft Azure
Microsoft Azure

이 분석은 사용 사례에 가장 적합한 Microsoft Azure 제공 모델을 선택하는 데 도움을 드립니다.

가장 높은 지능

Updated
#1
GPT-6 Astra (max)GPT-6 Astra (max)
53
#2
Claude Fable 5 (with fallback)Claude Fable 5 (with fallback)
50
#3
GPT-6 Sol (max)GPT-6 Sol (max)
48
#4
GPT-5.6 Sol (max)GPT-5.6 Sol (max)
47
#5
GPT-6 Astra (low)GPT-6 Astra (low)
46

Intelligence Index

총 모델 82개

가장 빠름

#1
Llama 4 Maverick (FP8)Llama 4 Maverick (FP8)
436 t/s
#2
gpt-oss-120b (low)gpt-oss-120b (low)
335 t/s
#3
GPT-5.4 mini (xhigh)GPT-5.4 mini (xhigh)
328 t/s
#4
gpt-oss-120b (high)gpt-oss-120b (high)
320 t/s
#5
GPT-4.1 nanoGPT-4.1 nano
287 t/s

출력 속도

총 모델 82개

가장 낮은 가격

#1
GPT-5 nano (high)GPT-5 nano (high)
$0.05
#2
GPT-5 nano (medium)GPT-5 nano (medium)
$0.05
#3
GPT-6 Luna (max)GPT-6 Luna (max)
$0.08
#4
GPT-4.1 nanoGPT-4.1 nano
$0.08
#5
GPT-4o miniGPT-4o mini
$0.14

혼합 가격(토큰 100만 개당)

총 모델 82개

Azure에서 지능, 성능, 가격 특성이 서로 다른 모델 82개를 제공합니다. 아래에서 모델별 주요 지표를 비교합니다.

  • Azure에서 지능이 가장 높은 모델은 GPT-6 Astra (max)(53), Claude Fable 5 (with fallback)(50) 및 GPT-6 Sol (max)(48)입니다.
  • 출력 속도가 가장 빠른 모델은 Llama 4 Maverick (FP8)(436 t/s), gpt-oss-120b (low)(335 t/s) 및 GPT-5.4 mini (xhigh)(328 t/s)입니다. 모델별 속도 차이가 크며, 가장 빠른 모델과 가장 느린 모델의 차이는 52%입니다.
  • 첫 답변 토큰까지 걸린 시간이 가장 짧은 모델은 Phi-4 Mini(0.83초), Llama 4 Scout(0.84초) 및 Claude 4.5 Haiku (non-reasoning)(0.93초)입니다.
  • 토큰 100만 개당 혼합 가격이 가장 낮은 모델은 GPT-5 nano (high)($0.05), GPT-5 nano (medium)($0.05) 및 GPT-6 Luna (max)($0.08)입니다. 모델별 가격은 최대 2.7배 차이 납니다.
  • Azure에서 가장 큰 컨텍스트 창을 지원하는 모델은 GPT-6 Sol (max)(1M), GPT-5.4 (xhigh)(1M) 및 Claude Fable 5 (with fallback)(1M)입니다.
Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

지능 평가

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
더 보기

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

Quantitative analysis on spreadsheets & documents

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Intelligence Index vs. 가격

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

컨텍스트 창

컨텍스트 창

Context window: tokens limit · Higher is better

가격

Intelligence Index vs. 가격

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

성능 요약

출력 속도와 가격

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

속도

출력 속도(초당 토큰 수)로 측정

출력 속도

Output tokens per second · Higher is better

지연 시간

첫 토큰까지 걸린 시간(초)으로 측정

지연 시간: 첫 답변 토큰까지 걸린 시간

첫 답변 토큰 수신까지의 초 · 추론 모델의 ‘생각’ 시간 포함

종단 간 응답 시간

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

종단 간 응답 시간과 가격

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

추가 분석
OpenAI 로고
GPT-6 Astra (max)
524k
독점
53
$3.19
69
354.77
362.00
--
Anthropic 로고
Claude Fable 5 (with fallback)
1M
독점
50
$8.50
66
100.61
108.24
--
OpenAI 로고
GPT-6 Sol (max)
1.05M
독점
48
--
149
99.81
103.16
--
OpenAI 로고
GPT-5.6 Sol (max)
524k
독점
47
$1.95
103
127.37
132.24
--
OpenAI 로고
GPT-6 Astra (low)
524k
독점
46
$0.79
56
3.10
12.11
--
OpenAI 로고
GPT-5.6 Sol (xhigh)
524k
독점
44
$1.26
98
66.87
71.95
--
OpenAI 로고
GPT-5.6 Sol (high)
524k
독점
42
$0.85
88
17.16
22.86
--
Anthropic 로고
Claude Opus 4.7 (max)
1M
독점
41*
--
46
20.67
31.46
--
OpenAI 로고
GPT-5.4 (xhigh)
1.05M
독점
39*
--
100
181.33
186.34
--
Anthropic 로고
Claude Sonnet 5 (max)
1M
독점
38
$4.75
85
194.75
200.63
--
OpenAI 로고
GPT-6 Luna (max)
524k
독점
38
--
206
70.92
73.35
--
OpenAI 로고
GPT-5.6 Terra (xhigh)
524k
독점
38
$0.67
116
45.63
49.93
--
OpenAI 로고
GPT-5.5 (high)
524k
독점
37
$1.13
83
35.33
41.33
--
OpenAI 로고
GPT-5.6 Luna (xhigh)
524k
독점
35
$0.09
162
46.38
49.47
--
OpenAI 로고
GPT-5.6 Terra (high)
524k
독점
34
$0.35
109
3.09
7.67
--
OpenAI 로고
GPT-5.6 Luna (high)
524k
독점
32
$0.05
150
13.55
16.89
--
Anthropic 로고
Claude Opus 4.6 (max)
1M
독점
32*
--
41
24.77
37.10
--
DeepSeek 로고
DeepSeek V4 Pro (max)
1M
오픈
30
$9.65
81
1.72
62.11
54.20
OpenAI 로고
GPT-5.2 (xhigh)
400k
독점
30*
--
89
110.20
115.85
--
DeepSeek 로고
DeepSeek V4 Pro (high)
1M
오픈
30*
--
82
1.85
32.08
24.17
Anthropic 로고
Claude Sonnet 4.6 (max)
200k
독점
30
$2.70
56
130.59
139.48
--
Anthropic 로고
Claude Opus 4.5
200k
독점
29*
--
48
18.72
29.21
--
OpenAI 로고
GPT-5.2 Codex (xhigh)
400k
독점
29*
--
115
86.52
90.87
--
Kimi 로고
Kimi K2.6
262k
오픈
27
$1.91
227
1.53
23.34
19.61
OpenAI 로고
GPT-5.2 (medium)
400k
독점
27*
--
88
5.18
10.87
--
Anthropic 로고
Claude Opus 4.6 (non-reasoning, high)
1M
독점
26*
--
38
1.88
15.12
--
SpaceXAI 로고
Grok 4.20 0309 v2
262k
독점
26*
--
216
10.56
12.87
--
OpenAI 로고
GPT-5 Codex (high)
400k
독점
25*
--
156
10.45
13.65
--
SpaceXAI 로고
Grok 4.3 (high)
200k
독점
25
$0.53
157
20.96
24.14
--
SpaceXAI 로고
Grok 4.3 (medium)
200k
독점
25*
--
157
14.72
17.91
--
OpenAI 로고
GPT-5.1 (high)
272k
독점
25*
--
115
41.64
45.99
--
Anthropic 로고
Claude Sonnet 4.6 (non-reasoning, high)
200k
독점
25*
--
43
1.63
13.15
--
SpaceXAI 로고
Grok 4.3 (low)
200k
독점
24*
--
139
6.02
9.61
--
OpenAI 로고
GPT-5.4 mini (xhigh)
400k
독점
24
$0.43
254
127.11
129.08
--
OpenAI 로고
GPT-5.1 Codex (high)
400k
독점
24*
--
120
9.35
13.50
--
Anthropic 로고
Claude Opus 4.5 (non-reasoning)
200k
독점
24*
--
47
1.51
12.13
--
Kimi 로고
Kimi K2.6 (non-reasoning)
262k
오픈
24*
--
194
1.60
4.18
--
Kimi 로고
Kimi K2.5
262k
오픈
23*
--
131
1.40
27.93
22.70
OpenAI 로고
GPT-5 (high)
400k
독점
23*
--
97
68.03
73.21
--
OpenAI 로고
GPT-5 (medium)
400k
독점
23*
--
91
35.09
40.55
--
Anthropic 로고
Claude 4.1 Opus
200k
독점
23*
--
--
--
--
--
SpaceXAI 로고
Grok 4
256k
독점
22*
--
71
10.93
17.93
--
Kimi 로고
Kimi K2 Thinking
256k
오픈
22*
--
99
1.91
27.12
20.17
OpenAI 로고
o3-pro
200k
독점
22*
--
--
--
--
--
DeepSeek 로고
DeepSeek V4 Pro (non-reasoning)
1M
오픈
21*
--
89
1.58
7.21
--
OpenAI 로고
GPT-5 (low)
400k
독점
21*
--
92
11.44
16.85
--
Anthropic 로고
Claude 4.5 Sonnet
200k
독점
21
$0.54
44
14.87
26.12
--
OpenAI 로고
GPT-5 mini (medium)
400k
독점
21*
--
132
10.36
14.15
--
OpenAI 로고
GPT-5.1 Codex mini (high)
400k
독점
20*
--
163
15.60
18.67
--
OpenAI 로고
o3
200k
독점
20*
--
97
24.29
29.43
--
OpenAI 로고
GPT-5.4 mini (medium)
400k
독점
20*
--
211
9.14
11.51
--
Kimi 로고
Kimi K2.5 (non-reasoning)
262k
오픈
19*
--
122
1.35
5.46
--
Anthropic 로고
Claude 4.5 Sonnet (non-reasoning)
200k
독점
19*
--
42
1.46
13.31
--
Anthropic 로고
Claude 4.1 Opus (non-reasoning)
200k
독점
19*
--
--
--
--
--
SpaceXAI 로고
Grok 4 Fast
2M
독점
18*
--
--
--
--
--
OpenAI 로고
GPT-5.2 (non-reasoning)
400k
독점
17*
--
86
1.48
7.31
--
Anthropic 로고
Claude 4.5 Haiku
200k
독점
17
$0.22
98
15.36
20.47
--
OpenAI 로고
GPT-5 mini (high)
400k
독점
17
$0.05
131
53.20
57.02
--
OpenAI 로고
o4-mini (high)
200k
독점
17*
--
138
22.09
25.71
--
DeepSeek 로고
DeepSeek V3.2 (non-reasoning)
128k
오픈
16*
--
166
1.90
4.91
--
Anthropic 로고
Claude 4.5 Haiku (non-reasoning)
200k
독점
15*
--
90
1.11
6.68
--
OpenAI 로고
o1
200k
독점
15*
--
--
--
--
--
SpaceXAI 로고
Grok 3 mini Reasoning (high)
32k
독점
15*
--
--
--
--
--
OpenAI 로고
GPT-5.1 (non-reasoning)
400k
독점
13*
--
110
1.24
5.80
--
OpenAI 로고
GPT-5 nano (high)
400k
독점
13*
--
203
69.34
71.80
--
OpenAI 로고
GPT-4.1
1M
독점
13*
--
114
1.64
6.02
--
OpenAI 로고
GPT-5 nano (medium)
400k
독점
12*
--
205
32.76
35.20
--
OpenAI 로고
o3-mini
200k
독점
12*
--
218
7.00
9.29
--
SpaceXAI 로고
Grok 3
16k
독점
12*
--
--
--
--
--
OpenAI 로고
gpt-oss-120b (high)
131k
오픈
12
$0.11
315
0.72
8.65
6.34
OpenAI 로고
GPT-5 (minimal)
400k
독점
11*
--
93
1.78
7.14
--
OpenAI 로고
o1-preview
128k
독점
11*
--
--
--
--
--
OpenAI 로고
GPT-5.4 mini (non-reasoning)
400k
독점
11*
--
187
1.05
3.73
--
SpaceXAI 로고
Grok 4 Fast (non-reasoning)
2M
독점
11*
--
--
--
--
--
OpenAI 로고
o3-mini (high)
200k
독점
11
--
228
20.21
22.40
--
OpenAI 로고
gpt-oss-120b (low)
131k
오픈
10*
--
334
0.84
8.32
5.99
OpenAI 로고
GPT-4.1 mini
1M
독점
10*
--
103
1.54
6.38
--
Meta 로고
Llama 4 Maverick (FP8)
128k
오픈
10*
--
455
1.28
2.38
--
OpenAI 로고
GPT-5 mini (minimal) East US 2 - Global Standard
400k
독점
10*
--
--
--
--
--
Mistral 로고
Mistral Large 3
256k
오픈
9
$0.10
56
1.86
10.78
--
Mistral 로고
Mistral Medium 3
128k
독점
9*
--
47
2.27
12.91
--
OpenAI 로고
GPT-4o (Nov)
128k
독점
8*
--
125
1.90
5.91
--
Meta 로고
Llama 4 Scout
128k
오픈
8*
--
134
0.85
4.57
--
OpenAI 로고
GPT-4.1 nano
1M
독점
8*
--
276
1.47
3.27
--
OpenAI 로고
GPT-4o (Aug)
128k
독점
8*
--
141
1.38
4.93
--
Meta 로고
Llama 3.3 70B
128k
오픈
8*
--
124
2.18
6.20
--
OpenAI 로고
GPT-4o (May)
128k
독점
7*
--
143
1.55
5.03
--
OpenAI 로고
GPT-5 nano (minimal) East US 2 - Global Standard
400k
독점
7*
--
--
--
--
--
OpenAI 로고
GPT-4 Turbo
128k
독점
7*
--
108
1.78
6.42
--
Cohere 로고
Command A
256k
오픈
7*
--
42
3.04
14.82
--
OpenAI 로고
GPT-4o mini
128k
독점
7*
--
78
1.87
8.24
--
Microsoft 로고
Phi-4 Mini
128k
오픈
6*
--
44
0.82
12.09
--
Microsoft 로고
Phi-4
16.4k
오픈
6*
--
36
2.79
16.59
--
Microsoft 로고
Phi-4 Multimodal
4.1k
오픈
6*
--
--
--
--
--

주요 용어 정의

자주 묻는 질문

Microsoft Azure에 관한 일반적인 질문