Microsoft Azure:モデルの知能、性能、料金
この分析は、ユースケースに最適なMicrosoft Azure提供モデルを選ぶための参考情報です。
最高の知能
Intelligence Index
モデル合計:71件
最速
出力速度
モデル合計:71件
最安料金
ブレンド料金(100万トークンあたり)
モデル合計:71件
Azureは71モデルを提供しており、知能、性能、料金の特性はそれぞれ異なります。 以下でモデル間の主要指標を比較します。
- Azureで知能が上位のモデルはClaude Fable 5 (with fallback)(62)、Claude Sonnet 5 (max)(55)、Claude Opus 4.7 (max)(55)です。
- 出力速度が最も速いモデルはLlama 4 Maverick (FP8)(468 t/s)、gpt-oss-120b (low)(341 t/s)、gpt-oss-120b (high)(325 t/s)です。 モデル間の速度差は大きく、最速と最遅で102%の差があります。
- 遅延では、Phi-4 Multimodal(0.82秒)、Llama 4 Scout(0.82秒)、Phi-4 Mini(0.83秒)の最初の回答トークンまでの時間が最短です。
- 料金では、GPT-5 nano (high)($0.05)、GPT-5 nano (medium)($0.05)、GPT-4.1 nano($0.08)の100万トークンあたりのブレンド料金が最安です。 モデル間で料金に最大3.0倍の差があります。
- Azureで最大のコンテキストウィンドウに対応するモデルはGPT-5.4 (xhigh)(1M)、Claude Fable 5 (with fallback)(1M)、Claude Sonnet 5 (max)(1M)です。
ハイライト
知能評価
Artificial Analysis Intelligence Index
Intelligence Evaluations
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Scientific reasoning
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic knowledge work, Elo
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Quantitative analysis on spreadsheets & documents
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
Intelligence Index vs. Price
コンテキストウィンドウ
Context Window
料金
Intelligence Index vs. Price
性能の概要
Output Speed vs. Price
速度
出力速度(1秒あたりのトークン数)で測定
Output Speed
遅延
最初のトークンまでの時間(秒)で測定
Latency: Time To First Answer Token
エンドツーエンド応答時間
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
End-to-End Response Time vs. Price
詳細分析 | |||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|
Claude Fable 5 (with fallback) | 1M | 独自 | 62 | $10.16 | 71 | 118.04 | 125.11 | -- | |||
Claude Sonnet 5 (max) | 1M | 独自 | 55 | $1.64 | 78 | 180.01 | 186.43 | -- | |||
Claude Opus 4.7 (max) | 1M | 独自 | 55 | $2.02 | 53 | 26.48 | 35.92 | -- | |||
GPT-5.4 (xhigh) | 1.05M | 独自 | 53 | $0.91 | 94 | 187.09 | 192.39 | -- | |||
Claude Sonnet 4.6 (max) | 200k | 独自 | 48 | $1.27 | 50 | 125.95 | 135.85 | -- | |||
DeepSeek V4 Pro (max) | 1M | オープン | 45 | $0.89 | 86 | 1.66 | 58.02 | 50.59 | |||
Kimi K2.6 | 262k | オープン | 45 | $0.76 | 240 | 1.35 | 21.97 | 18.54 | |||
Claude Opus 4.6 (max) | 1M | 独自 | 45* | -- | 45 | 17.47 | 28.55 | -- | |||
DeepSeek V4 Pro (high) | 1M | オープン | 44 | $0.94 | 93 | 1.67 | 28.50 | 21.45 | |||
GPT-5.2 (xhigh) | 400k | 独自 | 43* | -- | 86 | 107.70 | 113.49 | -- | |||
Claude Opus 4.5 | 200k | 独自 | 42* | -- | 56 | 18.26 | 27.20 | -- | |||
GPT-5.2 Codex (xhigh) | 400k | 独自 | 41* | -- | 113 | 91.88 | 96.31 | -- | |||
GPT-5.4 mini (xhigh) | 400k | 独自 | 41 | $0.54 | 195 | 128.96 | 131.53 | -- | |||
GPT-5.2 (medium) | 400k | 独自 | 39* | -- | 82 | 6.31 | 12.40 | -- | |||
Claude Opus 4.6 (high) | 1M | 独自 | 39* | -- | 41 | 2.17 | 14.23 | -- | |||
Grok 4.20 0309 v2 | 262k | 独自 | 38* | -- | 227 | 12.36 | 14.56 | -- | |||
Grok 4.3 (high) | 200k | 独自 | 38 | $0.48 | 179 | 17.71 | 20.50 | -- | |||
GPT-5.1 (high) | 272k | 独自 | 37 | $0.30 | 152 | 35.38 | 38.68 | -- | |||
Claude 4.5 Sonnet | 200k | 独自 | 37 | $1.27 | 50 | 12.46 | 22.53 | -- | |||
GPT-5 Codex (high) | 400k | 独自 | 37* | -- | 167 | 8.53 | 11.52 | -- | |||
Grok 4.3 (medium) | 200k | 独自 | 37* | -- | 166 | 9.80 | 12.81 | -- | |||
Claude Sonnet 4.6 (Non-reasoning) | 200k | 独自 | 37* | -- | 47 | 1.46 | 12.04 | -- | |||
Grok 4.3 (low) | 200k | 独自 | 36* | -- | 154 | 5.26 | 8.51 | -- | |||
Kimi K2.5 | 262k | オープン | 36 | $0.26 | 106 | 1.45 | 34.06 | 27.91 | |||
GPT-5.1 Codex (high) | 400k | 独自 | 36* | -- | 122 | 7.75 | 11.85 | -- | |||
Claude Opus 4.5 | 200k | 独自 | 36* | -- | 49 | 1.44 | 11.55 | -- | |||
Kimi K2.6 | 262k | オープン | 35* | -- | 211 | 1.44 | 3.81 | -- | |||
GPT-5 (high) | 400k | 独自 | 35 | $0.24 | 96 | 65.78 | 71.01 | -- | |||
GPT-5 (medium) | 400k | 独自 | 35* | -- | 97 | 29.59 | 34.72 | -- | |||
Claude 4.1 Opus | 200k | 独自 | 35* | -- | -- | -- | -- | -- | |||
Grok 4 | 256k | 独自 | 34* | -- | 76 | 9.80 | 16.37 | -- | |||
Kimi K2 Thinking | 256k | オープン | 33* | -- | 97 | 1.45 | 27.25 | 20.64 | |||
o3-pro | 200k | 独自 | 33* | -- | -- | -- | -- | -- | |||
DeepSeek V4 Pro | 1M | オープン | 32* | -- | 96 | 1.71 | 6.93 | -- | |||
GPT-5 (low) | 400k | 独自 | 32* | -- | 94 | 6.00 | 11.31 | -- | |||
GPT-5 mini (medium) | 400k | 独自 | 32* | -- | 135 | 10.86 | 14.55 | -- | |||
GPT-5.1 Codex mini (high) | 400k | 独自 | 31* | -- | 158 | 26.39 | 29.56 | -- | |||
o3 | 200k | 独自 | 31* | -- | 120 | 26.09 | 30.25 | -- | |||
GPT-5.4 mini (medium) | 400k | 独自 | 30* | -- | 171 | 10.52 | 13.45 | -- | |||
Kimi K2.5 | 262k | オープン | 30* | -- | 82 | 1.27 | 7.39 | -- | |||
Claude 4.5 Sonnet | 200k | 独自 | 30* | -- | 43 | 1.67 | 13.39 | -- | |||
Claude 4.5 Haiku | 200k | 独自 | 30 | $0.54 | 103 | 21.74 | 26.60 | -- | |||
Claude 4.1 Opus | 200k | 独自 | 29* | -- | -- | -- | -- | -- | |||
Grok 4 Fast | 2M | 独自 | 28* | -- | -- | -- | -- | -- | |||
GPT-5.2 | 400k | 独自 | 27* | -- | 75 | 1.57 | 8.23 | -- | |||
o4-mini (high) | 200k | 独自 | 26* | -- | 115 | 27.38 | 31.73 | -- | |||
GPT-5 mini (high) | 400k | 独自 | 26 | $0.04 | 134 | 56.27 | 60.01 | -- | |||
DeepSeek V3.2 | 128k | オープン | 25* | -- | 162 | 1.77 | 4.85 | -- | |||
Claude 4.5 Haiku | 200k | 独自 | 24* | -- | 94 | 1.13 | 6.46 | -- | |||
gpt-oss-120b (high) | 131k | オープン | 24 | $0.07 | 329 | 0.71 | 8.31 | 6.08 | |||
o1 | 200k | 独自 | 24* | -- | -- | -- | -- | -- | |||
Grok 3 mini Reasoning (high) | 32k | 独自 | 23* | -- | -- | -- | -- | -- | |||
GPT-5.1 | 400k | 独自 | 21* | -- | 145 | 1.61 | 5.07 | -- | |||
GPT-5 nano (high) | 400k | 独自 | 20* | -- | 164 | 82.95 | 86.00 | -- | |||
GPT-4.1 | 1M | 独自 | 20* | -- | 120 | 1.52 | 5.69 | -- | |||
GPT-5 nano (medium) | 400k | 独自 | 19* | -- | 155 | 41.61 | 44.83 | -- | |||
o3-mini | 200k | 独自 | 19* | -- | 228 | 8.17 | 10.37 | -- | |||
Grok 3 | 16k | 独自 | 19* | -- | -- | -- | -- | -- | |||
GPT-5 (minimal) | 400k | 独自 | 17* | -- | 98 | 1.76 | 6.86 | -- | |||
o1-preview | 128k | 独自 | 17* | -- | -- | -- | -- | -- | |||
GPT-5.4 mini | 400k | 独自 | 17* | -- | 172 | 0.97 | 3.87 | -- | |||
Grok 4 Fast | 2M | 独自 | 17* | -- | -- | -- | -- | -- | |||
Mistral Large 3 | 256k | オープン | 16 | $0.08 | 84 | 1.69 | 7.66 | -- | |||
o3-mini (high) | 200k | 独自 | 16 | -- | 219 | 18.55 | 20.84 | -- | |||
gpt-oss-120b (low) | 131k | オープン | 15 | $0.02 | 342 | 0.74 | 8.04 | 5.85 | |||
GPT-4.1 mini | 1M | 独自 | 15 | $0.05 | 132 | 1.22 | 5.00 | -- | |||
Llama 4 Maverick (FP8) | 128k | オープン | 14 | $0.03 | 535 | 1.07 | 2.00 | -- | |||
GPT-5 mini (minimal) East US 2 - Global Standard | 400k | 独自 | 14* | -- | -- | -- | -- | -- | |||
Mistral Medium 3 | 128k | 独自 | 12* | -- | 47 | 2.20 | 12.84 | -- | |||
GPT-4o (Nov) | 128k | 独自 | 11* | -- | 149 | 1.92 | 5.27 | -- | |||
Llama 4 Scout | 128k | オープン | 10 | $0.01 | 133 | 0.81 | 4.57 | -- | |||
GPT-4.1 nano | 1M | 独自 | 10 | $0.03 | 237 | 1.09 | 3.20 | -- | |||
GPT-4o (Aug) | 128k | 独自 | 9* | -- | 163 | 1.41 | 4.48 | -- | |||
Llama 3.3 70B | 128k | オープン | 9* | -- | 123 | 2.12 | 6.17 | -- | |||
GPT-4o (May) | 128k | 独自 | 8* | -- | 160 | 1.44 | 4.58 | -- | |||
GPT-5 nano (minimal) East US 2 - Global Standard | 400k | 独自 | 8* | -- | -- | -- | -- | -- | |||
GPT-4 Turbo | 128k | 独自 | 8* | -- | 146 | 1.74 | 5.16 | -- | |||
Command A | 256k | オープン | 7* | -- | 43 | 2.91 | 14.48 | -- | |||
GPT-4o mini | 128k | 独自 | 7* | -- | 100 | 1.54 | 6.54 | -- | |||
Phi-4 Mini | 128k | オープン | 6* | -- | 43 | 0.82 | 12.43 | -- | |||
Phi-4 | 16.4k | オープン | 5* | -- | 42 | 2.45 | 14.39 | -- | |||
Phi-4 Multimodal | 128k | オープン | 4* | -- | 18 | 0.82 | 29.22 | -- | |||
主要な定義
よくある質問
Microsoft Azureに関するよくある質問
Microsoft Azureが提供し、当社が追跡しているモデルは71モデルです:Claude Fable 5 (with fallback)、Claude Sonnet 5 (max)、Claude Opus 4.7 (max)、GPT-5.4 (xhigh)、Claude Sonnet 4.6 (max)、DeepSeek V4 Pro (max)、Kimi K2.6、Claude Opus 4.6 (max)、DeepSeek V4 Pro (high)、GPT-5.2 (xhigh)、Claude Opus 4.5、GPT-5.2 Codex (xhigh)、GPT-5.4 mini (xhigh)、GPT-5.2 (medium)、Claude Opus 4.6 (high)、Grok 4.20 0309 v2、Grok 4.3 (high)、GPT-5.1 (high)、Claude 4.5 Sonnet、GPT-5 Codex (high)、Grok 4.3 (medium)、Claude Sonnet 4.6 (Non-reasoning)、Grok 4.3 (low)、Kimi K2.5、GPT-5.1 Codex (high)、Claude Opus 4.5、Kimi K2.6、GPT-5 (high)、GPT-5 (medium)、Grok 4、Kimi K2 Thinking、DeepSeek V4 Pro、GPT-5 (low)、GPT-5 mini (medium)、GPT-5.1 Codex mini (high)、o3、GPT-5.4 mini (medium)、Kimi K2.5、Claude 4.5 Sonnet、Claude 4.5 Haiku、GPT-5.2、o4-mini (high)、GPT-5 mini (high)、DeepSeek V3.2、Claude 4.5 Haiku、gpt-oss-120b (high)、GPT-5.1、GPT-5 nano (high)、GPT-4.1、GPT-5 nano (medium)、o3-mini、GPT-5 (minimal)、GPT-5.4 mini、Mistral Large 3、o3-mini (high)、gpt-oss-120b (low)、GPT-4.1 mini、Llama 4 Maverick (FP8)、Mistral Medium 3、GPT-4o (Nov)、Llama 4 Scout、GPT-4.1 nano、GPT-4o (Aug)、Llama 3.3 70B、GPT-4o (May)、GPT-4 Turbo、Command A、GPT-4o mini、Phi-4 Mini、Phi-4、Phi-4 Multimodal。
Microsoft Azureで利用できるモデルのうち、知能が最も高いのはIntelligence Indexスコア62のClaude Fable 5 (with fallback)です。
Microsoft Azureで出力速度が最も速いモデルは、毎秒468.4トークンのLlama 4 Maverick (FP8)です。
Microsoft Azureで最初の回答トークンまでの時間が最短のモデルは、0.82秒のPhi-4 Multimodalです。遅延が短いほど、最初の応答が速くなります。
Microsoft Azureでブレンド料金が最も安いモデルは、100万トークンあたり$0.05のGPT-5 nano (high)です(キャッシュヒット/入力/出力を7:2:1とした場合)。
Microsoft Azureのモデル間では料金に最大262倍の差があり、GPT-5 nano (high)の100万トークンあたり$0.05から、Claude Fable 5 (with fallback)の$14.00までとなっています。
はい。Microsoft AzureはOpenAI互換APIを提供しているため、OpenAIからの切り替えや既存のOpenAI SDK連携の利用が容易です。
Microsoft Azureの71モデル中58モデルが、構造化出力のJSONモードに対応しています。
Microsoft Azureの71モデル中68モデルが関数呼び出し(ツール利用)に対応しています。
はい。Microsoft Azureは41推論モデルを提供しています:Claude Fable 5 (with fallback)、Claude Sonnet 5 (max)、Claude Opus 4.7 (max)、GPT-5.4 (xhigh)、Claude Sonnet 4.6 (max)、DeepSeek V4 Pro (max)、Kimi K2.6、Claude Opus 4.6 (max)、DeepSeek V4 Pro (high)、GPT-5.2 (xhigh)、Claude Opus 4.5、GPT-5.2 Codex (xhigh)、GPT-5.4 mini (xhigh)、GPT-5.2 (medium)、Grok 4.20 0309 v2、Grok 4.3 (high)、GPT-5.1 (high)、Claude 4.5 Sonnet、GPT-5 Codex (high)、Grok 4.3 (medium)、Grok 4.3 (low)、Kimi K2.5、GPT-5.1 Codex (high)、GPT-5 (high)、GPT-5 (medium)、Grok 4、Kimi K2 Thinking、GPT-5 (low)、GPT-5 mini (medium)、GPT-5.1 Codex mini (high)、o3、GPT-5.4 mini (medium)、Claude 4.5 Haiku、o4-mini (high)、GPT-5 mini (high)、gpt-oss-120b (high)、GPT-5 nano (high)、GPT-5 nano (medium)、o3-mini、o3-mini (high)、gpt-oss-120b (low)。推論モデルは回答前に拡張思考を行い、複雑な問題に取り組みます。
はい。Microsoft Azureの71モデル中19モデルがオープンウェイトです:DeepSeek V4 Pro (max)、Kimi K2.6、DeepSeek V4 Pro (high)、Kimi K2.5、Kimi K2.6、Kimi K2 Thinking、DeepSeek V4 Pro、Kimi K2.5、DeepSeek V3.2、gpt-oss-120b (high)、Mistral Large 3、gpt-oss-120b (low)、Llama 4 Maverick (FP8)、Llama 4 Scout、Llama 3.3 70B、Command A、Phi-4 Mini、Phi-4、Phi-4 Multimodal。
はい。インフラストラクチャの変更、負荷分散、アップデートにより、プロバイダーの性能は時間とともに変化する場合があります。すべてのプロバイダーを継続的にベンチマークし、「推移」グラフに過去の性能傾向を表示しています。
Microsoft Azureのモデルを選ぶ際は、知能(品質を重視するタスク)、出力速度(高スループットが必要なタスク)、遅延(最初の応答の速さが必要な対話型アプリケーション)、料金(費用を重視するワークロード)、コンテキストウィンドウの規模、JSONモード、関数呼び出しへの対応などを検討してください。