DeepSeekのモデル:知能・性能・料金
Artificial Analysis Intelligence Index
Artificial AnalysisはDeepSeekの36個のモデルをベンチマークしています。以下では、これらのモデルの主要指標を比較します。
- 知能が最も高いDeepSeekのモデルはDeepSeek V4.1 Flash (Reasoning, Max Effort)(39)です。
- 出力速度が最も速いモデルはDeepSeek V4.1 Flash (Non-Reasoning)(239トークン/秒)です。
- 最初の回答トークンまでの時間が最も短いモデルはDeepSeek V4.1 Flash (Non-Reasoning)(1.12秒)です。
- タスクあたりの費用が最も低いモデルはDeepSeek V4.1 Flash (Non-Reasoning)($0.15)です。モデル間の料金差は最大4.6倍です。
知能
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
費用
Cost per Intelligence Index Task
速度と遅延
Output Speed
能力スコア
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
DeepSeekのすべてのリリース
DeepSeek V4.1 Flash
2モデル
39
最高知能スコア
DeepSeek V4 Flash Vision
1モデル
35
最高知能スコア
DeepSeek V4 Pro 0813
1モデル
36
最高知能スコア
DeepSeek V4 Flash 0731
1モデル
34
最高知能スコア
DeepSeek V4 Flash 0420
3モデル
26
最高知能スコア
DeepSeek V4 Pro 0424
3モデル
30
最高知能スコア
DeepSeek V3.2
2モデル
21
最高知能スコア
DeepSeek V3.2 Speciale
1モデル
14
最高知能スコア
DeepSeek V3.2 Exp
2モデル
17
最高知能スコア
DeepSeek V3.1 Terminus
2モデル
15
最高知能スコア
DeepSeek V3.1
2モデル
14
最高知能スコア
DeepSeek R1 0528 Qwen3 8B
1モデル
8
最高知能スコア
DeepSeek R1 0528 (May '25)
1モデル
13
最高知能スコア
DeepSeek V3 0324
1モデル
10
最高知能スコア
DeepSeek R1 (Jan '25)
1モデル
11
最高知能スコア
DeepSeek R1 Distill Llama 70B
1モデル
8
最高知能スコア
DeepSeek R1 Distill Llama 8B
1モデル
6
最高知能スコア
DeepSeek R1 Distill Qwen 1.5B
1モデル
6
最高知能スコア
DeepSeek R1 Distill Qwen 14B
1モデル
8
最高知能スコア
DeepSeek R1 Distill Qwen 32B
1モデル
8
最高知能スコア
DeepSeek V3 (Dec '24)
1モデル
8
最高知能スコア
DeepSeek-V2.5 (Dec '24)
1モデル
7
最高知能スコア
DeepSeek-V2.5
1モデル
7
最高知能スコア
DeepSeek-Coder-V2
1モデル
6
最高知能スコア
DeepSeek Coder V2 Lite Instruct
1モデル
5
最高知能スコア
DeepSeek-V2-Chat
1モデル
6
最高知能スコア
DeepSeek LLM 67B Chat (V1)
1モデル
5
最高知能スコア
詳細
ウェイト | プロバイダーのベンチマーク | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash (Reasoning, Max Effort) | 39 | 552B 推論時に16Bが有効 | 1M | $0.2 | 221 | +15 | |||
| DeepSeek V4 Pro 0813 (Reasoning, Max Effort) | 36 | 1.6T 推論時に49Bが有効 | 1M | $0.7 | 104 | +8 | |||
| DeepSeek V4 Flash Vision (Reasoning, Max Effort) | 35 | 284B 推論時に13Bが有効 | 1M | $0.2 | 223 | 利用不可 | +2 | ||
| DeepSeek V4 Flash 0731 (Reasoning, Max Effort) | 34 | 284B 推論時に13Bが有効 | 1M | $0.2 | 227 | +14 | |||
| DeepSeek V4 Pro 0424 (Reasoning, Max Effort) | 30 | 1.6T 推論時に49Bが有効 | 1M | $0.2 | 111 | +7 | |||
| DeepSeek V4 Pro 0424 (Reasoning, High Effort) | 30 | 1.6T 推論時に49Bが有効 | 1M | $0.2 | 106 | +5 | |||
| DeepSeek V4 Flash 0420 (Reasoning, High Effort) | 26 | 284B 推論時に13Bが有効 | 1M | $0.1 | - | +4 | |||
| DeepSeek V4.1 Flash (Non-Reasoning) | 25 | 552B 推論時に16Bが有効 | 1M | $0.2 | 239 | ||||
| DeepSeek V4 Flash 0420 (Reasoning, Max Effort) | 24 | 284B 推論時に13Bが有効 | 1M | $0.1 | - | +2 | |||
| DeepSeek V3.2 (Reasoning) | 21 | 685B 推論時に37Bが有効 | 128k | $0.1 | - | +5 | |||
| DeepSeek V4 Pro 0424 (Non-reasoning) | 21 | 1.6T 推論時に49Bが有効 | 1M | $0.2 | 99 | +3 | |||
| DeepSeek V4 Flash 0420 (Non-reasoning) | 19 | 284B 推論時に13Bが有効 | 1M | $0.1 | - | ||||
| DeepSeek V3.2 Exp (Reasoning) | 17 | 685B 推論時に37Bが有効 | 128k | $0.1 | - | ||||
| DeepSeek V3.2 (Non-reasoning) | 16 | 685B 推論時に37Bが有効 | 128k | $0.3 | - | +8 | |||
| DeepSeek V3.1 Terminus (Reasoning) | 15 | 685B 推論時に37Bが有効 | 128k | $1.7 | - | ||||
| DeepSeek V3.2 Speciale | 14 | 685B 推論時に37Bが有効 | 128k | - | - | - | |||
| DeepSeek V3.1 Terminus (Non-reasoning) | 14 | 685B 推論時に37Bが有効 | 128k | $0.2 | - | ||||
| DeepSeek V3.2 Exp (Non-reasoning) | 14 | 685B 推論時に37Bが有効 | 128k | $0.1 | - | ||||
| DeepSeek V3.1 (Non-reasoning) | 14 | 685B 推論時に37Bが有効 | 128k | $0.7 | - | +5 | |||
| DeepSeek V3.1 (Reasoning) | 13 | 685B 推論時に37Bが有効 | 128k | $0.7 | - | ||||
| DeepSeek R1 0528 (May '25) | 13 | 685B 推論時に37Bが有効 | 128k | $1.5 | - | +2 | |||
| DeepSeek R1 (Jan '25) | 11 | 685B 推論時に37Bが有効 | 128k | $2.2 | - | ||||
| DeepSeek V3 0324 | 10 | 671B 推論時に37Bが有効 | 128k | $0.8 | - | ||||
| DeepSeek V3 (Dec '24) | 8 | 671B 推論時に37Bが有効 | 128k | $0.4 | - | ||||
| DeepSeek R1 Distill Qwen 32B | 8 | 32B | 128k | - | - | - | |||
| DeepSeek R1 0528 Qwen3 8B | 8 | 8.2B | 33k | - | - | - | |||
| DeepSeek R1 Distill Llama 70B | 8 | 70B | 128k | $0.7 | - | ||||
| DeepSeek R1 Distill Qwen 14B | 8 | 14B | 128k | - | - | - | |||
| DeepSeek-V2.5 (Dec '24) | 7 | 236B 推論時に21Bが有効 | 128k | - | - | - | |||
| DeepSeek-V2.5 | 7 | 236B 推論時に21Bが有効 | 128k | - | - | - | |||
| DeepSeek R1 Distill Llama 8B | 6 | 8B | 128k | - | - | - | |||
| DeepSeek-Coder-V2 | 6 | 236B 推論時に21Bが有効 | 128k | - | - | - | |||
| DeepSeek R1 Distill Qwen 1.5B | 6 | 1.5B | 128k | - | - | - | |||
| DeepSeek-V2-Chat | 6 | 236B 推論時に21Bが有効 | 128k | - | - | - | |||
| DeepSeek Coder V2 Lite Instruct | 5 | 16B 推論時に2.4Bが有効 | 128k | - | - | - | |||
| DeepSeek LLM 67B Chat (V1) | 5 | 7B | 4k | - | - | - |