DeepSeek 모델: 지능, 성능 및 가격
Artificial Analysis Intelligence Index
Artificial Analysis는 DeepSeek의 모델 36개를 벤치마크했습니다. 아래에서 이 모델들의 주요 지표를 비교합니다.
- 지능 부문에서 DeepSeek의 최고 모델은 DeepSeek V4.1 Flash (Reasoning, Max Effort)(39)입니다.
- 출력 속도가 가장 빠른 모델은 DeepSeek V4.1 Flash (Non-Reasoning)(239 토큰/초)입니다.
- 지연 시간 부문에서 첫 응답 토큰까지 걸리는 시간이 가장 짧은 모델은 DeepSeek V4.1 Flash (Non-Reasoning)(1.12초)입니다.
- 가격 부문에서 작업당 비용이 가장 낮은 모델은 DeepSeek V4.1 Flash (Non-Reasoning)($0.15)입니다. 모델 간 가격 차이는 최대 4.6배입니다.
지능
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
비용
Cost per Intelligence Index Task
속도 및 지연 시간
Output Speed
역량 점수
역량 지수
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
DeepSeek의 모든 릴리스
DeepSeek V4.1 Flash
모델 2개
39
최고 지능 점수
DeepSeek V4 Flash Vision
모델 1개
35
최고 지능 점수
DeepSeek V4 Pro 0813
모델 1개
36
최고 지능 점수
DeepSeek V4 Flash 0731
모델 1개
34
최고 지능 점수
DeepSeek V4 Flash 0420
모델 3개
26
최고 지능 점수
DeepSeek V4 Pro 0424
모델 3개
30
최고 지능 점수
DeepSeek V3.2
모델 2개
21
최고 지능 점수
DeepSeek V3.2 Speciale
모델 1개
14
최고 지능 점수
DeepSeek V3.2 Exp
모델 2개
17
최고 지능 점수
DeepSeek V3.1 Terminus
모델 2개
15
최고 지능 점수
DeepSeek V3.1
모델 2개
14
최고 지능 점수
DeepSeek R1 0528 Qwen3 8B
모델 1개
8
최고 지능 점수
DeepSeek R1 0528 (May '25)
모델 1개
13
최고 지능 점수
DeepSeek V3 0324
모델 1개
10
최고 지능 점수
DeepSeek R1 (Jan '25)
모델 1개
11
최고 지능 점수
DeepSeek R1 Distill Llama 70B
모델 1개
8
최고 지능 점수
DeepSeek R1 Distill Llama 8B
모델 1개
6
최고 지능 점수
DeepSeek R1 Distill Qwen 1.5B
모델 1개
6
최고 지능 점수
DeepSeek R1 Distill Qwen 14B
모델 1개
8
최고 지능 점수
DeepSeek R1 Distill Qwen 32B
모델 1개
8
최고 지능 점수
DeepSeek V3 (Dec '24)
모델 1개
8
최고 지능 점수
DeepSeek-V2.5 (Dec '24)
모델 1개
7
최고 지능 점수
DeepSeek-V2.5
모델 1개
7
최고 지능 점수
DeepSeek-Coder-V2
모델 1개
6
최고 지능 점수
DeepSeek Coder V2 Lite Instruct
모델 1개
5
최고 지능 점수
DeepSeek-V2-Chat
모델 1개
6
최고 지능 점수
DeepSeek LLM 67B Chat (V1)
모델 1개
5
최고 지능 점수
상세 정보
웨이트 | 제공업체 벤치마크 | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash (Reasoning, Max Effort) | 39 | 552B 추론 시 16B 활성 | 1M | US$0.2 | 221 | +15 | |||
| DeepSeek V4 Pro 0813 (Reasoning, Max Effort) | 36 | 1.6T 추론 시 49B 활성 | 1M | US$0.7 | 104 | +8 | |||
| DeepSeek V4 Flash Vision (Reasoning, Max Effort) | 35 | 284B 추론 시 13B 활성 | 1M | US$0.2 | 223 | 제공되지 않음 | +2 | ||
| DeepSeek V4 Flash 0731 (Reasoning, Max Effort) | 34 | 284B 추론 시 13B 활성 | 1M | US$0.2 | 227 | +14 | |||
| DeepSeek V4 Pro 0424 (Reasoning, Max Effort) | 30 | 1.6T 추론 시 49B 활성 | 1M | US$0.2 | 111 | +7 | |||
| DeepSeek V4 Pro 0424 (Reasoning, High Effort) | 30 | 1.6T 추론 시 49B 활성 | 1M | US$0.2 | 106 | +5 | |||
| DeepSeek V4 Flash 0420 (Reasoning, High Effort) | 26 | 284B 추론 시 13B 활성 | 1M | US$0.1 | - | +4 | |||
| DeepSeek V4.1 Flash (Non-Reasoning) | 25 | 552B 추론 시 16B 활성 | 1M | US$0.2 | 239 | ||||
| DeepSeek V4 Flash 0420 (Reasoning, Max Effort) | 24 | 284B 추론 시 13B 활성 | 1M | US$0.1 | - | +2 | |||
| DeepSeek V3.2 (Reasoning) | 21 | 685B 추론 시 37B 활성 | 128k | US$0.1 | - | +5 | |||
| DeepSeek V4 Pro 0424 (Non-reasoning) | 21 | 1.6T 추론 시 49B 활성 | 1M | US$0.2 | 99 | +3 | |||
| DeepSeek V4 Flash 0420 (Non-reasoning) | 19 | 284B 추론 시 13B 활성 | 1M | US$0.1 | - | ||||
| DeepSeek V3.2 Exp (Reasoning) | 17 | 685B 추론 시 37B 활성 | 128k | US$0.1 | - | ||||
| DeepSeek V3.2 (Non-reasoning) | 16 | 685B 추론 시 37B 활성 | 128k | US$0.3 | - | +8 | |||
| DeepSeek V3.1 Terminus (Reasoning) | 15 | 685B 추론 시 37B 활성 | 128k | US$1.7 | - | ||||
| DeepSeek V3.2 Speciale | 14 | 685B 추론 시 37B 활성 | 128k | - | - | - | |||
| DeepSeek V3.1 Terminus (Non-reasoning) | 14 | 685B 추론 시 37B 활성 | 128k | US$0.2 | - | ||||
| DeepSeek V3.2 Exp (Non-reasoning) | 14 | 685B 추론 시 37B 활성 | 128k | US$0.1 | - | ||||
| DeepSeek V3.1 (Non-reasoning) | 14 | 685B 추론 시 37B 활성 | 128k | US$0.7 | - | +5 | |||
| DeepSeek V3.1 (Reasoning) | 13 | 685B 추론 시 37B 활성 | 128k | US$0.7 | - | ||||
| DeepSeek R1 0528 (May '25) | 13 | 685B 추론 시 37B 활성 | 128k | US$1.5 | - | +2 | |||
| DeepSeek R1 (Jan '25) | 11 | 685B 추론 시 37B 활성 | 128k | US$2.2 | - | ||||
| DeepSeek V3 0324 | 10 | 671B 추론 시 37B 활성 | 128k | US$0.8 | - | ||||
| DeepSeek V3 (Dec '24) | 8 | 671B 추론 시 37B 활성 | 128k | US$0.4 | - | ||||
| DeepSeek R1 Distill Qwen 32B | 8 | 32B | 128k | - | - | - | |||
| DeepSeek R1 0528 Qwen3 8B | 8 | 8.2B | 33k | - | - | - | |||
| DeepSeek R1 Distill Llama 70B | 8 | 70B | 128k | US$0.7 | - | ||||
| DeepSeek R1 Distill Qwen 14B | 8 | 14B | 128k | - | - | - | |||
| DeepSeek-V2.5 (Dec '24) | 7 | 236B 추론 시 21B 활성 | 128k | - | - | - | |||
| DeepSeek-V2.5 | 7 | 236B 추론 시 21B 활성 | 128k | - | - | - | |||
| DeepSeek R1 Distill Llama 8B | 6 | 8B | 128k | - | - | - | |||
| DeepSeek-Coder-V2 | 6 | 236B 추론 시 21B 활성 | 128k | - | - | - | |||
| DeepSeek R1 Distill Qwen 1.5B | 6 | 1.5B | 128k | - | - | - | |||
| DeepSeek-V2-Chat | 6 | 236B 추론 시 21B 활성 | 128k | - | - | - | |||
| DeepSeek Coder V2 Lite Instruct | 5 | 16B 추론 시 2.4B 활성 | 128k | - | - | - | |||
| DeepSeek LLM 67B Chat (V1) | 5 | 7B | 4k | - | - | - |