Microsoft 모델: 지능, 성능 및 가격
Artificial Analysis는 Microsoft의 모델 4개를 벤치마크했습니다. 아래에서 이 모델들의 주요 지표를 비교합니다.
- 지능 부문에서 Microsoft의 최고 모델은 Phi-4 Mini Instruct(6, 추정)입니다.
- 출력 속도가 가장 빠른 모델은 Phi-4 Mini Instruct(45 토큰/초)입니다.
- 지연 시간 부문에서 첫 응답 토큰까지 걸리는 시간이 가장 짧은 모델은 Phi-4 Multimodal Instruct(0.79초)입니다.
지능
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
비용
Cost per Intelligence Index Task
속도 및 지연 시간
Output Speed
역량 점수
역량 지수
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Microsoft의 모든 릴리스
상세 정보
웨이트 | 제공업체 벤치마크 | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Phi-4 Mini Instruct | 6 | 3.8B | 128k | US$0.0 | 45 | ||||
| Phi-4 | 6 | 14B | 16k | US$0.2 | 40 | ||||
| Phi-3 Mini Instruct 3.8B | 6 | 3.8B | 4k | - | - | - | |||
| Phi-4 Multimodal Instruct | 6 | 5.6B | 128k | US$0.0 | 17 |