GPT-6 Astra vs. Mistral Small 4: 릴리스 비교
GPT-6 Astra와 Mistral Small 4 릴리스 비교: 각각 5개, 2개 모델이며 지능, 성능, 가격 특성이 서로 다릅니다. 아래에서 전체 7개 모델의 주요 지표를 비교합니다.
- 지능 부문에서 GPT-6 Astra가 가장 높습니다. GPT-6 Astra (Max)(53), Mistral Small 4는 Mistral Small 4 (Reasoning)(11)입니다.
- 출력 속도가 가장 빠른 것은 Mistral Small 4입니다. Mistral Small 4 (Reasoning)(177 토큰/초), GPT-6 Astra는 GPT-6 Astra (Max)(51 토큰/초)입니다.
- 작업당 비용이 가장 낮은 것은 Mistral Small 4입니다. Mistral Small 4 (Reasoning)($0.02), GPT-6 Astra는 GPT-6 Astra (Low)($0.82)입니다.
| GPT-6 Astra (max) | GPT-6 Astra (xhigh) | GPT-6 Astra (high) | GPT-6 Astra (medium) | GPT-6 Astra (low) | Mistral Small 4 | Mistral Small 4 (non-reasoning) | |
|---|---|---|---|---|---|---|---|
| Intelligence Index | 53 | 52 | 51 | 50 | 46 | 11 | 9* |
| 재무 및 회계 | 55 | 54 | 53 | 52 | 49 | 10 | -- |
| 전략 및 운영 | 57 | 57 | 55 | 54 | 50 | 7 | -- |
| 법률 | 59 | 58 | 58 | 57 | 53 | 13 | -- |
| 의료 및 헬스케어 | 52 | -- | -- | -- | -- | -- | -- |
| 공학 | 55 | 55 | 53 | 52 | 48 | 16 | -- |
| 경제학 | 60 | 59 | 58 | 58 | 55 | 18 | -- |
| 작업당 비용USD | $3.26 | $2.31 | $1.73 | $1.54 | $0.82 | $0.02 | -- |
| 출력 속도토큰/초 | 51 | 47 | 44 | 44 | 43 | 177 | 166 |
| 첫 토큰까지 걸린 시간초 | 326.68 | 205.74 | 65.56 | 6.21 | 2.86 | 0.77 | 0.74 |
| 컨텍스트 창 | 1M | 1M | 1M | 1M | 1M | 256k | 256k |
| 개발사 | |||||||
| 라이선스 | 독점 | 독점 | 독점 | 독점 | 독점 | 오픈 | 오픈 |
| 입력 모달리티 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 |
| 출력 모달리티 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 |
| 제공업체 | |||||||
* 추정치
지능
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Cost per Task (USD, Log Scale)
비용
Cost per Intelligence Index Task
속도 및 지연 시간
Output Speed
역량 점수
역량 지수
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better