릴리스 비교 도구
모델 릴리스 최대 다섯 개를 각 릴리스의 모든 변형과 함께 지능, 가격, 출력 속도, 지연 시간, 컨텍스트 창 등에서 나란히 비교하세요.
모델 측정 및 평가 방법은 방법론 페이지에서 확인하세요.
| Claude Opus 5.5 (max with fallback) | Claude Opus 5.5 (xhigh with fallback) | Claude Opus 5.5 (high with fallback) | GPT-6 Astra (max) | GPT-6 Astra (xhigh) | Claude Opus 5.5 (medium with fallback) | GPT-6 Astra (high) | GPT-6 Astra (medium) | GPT-6 Astra (low) | Claude Opus 5.5 (low with fallback) | |
|---|---|---|---|---|---|---|---|---|---|---|
| Intelligence Index | 58 | 56 | 54 | 53 | 52 | 51 | 51 | 50 | 46 | 42 |
| 재무 및 회계 | 61 | 58 | 56 | 55 | 54 | 54 | 53 | 52 | 49 | 46 |
| 전략 및 운영 | 64 | 62 | 59 | 57 | 57 | 57 | 55 | 54 | 50 | 48 |
| 법률 | 63 | 61 | 59 | 59 | 58 | 57 | 58 | 57 | 53 | 52 |
| 의료 및 헬스케어 | 61 | -- | -- | 52 | -- | -- | -- | -- | -- | -- |
| 작업당 비용USD | $5.98 | $3.46 | $1.82 | $3.26 | $2.31 | $1.34 | $1.73 | $1.54 | $0.82 | $0.55 |
| 출력 속도토큰/초 | 92 | 79 | 72 | 59 | 55 | 73 | 53 | 51 | 51 | 71 |
| 첫 토큰까지 걸린 시간초 | 710.36 | 147.01 | 34.40 | 276.50 | 142.98 | 26.57 | 67.00 | 4.50 | 2.65 | 4.50 |
| 컨텍스트 창 | 1M | 1M | 1M | 1M | 1M | 1M | 1M | 1M | 1M | 1M |
| 개발사 | ||||||||||
| 라이선스 | 독점 | 독점 | 독점 | 독점 | 독점 | 독점 | 독점 | 독점 | 독점 | 독점 |
| 입력 모달리티 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 | 지원: 텍스트 및 이미지 |
| 출력 모달리티 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 | 지원: 텍스트 |
| 제공업체 | ||||||||||
지능
Artificial Analysis Intelligence Index
Intelligence Index와 작업당 비용
작업당 비용(USD, 로그 눈금)
비용
Intelligence Index 작업당 비용
속도 및 지연 시간
출력 속도
역량 점수
역량 지수
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better