Claude Sonnet 5 vs. gpt-oss-120b: 릴리스 비교
Claude Sonnet 5와 gpt-oss-120b 릴리스 비교: 각각 6개, 2개 모델이며 지능, 성능, 가격 특성이 서로 다릅니다. 아래에서 전체 8개 모델의 주요 지표를 비교합니다.
- 지능 부문에서 Claude Sonnet 5가 가장 높습니다. Claude Sonnet 5 (Adaptive Reasoning, Max Effort)(38), gpt-oss-120b는 gpt-oss-120b (high)(12)입니다.
- 출력 속도가 가장 빠른 것은 gpt-oss-120b입니다. gpt-oss-120b (high)(202 토큰/초), Claude Sonnet 5는 Claude Sonnet 5 (Adaptive Reasoning, Max Effort)(81 토큰/초)입니다.
- 작업당 비용이 가장 낮은 것은 gpt-oss-120b입니다. gpt-oss-120b (high)($0.11), Claude Sonnet 5는 Claude Sonnet 5 (Adaptive Reasoning, Low Effort)($0.51)입니다.
비교 중인 릴리스
지능
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Cost per Task (USD, Log Scale)
비용
Cost per Intelligence Index Task
속도 및 지연 시간
Output Speed
역량 점수
역량 지수
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
상세 정보
입력 모달리티 | 출력 모달리티 | 웨이트 | 제공업체 벤치마크 | ||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5 (Adaptive Reasoning, Max Effort) | 38 | 40 | 39 | 42 | 43 | 40 | 49 | $5.09 | US$1.5 | $2.00 | $10.00 | $0.20 | US$6,998 | 118k | 88k | 367M | 81 | 185.34초 | 185.34초 | 191.50초 | 852.58초 | - | 1M | 2026년 6월 | - | 예 | 지원: 텍스트 및 이미지 | 지원: 텍스트 | 제공되지 않음 | - | |||
| Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort) | 34 | 37 | 37 | 38 | - | 35 | 45 | $2.87 | US$1.5 | $2.00 | $10.00 | $0.20 | US$3,255 | 65k | 44k | 135M | 66 | 46.34초 | 46.34초 | 53.86초 | 610.51초 | - | 1M | 2026년 6월 | - | 예 | 지원: 텍스트 및 이미지 | 지원: 텍스트 | 제공되지 않음 | - | |||
| Claude Sonnet 5 (Adaptive Reasoning, High Effort) | 32 | 33 | 33 | 35 | - | 32 | 41 | $1.79 | US$1.5 | $2.00 | $10.00 | $0.20 | US$2,086 | 44k | 28k | 89M | 69 | 11.65초 | 11.65초 | 18.85초 | 417.78초 | - | 1M | 2026년 6월 | - | 예 | 지원: 텍스트 및 이미지 | 지원: 텍스트 | 제공되지 않음 | - | |||
| Claude Sonnet 5 (Adaptive Reasoning, Medium Effort) | 28 | 30 | 30 | 32 | - | 29 | 38 | $1.00 | US$1.5 | $2.00 | $10.00 | $0.20 | US$1,218 | 27k | 15k | 51M | 66 | 2.14초 | 2.14초 | 9.75초 | 262.64초 | - | 1M | 2026년 6월 | - | 예 | 지원: 텍스트 및 이미지 | 지원: 텍스트 | 제공되지 않음 | - | |||
| Claude Sonnet 5 (Adaptive Reasoning, Low Effort) | 24 | 26 | 26 | 28 | - | 25 | 33 | $0.51 | US$1.5 | $2.00 | $10.00 | $0.20 | US$653 | 15k | 7k | 25M | 64 | 1.84초 | 1.84초 | 9.68초 | 148.80초 | - | 1M | 2026년 6월 | - | 예 | 지원: 텍스트 및 이미지 | 지원: 텍스트 | 제공되지 않음 | - | |||
| Claude Sonnet 5 (Non-reasoning, High Effort) | 23 | - | - | - | - | - | - | - | US$1.5 | $2.00 | $10.00 | $0.20 | - | - | - | - | 63 | 1.19초 | 1.19초 | 9.07초 | - | - | 1M | 2026년 6월 | - | 아니요 | 지원: 텍스트 및 이미지 | 지원: 텍스트 | 제공되지 않음 | - | |||
| gpt-oss-120b (high) | 12 | 12 | 8 | 11 | 11 | 15 | 18 | $0.11 | US$0.2 | $0.15 | $0.595 | $0.125 | US$122 | 27k | 15k | 84M | 202 | 0.82초 | 10.70초 | 13.18초 | 131.58초 | 117B 추론 시 5.1B 활성 | 131k | 2025년 8월 | 2024년 5월 | 예 | 지원: 텍스트 | 지원: 텍스트 | +14 | ||||
| gpt-oss-120b (low) | 10 | - | - | - | - | - | - | - | US$0.2 | $0.15 | $0.545 | $0.15 | - | - | - | - | 199 | 0.80초 | 10.85초 | 13.36초 | - | 117B 추론 시 5.1B 활성 | 131k | 2025년 8월 | 2025년 5월 | 예 | 지원: 텍스트 | 지원: 텍스트 | +14 | ||||