Claude Sonnet 5 vs. gpt-oss-120b: comparação de lançamentos

Comparação dos lançamentos Claude Sonnet 5 e gpt-oss-120b: 6 e 2 modelos, respectivamente, cada um com diferentes características de inteligência, desempenho e preço. Abaixo, comparamos as principais métricas dos 8 modelos.

  • Em inteligência, Claude Sonnet 5 tem a pontuação mais alta: Claude Sonnet 5 (Adaptive Reasoning, Max Effort), com 38, diante de gpt-oss-120b (high), com 12 de gpt-oss-120b.
  • Em velocidade de saída, gpt-oss-120b é o mais rápido: gpt-oss-120b (high), com 201 tokens/s, diante de Claude Sonnet 5 (Adaptive Reasoning, Max Effort), com 79 tokens/s de Claude Sonnet 5.
  • Em custo por tarefa, gpt-oss-120b é o mais barato: gpt-oss-120b (high), com $0.11, diante de Claude Sonnet 5 (Adaptive Reasoning, Low Effort), com $0.51 de Claude Sonnet 5.

Lançamentos comparados

Inteligência

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Index vs. Cost per Intelligence Index Task

Artificial Analysis Intelligence Index · Weighted average cost (USD) per Artificial Analysis Intelligence Index task
Most attractive quadrant
Claude Sonnet 5
Pareto line

Cost per Task (USD, Log Scale)

Custo

Cost per Intelligence Index Task

Weighted average cost (USD) per Artificial Analysis Intelligence Index task, segmented by token type. Lower is better

Velocidade e latência

Output Speed

Output tokens per second · Higher is better

Pontuações de capacidades

Índices de capacidades

Mede o desempenho dos modelos em capacidades e setores específicos
Finance & Accounting Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Strategy & Ops Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Legal Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better

Healthcare & Medical Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better

Engineering Index

Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better

Economics Index

Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better

Mais detalhes

Modalidade de entrada
Modalidade de saída
Pesos
Benchmarks de provedores
Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
Logo: AnthropicAnthropic
38
40
39
42
43
40
49
$5.09
US$ 1,5
$2.00
$10.00
$0.20
US$ 6.998
118k
88k
367M
79
192.04s
192.04s
198.37s
867.49s
-
1M
jun. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
GoogleMicrosoft AzureAnthropicAmazon Bedrock
Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort)
Logo: AnthropicAnthropic
34
37
37
38
-
35
45
$2.87
US$ 1,5
$2.00
$10.00
$0.20
US$ 3.255
65k
44k
135M
66
38.42s
38.42s
45.97s
610.51s
-
1M
jun. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
Anthropic
Claude Sonnet 5 (Adaptive Reasoning, High Effort)
Logo: AnthropicAnthropic
32
33
33
35
-
32
41
$1.79
US$ 1,5
$2.00
$10.00
$0.20
US$ 2.086
44k
28k
89M
68
11.29s
11.29s
18.64s
417.53s
-
1M
jun. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
Anthropic
Claude Sonnet 5 (Adaptive Reasoning, Medium Effort)
Logo: AnthropicAnthropic
28
30
30
32
-
29
38
$1.00
US$ 1,5
$2.00
$10.00
$0.20
US$ 1.218
27k
15k
51M
66
2.14s
2.14s
9.75s
259.12s
-
1M
jun. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
Anthropic
Claude Sonnet 5 (Adaptive Reasoning, Low Effort)
Logo: AnthropicAnthropic
24
26
26
28
-
25
33
$0.51
US$ 1,5
$2.00
$10.00
$0.20
US$ 653
15k
7k
25M
61
1.84s
1.84s
9.97s
148.49s
-
1M
jun. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
Anthropic
Claude Sonnet 5 (Non-reasoning, High Effort)
Logo: AnthropicAnthropic
23
-
-
-
-
-
-
-
US$ 1,5
$2.00
$10.00
$0.20
-
-
-
-
63
1.19s
1.19s
9.11s
-
-
1M
jun. de 2026
-
Não

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
AnthropicAmazon Bedrock
gpt-oss-120b (high)
Logo: OpenAIOpenAI
12
12
8
11
11
15
18
$0.11
US$ 0,2
$0.15
$0.595
$0.125
US$ 122
27k
15k
84M
201
0.83s
10.80s
13.29s
132.30s
117B
5,1B ativos durante a inferência
131k
ago. de 2025
mai. de 2024
Sim

Compatível com: texto

Compatível com: texto

GroqCloudflareScaleway
+14
gpt-oss-120b (low)
Logo: OpenAIOpenAI
10
-
-
-
-
-
-
-
US$ 0,2
$0.15
$0.545
$0.15
-
-
-
-
192
0.80s
11.24s
13.85s
-
117B
5,1B ativos durante a inferência
131k
ago. de 2025
mai. de 2025
Sim

Compatível com: texto

Compatível com: texto

SnowflakeHyperbolicNebius
+14