GPT-5.6 Sol vs. Hermes 4 - Llama-3.1 405B: comparação de lançamentos

Comparação dos lançamentos GPT-5.6 Sol e Hermes 4 - Llama-3.1 405B: 6 e 2 modelos, respectivamente, cada um com diferentes características de inteligência, desempenho e preço. Abaixo, comparamos as principais métricas dos 8 modelos.

  • Em inteligência, GPT-5.6 Sol tem a pontuação mais alta: GPT-5.6 Sol (max), com 47, diante de Hermes 4 - Llama-3.1 405B (Reasoning), com 7 de Hermes 4 - Llama-3.1 405B.
  • Em velocidade de saída, GPT-5.6 Sol é o mais rápido: GPT-5.6 Sol (max), com 73 tokens/s, diante de Hermes 4 - Llama-3.1 405B (Non-reasoning), com 41 tokens/s de Hermes 4 - Llama-3.1 405B.

Lançamentos comparados

Inteligência

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Index vs. Cost per Intelligence Index Task

Artificial Analysis Intelligence Index · Weighted average cost (USD) per Artificial Analysis Intelligence Index task
Most attractive quadrant
GPT-5.6 Sol
Pareto line

Cost per Task (USD, Log Scale)

Custo

Cost per Intelligence Index Task

Weighted average cost (USD) per Artificial Analysis Intelligence Index task, segmented by token type. Lower is better

Velocidade e latência

Output Speed

Output tokens per second · Higher is better

Pontuações de capacidades

Índices de capacidades

Mede o desempenho dos modelos em capacidades e setores específicos
Finance & Accounting Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Strategy & Ops Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Legal Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better

Healthcare & Medical Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better

Engineering Index

Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better

Economics Index

Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better

Mais detalhes

Modalidade de entrada
Modalidade de saída
Pesos
Benchmarks de provedores
GPT-5.6 Sol (max)
Logo: OpenAIOpenAI
47
49
54
50
45
49
53
$1.99
US$ 3,1
$4.00
$20.00
$0.40
US$ 3.465
29k
17k
90M
73
130.17s
130.17s
137.05s
398.87s
-
1M
jul. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
Amazon BedrockOpenAIMicrosoft Azure
GPT-5.6 Sol (xhigh)
Logo: OpenAIOpenAI
44
47
52
49
43
45
51
$1.18
US$ 3,1
$4.00
$20.00
$0.40
US$ 2.082
20k
10k
51M
69
35.55s
35.55s
42.81s
287.80s
-
1M
jul. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAIMicrosoft Azure
GPT-5.6 Sol (high)
Logo: OpenAIOpenAI
42
46
51
47
42
43
50
$0.81
US$ 3,1
$4.00
$20.00
$0.40
US$ 1.487
13k
6k
34M
64
17.49s
17.49s
25.28s
204.81s
-
1M
jul. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAIMicrosoft Azure
GPT-5.6 Sol (medium)
Logo: OpenAIOpenAI
39
43
48
45
39
40
48
$0.50
US$ 3,1
$4.00
$20.00
$0.40
US$ 997
8k
3k
21M
58
5.07s
5.07s
13.67s
133.74s
-
1M
jul. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAI
GPT-5.6 Sol (low)
Logo: OpenAIOpenAI
33
38
42
42
36
34
44
$0.26
US$ 3,1
$4.00
$20.00
$0.40
US$ 637
4k
837
13M
58
3.71s
3.71s
12.31s
68.60s
-
1M
jul. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAI
GPT-5.6 Sol (Non-reasoning)
Logo: OpenAIOpenAI
28
29
32
31
-
-
32
-
US$ 3,1
$4.00
$20.00
$0.40
-
-
-
-
64
1.22s
1.22s
9.08s
-
-
1M
jul. de 2026
-
Não

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAIAmazon Bedrock
Hermes 4 - Llama-3.1 405B (Reasoning)
Logo: Nous ResearchNous Research
7
-
-
-
-
-
-
-
US$ 1,2
$1.00
$3.00
-
-
-
-
-
40
2.44s
52.37s
64.86s
-
406B
128k
ago. de 2025
-
Sim

Compatível com: texto

Compatível com: texto

Nebius
Hermes 4 - Llama-3.1 405B (Non-reasoning)
Logo: Nous ResearchNous Research
7
-
-
-
-
-
-
-
US$ 1,2
$1.00
$3.00
-
-
-
-
-
41
2.37s
2.37s
14.52s
-
406B
128k
ago. de 2025
-
Não

Compatível com: texto

Compatível com: texto

Nebius