GPT-5.6 Terra vs. Hermes 4 - Llama-3.1 70B: comparação de lançamentos

Comparação dos lançamentos GPT-5.6 Terra e Hermes 4 - Llama-3.1 70B: 6 e 2 modelos, respectivamente, cada um com diferentes características de inteligência, desempenho e preço. Abaixo, comparamos as principais métricas dos 8 modelos.

  • Em inteligência, GPT-5.6 Terra tem a pontuação mais alta: GPT-5.6 Terra (max), com 42, diante de Hermes 4 - Llama-3.1 70B (Reasoning), com 8 de Hermes 4 - Llama-3.1 70B.

Lançamentos comparados

Inteligência

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Index vs. Cost per Intelligence Index Task

Artificial Analysis Intelligence Index · Weighted average cost (USD) per Artificial Analysis Intelligence Index task
Most attractive quadrant
GPT-5.6 Terra
Pareto line

Cost per Task (USD, Log Scale)

Custo

Cost per Intelligence Index Task

Weighted average cost (USD) per Artificial Analysis Intelligence Index task, segmented by token type. Lower is better

Velocidade e latência

Output Speed

Output tokens per second · Higher is better

Pontuações de capacidades

Índices de capacidades

Mede o desempenho dos modelos em capacidades e setores específicos
Finance & Accounting Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Strategy & Ops Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Legal Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better

Healthcare & Medical Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better

Engineering Index

Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better

Economics Index

Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better

Mais detalhes

Modalidade de entrada
Modalidade de saída
Pesos
Benchmarks de provedores
GPT-5.6 Terra (max)
Logo: OpenAIOpenAI
42
41
47
41
40
43
45
$1.40
US$ 1,7
$2.00
$12.00
$0.20
US$ 2.501
39k
26k
122M
95
237.17s
237.17s
242.42s
403.47s
-
1M
jul. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAIAmazon Bedrock
GPT-5.6 Terra (xhigh)
Logo: OpenAIOpenAI
38
40
44
40
38
38
44
$0.63
US$ 1,7
$2.00
$12.00
$0.20
US$ 1.187
20k
12k
52M
94
34.50s
34.50s
39.84s
214.98s
-
1M
jul. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAIMicrosoft Azure
GPT-5.6 Terra (high)
Logo: OpenAIOpenAI
34
37
40
37
34
34
42
$0.34
US$ 1,7
$2.00
$12.00
$0.20
US$ 768
11k
5k
33M
85
3.38s
3.38s
9.29s
134.01s
-
1M
jul. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAIMicrosoft Azure
GPT-5.6 Terra (medium)
Logo: OpenAIOpenAI
30
32
34
34
31
31
37
$0.18
US$ 1,7
$2.00
$12.00
$0.20
US$ 447
5k
2k
17M
84
2.16s
2.16s
8.08s
63.71s
-
1M
jul. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAI
GPT-5.6 Terra (low)
Logo: OpenAIOpenAI
27
30
31
31
27
28
34
$0.14
US$ 1,7
$2.00
$12.00
$0.20
US$ 350
4k
1k
11M
82
1.95s
1.95s
8.05s
48.66s
-
1M
jul. de 2026
-
Sim

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAI
GPT-5.6 Terra (Non-reasoning)
Logo: OpenAIOpenAI
21
21
23
22
-
21
24
$0.14
US$ 1,7
$2.00
$12.00
$0.20
US$ 256
3k
0
6M
80
0.89s
0.89s
7.11s
38.83s
-
1M
jul. de 2026
-
Não

Compatível com: texto e imagem

Compatível com: texto

Não disponível
-
OpenAIAmazon Bedrock
Hermes 4 - Llama-3.1 70B (Reasoning)
Logo: Nous ResearchNous Research
8
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
70.6B
128k
ago. de 2025
-
Sim

Compatível com: texto

Compatível com: texto

-
Hermes 4 - Llama-3.1 70B (Non-reasoning)
Logo: Nous ResearchNous Research
7
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
70.6B
128k
ago. de 2025
-
Não

Compatível com: texto

Compatível com: texto

-