Comparação de modelos médios de IA de pesos abertos (40B-150B)

Modelos de IA de pesos abertos com 40B a 150B parâmetros.

Os modelos são considerados de pesos abertos (também chamados frequentemente de código aberto) quando seus pesos estão disponíveis para download. Isso permite a auto-hospedagem em sua própria infraestrutura e a personalização do modelo, por exemplo, por meio de ajuste fino.

Para mais detalhes sobre nossa metodologia, consulte as perguntas frequentes.

Logo: InclusionAILing-3.0-flash-VL e Logo: InclusionAILing-3.0-flash-Fin são os modelos com maior inteligência entre os modelos médios de pesos abertos, definidos como aqueles com 40B-150B parâmetros, seguidos por Logo: InclusionAILing 3.0 Flash e Logo: AlibabaQwen3.5 122B A10B (non-reasoning).
Artificial Analysis Openness Index · Higher is better
Updated
Artificial Analysis Intelligence Index · Higher is better
Parâmetros treináveis em bilhões

Abertura

Artificial Analysis Openness Index: pontuação

O Openness Index avalia a abertura dos modelos em uma escala normalizada de 0 a 100 (quanto maior, mais aberto)

Inteligência

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
Ver mais

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

No data available

Quantitative analysis on spreadsheets & documents

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Tamanho

Tamanho do modelo: parâmetros totais e ativos

Comparison between total model parameters and parameters active during inference (billions)

Intelligence Index vs. parâmetros ativos

Artificial Analysis Intelligence Index · Active parameters at inference time (billions)
Most attractive quadrant
Pareto line

Intelligence Index vs. parâmetros totais

Artificial Analysis Intelligence Index · Size in parameters (billions)
Most attractive quadrant
Pareto line

Janela de contexto

Janela de contexto

Context window: tokens limit · Higher is better

Mais detalhes

Pesos
Benchmarks de provedores
Ling-3.0-flash-VL
Logo: InclusionAIInclusionAI
25
124B
5.5B ativos durante a inferência
262k
$0.0
145
InclusionAI
Ling-3.0-flash-Fin
Logo: InclusionAIInclusionAI
23
124B
5.1B ativos durante a inferência
262k
$0.0
342
InclusionAI
Ling 3.0 Flash
Logo: InclusionAIInclusionAI
20
124B
5.1B ativos durante a inferência
262k
$0.0
334
Não disponível
DeepInfraInclusionAI
Qwen3.5 122B A10B (Non-reasoning)
Logo: AlibabaAlibaba
18
125B
10B ativos durante a inferência
262k
$0.7
142
DeepInfraAlibaba Cloud
Qwen3.5 122B A10B (Reasoning)
Logo: AlibabaAlibaba
16
125B
10B ativos durante a inferência
262k
$0.7
128
SiliconFlowDeepInfraAlibaba Cloud
+2
Mistral Medium 3.5
Logo: MistralMistral
14
128B
256k
$1.2
168
MistralSelf-hosted
Nemotron 3 Super 120B A12B (Reasoning)
Logo: NVIDIANVIDIA
13
120.6B
12.7B ativos durante a inferência
1M
$0.3
156
CrusoeNebiusDeepInfra
HyperNova 60B 2605 (High, Based on gpt-oss-120b)
Logo: Multiverse ComputingMultiverse Computing
12
58.7B
4.8B ativos durante a inferência
131k
-
-
-
gpt-oss-120b (High)
Logo: OpenAIOpenAI
12
117B
5.1B ativos durante a inferência
131k
$0.2
196
GroqCloudflareScaleway
+17
K2 Think V2
Logo: Institute of Foundation ModelsInstitute of Foundation Models
11
70B
262k
-
-
-
LongCat Flash Lite
Logo: LongCatLongCat
11
68.5B
3B ativos durante a inferência
256k
-
-
-
Mistral Small 4 (Reasoning)
Logo: MistralMistral
11
119B
6.5B ativos durante a inferência
256k
$0.1
174
Mistral