Comparación de modelos de IA medianos con pesos abiertos (40B-150B)

Modelos de IA con pesos abiertos de entre 40B y 150B parámetros.

Consideramos que un modelo tiene pesos abiertos (también denominado comúnmente «open source») cuando sus pesos están disponibles para descargar. Esto permite alojarlo en infraestructura propia y personalizarlo, por ejemplo, mediante ajuste fino.

Para más detalles sobre nuestra metodología, consulta nuestras FAQs.

Logo de InclusionAILing 3.0 Flash y Logo de InclusionAILing-3.0-flash-VL son los modelos medianos con pesos abiertos, definidos como aquellos con 40B-150B parámetros de mayor inteligencia, seguidos por Logo de InclusionAILing-3.0-flash-Fin y Logo de AlibabaQwen3.5 122B A10B (Non-reasoning).

Aspectos destacados

Artificial Analysis Openness Index · Higher is better
Updated
Artificial Analysis Intelligence Index · Higher is better
Parámetros entrenables en miles de millones

Openness

Artificial Analysis Openness Index: Score

Openness Index assesses model openness on a 0 to 100 normalized scale (higher is more open)

Inteligencia

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
See more

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

No data available

Quantitative analysis on spreadsheets & documents

Agentic tool use

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Tamaño

Model Size: Total and Active Parameters

Comparison between total model parameters and parameters active during inference (billions)

Intelligence Index vs. Active Parameters

Artificial Analysis Intelligence Index · Active parameters at inference time (billions)
Most attractive quadrant
Pareto line

Intelligence Index vs. Total Parameters

Artificial Analysis Intelligence Index · Size in parameters (billions)
Most attractive quadrant
Pareto line

Ventana de contexto

Context Window

Context window: tokens limit · Higher is better

Más detalles

Pesos
Benchmarks de proveedores
Ling 3.0 Flash
Logo de InclusionAIInclusionAI
25
124B
5.1B activos en inferencia
262k
$0.0
363
No disponible
DeepInfraInclusionAI
Ling-3.0-flash-VL
Logo de InclusionAIInclusionAI
25
124B
5.5B activos en inferencia
262k
$0.0
147
InclusionAI
Ling-3.0-flash-Fin
Logo de InclusionAIInclusionAI
23
124B
5.1B activos en inferencia
262k
$0.0
159
InclusionAI
Qwen3.5 122B A10B (Non-reasoning)
Logo de AlibabaAlibaba
18
125B
10B activos en inferencia
262k
$0.7
141
DeepInfraAlibaba Cloud
Qwen3.5 122B A10B (Reasoning)
Logo de AlibabaAlibaba
16
125B
10B activos en inferencia
262k
$0.7
132
SiliconFlowDeepInfraAlibaba Cloud
+2
Mistral Medium 3.5
Logo de MistralMistral
14
128B
256k
$1.2
152
MistralSelf-hosted
Nemotron 3 Super 120B A12B (Reasoning)
Logo de NVIDIANVIDIA
13
120.6B
12.7B activos en inferencia
1M
$0.3
169
CrusoeNebiusDeepInfra
HyperNova 60B 2605 (high, based on gpt-oss-120b)
Logo de Multiverse ComputingMultiverse Computing
12
58.7B
4.8B activos en inferencia
131k
-
-
-
gpt-oss-120b (high)
Logo de OpenAIOpenAI
12
117B
5.1B activos en inferencia
131k
$0.2
182
GroqCloudflareScaleway
+17
K2 Think V2
Logo de Institute of Foundation ModelsInstitute of Foundation Models
11
70B
262k
-
-
-
LongCat Flash Lite
Logo de LongCatLongCat
11
68.5B
3B activos en inferencia
256k
-
-
-
Mistral Small 4 (Reasoning)
Logo de MistralMistral
11
119B
6.5B activos en inferencia
256k
$0.1
170
Mistral