Comparación de modelos de IA medianos con pesos abiertos (40B-150B)
Modelos de IA con pesos abiertos de entre 40B y 150B parámetros.
Consideramos que un modelo tiene pesos abiertos (también denominado comúnmente «open source») cuando sus pesos están disponibles para descargar. Esto permite alojarlo en infraestructura propia y personalizarlo, por ejemplo, mediante ajuste fino.
Para más detalles sobre nuestra metodología, consulta nuestras FAQs.
Aspectos destacados
Openness
Artificial Analysis Openness Index: Score
Inteligencia
Artificial Analysis Intelligence Index
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Scientific reasoning
Quantitative analysis on spreadsheets & documents
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
Tamaño
Model Size: Total and Active Parameters
Intelligence Index vs. Active Parameters
Intelligence Index vs. Total Parameters
Ventana de contexto
Context Window
Más detalles
Pesos | Benchmarks de proveedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
Ling 3.0 Flash | 27 | 124B 5.1B activos en inferencia | 262k | $0.0 | 322 | No disponible | |||
Qwen3.5 122B A10B (Reasoning) | 25 | 125B 10B activos en inferencia | 262k | $0.7 | 132 | +2 | |||
Mistral Medium 3.5 | 23 | 128B | 256k | $1.2 | 147 | ||||
Qwen3.5 122B A10B (Non-reasoning) | 21 | 125B 10B activos en inferencia | 262k | $0.7 | 145 | ||||
Nemotron 3 Super 120B A12B (Reasoning) | 19 | 120.6B 12.7B activos en inferencia | 1M | $0.3 | 141 | ||||
gpt-oss-120b (high) | 16 | 117B 5.1B activos en inferencia | 131k | $0.2 | 176 | +17 | |||
Qwen3 Coder Next | 14 | 79.7B 3B activos en inferencia | 256k | $0.4 | 102 | ||||
Mistral Small 4 (Reasoning) | 13 | 119B 6.5B activos en inferencia | 256k | $0.2 | 170 | ||||
Devstral 2 | 13 | 125B | 256k | - | 132 | ||||
HyperNova 60B 2605 (high, based on gpt-oss-120b) | 12 | 58.7B 4.8B activos en inferencia | 131k | $0.1 | 349 | ||||
K2 Think V2 | 11 | 70B | 262k | - | - | - | |||
LongCat Flash Lite | 11 | 68.5B 3B activos en inferencia | 256k | - | - | - |