Comparación de modelos con pesos abiertos
Comparación y análisis de modelos de IA con pesos abiertos en métricas clave como calidad, rendimiento, velocidad de inferencia, ventana de contexto, número de parámetros y detalles de licencia.
Consideramos que un modelo tiene pesos abiertos (también denominado comúnmente «open source») cuando sus pesos están disponibles para descargar. Esto permite alojarlo en infraestructura propia y personalizarlo, por ejemplo, mediante ajuste fino.
Para más detalles sobre nuestra metodología, consulta nuestras FAQs.
Aspectos destacados
Openness
Artificial Analysis Openness Index: Score
Progreso de los modelos con pesos abiertos
Progress in Open Weights vs. Proprietary Intelligence
Evolución de la inteligencia de los modelos de lenguaje con pesos abiertos por laboratorio
Evolución de la inteligencia de los modelos con pesos abiertos por tamaño
Inteligencia
Artificial Analysis Intelligence Index
Intelligence Evaluations
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Scientific reasoning
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic knowledge work, Elo
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
Tamaño
Intelligence Index por tamaño de modelo
Model Size: Total and Active Parameters
Intelligence Index vs. Active Parameters
Intelligence Index vs. Total Parameters
Ventana de contexto
Context Window
Más detalles
Pesos | Benchmarks de proveedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
Kimi K3 | 57 | 2.8T 104B activos en inferencia | 1M | $2.3 | 33 | ||||
GLM-5.2 (max) | 51 | 753B 40B activos en inferencia | 1M | $0.9 | 225 | +14 | |||
MiniMax-M3 | 44 | 428B 23B activos en inferencia | 1M | $0.2 | 83 | +5 | |||
DeepSeek V4 Pro (Reasoning, Max Effort) | 44 | 1.6T 49B activos en inferencia | 1M | $0.2 | 71 | +8 | |||
MiMo-V2.5-Pro | 42 | 1.0T 42B activos en inferencia | 1M | $0.2 | 67 | ||||
Inkling (xhigh) | 41 | 975B 41B activos en inferencia | 1M | $1.1 | 87 | ||||
DeepSeek V4 Flash (Reasoning, Max Effort) | 40 | 284B 13B activos en inferencia | 1M | $0.1 | 122 | +4 | |||
Nemotron 3 Ultra 550B A55B (Reasoning) | 38 | 550B 55B activos en inferencia | 262k | $0.6 | 204 | No disponible | +5 | ||
Mistral Medium 3.5 | 30 | 128B | 256k | $1.2 | 104 | ||||
Gemma 4 31B (Reasoning) | 29 | 30.7B | 256k | - | 35 | +9 | |||
gpt-oss-120b (high) | 24 | 117B 5.1B activos en inferencia | 131k | $0.2 | 288 | +19 | |||
Command A+ | 23 | 218B 25B activos en inferencia | 192k | - | 203 |