Comparação de modelos pequenos de IA de pesos abertos (4B-40B)
Modelos de IA de pesos abertos com 4B a 40B parâmetros.
Os modelos são considerados de pesos abertos (também chamados frequentemente de código aberto) quando seus pesos estão disponíveis para download. Isso permite a auto-hospedagem em sua própria infraestrutura e a personalização do modelo, por exemplo, por meio de ajuste fino.
Para mais detalhes sobre nossa metodologia, consulte as perguntas frequentes.
Abertura
Artificial Analysis Openness Index: pontuação
Inteligência
Artificial Analysis Intelligence Index
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Agentic scientific research workflows in a terminal
Quantitative analysis on spreadsheets & documents
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
Tamanho
Tamanho do modelo: parâmetros totais e ativos
Intelligence Index vs. parâmetros ativos
Intelligence Index vs. parâmetros totais
Janela de contexto
Janela de contexto
Mais detalhes
Pesos | Benchmarks de provedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
Qwen3.8 27B (Xhigh) | 34 | 27B | 256k | $0.5 | 45 | +8 | |||
Qwen3.8 27B (Medium) | 28 | 27B | 256k | $0.5 | 52 | ||||
Qwen3.8 27B (Low) | 26 | 27B | 256k | $0.5 | 50 | ||||
K2 Horizon MoVA 36B A4B | 25 | 36B 4B ativos durante a inferência | 524k | - | - | - | |||
G9v3-39A5B | 22 | 39B 5B ativos durante a inferência | 131k | - | - | ||||
K2 Horizon 7B | 21 | 7B | 524k | - | - | - | |||
Qwen3.8 27B (Non-reasoning) | 20 | 27B | 256k | $0.5 | 51 | +2 | |||
Qwen3.6 35B A3B (Reasoning) | 18 | 36B 3B ativos durante a inferência | 262k | $0.6 | 131 | +6 | |||
Muse Glimmer (High) | 17 | 30B | 131k | $0.2 | 131 | ||||
Gemma 4 26B A4B (Reasoning) | 17 | 25.2B 3.8B ativos durante a inferência | 256k | $0.1 | - | +7 | |||
Qwen3.6 35B A3B (Non-reasoning) | 15 | 36B 3B ativos durante a inferência | 262k | $0.6 | 134 | +5 | |||
Granite 4.2 30B | 15 | 30B | 131k | $0.1 | 76 |