Comparação de modelos pequenos de IA de pesos abertos (4B-40B)
Modelos de IA de pesos abertos com 4B a 40B parâmetros.
Os modelos são considerados de pesos abertos (também chamados frequentemente de código aberto) quando seus pesos estão disponíveis para download. Isso permite a auto-hospedagem em sua própria infraestrutura e a personalização do modelo, por exemplo, por meio de ajuste fino.
Para mais detalhes sobre nossa metodologia, consulte as perguntas frequentes.
Destaques
Abertura
Artificial Analysis Openness Index: Score
Inteligência
Artificial Analysis Intelligence Index
Intelligence Evaluations
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Scientific reasoning
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic knowledge work, Elo
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Quantitative analysis on spreadsheets & documents
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
Tamanho
Model Size: Total and Active Parameters
Intelligence Index vs. Active Parameters
Intelligence Index vs. Total Parameters
Janela de contexto
Context Window
Mais detalhes
Pesos | Benchmarks de provedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
Qwen3.8 27B (xhigh) | 52 | 27B | 256k | $0.4 | 53 | +2 | |||
Qwen3.8 27B (medium) | 44 | 27B | 256k | $0.4 | 59 | ||||
Qwen3.8 27B (low) | 43 | 27B | 256k | $0.4 | 64 | ||||
Qwen3.6 27B (Reasoning) | 38 | 27.8B | 262k | $0.9 | 56 | +3 | |||
Muse Glimmer (high) | 35 | 30B | 131k | $0.2 | 109 | ||||
Qwen3.8 27B (Non-reasoning) | 35 | 27B | 256k | $0.4 | 64 | ||||
G9v3-39A5B | 34 | 39B 5B ativos durante a inferência | 131k | - | - | ||||
Qwen3.6 35B A3B (Reasoning) | 32 | 36B 3B ativos durante a inferência | 262k | $0.6 | 122 | +5 | |||
Qwen3.6 27B (Non-reasoning) | 31 | 27.8B | 262k | $0.9 | 58 | +2 | |||
Gemma 4 31B (Reasoning) | 30 | 30.7B | 256k | - | 35 | +11 | |||
Gemma 4 26B A4B (Reasoning) | 26 | 25.2B 3.8B ativos durante a inferência | 256k | $0.1 | - | +5 | |||
Qwen3.6 35B A3B (Non-reasoning) | 25 | 36B 3B ativos durante a inferência | 262k | $0.6 | 140 | +4 |