Comparação de modelos médios de IA de pesos abertos (40B-150B)
Modelos de IA de pesos abertos com 40B a 150B parâmetros.
Os modelos são considerados de pesos abertos (também chamados frequentemente de código aberto) quando seus pesos estão disponíveis para download. Isso permite a auto-hospedagem em sua própria infraestrutura e a personalização do modelo, por exemplo, por meio de ajuste fino.
Para mais detalhes sobre nossa metodologia, consulte as perguntas frequentes.
Abertura
Artificial Analysis Openness Index: pontuação
Inteligência
Artificial Analysis Intelligence Index
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Agentic scientific research workflows in a terminal
Quantitative analysis on spreadsheets & documents
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
Tamanho
Tamanho do modelo: parâmetros totais e ativos
Intelligence Index vs. parâmetros ativos
Intelligence Index vs. parâmetros totais
Janela de contexto
Janela de contexto
Mais detalhes
Pesos | Benchmarks de provedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
Ling-3.0-flash-VL | 25 | 124B 5.5B ativos durante a inferência | 262k | $0.0 | 145 | ||||
Ling-3.0-flash-Fin | 23 | 124B 5.1B ativos durante a inferência | 262k | $0.0 | 342 | ||||
Ling 3.0 Flash | 20 | 124B 5.1B ativos durante a inferência | 262k | $0.0 | 334 | Não disponível | |||
Qwen3.5 122B A10B (Non-reasoning) | 18 | 125B 10B ativos durante a inferência | 262k | $0.7 | 142 | ||||
Qwen3.5 122B A10B (Reasoning) | 16 | 125B 10B ativos durante a inferência | 262k | $0.7 | 128 | +2 | |||
Mistral Medium 3.5 | 14 | 128B | 256k | $1.2 | 168 | ||||
Nemotron 3 Super 120B A12B (Reasoning) | 13 | 120.6B 12.7B ativos durante a inferência | 1M | $0.3 | 156 | ||||
HyperNova 60B 2605 (High, Based on gpt-oss-120b) | 12 | 58.7B 4.8B ativos durante a inferência | 131k | - | - | - | |||
gpt-oss-120b (High) | 12 | 117B 5.1B ativos durante a inferência | 131k | $0.2 | 196 | +17 | |||
K2 Think V2 | 11 | 70B | 262k | - | - | - | |||
LongCat Flash Lite | 11 | 68.5B 3B ativos durante a inferência | 256k | - | - | - | |||
Mistral Small 4 (Reasoning) | 11 | 119B 6.5B ativos durante a inferência | 256k | $0.1 | 174 |