Este modelo está obsoleto. Continuamos medindo o desempenho apenas para a carga padrão de 10 mil tokens de entrada. Os resultados de outras cargas são históricos e não são mais atualizados.
Mistral lançou uma versão mais recente, Mistral Medium 3.5. Sugerimos considerá-la como alternativa.
Análise de inteligência, desempenho e preço do Devstral 2
Resumo do modelo
Velocidade
Devstral 2 está entre os modelos líderes em inteligência e tem preço competitivo em comparação com outros modelos sem raciocínio, de pesos abertos e tamanho semelhante. O modelo aceita entrada em texto, gera saída em texto e tem uma janela de contexto de 256k tokens.
Devstral 2 alcança 9 pontos no Artificial Analysis Intelligence Index, ficando bem acima da média entre os modelos comparáveis (mediana: 7). Na avaliação do Intelligence Index, gerou 18M tokens, um resultado muito conciso em comparação com a mediana de 26M.
| Raciocínio | Não Esta página mostra a versão sem raciocínio deste modelo. Também pode existir uma variante com raciocínio. |
|---|---|
| Modalidade de entrada | Compatível com: texto |
| Modalidade de saída | Compatível com: texto |
| Janela de contexto | 256k ~384 páginas A4 em fonte Arial tamanho 12 |
| Parâmetros totais | 125B |
| Licença | Modified MIT License |
| Pesos do modelo | Hugging Face |
As métricas são comparadas com modelos da mesma classe:
- Modelos sem raciocínio → comparados apenas com outros modelos sem raciocínio
- Modelos de raciocínio → comparados com modelos com e sem raciocínio
- Modelos de pesos abertos → comparados apenas com outros modelos de pesos abertos da mesma classe de tamanho:
- Muito pequeno: ≤4B parâmetros
- Pequeno: 4B–40B parâmetros
- Médio: 40B–150B parâmetros
- Grande: >150B parâmetros
- Modelos proprietários → comparados com modelos proprietários e de pesos abertos da mesma faixa de preço, usando uma proporção combinada de 3:1 entre os preços de entrada e saída:
- <$0.15 por 1M de tokens
- $0.15–$1 por 1M de tokens
- >$1 por 1M de tokens
Velocidade
InteligênciaUpdated
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index: pesos abertos vs. proprietários
Mede o desempenho dos modelos em capacidades e setores específicos
Artificial Analysis Índice de Finanças e Contabilidade
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Agentic scientific research workflows in a terminal
Quantitative analysis on spreadsheets & documents
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
AA-Briefcase v1.1Updated
Elo do AA-Briefcase
AA-Omniscience
AA-Omniscience Index
Openness Index
Artificial Analysis Openness Index: pontuação
Comparações do Intelligence Index
Intelligence Index vs. custo por tarefa do Intelligence Index
Uso de tokens
Tokens de saída por tarefa do Índice de Inteligência
Custo
Custo por tarefa do Intelligence Index
Custo de executar o Artificial Analysis Intelligence Index
Preços: acertos de cache, entrada e saída
Janela de contexto
Janela de contexto
Tamanho do modelo (somente modelos de pesos abertos)
Tamanho do modelo: parâmetros totais e ativos
Perguntas frequentes
Perguntas comuns sobre o Devstral 2
O Devstral 2 foi lançado em 9 de dezembro de 2025.
Mistral criou o Devstral 2.
Devstral 2 alcança 9 pontos no Artificial Analysis Intelligence Index, ficando bem acima da média entre outros modelos sem raciocínio, de pesos abertos e tamanho semelhante (mediana: 7).
Na avaliação do Intelligence Index, Devstral 2 gerou 18M tokens de saída, um resultado muito competitivo em comparação com outros modelos sem raciocínio, de pesos abertos e tamanho semelhante (mediana: 26M).
Não, o Devstral 2 não é um modelo de raciocínio. Ele fornece respostas diretas, sem raciocínio em cadeia prolongado.
Devstral 2 aceita entrada em texto.
Devstral 2 permite saída em texto.
Não, o Devstral 2 não aceita imagens como entrada. Ele só consegue processar texto.
Não, o Devstral 2 não é multimodal. Ele aceita apenas entrada em texto.
Devstral 2 tem uma janela de contexto de 260k tokens. Isso determina quanto texto e histórico da conversa o modelo consegue processar em uma única solicitação.
Sim, o Devstral 2 é um modelo de pesos abertos. Os pesos estão disponíveis publicamente e podem ser baixados para auto-hospedagem.
Devstral 2 tem 125 bilhões parâmetros.
Devstral 2 foi lançado sob a licença Modified MIT License. O uso comercial é permitido com restrições. Ver licença
Devstral 2 alcança 9 pontos no Artificial Analysis Intelligence Index. Esse benchmark composto avalia os modelos em raciocínio, conhecimento, matemática e programação.
Devstral 2 é um modelo de pesos abertos que pode ser auto-hospedado. Ver provedores
Devstral 2 é um modelo de pesos abertos que pode ser baixado e auto-hospedado. Comparar provedores