Análise de inteligência, desempenho e preço do DeepSeek V4.1 Flash (Max)
Resumo do modelo
DeepSeek V4.1 Flash (Max) está entre os modelos líderes em inteligência e tem preço razoável em comparação com outros modelos de pesos abertos de tamanho semelhante. Também é especialmente rápido, mas é muito verboso. O modelo aceita entrada em texto e imagem, gera saída em texto e tem uma janela de contexto de 1M tokens.
DeepSeek V4.1 Flash (Max) alcança 39 pontos no Artificial Analysis Intelligence Index, ficando bem acima da média entre os modelos comparáveis (mediana: 19). Na avaliação do Intelligence Index, gerou 250M tokens, um resultado muito verboso em comparação com a mediana de 140M.
O preço do DeepSeek V4.1 Flash (Max) é de $0.30 por 1M de tokens de entrada (preço moderado, mediana: $0.30) e $1.20 por 1M de tokens de saída (preço um pouco alto, mediana: $1.13). Em média, a avaliação do DeepSeek V4.1 Flash (Max) no Intelligence Index custa $0.27 por tarefa.
Com 213 tokens por segundo, DeepSeek V4.1 Flash (Max) é especialmente rápido (71).
| Raciocínio | Sim Esta página mostra a versão com raciocínio deste modelo. Também pode existir uma variante sem raciocínio. |
|---|---|
| Modalidade de entrada | Compatível com: texto e imagem |
| Modalidade de saída | Compatível com: texto |
| Janela de contexto | 1M ~1500 páginas A4 em fonte Arial tamanho 12 |
| Parâmetros totais | 552B |
| Parâmetros ativos | 16B Número de parâmetros ativos por token durante a inferência |
| Licença | MIT |
| Pesos do modelo | Hugging Face |
As métricas são comparadas com modelos da mesma classe:
- Modelos sem raciocínio → comparados apenas com outros modelos sem raciocínio
- Modelos de raciocínio → comparados com modelos com e sem raciocínio
- Modelos de pesos abertos → comparados apenas com outros modelos de pesos abertos da mesma classe de tamanho:
- Muito pequeno: ≤4B parâmetros
- Pequeno: 4B–40B parâmetros
- Médio: 40B–150B parâmetros
- Grande: >150B parâmetros
- Modelos proprietários → comparados com modelos proprietários e de pesos abertos da mesma faixa de preço, usando uma proporção combinada de 3:1 entre os preços de entrada e saída:
- <$0.15 por 1M de tokens
- $0.15–$1 por 1M de tokens
- >$1 por 1M de tokens
InteligênciaUpdated
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index: pesos abertos vs. proprietários
Mede o desempenho dos modelos em capacidades e setores específicos
Artificial Analysis Índice de Finanças e Contabilidade
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Agentic scientific research workflows in a terminal
Quantitative analysis on spreadsheets & documents
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
AA-Briefcase v1.1Updated
Elo do AA-Briefcase
AA-Omniscience
AA-Omniscience Index
Openness Index
Artificial Analysis Openness Index: pontuação
Comparações do Intelligence Index
Intelligence Index vs. custo por tarefa do Intelligence Index
Uso de tokens
Tokens de saída por tarefa do Índice de Inteligência
Custo
Custo por tarefa do Intelligence Index
Custo de executar o Artificial Analysis Intelligence Index
Preços: acertos de cache, entrada e saída
Janela de contexto
Janela de contexto
Velocidade
Medida pela velocidade de saída (tokens por segundo)
Velocidade de saída
Tempo por tarefa do Índice de Inteligência
Latência
Medida pelo tempo (segundos) até o primeiro token
Latência: Tempo até o primeiro token da resposta final
Tempo de resposta de ponta a ponta
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
Tempo de resposta de ponta a ponta
Tamanho do modelo (somente modelos de pesos abertos)
Tamanho do modelo: parâmetros totais e ativos
Perguntas frequentes
Perguntas comuns sobre o DeepSeek V4.1 Flash (Max)
O DeepSeek V4.1 Flash (Max) foi lançado em 10 de setembro de 2026.
DeepSeek criou o DeepSeek V4.1 Flash (Max).
DeepSeek V4.1 Flash (Max) alcança 39 pontos no Artificial Analysis Intelligence Index, ficando bem acima da média entre outros modelos de pesos abertos de tamanho semelhante (mediana: 19).
DeepSeek V4.1 Flash (Max) gera a saída a 213.2 tokens por segundo (com base na API de DeepSeek), um resultado bem acima da média em comparação com outros modelos de pesos abertos de tamanho semelhante (mediana: 71.0 t/s).
DeepSeek V4.1 Flash (Max) tem um tempo até o primeiro token (TTFT) de 1.05s (com base na API de DeepSeek), um resultado muito competitivo em comparação com outros modelos de pesos abertos de tamanho semelhante (mediana: 2.19s).
DeepSeek V4.1 Flash (Max) custa $0.30 por 1M de tokens de entrada (melhor que a média, mediana: $0.43) e $1.20 por 1M de tokens de saída (melhor que a média, mediana: $1.68), com base na API de DeepSeek.
DeepSeek V4.1 Flash (Max) custa $0.30 por 1M de tokens de entrada e $1.20 por 1M de tokens de saída (com base na API de DeepSeek). Considerando uma tarifa combinada (proporção de 7:2:1 entre acerto do cache, entrada e saída), o preço é de $0.18 por 1M de tokens. O preço pode variar conforme o provedor. Comparar preços dos provedores
Na avaliação do Intelligence Index, DeepSeek V4.1 Flash (Max) gerou 250M tokens de saída, um resultado na faixa superior em comparação com outros modelos de pesos abertos de tamanho semelhante (mediana: 140M).
Sim, o DeepSeek V4.1 Flash (Max) é um modelo de raciocínio. Ele usa reflexão prolongada ou raciocínio em cadeia para resolver problemas complexos antes de fornecer uma resposta.
DeepSeek V4.1 Flash (Max) aceita entrada em texto e imagem.
DeepSeek V4.1 Flash (Max) permite saída em texto.
Sim, o DeepSeek V4.1 Flash (Max) aceita imagens como entrada e pode analisá-las, descrevê-las e responder a perguntas sobre elas.
Sim, o DeepSeek V4.1 Flash (Max) é multimodal. Ele consegue processar entrada em texto e imagem e gerar saída em texto.
DeepSeek V4.1 Flash (Max) tem uma janela de contexto de 1.0M tokens. Isso determina quanto texto e histórico da conversa o modelo consegue processar em uma única solicitação.
Sim, o DeepSeek V4.1 Flash (Max) é um modelo de pesos abertos. Os pesos estão disponíveis publicamente e podem ser baixados para auto-hospedagem.
DeepSeek V4.1 Flash (Max) tem 552 bilhões parâmetros (16 bilhões ativos).
DeepSeek V4.1 Flash (Max) é um modelo de mistura de especialistas (MoE) com 552 bilhões parâmetros no total, mas apenas 16 bilhões parâmetros ativos são usados durante a inferência.
DeepSeek V4.1 Flash (Max) foi lançado sob a licença MIT. Essa licença permite o uso comercial. Ver licença
DeepSeek V4.1 Flash (Max) alcança 39 pontos no Artificial Analysis Intelligence Index. Esse benchmark composto avalia os modelos em raciocínio, conhecimento, matemática e programação.
Sim, o DeepSeek V4.1 Flash (Max) está disponível por API em 24 provedores. Comparar provedores de API
DeepSeek V4.1 Flash (Max) está disponível em 24 provedores de API. Comparar provedores