This model is deprecated. We only continue performance benchmarking for the default 10k input token workload. Results for other workloads are historical and no longer updated.
Google has launched a newer model, Gemma 3n E4B. We suggest considering it instead.
For more information, see comparison of Gemma 3n E4B to other models and API provider benchmarks for Gemma 3n E4B.
Análise de inteligência, desempenho e preço do Gemma 3n E4B Instruct Preview (May '25)
Resumo do modelo
Velocidade
Verbosidade
Gemma 3n E4B Instruct Preview (May '25) está abaixo da média em inteligência, mas tem preço competitivo em comparação com outros modelos sem raciocínio, de pesos abertos e tamanho semelhante. O modelo aceita entrada em texto, fala e vídeo, gera saída em texto e tem uma janela de contexto de 32k tokens, com conhecimento até agosto de 2024.
Gemma 3n E4B Instruct Preview (May '25) alcança 6 pontos no Artificial Analysis Intelligence Index, ficando abaixo da média entre os modelos comparáveis (mediana: 6).
O preço do Gemma 3n E4B Instruct Preview (May '25) é de $0.00 por 1M de tokens de entrada (preço competitivo, mediana: $0.04) e $0.00 por 1M de tokens de saída (preço competitivo, mediana: $0.14).
| Raciocínio | Não Esta página mostra a versão sem raciocínio deste modelo. Também pode existir uma variante com raciocínio. |
|---|---|
| Modalidade de entrada | Compatível com: texto, fala e vídeo |
| Modalidade de saída | Compatível com: texto |
| Data-limite do conhecimento | 1 de ago. de 2024 |
| Janela de contexto | 32k ~48 páginas A4 em fonte Arial tamanho 12 |
| Parâmetros totais | 8.4B |
| Parâmetros ativos | 4B Número de parâmetros ativos por token durante a inferência |
| Licença | Gemma license |
| Pesos do modelo | Hugging Face |
As métricas são comparadas com modelos da mesma classe:
- Modelos sem raciocínio → comparados apenas com outros modelos sem raciocínio
- Modelos de raciocínio → comparados com modelos com e sem raciocínio
- Modelos de pesos abertos → comparados apenas com outros modelos de pesos abertos da mesma classe de tamanho:
- Muito pequeno: ≤4B parâmetros
- Pequeno: 4B–40B parâmetros
- Médio: 40B–150B parâmetros
- Grande: >150B parâmetros
- Modelos proprietários → comparados com modelos proprietários e de pesos abertos da mesma faixa de preço, usando uma proporção combinada de 3:1 entre os preços de entrada e saída:
- <$0.15 por 1M de tokens
- $0.15–$1 por 1M de tokens
- >$1 por 1M de tokens
Destaques
Velocidade
InteligênciaUpdated
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Quantitative analysis on spreadsheets & documents
Agentic tool use
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
Openness Index
Artificial Analysis Openness Index: Score
Comparações do Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Custo
Cost per Intelligence Index Task
Cost to Run Artificial Analysis Intelligence Index
Pricing: Cache Hit, Input, and Output
Janela de contexto
Context Window
Tamanho do modelo (somente modelos de pesos abertos)
Model Size: Total and Active Parameters
Perguntas frequentes
Perguntas comuns sobre o Gemma 3n E4B Instruct Preview (May '25)
O Gemma 3n E4B Instruct Preview (May '25) foi lançado em 20 de maio de 2025.
Google criou o Gemma 3n E4B Instruct Preview (May '25).
Gemma 3n E4B Instruct Preview (May '25) alcança 6 pontos (estimativa) no Artificial Analysis Intelligence Index, ficando abaixo da média entre outros modelos sem raciocínio, de pesos abertos e tamanho semelhante (mediana: 6).
Não, o Gemma 3n E4B Instruct Preview (May '25) não é um modelo de raciocínio. Ele fornece respostas diretas, sem raciocínio em cadeia prolongado.
Gemma 3n E4B Instruct Preview (May '25) aceita entrada em texto, fala e vídeo.
Gemma 3n E4B Instruct Preview (May '25) permite saída em texto.
Não, o Gemma 3n E4B Instruct Preview (May '25) não aceita imagens como entrada. Ele só consegue processar texto, fala e vídeo.
Sim, o Gemma 3n E4B Instruct Preview (May '25) é multimodal. Ele consegue processar entrada em texto, fala e vídeo e gerar saída em texto.
Gemma 3n E4B Instruct Preview (May '25) tem uma janela de contexto de 32k tokens. Isso determina quanto texto e histórico da conversa o modelo consegue processar em uma única solicitação.
Sim, o Gemma 3n E4B Instruct Preview (May '25) é um modelo de pesos abertos. Os pesos estão disponíveis publicamente e podem ser baixados para auto-hospedagem.
Gemma 3n E4B Instruct Preview (May '25) tem 8,39 bilhões parâmetros (4 bilhões ativos).
Gemma 3n E4B Instruct Preview (May '25) é um modelo de mistura de especialistas (MoE) com 8,39 bilhões parâmetros no total, mas apenas 4 bilhões parâmetros ativos são usados durante a inferência.
Gemma 3n E4B Instruct Preview (May '25) foi lançado sob a licença Gemma license. Essa licença permite o uso comercial. Ver licença
Gemma 3n E4B Instruct Preview (May '25) alcança 6 pontos no Artificial Analysis Intelligence Index. Esse benchmark composto avalia os modelos em raciocínio, conhecimento, matemática e programação.
A data-limite do conhecimento do Gemma 3n E4B Instruct Preview (May '25) é agosto de 2024. Os dados de treinamento do modelo incluem informações até essa data.
Gemma 3n E4B Instruct Preview (May '25) é um modelo de pesos abertos que pode ser auto-hospedado. Ver provedores
Gemma 3n E4B Instruct Preview (May '25) é um modelo de pesos abertos que pode ser baixado e auto-hospedado. Comparar provedores