This model is deprecated. We only continue performance benchmarking for the default 10k input token workload. Results for other workloads are historical and no longer updated.
Google has launched a newer model, Gemini 3.5 Flash. We suggest considering it instead.
For more information, see comparison of Gemini 3.5 Flash to other models and API provider benchmarks for Gemini 3.5 Flash.
Análise de inteligência, desempenho e preço do Gemini 3 Flash Preview (Reasoning)
Resumo do modelo
Inteligência
Velocidade
Preço
Preço de acerto do cache
Verbosidade
Gemini 3 Flash Preview (Reasoning) está acima da média em inteligência e tem preço competitivo em comparação com outros modelos de preço semelhante. O modelo aceita entrada em texto, imagem, fala e vídeo, gera saída em texto e tem uma janela de contexto de 1M tokens, com conhecimento até janeiro de 2025.
Gemini 3 Flash Preview (Reasoning) alcança 38 pontos no Artificial Analysis Intelligence Index, ficando acima da média entre os modelos comparáveis (mediana: 32).
O preço do Gemini 3 Flash Preview (Reasoning) é de $0.50 por 1M de tokens de entrada (preço competitivo, mediana: $1.75) e $3.00 por 1M de tokens de saída (preço competitivo, mediana: $10.00).
Com 178 tokens por segundo, Gemini 3 Flash Preview (Reasoning) é especialmente rápido (72).
| Raciocínio | Sim Esta página mostra a versão com raciocínio deste modelo. Também pode existir uma variante sem raciocínio. |
|---|---|
| Modalidade de entrada | Compatível com: texto, imagem, fala e vídeo |
| Modalidade de saída | Compatível com: texto |
| Data-limite do conhecimento | 1 de jan. de 2025 |
| Janela de contexto | 1M ~1500 páginas A4 em fonte Arial tamanho 12 |
As métricas são comparadas com modelos da mesma classe:
- Modelos sem raciocínio → comparados apenas com outros modelos sem raciocínio
- Modelos de raciocínio → comparados com modelos com e sem raciocínio
- Modelos de pesos abertos → comparados apenas com outros modelos de pesos abertos da mesma classe de tamanho:
- Muito pequeno: ≤4B parâmetros
- Pequeno: 4B–40B parâmetros
- Médio: 40B–150B parâmetros
- Grande: >150B parâmetros
- Modelos proprietários → comparados com modelos proprietários e de pesos abertos da mesma faixa de preço, usando uma proporção combinada de 3:1 entre os preços de entrada e saída:
- <$0.15 por 1M de tokens
- $0.15–$1 por 1M de tokens
- >$1 por 1M de tokens
Destaques
Inteligência
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Intelligence Evaluations
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Scientific reasoning
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic knowledge work, Elo
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
AA-Omniscience
AA-Omniscience Index
Comparações do Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Custo
Cost per Intelligence Index Task
Cost to Run Artificial Analysis Intelligence Index
Pricing: Cache Hit, Input, and Output
Janela de contexto
Context Window
Velocidade
Medida pela velocidade de saída (tokens por segundo)
Output Speed
Time per Intelligence Index Task
Latência
Medida pelo tempo (segundos) até o primeiro token
Latency: Time To First Answer Token
Tempo de resposta de ponta a ponta
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
End-to-End Response Time
Perguntas frequentes
Perguntas comuns sobre o Gemini 3 Flash Preview (Reasoning)
O Gemini 3 Flash Preview (Reasoning) foi lançado em 17 de dezembro de 2025.
Google criou o Gemini 3 Flash Preview (Reasoning).
Gemini 3 Flash Preview (Reasoning) alcança 38 pontos (estimativa) no Artificial Analysis Intelligence Index, ficando acima da média entre outros modelos de raciocínio em uma faixa de preço semelhante (mediana: 32).
Gemini 3 Flash Preview (Reasoning) gera a saída a 177.9 tokens por segundo (com base na API de Google), um resultado bem acima da média em comparação com outros modelos de raciocínio em uma faixa de preço semelhante (mediana: 72.2 t/s).
Gemini 3 Flash Preview (Reasoning) tem um tempo até o primeiro token (TTFT) de 7.31s (com base na API de Google), um resultado um pouco acima da média em comparação com outros modelos de raciocínio em uma faixa de preço semelhante (mediana: 2.83s).
Gemini 3 Flash Preview (Reasoning) custa $0.50 por 1M de tokens de entrada (muito competitivo, mediana: $1.75) e $3.00 por 1M de tokens de saída (muito competitivo, mediana: $10.00), com base na API de Google.
Gemini 3 Flash Preview (Reasoning) custa $0.50 por 1M de tokens de entrada e $3.00 por 1M de tokens de saída (com base na API de Google). Considerando uma tarifa combinada (proporção de 7:2:1 entre acerto do cache, entrada e saída), o preço é de $0.43 por 1M de tokens. O preço pode variar conforme o provedor. Comparar preços dos provedores
Sim, o Gemini 3 Flash Preview (Reasoning) é um modelo de raciocínio. Ele usa reflexão prolongada ou raciocínio em cadeia para resolver problemas complexos antes de fornecer uma resposta.
Gemini 3 Flash Preview (Reasoning) aceita entrada em texto, imagem, fala e vídeo.
Gemini 3 Flash Preview (Reasoning) permite saída em texto.
Sim, o Gemini 3 Flash Preview (Reasoning) aceita imagens como entrada e pode analisá-las, descrevê-las e responder a perguntas sobre elas.
Sim, o Gemini 3 Flash Preview (Reasoning) é multimodal. Ele consegue processar entrada em texto, imagem, fala e vídeo e gerar saída em texto.
Gemini 3 Flash Preview (Reasoning) tem uma janela de contexto de 1.0M tokens. Isso determina quanto texto e histórico da conversa o modelo consegue processar em uma única solicitação.
Não, o Gemini 3 Flash Preview (Reasoning) é proprietário. Os pesos não estão disponíveis publicamente.
Gemini 3 Flash Preview (Reasoning) é um modelo proprietário, e Google não divulgou o tamanho nem o número de parâmetros do modelo.
Gemini 3 Flash Preview (Reasoning) alcança 38 pontos no Artificial Analysis Intelligence Index. Esse benchmark composto avalia os modelos em raciocínio, conhecimento, matemática e programação.
A data-limite do conhecimento do Gemini 3 Flash Preview (Reasoning) é janeiro de 2025. Os dados de treinamento do modelo incluem informações até essa data.
Sim, o Gemini 3 Flash Preview (Reasoning) está disponível por API em 1 provedor. Comparar provedores de API
Gemini 3 Flash Preview (Reasoning) está disponível em 1 provedor de API. Comparar provedores