This model is deprecated. We only continue performance benchmarking for the default 10k input token workload. Results for other workloads are historical and no longer updated.
Alibaba has launched a newer model, Qwen3 4B 2507. We suggest considering it instead.
For more information, see comparison of Qwen3 4B 2507 to other models and API provider benchmarks for Qwen3 4B 2507.
Qwen3 4B (Non-reasoning) Benchmarking e análise de provedores de API
Esta análise ajuda você a escolher o melhor provedor de API de Qwen3 4B (Non-reasoning) para seu caso de uso.
Mais rápido
Velocidade de saída
0 provedor no total
Menor latência
Tempo até o primeiro token
0 provedor no total
Menor preço
Preço combinado (por 1M de tokens)
0 provedor no total
Nenhum provedor de API está disponível atualmente para o Qwen3 4B.
Consulte a página do modelo Qwen3 4B (Non-reasoning) para ver detalhes do modelo e comparar sua inteligência com a de outros modelos.
Destaques
Preços
Pricing: Cache Hit, Input, and Output
Pricing: Blended Price
Output Speed vs. Price
Velocidade
Medida pela velocidade de saída (tokens por segundo)
Output Speed: Qwen3 4B (Non-reasoning)
Latency vs. Output Speed
Latência
Medida pelo tempo (segundos) até o primeiro token
Tempo até o primeiro token
Tempo de resposta de ponta a ponta
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
Tempo de resposta de ponta a ponta
Principais métricas de comparação e recursos da API
| No results. | |||||||||
Perguntas frequentes
Perguntas comuns sobre os provedores do Qwen3 4B (Non-reasoning)
Qwen3 4B (Non-reasoning) não está disponível atualmente em nenhum provedor de API que avaliamos. Como é um modelo de pesos abertos, ele pode ser auto-hospedado.