Qwen3.6 27B

Open weights model

Released abril de 2026

Qwen3.6 27B (Reasoning) Benchmarking e análise de provedores de API

Comparação de modelos

Esta análise ajuda você a escolher o melhor provedor de API de Qwen3.6 27B (Reasoning) para seu caso de uso.

Mais rápido

#1
GroqGroq
444.4 t/s
#2
DeepInfra FP8DeepInfra FP8
66.7 t/s
#3
NovitaNovita
57.9 t/s
#4
Alibaba CloudAlibaba Cloud
57.4 t/s
#5
SiliconFlow (FP8)SiliconFlow (FP8)
42.9 t/s

Velocidade de saída

5 provedores no total

Menor latência

#1
GroqGroq
13.99 s
#2
DeepInfra FP8DeepInfra FP8
86.07 s
#3
NovitaNovita
101.00 s
#4
Alibaba CloudAlibaba Cloud
102.51 s
#5
SiliconFlow (FP8)SiliconFlow (FP8)
135.66 s

Tempo até o primeiro token da resposta final

5 provedores no total

Menor preço

#1
SiliconFlow (FP8)SiliconFlow (FP8)
$0.59
#2
DeepInfra FP8DeepInfra FP8
$0.61
#3
GroqGroq
$0.84
#4
NovitaNovita
$0.90
#5
Alibaba CloudAlibaba Cloud
$0.90

Preço combinado (por 1M de tokens)

5 provedores no total

Qwen3.6 27B está disponível em 5 provedores de API, cada um com características de desempenho e preços diferentes. Veja abaixo uma comparação das principais métricas entre os provedores.

  • Em velocidade de saída, os principais provedores são Groq (444.4 t/s), DeepInfra FP8 (66.7 t/s) e Novita (57.9 t/s). A velocidade varia significativamente entre os provedores, com uma diferença de 935% entre o mais rápido e o mais lento.
  • Em latência, Groq (13.99s), DeepInfra FP8 (86.07s) e Novita (101.00s) têm o menor tempo até o primeiro token da resposta final.
  • Em preço, SiliconFlow (FP8) (0.59), DeepInfra FP8 (0.61) e Groq (0.84) têm os menores preços combinados por 1M de tokens.
  • Groq oferece o melhor desempenho, com a maior velocidade e a menor latência. Para otimizar os custos, SiliconFlow (FP8) tem o preço mais competitivo.

Destaques

Output tokens per second · Higher is better
Seconds · Lower is better
USD per 1M tokens (blended) · Lower is better

Atualização: A carga de trabalho padrão do benchmarking de desempenho passou a usar 10k tokens de entrada para representar melhor os casos de uso em produção. Você ainda pode selecionar outras cargas de trabalho acima.

Preços

Pricing: Cache Hit, Input, and Output

Price (USD per M Tokens) · Lower is better · 10,000 input tokens

Pricing: Blended Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended) · Lower is better

Output Speed vs. Price

Blended at 7:2:1 (cache-input-output) · Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Velocidade

Medida pela velocidade de saída (tokens por segundo)

Output Speed: Qwen3.6 27B (Reasoning)

Output speed: output tokens per second · 10,000 input tokens

Latency vs. Output Speed

Latency: seconds to first token received · Output speed: output tokens per second · 10,000 input tokens
Most attractive quadrant
Pareto line

Latência

Medida pelo tempo (segundos) até o primeiro token

Tempo até o primeiro token da resposta final

Seconds to first token received · Lower is better · 10,000 input tokens

Tempo de resposta de ponta a ponta

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

Tempo de resposta de ponta a ponta

Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better · 10,000 input tokens

Principais métricas de comparação e recursos da API

Logo: DeepInfraDeepInfra
262k
Aberto
$0.37
67
0.94
93.57
85.14
Logo: GroqGroq
131k
Aberto
$0.60
444
1.22
15.12
12.77
Logo: NovitaNovita
262k
Aberto
$0.62
58
2.95
109.64
98.05
Logo: Alibaba CloudAlibaba Cloud
262k
Aberto
$0.62
57
3.66
111.22
98.85
Logo: SiliconFlowSiliconFlow
262k
Aberto
$0.36
43
3.39
147.31
132.27

Perguntas frequentes

Perguntas comuns sobre os provedores do Qwen3.6 27B (Reasoning)