Modelos de Alibaba: inteligência, desempenho e preço
Artificial Analysis Intelligence Index
Velocidade de saída
Por tarefa do Intelligence Index
A Artificial Analysis avaliou 89 modelos de Alibaba. Abaixo, comparamos as principais métricas desses modelos.
- Em inteligência, o principal modelo de Alibaba é Qwen3.8 Max (0902), com 45.
- Em velocidade de saída, o modelo mais rápido é Qwen3.5 Omni Flash, com 242 tokens/s.
- Em latência, Qwen3.5 9B (Non-reasoning), com 0,79 s oferece o menor tempo até o primeiro token de resposta.
- Em termos de preço, Qwen3.7 Plus, com $0.22 oferece o menor custo por tarefa. Os preços variam em até 25 vezes entre os modelos.
Inteligência
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Custo
Cost per Intelligence Index Task
Velocidade e latência
Output Speed
Pontuações de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Todos os lançamentos de Alibaba
Qwen3.8 Max (0902)
1 modelo
45
Maior inteligência
Qwen3.8-Flash-Next
1 modelo
40
Maior inteligência
Qwen3.8 27B
4 modelos
34
Maior inteligência
Qwen3.8 2.4T A95B
1 modelo
40
Maior inteligência
Qwen3.8 Max
1 modelo
40
Maior inteligência
Qwen3.7 Plus
1 modelo
25
Maior inteligência
Qwen3.7 Max
1 modelo
29
Maior inteligência
Qwen3.6 27B
2 modelos
21
Maior inteligência
Qwen3.6 Max Preview
1 modelo
28
Maior inteligência
Qwen3.6 35B A3B
2 modelos
18
Maior inteligência
Qwen3.6 Plus
1 modelo
27
Maior inteligência
Qwen3.5 Omni Flash
1 modelo
12
Maior inteligência
Qwen3.5 Omni Plus
1 modelo
20
Maior inteligência
Qwen3.5 0.8B
2 modelos
6
Maior inteligência
Qwen3.5 2B
2 modelos
7
Maior inteligência
Qwen3.5 4B
2 modelos
13
Maior inteligência
Qwen3.5 9B
2 modelos
14
Maior inteligência
Qwen3.5 122B A10B
2 modelos
18
Maior inteligência
Qwen3.5 27B
2 modelos
23
Maior inteligência
Qwen3.5 35B A3B
2 modelos
19
Maior inteligência
Qwen3.5 397B A17B
2 modelos
21
Maior inteligência
Qwen3 Coder Next
1 modelo
9
Maior inteligência
Qwen3 Max Thinking
1 modelo
21
Maior inteligência
Qwen3 Max Thinking (Preview)
1 modelo
16
Maior inteligência
Qwen3 VL 32B (Reasoning)
1 modelo
12
Maior inteligência
Qwen3 VL 32B Instruct
1 modelo
8
Maior inteligência
Qwen3 VL 4B (Reasoning)
1 modelo
7
Maior inteligência
Qwen3 VL 4B Instruct
1 modelo
6
Maior inteligência
Qwen3 VL 8B (Reasoning)
1 modelo
8
Maior inteligência
Qwen3 VL 8B Instruct
1 modelo
7
Maior inteligência
Qwen3 VL 30B A3B (Reasoning)
1 modelo
9
Maior inteligência
Qwen3 VL 30B A3B Instruct
1 modelo
8
Maior inteligência
Qwen3 Max
1 modelo
16
Maior inteligência
Qwen3 VL 235B A22B (Reasoning)
1 modelo
13
Maior inteligência
Qwen3 VL 235B A22B Instruct
1 modelo
10
Maior inteligência
Qwen3 Omni 30B A3B (Reasoning)
1 modelo
8
Maior inteligência
Qwen3 Omni 30B A3B Instruct
1 modelo
6
Maior inteligência
Qwen3 Next 80B A3B (Reasoning)
1 modelo
11
Maior inteligência
Qwen3 Next 80B A3B Instruct
1 modelo
10
Maior inteligência
Qwen3 Max (Preview)
1 modelo
13
Maior inteligência
Qwen3 4B 2507
1 modelo
7
Maior inteligência
Qwen3 4B 2507 (Reasoning)
1 modelo
9
Maior inteligência
Qwen3 Coder 30B A3B Instruct
1 modelo
10
Maior inteligência
Qwen3 30B A3B 2507 (Reasoning)
1 modelo
10
Maior inteligência
Qwen3 30B A3B 2507
1 modelo
8
Maior inteligência
Qwen3 235B A22B 2507 (Reasoning)
1 modelo
13
Maior inteligência
Qwen3 Coder 480B A35B Instruct
1 modelo
12
Maior inteligência
Qwen3 235B A22B 2507
1 modelo
12
Maior inteligência
Qwen3 0.6B
2 modelos
5
Maior inteligência
Qwen3 1.7B
2 modelos
5
Maior inteligência
Qwen3 14B
2 modelos
8
Maior inteligência
Qwen3 235B A22B
2 modelos
9
Maior inteligência
Qwen3 30B A3B
2 modelos
8
Maior inteligência
Qwen3 32B
2 modelos
9
Maior inteligência
Qwen3 4B
2 modelos
7
Maior inteligência
Qwen3 8B
2 modelos
7
Maior inteligência
QwQ 32B
1 modelo
9
Maior inteligência
Qwen2.5 Max
1 modelo
8
Maior inteligência
QwQ 32B-Preview
1 modelo
8
Maior inteligência
Qwen2.5 Turbo
1 modelo
6
Maior inteligência
Qwen2.5 Coder Instruct 32B
1 modelo
7
Maior inteligência
Qwen2.5 Instruct 72B
1 modelo
8
Maior inteligência
Qwen2.5 Coder Instruct 7B
1 modelo
6
Maior inteligência
Qwen2.5 Instruct 32B
1 modelo
7
Maior inteligência
Qwen2 Instruct 72B
1 modelo
6
Maior inteligência
Qwen1.5 Chat 110B
1 modelo
6
Maior inteligência
Qwen Chat 72B
1 modelo
5
Maior inteligência
Qwen Chat 14B
1 modelo
5
Maior inteligência
Mais detalhes
Pesos | Benchmarks de provedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.8 Max (0902) | 45 | - | 984k | US$ 1,2 | 39 | Não disponível | |||
| Qwen3.8 Max | 40 | - | 1M | US$ 1,2 | 38 | Não disponível | |||
| Qwen3.8 2.4T A95B | 40 | 2.4T 95B ativos durante a inferência | 984k | US$ 1,2 | 38 | +4 | |||
| Qwen3.8-Flash-Next | 40 | 180B 6B ativos durante a inferência | 256k | US$ 0,1 | 57 | ||||
| Qwen3.8 27B (xhigh) | 34 | 27B | 256k | US$ 0,5 | 47 | +4 | |||
| Qwen3.7 Max | 29 | - | 1M | US$ 1,6 | 207 | Não disponível | |||
| Qwen3.6 Max Preview | 28 | - | 256k | US$ 1,1 | 75 | Não disponível | |||
| Qwen3.8 27B (medium) | 28 | 27B | 256k | US$ 0,5 | 54 | ||||
| Qwen3.6 Plus | 27 | - | 1M | US$ 0,4 | 57 | Não disponível | |||
| Qwen3.8 27B (low) | 26 | 27B | 256k | US$ 0,5 | 57 | ||||
| Qwen3.7 Plus | 25 | - | 1M | US$ 0,3 | 71 | Não disponível | |||
| Qwen3.5 27B (Reasoning) | 23 | 27.8B | 262k | US$ 0,5 | 79 | +2 | |||
| Qwen3.5 397B A17B (Non-reasoning) | 21 | 397B 17B ativos durante a inferência | 262k | US$ 0,9 | 93 | +2 | |||
| Qwen3.6 27B (Reasoning) | 21 | 27.8B | 262k | US$ 0,9 | 59 | +2 | |||
| Qwen3 Max Thinking | 21 | - | 256k | - | - | Não disponível | - | ||
| Qwen3.5 Omni Plus | 20 | - | 256k | US$ 0,8 | 104 | Não disponível | |||
| Qwen3.8 27B (Non-reasoning) | 20 | 27B | 256k | US$ 0,5 | 54 | ||||
| Qwen3.6 27B (Non-reasoning) | 20 | 27.8B | 262k | US$ 0,9 | 62 | ||||
| Qwen3.5 27B (Non-reasoning) | 19 | 27.8B | 262k | US$ 0,5 | 86 | ||||
| Qwen3.5 35B A3B (Reasoning) | 19 | 36B 3B ativos durante a inferência | 262k | US$ 0,4 | 142 | +3 | |||
| Qwen3.5 397B A17B (Reasoning) | 18 | 397B 17B ativos durante a inferência | 262k | US$ 0,9 | 94 | +4 | |||
| Qwen3.6 35B A3B (Reasoning) | 18 | 36B 3B ativos durante a inferência | 262k | US$ 0,6 | 131 | +5 | |||
| Qwen3.5 122B A10B (Non-reasoning) | 18 | 125B 10B ativos durante a inferência | 262k | US$ 0,7 | 146 | ||||
| Qwen3 Max Thinking (Preview) | 16 | - | 262k | US$ 1,0 | 64 | Não disponível | |||
| Qwen3 Max | 16 | - | 262k | US$ 1,7 | 56 | Não disponível | |||
| Qwen3.5 122B A10B (Reasoning) | 16 | 125B 10B ativos durante a inferência | 262k | US$ 0,7 | 133 | +2 | |||
| Qwen3.6 35B A3B (Non-reasoning) | 15 | 36B 3B ativos durante a inferência | 262k | US$ 0,6 | 142 | +4 | |||
| Qwen3.5 35B A3B (Non-reasoning) | 15 | 36B 3B ativos durante a inferência | 262k | US$ 0,4 | 165 | ||||
| Qwen3.5 9B (Reasoning) | 14 | 9.7B | 262k | US$ 0,1 | 44 | ||||
| Qwen3 VL 235B A22B (Reasoning) | 13 | 235B 22B ativos durante a inferência | 262k | US$ 0,8 | 57 | ||||
| Qwen3.5 9B (Non-reasoning) | 13 | 9.7B | 262k | US$ 0,2 | 80 | ||||
| Qwen3.5 4B (Reasoning) | 13 | 4.7B | 262k | US$ 0,0 | 24 | ||||
| Qwen3 235B A22B 2507 (Reasoning) | 13 | 235B 22B ativos durante a inferência | 256k | US$ 0,4 | 53 | ||||
| Qwen3 Max (Preview) | 13 | - | 262k | US$ 1,0 | 57 | Não disponível | |||
| Qwen3.5 Omni Flash | 12 | - | 256k | US$ 0,2 | 242 | Não disponível | |||
| Qwen3 235B A22B 2507 Instruct | 12 | 235B 22B ativos durante a inferência | 256k | US$ 0,3 | 60 | +6 | |||
| Qwen3 Coder 480B A35B Instruct | 12 | 480B 35B ativos durante a inferência | 262k | US$ 2,1 | 52 | +2 | |||
| Qwen3 VL 32B (Reasoning) | 12 | 33.4B | 256k | US$ 0,2 | 90 | ||||
| Qwen3 Next 80B A3B (Reasoning) | 11 | 80B 3B ativos durante a inferência | 262k | US$ 0,3 | 191 | ||||
| Qwen3.5 4B (Non-reasoning) | 11 | 4.7B | 262k | US$ 0,0 | 23 | ||||
| Qwen3 VL 235B A22B Instruct | 10 | 235B 22B ativos durante a inferência | 262k | US$ 0,5 | 52 | ||||
| Qwen3 30B A3B 2507 (Reasoning) | 10 | 30.5B 3,3B ativos durante a inferência | 262k | US$ 0,4 | 146 | ||||
| Qwen3 Next 80B A3B Instruct | 10 | 80B 3B ativos durante a inferência | 262k | US$ 0,3 | 183 | +5 | |||
| Qwen3 Coder 30B A3B Instruct | 10 | 30.5B 3,3B ativos durante a inferência | 262k | US$ 0,6 | 92 | ||||
| Qwen3 235B A22B (Reasoning) | 9 | 235B 22B ativos durante a inferência | 33k | US$ 1,5 | 60 | ||||
| QwQ 32B | 9 | 32.8B | 131k | US$ 0,7 | - | ||||
| Qwen3 VL 30B A3B (Reasoning) | 9 | 30B 3B ativos durante a inferência | 256k | US$ 0,4 | 113 | ||||
| Qwen3 Coder Next | 9 | 79.7B 3B ativos durante a inferência | 256k | US$ 0,4 | 131 | ||||
| Qwen3 4B 2507 (Reasoning) | 9 | 4.0B | 262k | - | - | - | |||
| Qwen3 32B (Reasoning) | 9 | 32.8B | 33k | US$ 0,2 | 106 | ||||
| Qwen3 VL 32B Instruct | 8 | 33.4B | 256k | US$ 0,2 | 72 | ||||
| Qwen3 235B A22B (Non-reasoning) | 8 | 235B 22B ativos durante a inferência | 33k | US$ 0,9 | 61 | ||||
| Qwen3 VL 8B (Reasoning) | 8 | 8.8B | 256k | US$ 0,4 | 114 | ||||
| Qwen3 14B (Reasoning) | 8 | 14.8B | 33k | US$ 0,7 | 63 | ||||
| Qwen2.5 Max | 8 | - | 32k | - | - | Não disponível | - | ||
| Qwen3 VL 30B A3B Instruct | 8 | 30B 3B ativos durante a inferência | 256k | US$ 0,3 | 112 | ||||
| Qwen3 Omni 30B A3B (Reasoning) | 8 | 35.3B 3B ativos durante a inferência | 66k | US$ 0,3 | 101 | ||||
| Qwen2.5 Instruct 72B | 8 | 72B | 131k | US$ 0,4 | - | ||||
| Qwen3 30B A3B (Reasoning) | 8 | 30.5B 3,3B ativos durante a inferência | 33k | US$ 0,4 | 108 | ||||
| QwQ 32B-Preview | 8 | 32.8B | 33k | - | - | - | |||
| Qwen3 30B A3B 2507 Instruct | 8 | 30.5B 3,3B ativos durante a inferência | 262k | US$ 0,3 | 144 | ||||
| Qwen3 32B (Non-reasoning) | 7 | 32.8B | 33k | US$ 0,2 | 105 | ||||
| Qwen3 8B (Reasoning) | 7 | 8.2B | 131k | US$ 0,4 | 41 | ||||
| Qwen3 VL 8B Instruct | 7 | 8.8B | 256k | US$ 0,2 | 116 | ||||
| Qwen3 4B (Reasoning) | 7 | 4.0B | 32k | - | - | - | |||
| Qwen3 VL 4B (Reasoning) | 7 | 4.4B | 256k | - | - | - | |||
| Qwen3.5 2B (Reasoning) | 7 | 2.3B | 262k | - | - | - | |||
| Qwen2.5 Instruct 32B | 7 | 32B | 128k | - | - | - | |||
| Qwen3 4B 2507 Instruct | 7 | 4.0B | 262k | - | - | - | |||
| Qwen2.5 Coder Instruct 32B | 7 | 32B | 131k | - | - | - | |||
| Qwen3 14B (Non-reasoning) | 7 | 14.8B | 33k | US$ 0,5 | 63 | ||||
| Qwen3 30B A3B (Non-reasoning) | 7 | 30.5B 3,3B ativos durante a inferência | 33k | US$ 0,3 | 106 | ||||
| Qwen3 4B (Non-reasoning) | 7 | 4.0B | 32k | - | - | - | |||
| Qwen2.5 Turbo | 6 | - | 1M | US$ 0,0 | 108 | Não disponível | |||
| Qwen2 Instruct 72B | 6 | 72B | 131k | - | - | - | |||
| Qwen3.5 2B (Non-reasoning) | 6 | 2.3B | 262k | - | - | - | |||
| Qwen3.5 0.8B (Reasoning) | 6 | 0.9B | 262k | - | - | - | |||
| Qwen3 Omni 30B A3B Instruct | 6 | 35.3B 3B ativos durante a inferência | 66k | US$ 0,3 | 96 | ||||
| Qwen3 8B (Non-reasoning) | 6 | 8.2B | 33k | US$ 0,2 | 42 | ||||
| Qwen2.5 Coder Instruct 7B | 6 | 7.6B | 131k | - | - | - | |||
| Qwen3 VL 4B Instruct | 6 | 4.4B | 256k | - | - | - | |||
| Qwen1.5 Chat 110B | 6 | 110B | 32k | - | - | - | |||
| Qwen Chat 72B | 5 | 72B | 34k | - | - | - | |||
| Qwen3.5 0.8B (Non-reasoning) | 5 | 0.9B | 262k | - | - | - | |||
| Qwen3 1.7B (Reasoning) | 5 | 2.0B | 32k | - | - | - | |||
| Qwen Chat 14B | 5 | 14B | 8k | - | - | - | |||
| Qwen3 1.7B (Non-reasoning) | 5 | 2.0B | 32k | - | - | - | |||
| Qwen3 0.6B (Non-reasoning) | 5 | 0.8B | 32k | - | - | - | |||
| Qwen3 0.6B (Reasoning) | 5 | 0.8B | 32k | - | - | - |