LLM 排行榜——比较 OpenAI、Anthropic、Google、SpaceXAI 等公司的 AI 模型

比较并排名 250 多个 AI 模型(LLM)在智能、价格、性能与速度(输出速度——每秒 token 数;延迟——TTFT)、上下文窗口等关键指标上的表现。

如需了解包括方法论在内的更多详情,请参阅我们的常见问题

智能

Claude Opus 5 (max) 和 Claude Opus 5 (xhigh) 是智能得分最高的模型,之后是 Claude Fable 5 (with fallback) 和 Claude Opus 5 (high)。

输出速度

Celeris-1 和 Mercury 2 是速度最快的模型,之后是 Ling 3.0 Flash 和 Gemini 3.5 Flash-Lite。

延迟

Gemini 2.5 Flash-Lite 和 Command A+ 是延迟最低的模型,之后是 Gemini 2.5 Flash 和 Grok Build 0.1 0616。

每任务成本

GPT-5.6 Luna (low) 和 MiMo-V2.5 的每任务成本最低,之后是 Llama 4 Scout 和 GPT-5.6 Luna (medium)。

上下文窗口

Llama 4 Scout 和 Grok 4.20 0309 支持最大的上下文窗口,之后是 Gemini 1.5 Pro (May) 和 Grok 4.1 Fast。

进一步分析
Claude Opus 5 (max)
1M
AnthropicAnthropic
63
$2.34
62
50.37
58.45
Claude Opus 5 (xhigh)
1M
AnthropicAnthropic
63
$1.80
60
34.19
42.48
Claude Fable 5 (with fallback)
1M
AnthropicAnthropic
62
$3.14
69
121.24
128.50
Claude Opus 5 (high)
1M
AnthropicAnthropic
61
$1.23
60
18.43
26.76
GPT-5.6 Sol (max)
1M
OpenAIOpenAI
61
$1.23
67
142.43
149.89
Grok 4.6 (high)
500k
SpaceXAISpaceXAI
61
$0.84
69
36.42
43.63
Kimi K3 (max)
1.05M
KimiKimi
60
$0.84
39
3.63
66.97
GPT-5.6 Sol (xhigh)
1M
OpenAIOpenAI
59
$0.81
64
42.36
50.16
Claude Opus 5 (medium)
1M
AnthropicAnthropic
59
$0.72
59
5.76
14.27
Qwen3.8 Max
1M
AlibabaAlibaba
58
$1.13
47
2.59
55.61
Qwen3.8 2.4T A95B
984k
AlibabaAlibaba
58
$1.09
49
2.75
54.04
GPT-5.6 Sol (high)
1M
OpenAIOpenAI
57
$0.55
70
17.33
24.46
Muse Spark 1.2 (xhigh)
1.05M
MetaMeta
57
$0.40
--
--
--
GPT-5.6 Terra (max)
1M
OpenAIOpenAI
57
$0.51
120
197.30
201.45
Gemini 3.7 Flash (high)
1M
GoogleGoogle
56
$0.40
340
9.83
11.30
Grok 4.5 (high)
500k
SpaceXAISpaceXAI
56
$0.36
68
11.51
18.84
GPT-5.6 Sol (medium)
1M
OpenAIOpenAI
56
$0.37
70
3.74
10.92
Claude Sonnet 5 (max)
1M
AnthropicAnthropic
55
$1.72
68
135.14
142.45
Gemini 3.7 Flash (medium)
1M
GoogleGoogle
53
$0.26
274
4.22
6.05
DeepSeek V4 Pro 0813 (max)
1M
DeepSeekDeepSeek
53
$0.25
90
1.82
29.70
GPT-5.6 Terra (xhigh)
1M
OpenAIOpenAI
53
$0.31
118
21.66
25.88
GLM-5.2 (max)
1M
Z AIZ AI
53
$0.32
111
1.38
23.93
Claude Opus 5 (low)
1M
AnthropicAnthropic
52
$0.43
58
3.55
12.22
GPT-5.6 Luna (max)
1M
OpenAIOpenAI
52
$0.05
166
137.60
140.61
DeepSeek V4 Flash 0731 (max)
1M
DeepSeekDeepSeek
52
$0.11
123
1.48
21.86
Gemini 3.6 Flash
1M
GoogleGoogle
52
$0.56
232
19.71
21.86
Gemini 3.7 Flash (low)
1M
GoogleGoogle
51
$0.16
253
0.74
2.71
GPT-5.6 Sol (low)
1M
OpenAIOpenAI
51
$0.23
62
3.79
11.81
GPT-5.6 Terra (high)
1M
OpenAIOpenAI
50
$0.22
119
3.56
7.78
GPT-5.6 Luna (xhigh)
1M
OpenAIOpenAI
50
$0.03
168
40.72
43.69
Kimi K3 (low)
1.05M
KimiKimi
48
$0.24
38
2.92
68.83
Gemini 3.1 Pro Preview
1M
GoogleGoogle
48
$0.33
118
33.91
38.14
Motif 3
262k
Motif TechnologiesMotif Technologies
47
--
--
--
--
GPT-5.6 Luna (high)
1M
OpenAIOpenAI
47
$0.02
169
16.98
19.93
GPT-5.6 Terra (medium)
1M
OpenAIOpenAI
47
$0.12
108
1.78
6.42
Gemini 3.5 Flash (medium)
1M
GoogleGoogle
47*
--
189
21.94
24.59
GPT-5.3 Codex (xhigh)
400k
OpenAIOpenAI
46*
--
133
77.85
81.61
MiniMax-M3
1M
MiniMaxMiniMax
45
$0.14
100
1.58
26.45
Motif 3 (Beta)
262k
Motif TechnologiesMotif Technologies
45*
--
--
--
--
DeepSeek V4 Pro (max)
1M
DeepSeekDeepSeek
45
$0.05
81
1.69
61.58
DeepSeek V4 Pro (high)
1M
DeepSeekDeepSeek
44
$0.04
79
1.73
33.13
Kimi K2.7 Code
256k
KimiKimi
43
$0.22
37
2.88
76.19
MiMo-V2.5-Pro
1M
XiaomiXiaomi
43
$0.03
51
3.38
52.10
Claude Sonnet 5 (Non-reasoning)
1M
AnthropicAnthropic
43
$0.42
71
1.61
8.66
Inkling
1M
Thinking MachinesThinking Machines
42
$0.34
78
1.82
34.00
Hy3
256k
TencentTencent
42
$0.04
68
2.87
39.75
GPT-5.6 Sol (Non-reasoning)
1M
OpenAIOpenAI
42
$0.24
64
1.32
9.17
Nex-N2-Pro
262k
Nex AGINex AGI
42
--
130
1.73
20.96
Solar Pro 4
512k
UpstageUpstage
42
$0.22
61
2.31
43.11
GPT-5.6 Terra (low)
1M
OpenAIOpenAI
41
$0.09
111
1.68
6.19
Inkling Small
1M
Thinking MachinesThinking Machines
41
$0.07
108
1.83
24.98
JT-4.1 Flash 236B A21B
256k
China MobileChina Mobile
40*
--
--
--
--
Agnes 2.5 Pro Alpha
1M
Sapiens AISapiens AI
40
--
131
2.21
21.28
Qwen3.7 Plus
1M
AlibabaAlibaba
39
$0.24
55
2.16
47.47
GPT-5.6 Luna (medium)
1M
OpenAIOpenAI
39
$0.01
167
2.13
5.13
Nemotron 3 Ultra
262k
NVIDIANVIDIA
38
$0.38
156
2.27
20.10
MiMo-V2.5
1M
XiaomiXiaomi
38
$0.01
107
1.93
25.24
Ling 3.0 Flash
262k
InclusionAIInclusionAI
38
$0.04
394
1.91
8.26
Qwen3.6 27B
262k
AlibabaAlibaba
38
$0.29
59
3.69
108.19
Gemini 3.5 Flash-Lite
1M
GoogleGoogle
37
$0.10
389
10.09
11.37
Solar Open2 250B
1.05M
UpstageUpstage
37
--
--
--
--
MiMo-V2-Omni-0327
256k
XiaomiXiaomi
37*
--
--
--
--
Grok 4.3 (medium)
1M
SpaceXAISpaceXAI
37*
--
123
15.09
19.15
Grok 4.3 (low)
1M
SpaceXAISpaceXAI
36*
--
122
8.72
12.83
MiMo-V2-Omni
256k
XiaomiXiaomi
36*
--
--
--
--
Gemini 3.5 Flash (minimal)
1M
GoogleGoogle
36*
--
173
0.90
3.79
Claude Sonnet 4.6 (Non-reasoning, Low Effort)
1M
AnthropicAnthropic
35*
--
47
1.90
12.60
Muse Glimmer (high)
131k
MetaMeta
35
$0.07
100
0.83
25.85
A.X-K2
262k
SK TelecomSK Telecom
35
--
--
--
--
GLM-5.2
1M
Z AIZ AI
35
--
140
1.93
5.50
GPT-5.6 Terra (Non-reasoning)
1M
OpenAIOpenAI
35
$0.10
118
0.80
5.05
Qwen3.5 397B A17B
262k
AlibabaAlibaba
34
$0.36
90
2.23
42.97
MiMo-V2-Flash (Feb 2026)
256k
XiaomiXiaomi
34*
--
--
--
--
LongCat 2.0
1M
LongCatLongCat
34
$0.12
42
2.82
62.08
GPT-5.6 Luna (low)
1M
OpenAIOpenAI
34
$0.01
167
1.85
4.84
KAT-Coder-Pro V2
256k
KwaiKATKwaiKAT
34
--
104
1.46
6.26
Qwen3.5 122B A10B
262k
AlibabaAlibaba
33
$0.25
139
2.35
20.30
Qwen3.5 397B A17B
262k
AlibabaAlibaba
33*
--
93
2.20
7.57
Qwen3.6 35B A3B
262k
AlibabaAlibaba
32
$0.29
141
2.16
43.89
DeepSeek V4 Pro
1M
DeepSeekDeepSeek
32*
--
84
1.74
7.67
Ring-2.6-1T
262k
InclusionAIInclusionAI
32
$0.36
130
2.92
22.19
G9v3-39A5B
131k
AI9StarsAI9Stars
32*
--
--
--
--
Qwen3.5 Omni Plus
256k
AlibabaAlibaba
31*
--
50
2.50
12.48
Qwen3.6 27B
262k
AlibabaAlibaba
31
$0.40
60
3.89
12.23
o3
200k
OpenAIOpenAI
31*
--
132
8.11
11.91
K-EXAONE 2.0
262k
LG AI ResearchLG AI Research
31
--
--
--
--
Step 3.7 Flash
262k
StepFunStepFun
31
$0.09
380
0.88
7.45
Mistral Medium 3.5
256k
MistralMistral
30
$0.46
68
2.29
39.01
Claude 4.5 Haiku
200k
AnthropicAnthropic
30
$0.22
100
15.77
20.75
Gemma 4 31B
256k
GoogleGoogle
30
$0.00
35
1.12
64.79
DeepSeek V4 Flash
1M
DeepSeekDeepSeek
29*
--
--
--
--
GPT-5.5 Instant (June 2026)
400k
OpenAIOpenAI
29
$0.54
159
1.08
16.83
JT-35B-Flash
256k
China MobileChina Mobile
29*
--
--
--
--
MiMo-V2.5-Pro
1M
XiaomiXiaomi
28*
--
51
3.23
13.07
Qwen3.5 122B A10B
262k
AlibabaAlibaba
28
$0.20
148
2.35
5.73
GPT-5.6 Luna (Non-reasoning)
1M
OpenAIOpenAI
27
$0.01
174
0.78
3.66
Doubao Seed Code
256k
ByteDance SeedByteDance Seed
26*
--
--
--
--
Gemma 4 26B A4B
256k
GoogleGoogle
26
$0.04
--
--
--
Nemotron 3 Super
1M
NVIDIANVIDIA
26
$0.23
143
1.87
19.39
MiMo-V2-Flash
256k
XiaomiXiaomi
25*
--
--
--
--
Grok 4.3 (Non-reasoning)
1M
SpaceXAISpaceXAI
25
$0.29
115
0.80
5.14
Qwen3.6 35B A3B
262k
AlibabaAlibaba
25
$0.63
154
2.21
5.46
Ling 3.0 Tiny
262k
InclusionAIInclusionAI
25
$0.00
199
2.47
15.04
Qwen3.5 35B A3B
262k
AlibabaAlibaba
24
$0.24
172
2.10
5.00
Claude 4.5 Haiku
200k
AnthropicAnthropic
24*
--
93
0.83
6.20
gpt-oss-120b (high)
131k
OpenAIOpenAI
24
$0.07
176
0.92
15.15
Nemotron 3.5 Lightning
1M
NVIDIANVIDIA
24
$0.06
302
1.05
9.33
Command A+
192k
CohereCohere
23
$0.00
199
0.39
12.98
K-EXAONE
256k
LG AI ResearchLG AI Research
22*
--
--
--
--
ERNIE 5.0 Thinking Preview
128k
BaiduBaidu
22*
--
--
--
--
Gemma 4 31B
256k
GoogleGoogle
22
$0.04
71
2.11
9.17
Gemma 4 12B
256k
GoogleGoogle
22*
--
116
2.32
23.93
Nova 2.0 Pro Preview (medium)
256k
AmazonAmazon
22*
--
119
16.60
37.66
Mercury 2
128k
InceptionInception
22
$0.08
1,230
3.96
4.37
Qwen3.5 9B
262k
AlibabaAlibaba
22
$0.24
81
1.81
32.54
Qwen3 Coder Next
256k
AlibabaAlibaba
21
$0.34
123
1.53
5.59
Nova 2.0 Omni (medium)
1M
AmazonAmazon
21*
--
--
--
--
Apriel-v1.6-15B-Thinker
128k
ServiceNowServiceNow
21*
--
--
--
--
Nova 2.0 Lite (high)
1M
AmazonAmazon
21*
--
163
23.30
38.66
Qwen3.5 9B
262k
AlibabaAlibaba
21*
--
94
0.87
6.17
EXAONE 4.5 33B
262k
LG AI ResearchLG AI Research
21*
--
--
--
--
Gemma 4 26B A4B
256k
GoogleGoogle
20*
--
59
1.40
9.93
Qwen3.5 4B
262k
AlibabaAlibaba
20*
--
33
0.77
77.13
North Mini Code
256k
CohereCohere
20
$0.00
27
0.54
92.21
Nova 2.0 Pro Preview (low)
256k
AmazonAmazon
20*
--
116
11.31
32.79
Mistral Small 4
256k
MistralMistral
20
$0.10
178
0.86
14.86
Devstral 2
256k
MistralMistral
19
$0.00
47
1.48
12.18
Nova 2.0 Lite (medium)
1M
AmazonAmazon
19*
--
165
20.79
35.93
Qwen3.5 Omni Flash
256k
AlibabaAlibaba
19*
--
268
1.83
3.69
JT-MINI
128k
China MobileChina Mobile
19*
--
--
--
--
Trinity Large Thinking
512k
Arcee AIArcee AI
19
$0.16
203
1.21
13.52
HyperNova 60B 2605
131k
Multiverse ComputingMultiverse Computing
18
--
--
--
--
Magistral Medium 1.2
128k
MistralMistral
18
$0.89
112
2.22
24.48
Nova 2.0 Lite (low)
1M
AmazonAmazon
18*
--
161
10.68
26.21
Nemotron Cascade 2 30B A3B
1M
NVIDIANVIDIA
18*
--
--
--
--
Devstral Small 2
256k
MistralMistral
18
$0.00
130
2.22
6.07
K2 Think V2
262k
MBZUAI Institute of Foundation ModelsMBZUAI Institute of Foundation Models
17*
--
--
--
--
LongCat Flash Lite
256k
LongCatLongCat
17*
--
--
--
--
HyperCLOVA X SEED Think (32B)
128k
NaverNaver
17*
--
--
--
--
K-EXAONE
256k
LG AI ResearchLG AI Research
17*
--
--
--
--
Qwen3 Next 80B A3B
262k
AlibabaAlibaba
17
$0.19
204
2.31
14.59
Nova 2.0 Omni (low)
1M
AmazonAmazon
17*
--
--
--
--
Mi:dm K 2.5 Pro
128k
Korea TelecomKorea Telecom
17*
--
--
--
--
G9v3-3B
131k
AI9StarsAI9Stars
16*
--
--
--
--
Qwen3.5 4B
262k
AlibabaAlibaba
16*
--
24
0.85
21.90
Mistral Large 3
256k
MistralMistral
16
$0.08
50
1.17
11.17
INTELLECT-3
131k
Prime IntellectPrime Intellect
16*
--
--
--
--
Solar Open 100B
128k
UpstageUpstage
15*
--
--
--
--
gpt-oss-20b (high)
131k
OpenAIOpenAI
15
$0.02
140
1.00
18.84
Nemotron 3 Nano Omni 30B A3B
256k
NVIDIANVIDIA
15*
--
322
1.04
8.80
gpt-oss-120b (low)
131k
OpenAIOpenAI
15
$0.02
221
0.98
12.29
Nemotron 3 Nano
1M
NVIDIANVIDIA
15
$0.02
281
1.11
10.00
Solar Pro 3
128k
UpstageUpstage
14
$0.15
138
2.32
20.49
Llama 4 Maverick
1M
MetaMeta
14
$0.04
113
0.96
5.40
Nova 2.0 Pro Preview
256k
AmazonAmazon
14*
--
104
1.11
5.92
gpt-oss-20b (low)
131k
OpenAIOpenAI
14*
--
165
1.06
16.25
K2-V2 (high)
512k
MBZUAI Institute of Foundation ModelsMBZUAI Institute of Foundation Models
14*
--
--
--
--
Qwen3 Next 80B A3B
262k
AlibabaAlibaba
14*
--
203
2.15
4.62
DiffusionGemma 26B A4B
256k
GoogleGoogle
13*
--
--
--
--
Gemma 4 12B (Non-reasoning)
262k
GoogleGoogle
13*
--
116
2.40
6.71
Motif-2-12.7B
128k
Motif TechnologiesMotif Technologies
13*
--
--
--
--
Nova Premier
1M
AmazonAmazon
13*
--
32
2.85
18.51
K2-V2 (medium)
512k
MBZUAI Institute of Foundation ModelsMBZUAI Institute of Foundation Models
12*
--
--
--
--
Llama Nemotron Super 49B v1.5
128k
NVIDIANVIDIA
12*
--
124
4.93
25.08
Celeris-1
131k
CelerisCeleris
12
$0.26
1,629
0.60
0.91
Mistral Small 4
256k
MistralMistral
12*
--
151
0.85
4.16
Tri-21B-Think
32k
Trillion LabsTrillion Labs
12*
--
--
--
--
Gemma 4 E4B
128k
GoogleGoogle
12*
--
58
0.91
43.86
MiniCPM5-1B
128k
OpenBMBOpenBMB
12*
--
--
--
--
Sarvam 105B (high)
128k
SarvamSarvam
12*
--
--
--
--
Nova 2.0 Lite
1M
AmazonAmazon
12*
--
167
1.19
4.18
MiniCPM5-1B
128k
OpenBMBOpenBMB
12*
--
--
--
--
Magistral Small 1.2
128k
MistralMistral
11
$0.30
160
0.83
16.47
Ministral 3 14B
256k
MistralMistral
11
$0.16
92
0.84
6.27
Nanbeige4.1-3B
256k
NanbeigeNanbeige
11*
--
--
--
--
EXAONE 4.0 32B
131k
LG AI ResearchLG AI Research
11*
--
--
--
--
Nova 2.0 Omni
1M
AmazonAmazon
10*
--
--
--
--
Llama 4 Scout
10M
MetaMeta
10
$0.01
128
0.83
4.74
Hermes 4 70B
128k
Nous ResearchNous Research
10*
--
84
1.38
31.12
Falcon-H1R-7B
256k
TII UAETII UAE
10*
--
--
--
--
Gemma 4 E2B
128k
GoogleGoogle
10*
--
--
--
--
Qwen3 Omni 30B A3B
65.5k
AlibabaAlibaba
10*
--
97
1.90
27.55
Step3 VL 10B
65.5k
StepFunStepFun
9*
--
--
--
--
Llama 3.3 70B
128k
MetaMeta
9*
--
82
1.72
7.80
Ministral 3 8B
256k
MistralMistral
9
$0.18
110
0.75
5.31
Llama Nemotron Ultra
128k
NVIDIANVIDIA
9*
--
52
2.35
49.99
ERNIE 4.5 300B A47B
131k
BaiduBaidu
9*
--
--
--
--
Hermes 4 405B
128k
Nous ResearchNous Research
9*
--
32
2.55
80.38
NVIDIA Nemotron Nano 12B v2 VL
128k
NVIDIANVIDIA
9*
--
106
4.16
27.70
Gemma 4 E4B
128k
GoogleGoogle
9*
--
56
0.89
9.82
Granite 4.1 30B
131k
IBMIBM
9*
--
--
--
--
NVIDIA Nemotron Nano 9B V2
131k
NVIDIANVIDIA
9*
--
180
4.02
17.88
Hermes 4 405B
128k
Nous ResearchNous Research
9*
--
32
2.51
17.94
Nemotron 3 Nano 4B
262k
NVIDIANVIDIA
9*
--
--
--
--
Llama Nemotron Super 49B v1.5
128k
NVIDIANVIDIA
9*
--
92
8.22
13.65
K2-V2 (low)
512k
MBZUAI Institute of Foundation ModelsMBZUAI Institute of Foundation Models
8*
--
--
--
--
Kimi Linear 48B A3B Instruct
1M
KimiKimi
8*
--
--
--
--
Llama 3.1 405B
128k
MetaMeta
8*
--
--
--
--
LFM2.5-8B-A1B
32.8k
Liquid AILiquid AI
8*
--
341
2.02
9.36
Ring-flash-2.0
128k
InclusionAIInclusionAI
8*
--
--
--
--
Olmo 3.1 32B Think
65.5k
Allen Institute for AIAllen Institute for AI
8*
--
--
--
--
Command A
256k
CohereCohere
7*
--
59
1.91
10.34
Qwen3.5 2B
262k
AlibabaAlibaba
7*
--
--
--
--
Llama 3.1 Nemotron 70B
128k
NVIDIANVIDIA
7*
--
113
6.93
11.36
Nemotron 3 Nano
1M
NVIDIANVIDIA
7*
--
220
0.91
3.18
NVIDIA Nemotron Nano 9B V2
131k
NVIDIANVIDIA
7*
--
166
1.42
4.43
Ministral 3 3B
256k
MistralMistral
7
$0.13
205
0.65
3.09
Hermes 4 70B
128k
Nous ResearchNous Research
7*
--
84
1.39
7.35
Granite 4.1 8B
131k
IBMIBM
6*
--
113
0.76
5.17
Sarvam 30B (high)
65.5k
SarvamSarvam
6*
--
--
--
--
Olmo 3.1 32B Instruct
65.5k
Allen Institute for AIAllen Institute for AI
6*
--
--
--
--
Gemma 4 E2B
128k
GoogleGoogle
6*
--
--
--
--
R1 1776
128k
PerplexityPerplexity
6*
--
--
--
--
Llama 3.2 90B (Vision)
128k
MetaMeta
6*
--
--
--
--
Phi-4 Mini
128k
MicrosoftMicrosoft
6*
--
44
0.84
12.31
EXAONE 4.0 32B
131k
LG AI ResearchLG AI Research
6*
--
--
--
--
Qwen3.5 2B
262k
AlibabaAlibaba
5*
--
--
--
--
Qwen3.5 0.8B
262k
AlibabaAlibaba
5*
--
--
--
--
DeepHermes 3 - Mistral 24B
32k
Nous ResearchNous Research
5*
--
--
--
--
Jamba 1.7 Large
256k
AI21 LabsAI21 Labs
5*
--
--
--
--
Granite 4.0 H Small
128k
IBMIBM
5*
--
27
18.87
37.55
Qwen3 Omni 30B A3B
65.5k
AlibabaAlibaba
5*
--
93
1.93
7.28
LFM2 24B A2B
32.8k
Liquid AILiquid AI
5*
--
--
--
--
Phi-4
16k
MicrosoftMicrosoft
5*
--
29
2.67
20.18
Nova Micro
130k
AmazonAmazon
4*
--
304
0.87
2.51
Granite 4.1 3B
131k
IBMIBM
4*
--
--
--
--
NVIDIA Nemotron Nano 12B v2 VL
128k
NVIDIANVIDIA
4*
--
199
1.78
4.30
Phi-4 Multimodal
128k
MicrosoftMicrosoft
4*
--
18
0.85
29.41
MiniCPM-V 4.6 1.3B
262k
OpenBMBOpenBMB
4*
--
--
--
--
Jamba Reasoning 3B
262k
AI21 LabsAI21 Labs
4*
--
--
--
--
Reka Flash 3
128k
Reka AIReka AI
4*
--
--
--
--
Olmo 3 7B Think
65.5k
Allen Institute for AIAllen Institute for AI
4*
--
--
--
--
Molmo 7B-D
4.1k
Allen Institute for AIAllen Institute for AI
3*
--
--
--
--
Llama 3.2 11B (Vision)
128k
MetaMeta
3*
--
20
1.39
26.18
Qwen3.5 0.8B
262k
AlibabaAlibaba
3*
--
--
--
--
Exaone 4.0 1.2B
64k
LG AI ResearchLG AI Research
3*
--
--
--
--
Olmo 3 7B
65.5k
Allen Institute for AIAllen Institute for AI
2*
--
--
--
--
Exaone 4.0 1.2B
64k
LG AI ResearchLG AI Research
2*
--
--
--
--
LFM2.5-1.2B-Thinking
32k
Liquid AILiquid AI
2*
--
--
--
--
Jamba 1.7 Mini
258k
AI21 LabsAI21 Labs
2*
--
--
--
--
LFM2 2.6B
32.8k
Liquid AILiquid AI
2*
--
--
--
--
LFM2.5-1.2B-Instruct
32k
Liquid AILiquid AI
2*
--
--
--
--
Granite 4.0 H 1B
128k
IBMIBM
2*
--
--
--
--
Gemma 3 270M
32k
GoogleGoogle
2*
--
--
--
--
Apertus 70B Instruct
65.5k
Swiss AI InitiativeSwiss AI Initiative
2*
--
--
--
--
Granite 4.0 Micro
128k
IBMIBM
2*
--
--
--
--
DeepHermes 3 - Llama-3.1 8B
128k
Nous ResearchNous Research
2*
--
--
--
--
Granite 4.0 1B
128k
IBMIBM
2*
--
--
--
--
Molmo2-8B
36.9k
Allen Institute for AIAllen Institute for AI
2*
--
--
--
--
LFM2 8B A1B
32.8k
Liquid AILiquid AI
1*
--
--
--
--
LFM2.5-VL-1.6B
32k
Liquid AILiquid AI
1*
--
349
1.06
2.49
Granite 4.0 350M
32.8k
IBMIBM
1*
--
--
--
--
Tiny Aya Global
8.19k
CohereCohere
1*
--
--
--
--
Apertus 8B Instruct
65.5k
Swiss AI InitiativeSwiss AI Initiative
1*
--
--
--
--
Granite 4.0 H 350M
32.8k
IBMIBM
1*
--
--
--
--
Claude Sonnet 5 (low)
1M
AnthropicAnthropic
--
--
71
2.83
9.92
EXAONE 4.5 33B
262k
LG AI ResearchLG AI Research
--
--
--
--
--
Claude Sonnet 5 (xhigh)
1M
AnthropicAnthropic
--
--
78
36.70
43.10
Gemini 3 Deep Think
128k
GoogleGoogle
--
--
--
--
--
Claude Sonnet 5 (high)
1M
AnthropicAnthropic
--
--
73
9.30
16.12
GPT-5.5 Pro (xhigh)
922k
OpenAIOpenAI
--
--
--
--
--
Cogito v2.1
128k
Deep CogitoDeep Cogito
--
--
--
--
--
Claude Sonnet 5 (medium)
1M
AnthropicAnthropic
--
--
71
2.62
9.71

关键定义

Maximum number of combined input & output tokens. Output tokens commonly have a significantly lower limit (varied by model).

常见问题

在参与排名的 159 个模型中,Claude Opus 5 (Adaptive Reasoning, Max Effort) 目前以 63 的 Intelligence Index 得分位居 Artificial Analysis LLM 排行榜第一。

按 Intelligence Index 排名,顶尖模型是:1. Claude Opus 5 (Adaptive Reasoning, Max Effort)(63), 2. Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)(63), 3. Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)(62), 4. Claude Opus 5 (Adaptive Reasoning, High Effort)(61), 5. GPT-5.6 Sol (max)(61)。

Celeris-1 最快,输出速度为每秒 1,628.7 个 token,其次是 Mercury 2(1,230.3 t/s)和 Ling 3.0 Flash(394.2 t/s)。

GPT-5.6 Luna (low) 的每项 Intelligence Index 任务成本最低,为 $0.01,其次是 MiMo-V2.5($0.01)和 Llama 4 Scout($0.01)。

Kimi K3 (max) 是排名最高的开放权重模型,Intelligence Index 得分为 60。排行榜上的 159 个模型中,有 84 个开放权重模型。

按 Intelligence Index 排名,顶尖开放权重模型是:1. Kimi K3 (max)(60), 2. Qwen3.8 2.4T A95B(58), 3. DeepSeek V4 Pro 0813 (Reasoning, Max Effort)(53)。

在 126 个推理模型中,Claude Opus 5 (Adaptive Reasoning, Max Effort) 以 63 的 Intelligence Index 得分领先。推理模型会先通过扩展思考来解决复杂问题,再给出回答。

排行榜提供筛选条件,可按模型类型(推理与非推理)、开放性(开放权重与专有)及其他标准缩小结果范围。您还可以调整提示词选项,查看不同输入长度下的性能变化。

点击排行榜中的任意模型名称,即可访问其专属比较页面,查看智能、价格、速度、延迟等详细图表。您还可以比较每个模型的 API 服务商。 查看所有模型