LLM 排行榜——比较 OpenAI、Anthropic、Google、SpaceXAI 等公司的 AI 模型
比较并排名 250 多个 AI 模型(LLM)在智能、价格、性能与速度(输出速度——每秒 token 数;延迟——TTFT)、上下文窗口等关键指标上的表现。
如需了解包括方法论在内的更多详情,请参阅我们的常见问题。
智能
Claude Opus 5 (max) 和 Claude Opus 5 (xhigh) 是智能得分最高的模型,之后是 Claude Fable 5 (with fallback) 和 Claude Opus 5 (high)。
输出速度
Celeris-1 和 Mercury 2 是速度最快的模型,之后是 Ling 3.0 Flash 和 Gemini 3.5 Flash-Lite。
延迟
Gemini 2.5 Flash-Lite 和 Command A+ 是延迟最低的模型,之后是 Gemini 2.5 Flash 和 Grok Build 0.1 0616。
每任务成本
GPT-5.6 Luna (low) 和 MiMo-V2.5 的每任务成本最低,之后是 Llama 4 Scout 和 GPT-5.6 Luna (medium)。
上下文窗口
Llama 4 Scout 和 Grok 4.20 0309 支持最大的上下文窗口,之后是 Gemini 1.5 Pro (May) 和 Grok 4.1 Fast。
进一步分析 | ||||||||
|---|---|---|---|---|---|---|---|---|
Claude Opus 5 (max) | 1M | 63 | $2.34 | 62 | 50.37 | 58.45 | ||
Claude Opus 5 (xhigh) | 1M | 63 | $1.80 | 60 | 34.19 | 42.48 | ||
Claude Fable 5 (with fallback) | 1M | 62 | $3.14 | 69 | 121.24 | 128.50 | ||
Claude Opus 5 (high) | 1M | 61 | $1.23 | 60 | 18.43 | 26.76 | ||
GPT-5.6 Sol (max) | 1M | 61 | $1.23 | 67 | 142.43 | 149.89 | ||
Grok 4.6 (high) | 500k | 61 | $0.84 | 69 | 36.42 | 43.63 | ||
Kimi K3 (max) | 1.05M | 60 | $0.84 | 39 | 3.63 | 66.97 | ||
GPT-5.6 Sol (xhigh) | 1M | 59 | $0.81 | 64 | 42.36 | 50.16 | ||
Claude Opus 5 (medium) | 1M | 59 | $0.72 | 59 | 5.76 | 14.27 | ||
Qwen3.8 Max | 1M | 58 | $1.13 | 47 | 2.59 | 55.61 | ||
Qwen3.8 2.4T A95B | 984k | 58 | $1.09 | 49 | 2.75 | 54.04 | ||
GPT-5.6 Sol (high) | 1M | 57 | $0.55 | 70 | 17.33 | 24.46 | ||
Muse Spark 1.2 (xhigh) | 1.05M | 57 | $0.40 | -- | -- | -- | ||
GPT-5.6 Terra (max) | 1M | 57 | $0.51 | 120 | 197.30 | 201.45 | ||
Gemini 3.7 Flash (high) | 1M | 56 | $0.40 | 340 | 9.83 | 11.30 | ||
Grok 4.5 (high) | 500k | 56 | $0.36 | 68 | 11.51 | 18.84 | ||
GPT-5.6 Sol (medium) | 1M | 56 | $0.37 | 70 | 3.74 | 10.92 | ||
Claude Sonnet 5 (max) | 1M | 55 | $1.72 | 68 | 135.14 | 142.45 | ||
Gemini 3.7 Flash (medium) | 1M | 53 | $0.26 | 274 | 4.22 | 6.05 | ||
DeepSeek V4 Pro 0813 (max) | 1M | 53 | $0.25 | 90 | 1.82 | 29.70 | ||
GPT-5.6 Terra (xhigh) | 1M | 53 | $0.31 | 118 | 21.66 | 25.88 | ||
GLM-5.2 (max) | 1M | 53 | $0.32 | 111 | 1.38 | 23.93 | ||
Claude Opus 5 (low) | 1M | 52 | $0.43 | 58 | 3.55 | 12.22 | ||
GPT-5.6 Luna (max) | 1M | 52 | $0.05 | 166 | 137.60 | 140.61 | ||
DeepSeek V4 Flash 0731 (max) | 1M | 52 | $0.11 | 123 | 1.48 | 21.86 | ||
Gemini 3.6 Flash | 1M | 52 | $0.56 | 232 | 19.71 | 21.86 | ||
Gemini 3.7 Flash (low) | 1M | 51 | $0.16 | 253 | 0.74 | 2.71 | ||
GPT-5.6 Sol (low) | 1M | 51 | $0.23 | 62 | 3.79 | 11.81 | ||
GPT-5.6 Terra (high) | 1M | 50 | $0.22 | 119 | 3.56 | 7.78 | ||
GPT-5.6 Luna (xhigh) | 1M | 50 | $0.03 | 168 | 40.72 | 43.69 | ||
Kimi K3 (low) | 1.05M | 48 | $0.24 | 38 | 2.92 | 68.83 | ||
Gemini 3.1 Pro Preview | 1M | 48 | $0.33 | 118 | 33.91 | 38.14 | ||
Motif 3 | 262k | 47 | -- | -- | -- | -- | ||
GPT-5.6 Luna (high) | 1M | 47 | $0.02 | 169 | 16.98 | 19.93 | ||
GPT-5.6 Terra (medium) | 1M | 47 | $0.12 | 108 | 1.78 | 6.42 | ||
Gemini 3.5 Flash (medium) | 1M | 47* | -- | 189 | 21.94 | 24.59 | ||
GPT-5.3 Codex (xhigh) | 400k | 46* | -- | 133 | 77.85 | 81.61 | ||
MiniMax-M3 | 1M | 45 | $0.14 | 100 | 1.58 | 26.45 | ||
Motif 3 (Beta) | 262k | 45* | -- | -- | -- | -- | ||
DeepSeek V4 Pro (max) | 1M | 45 | $0.05 | 81 | 1.69 | 61.58 | ||
DeepSeek V4 Pro (high) | 1M | 44 | $0.04 | 79 | 1.73 | 33.13 | ||
Kimi K2.7 Code | 256k | 43 | $0.22 | 37 | 2.88 | 76.19 | ||
MiMo-V2.5-Pro | 1M | 43 | $0.03 | 51 | 3.38 | 52.10 | ||
Claude Sonnet 5 (Non-reasoning) | 1M | 43 | $0.42 | 71 | 1.61 | 8.66 | ||
Inkling | 1M | 42 | $0.34 | 78 | 1.82 | 34.00 | ||
Hy3 | 256k | 42 | $0.04 | 68 | 2.87 | 39.75 | ||
GPT-5.6 Sol (Non-reasoning) | 1M | 42 | $0.24 | 64 | 1.32 | 9.17 | ||
Nex-N2-Pro | 262k | 42 | -- | 130 | 1.73 | 20.96 | ||
Solar Pro 4 | 512k | 42 | $0.22 | 61 | 2.31 | 43.11 | ||
GPT-5.6 Terra (low) | 1M | 41 | $0.09 | 111 | 1.68 | 6.19 | ||
Inkling Small | 1M | 41 | $0.07 | 108 | 1.83 | 24.98 | ||
JT-4.1 Flash 236B A21B | 256k | 40* | -- | -- | -- | -- | ||
Agnes 2.5 Pro Alpha | 1M | 40 | -- | 131 | 2.21 | 21.28 | ||
Qwen3.7 Plus | 1M | 39 | $0.24 | 55 | 2.16 | 47.47 | ||
GPT-5.6 Luna (medium) | 1M | 39 | $0.01 | 167 | 2.13 | 5.13 | ||
Nemotron 3 Ultra | 262k | 38 | $0.38 | 156 | 2.27 | 20.10 | ||
MiMo-V2.5 | 1M | 38 | $0.01 | 107 | 1.93 | 25.24 | ||
Ling 3.0 Flash | 262k | 38 | $0.04 | 394 | 1.91 | 8.26 | ||
Qwen3.6 27B | 262k | 38 | $0.29 | 59 | 3.69 | 108.19 | ||
Gemini 3.5 Flash-Lite | 1M | 37 | $0.10 | 389 | 10.09 | 11.37 | ||
Solar Open2 250B | 1.05M | 37 | -- | -- | -- | -- | ||
MiMo-V2-Omni-0327 | 256k | 37* | -- | -- | -- | -- | ||
Grok 4.3 (medium) | 1M | 37* | -- | 123 | 15.09 | 19.15 | ||
Grok 4.3 (low) | 1M | 36* | -- | 122 | 8.72 | 12.83 | ||
MiMo-V2-Omni | 256k | 36* | -- | -- | -- | -- | ||
Gemini 3.5 Flash (minimal) | 1M | 36* | -- | 173 | 0.90 | 3.79 | ||
Claude Sonnet 4.6 (Non-reasoning, Low Effort) | 1M | 35* | -- | 47 | 1.90 | 12.60 | ||
Muse Glimmer (high) | 131k | 35 | $0.07 | 100 | 0.83 | 25.85 | ||
A.X-K2 | 262k | 35 | -- | -- | -- | -- | ||
GLM-5.2 | 1M | 35 | -- | 140 | 1.93 | 5.50 | ||
GPT-5.6 Terra (Non-reasoning) | 1M | 35 | $0.10 | 118 | 0.80 | 5.05 | ||
Qwen3.5 397B A17B | 262k | 34 | $0.36 | 90 | 2.23 | 42.97 | ||
MiMo-V2-Flash (Feb 2026) | 256k | 34* | -- | -- | -- | -- | ||
LongCat 2.0 | 1M | 34 | $0.12 | 42 | 2.82 | 62.08 | ||
GPT-5.6 Luna (low) | 1M | 34 | $0.01 | 167 | 1.85 | 4.84 | ||
KAT-Coder-Pro V2 | 256k | 34 | -- | 104 | 1.46 | 6.26 | ||
Qwen3.5 122B A10B | 262k | 33 | $0.25 | 139 | 2.35 | 20.30 | ||
Qwen3.5 397B A17B | 262k | 33* | -- | 93 | 2.20 | 7.57 | ||
Qwen3.6 35B A3B | 262k | 32 | $0.29 | 141 | 2.16 | 43.89 | ||
DeepSeek V4 Pro | 1M | 32* | -- | 84 | 1.74 | 7.67 | ||
Ring-2.6-1T | 262k | 32 | $0.36 | 130 | 2.92 | 22.19 | ||
G9v3-39A5B | 131k | 32* | -- | -- | -- | -- | ||
Qwen3.5 Omni Plus | 256k | 31* | -- | 50 | 2.50 | 12.48 | ||
Qwen3.6 27B | 262k | 31 | $0.40 | 60 | 3.89 | 12.23 | ||
o3 | 200k | 31* | -- | 132 | 8.11 | 11.91 | ||
K-EXAONE 2.0 | 262k | 31 | -- | -- | -- | -- | ||
Step 3.7 Flash | 262k | 31 | $0.09 | 380 | 0.88 | 7.45 | ||
Mistral Medium 3.5 | 256k | 30 | $0.46 | 68 | 2.29 | 39.01 | ||
Claude 4.5 Haiku | 200k | 30 | $0.22 | 100 | 15.77 | 20.75 | ||
Gemma 4 31B | 256k | 30 | $0.00 | 35 | 1.12 | 64.79 | ||
DeepSeek V4 Flash | 1M | 29* | -- | -- | -- | -- | ||
GPT-5.5 Instant (June 2026) | 400k | 29 | $0.54 | 159 | 1.08 | 16.83 | ||
JT-35B-Flash | 256k | 29* | -- | -- | -- | -- | ||
MiMo-V2.5-Pro | 1M | 28* | -- | 51 | 3.23 | 13.07 | ||
Qwen3.5 122B A10B | 262k | 28 | $0.20 | 148 | 2.35 | 5.73 | ||
GPT-5.6 Luna (Non-reasoning) | 1M | 27 | $0.01 | 174 | 0.78 | 3.66 | ||
Doubao Seed Code | 256k | 26* | -- | -- | -- | -- | ||
Gemma 4 26B A4B | 256k | 26 | $0.04 | -- | -- | -- | ||
Nemotron 3 Super | 1M | 26 | $0.23 | 143 | 1.87 | 19.39 | ||
MiMo-V2-Flash | 256k | 25* | -- | -- | -- | -- | ||
Grok 4.3 (Non-reasoning) | 1M | 25 | $0.29 | 115 | 0.80 | 5.14 | ||
Qwen3.6 35B A3B | 262k | 25 | $0.63 | 154 | 2.21 | 5.46 | ||
Ling 3.0 Tiny | 262k | 25 | $0.00 | 199 | 2.47 | 15.04 | ||
Qwen3.5 35B A3B | 262k | 24 | $0.24 | 172 | 2.10 | 5.00 | ||
Claude 4.5 Haiku | 200k | 24* | -- | 93 | 0.83 | 6.20 | ||
gpt-oss-120b (high) | 131k | 24 | $0.07 | 176 | 0.92 | 15.15 | ||
Nemotron 3.5 Lightning | 1M | 24 | $0.06 | 302 | 1.05 | 9.33 | ||
Command A+ | 192k | 23 | $0.00 | 199 | 0.39 | 12.98 | ||
K-EXAONE | 256k | 22* | -- | -- | -- | -- | ||
ERNIE 5.0 Thinking Preview | 128k | 22* | -- | -- | -- | -- | ||
Gemma 4 31B | 256k | 22 | $0.04 | 71 | 2.11 | 9.17 | ||
Gemma 4 12B | 256k | 22* | -- | 116 | 2.32 | 23.93 | ||
Nova 2.0 Pro Preview (medium) | 256k | 22* | -- | 119 | 16.60 | 37.66 | ||
Mercury 2 | 128k | 22 | $0.08 | 1,230 | 3.96 | 4.37 | ||
Qwen3.5 9B | 262k | 22 | $0.24 | 81 | 1.81 | 32.54 | ||
Qwen3 Coder Next | 256k | 21 | $0.34 | 123 | 1.53 | 5.59 | ||
Nova 2.0 Omni (medium) | 1M | 21* | -- | -- | -- | -- | ||
Apriel-v1.6-15B-Thinker | 128k | 21* | -- | -- | -- | -- | ||
Nova 2.0 Lite (high) | 1M | 21* | -- | 163 | 23.30 | 38.66 | ||
Qwen3.5 9B | 262k | 21* | -- | 94 | 0.87 | 6.17 | ||
EXAONE 4.5 33B | 262k | 21* | -- | -- | -- | -- | ||
Gemma 4 26B A4B | 256k | 20* | -- | 59 | 1.40 | 9.93 | ||
Qwen3.5 4B | 262k | 20* | -- | 33 | 0.77 | 77.13 | ||
North Mini Code | 256k | 20 | $0.00 | 27 | 0.54 | 92.21 | ||
Nova 2.0 Pro Preview (low) | 256k | 20* | -- | 116 | 11.31 | 32.79 | ||
Mistral Small 4 | 256k | 20 | $0.10 | 178 | 0.86 | 14.86 | ||
Devstral 2 | 256k | 19 | $0.00 | 47 | 1.48 | 12.18 | ||
Nova 2.0 Lite (medium) | 1M | 19* | -- | 165 | 20.79 | 35.93 | ||
Qwen3.5 Omni Flash | 256k | 19* | -- | 268 | 1.83 | 3.69 | ||
JT-MINI | 128k | 19* | -- | -- | -- | -- | ||
Trinity Large Thinking | 512k | 19 | $0.16 | 203 | 1.21 | 13.52 | ||
HyperNova 60B 2605 | 131k | 18 | -- | -- | -- | -- | ||
Magistral Medium 1.2 | 128k | 18 | $0.89 | 112 | 2.22 | 24.48 | ||
Nova 2.0 Lite (low) | 1M | 18* | -- | 161 | 10.68 | 26.21 | ||
Nemotron Cascade 2 30B A3B | 1M | 18* | -- | -- | -- | -- | ||
Devstral Small 2 | 256k | 18 | $0.00 | 130 | 2.22 | 6.07 | ||
K2 Think V2 | 262k | 17* | -- | -- | -- | -- | ||
LongCat Flash Lite | 256k | 17* | -- | -- | -- | -- | ||
HyperCLOVA X SEED Think (32B) | 128k | 17* | -- | -- | -- | -- | ||
K-EXAONE | 256k | 17* | -- | -- | -- | -- | ||
Qwen3 Next 80B A3B | 262k | 17 | $0.19 | 204 | 2.31 | 14.59 | ||
Nova 2.0 Omni (low) | 1M | 17* | -- | -- | -- | -- | ||
Mi:dm K 2.5 Pro | 128k | 17* | -- | -- | -- | -- | ||
G9v3-3B | 131k | 16* | -- | -- | -- | -- | ||
Qwen3.5 4B | 262k | 16* | -- | 24 | 0.85 | 21.90 | ||
Mistral Large 3 | 256k | 16 | $0.08 | 50 | 1.17 | 11.17 | ||
INTELLECT-3 | 131k | 16* | -- | -- | -- | -- | ||
Solar Open 100B | 128k | 15* | -- | -- | -- | -- | ||
gpt-oss-20b (high) | 131k | 15 | $0.02 | 140 | 1.00 | 18.84 | ||
Nemotron 3 Nano Omni 30B A3B | 256k | 15* | -- | 322 | 1.04 | 8.80 | ||
gpt-oss-120b (low) | 131k | 15 | $0.02 | 221 | 0.98 | 12.29 | ||
Nemotron 3 Nano | 1M | 15 | $0.02 | 281 | 1.11 | 10.00 | ||
Solar Pro 3 | 128k | 14 | $0.15 | 138 | 2.32 | 20.49 | ||
Llama 4 Maverick | 1M | 14 | $0.04 | 113 | 0.96 | 5.40 | ||
Nova 2.0 Pro Preview | 256k | 14* | -- | 104 | 1.11 | 5.92 | ||
gpt-oss-20b (low) | 131k | 14* | -- | 165 | 1.06 | 16.25 | ||
K2-V2 (high) | 512k | 14* | -- | -- | -- | -- | ||
Qwen3 Next 80B A3B | 262k | 14* | -- | 203 | 2.15 | 4.62 | ||
DiffusionGemma 26B A4B | 256k | 13* | -- | -- | -- | -- | ||
Gemma 4 12B (Non-reasoning) | 262k | 13* | -- | 116 | 2.40 | 6.71 | ||
Motif-2-12.7B | 128k | 13* | -- | -- | -- | -- | ||
Nova Premier | 1M | 13* | -- | 32 | 2.85 | 18.51 | ||
K2-V2 (medium) | 512k | 12* | -- | -- | -- | -- | ||
Llama Nemotron Super 49B v1.5 | 128k | 12* | -- | 124 | 4.93 | 25.08 | ||
Celeris-1 | 131k | 12 | $0.26 | 1,629 | 0.60 | 0.91 | ||
Mistral Small 4 | 256k | 12* | -- | 151 | 0.85 | 4.16 | ||
Tri-21B-Think | 32k | 12* | -- | -- | -- | -- | ||
Gemma 4 E4B | 128k | 12* | -- | 58 | 0.91 | 43.86 | ||
MiniCPM5-1B | 128k | 12* | -- | -- | -- | -- | ||
Sarvam 105B (high) | 128k | 12* | -- | -- | -- | -- | ||
Nova 2.0 Lite | 1M | 12* | -- | 167 | 1.19 | 4.18 | ||
MiniCPM5-1B | 128k | 12* | -- | -- | -- | -- | ||
Magistral Small 1.2 | 128k | 11 | $0.30 | 160 | 0.83 | 16.47 | ||
Ministral 3 14B | 256k | 11 | $0.16 | 92 | 0.84 | 6.27 | ||
Nanbeige4.1-3B | 256k | 11* | -- | -- | -- | -- | ||
EXAONE 4.0 32B | 131k | 11* | -- | -- | -- | -- | ||
Nova 2.0 Omni | 1M | 10* | -- | -- | -- | -- | ||
Llama 4 Scout | 10M | 10 | $0.01 | 128 | 0.83 | 4.74 | ||
Hermes 4 70B | 128k | 10* | -- | 84 | 1.38 | 31.12 | ||
Falcon-H1R-7B | 256k | 10* | -- | -- | -- | -- | ||
Gemma 4 E2B | 128k | 10* | -- | -- | -- | -- | ||
Qwen3 Omni 30B A3B | 65.5k | 10* | -- | 97 | 1.90 | 27.55 | ||
Step3 VL 10B | 65.5k | 9* | -- | -- | -- | -- | ||
Llama 3.3 70B | 128k | 9* | -- | 82 | 1.72 | 7.80 | ||
Ministral 3 8B | 256k | 9 | $0.18 | 110 | 0.75 | 5.31 | ||
Llama Nemotron Ultra | 128k | 9* | -- | 52 | 2.35 | 49.99 | ||
ERNIE 4.5 300B A47B | 131k | 9* | -- | -- | -- | -- | ||
Hermes 4 405B | 128k | 9* | -- | 32 | 2.55 | 80.38 | ||
NVIDIA Nemotron Nano 12B v2 VL | 128k | 9* | -- | 106 | 4.16 | 27.70 | ||
Gemma 4 E4B | 128k | 9* | -- | 56 | 0.89 | 9.82 | ||
Granite 4.1 30B | 131k | 9* | -- | -- | -- | -- | ||
NVIDIA Nemotron Nano 9B V2 | 131k | 9* | -- | 180 | 4.02 | 17.88 | ||
Hermes 4 405B | 128k | 9* | -- | 32 | 2.51 | 17.94 | ||
Nemotron 3 Nano 4B | 262k | 9* | -- | -- | -- | -- | ||
Llama Nemotron Super 49B v1.5 | 128k | 9* | -- | 92 | 8.22 | 13.65 | ||
K2-V2 (low) | 512k | 8* | -- | -- | -- | -- | ||
Kimi Linear 48B A3B Instruct | 1M | 8* | -- | -- | -- | -- | ||
Llama 3.1 405B | 128k | 8* | -- | -- | -- | -- | ||
LFM2.5-8B-A1B | 32.8k | 8* | -- | 341 | 2.02 | 9.36 | ||
Ring-flash-2.0 | 128k | 8* | -- | -- | -- | -- | ||
Olmo 3.1 32B Think | 65.5k | 8* | -- | -- | -- | -- | ||
Command A | 256k | 7* | -- | 59 | 1.91 | 10.34 | ||
Qwen3.5 2B | 262k | 7* | -- | -- | -- | -- | ||
Llama 3.1 Nemotron 70B | 128k | 7* | -- | 113 | 6.93 | 11.36 | ||
Nemotron 3 Nano | 1M | 7* | -- | 220 | 0.91 | 3.18 | ||
NVIDIA Nemotron Nano 9B V2 | 131k | 7* | -- | 166 | 1.42 | 4.43 | ||
Ministral 3 3B | 256k | 7 | $0.13 | 205 | 0.65 | 3.09 | ||
Hermes 4 70B | 128k | 7* | -- | 84 | 1.39 | 7.35 | ||
Granite 4.1 8B | 131k | 6* | -- | 113 | 0.76 | 5.17 | ||
Sarvam 30B (high) | 65.5k | 6* | -- | -- | -- | -- | ||
Olmo 3.1 32B Instruct | 65.5k | 6* | -- | -- | -- | -- | ||
Gemma 4 E2B | 128k | 6* | -- | -- | -- | -- | ||
R1 1776 | 128k | 6* | -- | -- | -- | -- | ||
Llama 3.2 90B (Vision) | 128k | 6* | -- | -- | -- | -- | ||
Phi-4 Mini | 128k | 6* | -- | 44 | 0.84 | 12.31 | ||
EXAONE 4.0 32B | 131k | 6* | -- | -- | -- | -- | ||
Qwen3.5 2B | 262k | 5* | -- | -- | -- | -- | ||
Qwen3.5 0.8B | 262k | 5* | -- | -- | -- | -- | ||
DeepHermes 3 - Mistral 24B | 32k | 5* | -- | -- | -- | -- | ||
Jamba 1.7 Large | 256k | 5* | -- | -- | -- | -- | ||
Granite 4.0 H Small | 128k | 5* | -- | 27 | 18.87 | 37.55 | ||
Qwen3 Omni 30B A3B | 65.5k | 5* | -- | 93 | 1.93 | 7.28 | ||
LFM2 24B A2B | 32.8k | 5* | -- | -- | -- | -- | ||
Phi-4 | 16k | 5* | -- | 29 | 2.67 | 20.18 | ||
Nova Micro | 130k | 4* | -- | 304 | 0.87 | 2.51 | ||
Granite 4.1 3B | 131k | 4* | -- | -- | -- | -- | ||
NVIDIA Nemotron Nano 12B v2 VL | 128k | 4* | -- | 199 | 1.78 | 4.30 | ||
Phi-4 Multimodal | 128k | 4* | -- | 18 | 0.85 | 29.41 | ||
MiniCPM-V 4.6 1.3B | 262k | 4* | -- | -- | -- | -- | ||
Jamba Reasoning 3B | 262k | 4* | -- | -- | -- | -- | ||
Reka Flash 3 | 128k | 4* | -- | -- | -- | -- | ||
Olmo 3 7B Think | 65.5k | 4* | -- | -- | -- | -- | ||
Molmo 7B-D | 4.1k | 3* | -- | -- | -- | -- | ||
Llama 3.2 11B (Vision) | 128k | 3* | -- | 20 | 1.39 | 26.18 | ||
Qwen3.5 0.8B | 262k | 3* | -- | -- | -- | -- | ||
Exaone 4.0 1.2B | 64k | 3* | -- | -- | -- | -- | ||
Olmo 3 7B | 65.5k | 2* | -- | -- | -- | -- | ||
Exaone 4.0 1.2B | 64k | 2* | -- | -- | -- | -- | ||
LFM2.5-1.2B-Thinking | 32k | 2* | -- | -- | -- | -- | ||
Jamba 1.7 Mini | 258k | 2* | -- | -- | -- | -- | ||
LFM2 2.6B | 32.8k | 2* | -- | -- | -- | -- | ||
LFM2.5-1.2B-Instruct | 32k | 2* | -- | -- | -- | -- | ||
Granite 4.0 H 1B | 128k | 2* | -- | -- | -- | -- | ||
Gemma 3 270M | 32k | 2* | -- | -- | -- | -- | ||
Apertus 70B Instruct | 65.5k | 2* | -- | -- | -- | -- | ||
Granite 4.0 Micro | 128k | 2* | -- | -- | -- | -- | ||
DeepHermes 3 - Llama-3.1 8B | 128k | 2* | -- | -- | -- | -- | ||
Granite 4.0 1B | 128k | 2* | -- | -- | -- | -- | ||
Molmo2-8B | 36.9k | 2* | -- | -- | -- | -- | ||
LFM2 8B A1B | 32.8k | 1* | -- | -- | -- | -- | ||
LFM2.5-VL-1.6B | 32k | 1* | -- | 349 | 1.06 | 2.49 | ||
Granite 4.0 350M | 32.8k | 1* | -- | -- | -- | -- | ||
Tiny Aya Global | 8.19k | 1* | -- | -- | -- | -- | ||
Apertus 8B Instruct | 65.5k | 1* | -- | -- | -- | -- | ||
Granite 4.0 H 350M | 32.8k | 1* | -- | -- | -- | -- | ||
Claude Sonnet 5 (low) | 1M | -- | -- | 71 | 2.83 | 9.92 | ||
EXAONE 4.5 33B | 262k | -- | -- | -- | -- | -- | ||
Claude Sonnet 5 (xhigh) | 1M | -- | -- | 78 | 36.70 | 43.10 | ||
Gemini 3 Deep Think | 128k | -- | -- | -- | -- | -- | ||
Claude Sonnet 5 (high) | 1M | -- | -- | 73 | 9.30 | 16.12 | ||
GPT-5.5 Pro (xhigh) | 922k | -- | -- | -- | -- | -- | ||
Cogito v2.1 | 128k | -- | -- | -- | -- | -- | ||
Claude Sonnet 5 (medium) | 1M | -- | -- | 71 | 2.62 | 9.71 | ||
关键定义
常见问题
在参与排名的 159 个模型中,Claude Opus 5 (Adaptive Reasoning, Max Effort) 目前以 63 的 Intelligence Index 得分位居 Artificial Analysis LLM 排行榜第一。
按 Intelligence Index 排名,顶尖模型是:1. Claude Opus 5 (Adaptive Reasoning, Max Effort)(63), 2. Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)(63), 3. Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)(62), 4. Claude Opus 5 (Adaptive Reasoning, High Effort)(61), 5. GPT-5.6 Sol (max)(61)。
Celeris-1 最快,输出速度为每秒 1,628.7 个 token,其次是 Mercury 2(1,230.3 t/s)和 Ling 3.0 Flash(394.2 t/s)。
GPT-5.6 Luna (low) 的每项 Intelligence Index 任务成本最低,为 $0.01,其次是 MiMo-V2.5($0.01)和 Llama 4 Scout($0.01)。
Kimi K3 (max) 是排名最高的开放权重模型,Intelligence Index 得分为 60。排行榜上的 159 个模型中,有 84 个开放权重模型。
按 Intelligence Index 排名,顶尖开放权重模型是:1. Kimi K3 (max)(60), 2. Qwen3.8 2.4T A95B(58), 3. DeepSeek V4 Pro 0813 (Reasoning, Max Effort)(53)。
在 126 个推理模型中,Claude Opus 5 (Adaptive Reasoning, Max Effort) 以 63 的 Intelligence Index 得分领先。推理模型会先通过扩展思考来解决复杂问题,再给出回答。
排行榜提供筛选条件,可按模型类型(推理与非推理)、开放性(开放权重与专有)及其他标准缩小结果范围。您还可以调整提示词选项,查看不同输入长度下的性能变化。
点击排行榜中的任意模型名称,即可访问其专属比较页面,查看智能、价格、速度、延迟等详细图表。您还可以比较每个模型的 API 服务商。 查看所有模型