LLM Leaderboard - Comparison of AI models from OpenAI, Anthropic, Google, SpaceXAI & others
Comparison and ranking the performance of over 250 AI models (LLMs) across key metrics including intelligence, price, performance and speed (output speed - tokens per second & latency - TTFT), context window & others.
For more details including relating to our methodology, see our FAQs.
Intelligence
UpdatedClaude Fable 5.1 (max with fallback) and Claude Fable 5.1 (xhigh with fallback) are the highest intelligence models, followed by GPT-6 Astra (max) and GPT-6 Astra (xhigh).
Output Speed
Celeris-1 and Mercury 2 are the fastest models, followed by Gemini 2.5 Flash-Lite and HyperNova 60B 2605 (high).
Latency
Gemini 2.5 Flash-Lite (Non-reasoning) and North Mini Code are the lowest latency models, followed by Command A+ and Gemini 2.5 Flash (Non-reasoning).
Cost per Task
Granite 4.2 3B and gpt-oss-20b (high) have the lowest cost per task, followed by Nemotron 3 Nano and MiMo-V2.5.
Context Window
Llama 4 Scout and Grok 4.20 0309 support the largest context windows, followed by Gemini 1.5 Pro (May) and Grok 4.1 Fast.
Further Analysis | ||||||||
|---|---|---|---|---|---|---|---|---|
Claude Fable 5.1 (max with fallback) | 1M | 53 | $7.63 | 67 | 279.42 | 286.86 | ||
Claude Fable 5.1 (xhigh with fallback) | 1M | 53 | $5.98 | 58 | 125.70 | 134.32 | ||
GPT-6 Astra (max) | 1M | 53 | $3.26 | 54 | 334.76 | 343.96 | ||
GPT-6 Astra (xhigh) | 1M | 53 | $2.31 | 51 | 208.73 | 218.53 | ||
Claude Fable 5.1 (high with fallback) | 1M | 51 | $3.91 | 49 | 23.14 | 33.31 | ||
GPT-6 Astra (high) | 1M | 51 | $1.72 | 49 | 84.80 | 94.95 | ||
Claude Opus 5 (max) | 1M | 51 | $5.86 | 52 | 107.85 | 117.52 | ||
Claude Fable 5 (with fallback) | 1M | 50 | $8.75 | 64 | 97.28 | 105.14 | ||
GPT-6 Astra (medium) | 1M | 50 | $1.54 | 45 | 5.82 | 16.92 | ||
Claude Opus 5 (xhigh) | 1M | 50 | $4.88 | 51 | 30.58 | 40.47 | ||
Claude Fable 5.1 (medium with fallback) | 1M | 49 | $2.98 | 50 | 12.56 | 22.64 | ||
Claude Opus 5 (high) | 1M | 48 | $3.61 | 50 | 24.66 | 34.59 | ||
Muse Spark 1.3 (max) | 1M | 48 | $1.60 | 197 | 27.10 | 39.80 | ||
GPT-5.6 Sol (max) | 1M | 47 | $1.99 | 57 | 156.54 | 165.30 | ||
Claude Fable 5.1 (low with fallback) | 1M | 47 | $2.37 | 47 | 7.32 | 18.04 | ||
GPT-6 Astra (low) | 1M | 46 | $0.82 | 49 | 2.69 | 12.94 | ||
GPT-6 Astra (Non-reasoning) | 1M | 45 | -- | -- | -- | -- | ||
Muse Spark 1.3 (xhigh) | 1M | 45 | $1.37 | 190 | 27.28 | 40.42 | ||
Claude Opus 5 (medium) | 1M | 45 | $2.19 | 49 | 11.42 | 21.63 | ||
GLM-5.3 (max) | 1M | 45 | $2.01 | 58 | 3.04 | 46.03 | ||
Grok 4.6 (high) | 500k | 44 | $1.86 | 55 | 40.75 | 49.78 | ||
Grok 4.6 (xhigh) | 500k | 44 | $2.32 | 51 | 44.10 | 53.84 | ||
GPT-5.6 Sol (xhigh) | 1M | 44 | $1.18 | 61 | 64.58 | 72.82 | ||
Kimi K3 (max) | 1.05M | 44 | $2.00 | 35 | 3.44 | 74.22 | ||
Grok 4.6 (medium) | 500k | 43 | $1.50 | 53 | 33.39 | 42.83 | ||
GPT-5.6 Sol (high) | 1M | 42 | $0.81 | 59 | 31.04 | 39.57 | ||
GPT-5.6 Terra (max) | 1M | 42 | $1.40 | 82 | 190.83 | 196.92 | ||
GLM-5.3-Flash | 1M | 42 | $0.25 | 85 | 2.59 | 31.92 | ||
Gemini 3.8 Flash (high) | 1M | 41 | $1.24 | 268 | 11.82 | 13.68 | ||
Qwen3.8 Max | 1M | 40 | $2.67 | 38 | 2.44 | 67.92 | ||
Qwen3.8 2.4T A95B | 984k | 40 | $2.16 | 39 | 2.82 | 67.23 | ||
Gemini 3.8 Flash (medium) | 1M | 40 | $0.93 | -- | -- | -- | ||
Qwen3.8-Flash-Next | 256k | 40 | $0.37 | 54 | 2.81 | 49.05 | ||
Muse Spark 1.2 (xhigh) | 1.05M | 40 | $0.97 | 199 | 13.06 | 25.60 | ||
Claude Opus 5 (low) | 1M | 40 | $1.10 | 48 | 2.78 | 13.25 | ||
Gemini 3.7 Flash (medium) | 1M | 40* | -- | 272 | 4.75 | 6.59 | ||
GPT-5.6 Sol (medium) | 1M | 39 | $0.50 | 57 | 8.37 | 17.07 | ||
Gemini 3.7 Flash (high) | 1M | 39 | $0.93 | 292 | 8.68 | 10.39 | ||
Grok 4.5 (high) | 500k | 39 | $1.04 | 52 | 11.90 | 21.58 | ||
GLM-5.2 (max) | 1M | 39* | -- | 64 | 4.03 | 43.05 | ||
Claude Sonnet 5 (max) | 1M | 38 | $5.09 | 76 | 212.72 | 219.30 | ||
GPT-5.6 Terra (xhigh) | 1M | 38 | $0.63 | 79 | 33.58 | 39.92 | ||
GPT-5.6 Luna (max) | 1M | 38 | $0.18 | 110 | 138.61 | 143.18 | ||
Gemini 3.7 Flash (low) | 1M | 37* | -- | 290 | 0.63 | 2.36 | ||
DeepSeek V4 Pro 0813 (max) | 1M | 36 | $0.67 | 69 | 1.38 | 37.74 | ||
Grok 4.6 (low) | 500k | 35 | $0.48 | 51 | 7.02 | 16.82 | ||
Agnes 2.5 Pro Beta | 1M | 35* | -- | -- | -- | -- | ||
DeepSeek V4 Flash Vision (max) | 1M | 35 | $0.31 | 132 | 0.89 | 19.77 | ||
GPT-5.6 Luna (xhigh) | 1M | 35 | $0.09 | 107 | 52.30 | 56.97 | ||
DeepSeek V4 Flash 0731 (max) | 1M | 35 | $0.22 | 139 | 1.74 | 19.76 | ||
GPT-5.6 Terra (high) | 1M | 34 | $0.34 | 78 | 3.31 | 9.69 | ||
Kimi K3 (low) | 1.05M | 34* | -- | 38 | 3.70 | 69.56 | ||
Gemini 3.6 Flash | 1M | 34 | $0.93 | 194 | 16.62 | 19.20 | ||
K2 Horizon 375B A23B | 524k | 34* | -- | -- | -- | -- | ||
Qwen3.8 27B (xhigh) | 256k | 34 | $0.82 | 44 | 4.00 | 61.42 | ||
GPT-5.6 Sol (low) | 1M | 34 | $0.26 | 56 | 3.00 | 11.97 | ||
Gemini 3.8 Flash (low) | 1M | 34 | -- | -- | -- | -- | ||
Gemini 3.5 Flash (medium) | 1M | 34* | -- | 217 | 15.12 | 17.42 | ||
Motif 3 | 262k | 34* | -- | -- | -- | -- | ||
GPT-5.3 Codex (xhigh) | 400k | 33* | -- | 121 | 54.44 | 58.56 | ||
GPT-5.6 Luna (high) | 1M | 32 | $0.04 | 113 | 18.57 | 23.01 | ||
Motif 3 (Beta) | 262k | 32* | -- | -- | -- | -- | ||
DeepSeek V4 Pro (max) | 1M | 31 | $0.12 | 63 | 1.27 | 78.79 | ||
GPT-5.6 Terra (medium) | 1M | 30 | $0.18 | 73 | 2.09 | 8.94 | ||
Apodex 1.1 | 256k | 30* | -- | -- | -- | -- | ||
Gemini 3.1 Pro Preview | 1M | 30 | $0.67 | 110 | 28.40 | 32.93 | ||
DeepSeek V4 Pro (high) | 1M | 30* | -- | 65 | 1.52 | 39.95 | ||
MiniMax-M3 | 1M | 30 | $0.51 | 96 | 2.17 | 28.29 | ||
Claude Sonnet 5 (Non-reasoning) | 1M | 29* | -- | 57 | 1.02 | 9.79 | ||
Claude Sonnet 5 (medium) | 1M | 28 | $1.00 | 58 | 1.71 | 10.35 | ||
GPT-5.6 Sol (Non-reasoning) | 1M | 28* | -- | 64 | 1.24 | 9.05 | ||
Nex-N2-Pro | 262k | 28* | -- | 116 | 1.76 | 23.24 | ||
Solar Pro 4 | 512k | 28* | -- | 60 | 2.10 | 43.97 | ||
GPT-5.6 Terra (low) | 1M | 28 | $0.14 | 72 | 1.97 | 8.91 | ||
Qwen3.8 27B (medium) | 256k | 28 | $0.90 | 50 | 4.04 | 54.45 | ||
JT-4.1 Flash 236B A21B | 256k | 27* | -- | -- | -- | -- | ||
Quasar 438B (max) | 1M | 27 | $2.02 | 181 | 0.98 | 14.81 | ||
GPT-5.5 Instant (June 2026) | 400k | 27 | $0.69 | 129 | 1.25 | 20.70 | ||
Agnes 2.5 Pro Alpha | 1M | 27* | -- | 170 | 2.90 | 17.59 | ||
Qwen3.8 27B (low) | 256k | 26 | $0.83 | 49 | 3.96 | 54.72 | ||
MiMo-V2.5-Pro | 1M | 26 | $0.05 | 36 | 4.83 | 73.53 | ||
Kimi K2.7 Code | 256k | 26 | $0.54 | 57 | 3.12 | 50.99 | ||
Inkling Small | 1M | 26 | $0.09 | 133 | 2.37 | 21.12 | ||
Qwen3.7 Plus | 1M | 26 | $0.33 | 57 | 2.25 | 46.26 | ||
GPT-5.6 Luna (medium) | 1M | 26* | -- | 106 | 2.83 | 7.56 | ||
Hy3 | 256k | 26 | $0.07 | 84 | 2.65 | 32.34 | ||
Inkling | 1M | 26 | $0.61 | 75 | 2.70 | 36.06 | ||
MiMo-V2-Omni-0327 | 256k | 25* | -- | -- | -- | -- | ||
Ling 3.0 Flash | 262k | 25* | -- | 285 | 2.57 | 11.34 | ||
Grok 4.3 (medium) | 1M | 25* | -- | 113 | 12.07 | 16.49 | ||
Ling-3.0-flash-VL | 262k | 25 | -- | 139 | 1.76 | 19.78 | ||
Claude Sonnet 5 (low) | 1M | 25 | $0.51 | 57 | 1.42 | 10.24 | ||
Solar Open2 250B | 1.05M | 25* | -- | -- | -- | -- | ||
Grok 4.3 (low) | 1M | 24* | -- | 114 | 5.42 | 9.81 | ||
MiMo-V2-Omni | 256k | 24* | -- | -- | -- | -- | ||
Gemini 3.5 Flash (minimal) | 1M | 24* | -- | 199 | 0.90 | 3.42 | ||
Nemotron 3 Ultra | 262k | 23 | $0.58 | 156 | 2.30 | 20.04 | ||
Claude Sonnet 4.6 (Non-reasoning, low) | 1M | 23* | -- | 43 | 2.02 | 13.77 | ||
A.X-K2 | 262k | 23* | -- | -- | -- | -- | ||
Gemini 3.5 Flash-Lite | 1M | 23 | $0.12 | 348 | 7.44 | 8.88 | ||
MiMo-V2-Flash (Feb 2026) | 256k | 22* | -- | -- | -- | -- | ||
GLM-5.2 (Non-reasoning) | 1M | 22* | -- | 107 | 1.96 | 6.64 | ||
Qwen3.8 27B | 256k | 22* | -- | 49 | 3.92 | 14.15 | ||
MiMo-V2.5 | 1M | 22 | $0.02 | 52 | 8.12 | 56.03 | ||
GPT-5.6 Terra (Non-reasoning) | 1M | 22* | -- | 74 | 0.95 | 7.72 | ||
Qwen3.6 27B | 262k | 22 | $0.62 | 56 | 3.66 | 114.48 | ||
GPT-5.6 Luna (low) | 1M | 22* | -- | 102 | 1.65 | 6.53 | ||
G9v3-39A5B | 131k | 22* | -- | -- | -- | -- | ||
KAT-Coder-Pro V2 | 256k | 22* | -- | -- | -- | -- | ||
Qwen3.5 397B A17B (Non-reasoning) | 262k | 21* | -- | 77 | 2.01 | 8.52 | ||
DeepSeek V4 Pro (Non-reasoning) | 1M | 21* | -- | 65 | 1.74 | 9.49 | ||
Qwen3.5 Omni Plus | 256k | 20* | -- | 84 | 2.20 | 8.14 | ||
o3 | 200k | 20* | -- | 105 | 7.86 | 12.63 | ||
Qwen3.6 27B (Non-reasoning) | 262k | 20* | -- | 55 | 3.63 | 12.77 | ||
K-EXAONE 2.0 | 262k | 20* | -- | -- | -- | -- | ||
LongCat 2.0 | 1M | 20 | $0.15 | 47 | 3.54 | 56.67 | ||
Step 3.7 Flash | 262k | 19* | -- | 89 | 2.86 | 31.11 | ||
Qwen3.5 397B A17B | 262k | 19 | $0.47 | 78 | 2.18 | 49.16 | ||
DeepSeek V4 Flash (Non-reasoning) | 1M | 19* | -- | -- | -- | -- | ||
Qwen3.6 35B A3B | 262k | 19 | $0.48 | 128 | 2.03 | 47.99 | ||
JT-35B-Flash | 256k | 19* | -- | -- | -- | -- | ||
MiMo-V2.5-Pro (Non-reasoning) | 1M | 18* | -- | 33 | 5.12 | 20.10 | ||
Muse Glimmer (high) | 131k | 18 | $0.06 | 99 | 1.00 | 26.34 | ||
Qwen3.5 122B A10B (Non-reasoning) | 262k | 18* | -- | 139 | 2.30 | 5.90 | ||
Claude 4.5 Haiku | 200k | 18 | $0.21 | 83 | 22.24 | 28.27 | ||
Ring-2.6-1T | 262k | 17 | $0.29 | 116 | 3.89 | 25.48 | ||
Doubao Seed Code | 256k | 17* | -- | -- | -- | -- | ||
GPT-5.6 Luna (Non-reasoning) | 1M | 17* | -- | 110 | 0.82 | 5.38 | ||
Gemma 4 26B A4B | 256k | 17* | -- | -- | -- | -- | ||
Qwen3.5 122B A10B | 262k | 16 | $0.32 | 128 | 2.27 | 21.86 | ||
MiMo-V2-Flash (Non-reasoning) | 256k | 16* | -- | -- | -- | -- | ||
Gemma 4 31B | 256k | 15 | $0.00 | 35 | 1.10 | 64.26 | ||
Claude 4.5 Haiku (Non-reasoning) | 200k | 15* | -- | 78 | 0.78 | 7.16 | ||
Qwen3.6 35B A3B (Non-reasoning) | 262k | 15* | -- | 135 | 1.97 | 5.67 | ||
Qwen3.5 35B A3B (Non-reasoning) | 262k | 15* | -- | 160 | 2.12 | 5.24 | ||
Mistral Medium 3.5 | 256k | 15 | $0.44 | 137 | 2.33 | 20.64 | ||
Granite 4.2 30B | 131k | 15* | -- | 77 | 0.83 | 33.42 | ||
Grok 4.3 (Non-reasoning) | 1M | 15 | $0.14 | 110 | 0.69 | 5.25 | ||
K-EXAONE | 256k | 14* | -- | -- | -- | -- | ||
ERNIE 5.0 Thinking Preview | 128k | 14* | -- | -- | -- | -- | ||
Gemma 4 12B | 256k | 14* | -- | 106 | 2.35 | 26.02 | ||
Nova 2.0 Pro Preview (medium) | 256k | 14* | -- | 119 | 13.10 | 34.04 | ||
Command A+ | 192k | 14 | $0.00 | 236 | 0.40 | 11.00 | ||
Gemma 4 31B (Non-reasoning) | 256k | 14* | -- | 54 | 1.54 | 10.73 | ||
Qwen3.5 9B | 262k | 14* | -- | 86 | 1.67 | 30.82 | ||
Nova 2.0 Omni (medium) | 1M | 14* | -- | -- | -- | -- | ||
Nemotron 3.5 Lightning | 1M | 14 | $0.09 | 272 | 0.78 | 9.98 | ||
Nemotron 3 Super | 1M | 14 | $1.06 | 132 | 3.07 | 21.97 | ||
Apriel-v1.6-15B-Thinker | 128k | 13* | -- | -- | -- | -- | ||
Nova 2.0 Lite (high) | 1M | 13* | -- | 152 | 16.12 | 32.55 | ||
Qwen3.5 9B (Non-reasoning) | 262k | 13* | -- | 90 | 0.78 | 6.35 | ||
EXAONE 4.5 33B | 262k | 13* | -- | -- | -- | -- | ||
MiniCPM5-2B | 131k | 13 | -- | -- | -- | -- | ||
Gemma 4 26B A4B (Non-reasoning) | 256k | 13* | -- | 81 | 1.44 | 7.64 | ||
Qwen3.5 4B | 262k | 13* | -- | 29 | 0.76 | 88.02 | ||
North Mini Code | 256k | 13* | -- | 49 | 0.40 | 51.75 | ||
Nova 2.0 Pro Preview (low) | 256k | 13* | -- | 121 | 9.21 | 29.94 | ||
Nova 2.0 Lite (medium) | 1M | 12* | -- | 150 | 13.39 | 30.01 | ||
Qwen3.5 Omni Flash | 256k | 12* | -- | 223 | 1.82 | 4.07 | ||
gpt-oss-120b (high) | 131k | 12 | $0.11 | 194 | 0.79 | 13.65 | ||
JT-MINI | 128k | 12* | -- | -- | -- | -- | ||
Ling 3.0 Tiny | 262k | 12 | $0.00 | 158 | 2.56 | 18.33 | ||
Magistral Medium 1.2 | 128k | 12* | -- | -- | -- | -- | ||
Granite 4.2 8B | 131k | 12 | $0.02 | 98 | 0.64 | 26.12 | ||
Nova 2.0 Lite (low) | 1M | 12* | -- | 162 | 10.86 | 26.26 | ||
HyperNova 60B 2605 (high) | 131k | 12* | -- | 350 | 0.63 | 7.76 | ||
Nemotron Cascade 2 30B A3B | 1M | 12* | -- | -- | -- | -- | ||
Mercury 2 | 128k | 12 | $0.07 | 744 | 3.97 | 4.64 | ||
K2 Think V2 | 262k | 11* | -- | -- | -- | -- | ||
LongCat Flash Lite | 256k | 11* | -- | -- | -- | -- | ||
Mistral Small 4 | 256k | 11 | $0.05 | 169 | 0.74 | 15.54 | ||
HyperCLOVA X SEED Think (32B) | 128k | 11* | -- | -- | -- | -- | ||
K-EXAONE (Non-reasoning) | 256k | 11* | -- | -- | -- | -- | ||
Qwen3 Next 80B A3B (Reasoning) | 262k | 11* | -- | 194 | 2.34 | 15.21 | ||
Nova 2.0 Omni (low) | 1M | 11* | -- | -- | -- | -- | ||
Mi:dm K 2.5 Pro | 128k | 11* | -- | -- | -- | -- | ||
Trinity Large Thinking | 512k | 11 | $0.35 | 322 | 1.23 | 8.99 | ||
G9v3-3B | 131k | 11* | -- | -- | -- | -- | ||
Qwen3.5 4B (Non-reasoning) | 262k | 11* | -- | 19 | 0.88 | 26.95 | ||
INTELLECT-3 | 131k | 11* | -- | -- | -- | -- | ||
Solar Open 100B | 128k | 10* | -- | -- | -- | -- | ||
Nemotron 3 Nano Omni 30B A3B | 256k | 10* | -- | -- | -- | -- | ||
gpt-oss-120b (low) | 131k | 10* | -- | 211 | 0.83 | 12.70 | ||
Qwen3 Coder Next | 256k | 10 | $0.55 | 109 | 1.34 | 5.93 | ||
Nova 2.0 Pro Preview (Non-reasoning) | 256k | 10* | -- | 100 | 1.03 | 6.01 | ||
gpt-oss-20b (low) | 131k | 10* | -- | 232 | 0.86 | 11.63 | ||
K2-V2 (high) | 512k | 10* | -- | -- | -- | -- | ||
Mistral Large 3 | 256k | 10 | $0.10 | 76 | 1.03 | 7.63 | ||
Qwen3 Next 80B A3B | 262k | 10* | -- | 176 | 2.13 | 4.98 | ||
DiffusionGemma 26B A4B | 256k | 10* | -- | -- | -- | -- | ||
Devstral 2 | 256k | 9 | $0.00 | 136 | 2.32 | 6.00 | ||
Gemma 4 12B (Non-reasoning) | 262k | 9* | -- | 100 | 2.44 | 7.43 | ||
Llama 4 Maverick | 1M | 9 | $0.04 | 89 | 0.85 | 6.47 | ||
Motif-2-12.7B | 128k | 9* | -- | -- | -- | -- | ||
Nova Premier | 1M | 9* | -- | 31 | 2.83 | 18.73 | ||
Granite 4.2 3B | 131k | 9 | $0.01 | 215 | 0.47 | 12.09 | ||
gpt-oss-20b (high) | 131k | 9 | $0.01 | 179 | 0.81 | 14.79 | ||
K2-V2 (medium) | 512k | 9* | -- | -- | -- | -- | ||
Llama Nemotron Super 49B v1.5 | 128k | 9* | -- | 60 | 8.24 | 49.77 | ||
Mistral Small 4 (Non-reasoning) | 256k | 9* | -- | 150 | 0.75 | 4.08 | ||
Tri-21B-Think | 32k | 9* | -- | -- | -- | -- | ||
Gemma 4 E4B | 128k | 9* | -- | 43 | 0.94 | 59.13 | ||
Nemotron 3 Nano | 1M | 9 | $0.02 | 204 | 1.15 | 13.40 | ||
MiniCPM5-1B | 128k | 9* | -- | -- | -- | -- | ||
Sarvam 105B (high) | 128k | 9* | -- | -- | -- | -- | ||
Nova 2.0 Lite (Non-reasoning) | 1M | 9* | -- | 157 | 1.03 | 4.22 | ||
MiniCPM5-1B (Non-reasoning) | 128k | 9* | -- | -- | -- | -- | ||
Magistral Small 1.2 | 128k | 9* | -- | -- | -- | -- | ||
Nanbeige4.1-3B | 256k | 8* | -- | -- | -- | -- | ||
LFM2.5-2.6B | 128k | 8* | -- | 200 | 2.92 | 15.45 | ||
Devstral Small 2 | 256k | 8 | $0.00 | 144 | 2.43 | 5.92 | ||
EXAONE 4.0 32B | 131k | 8* | -- | -- | -- | -- | ||
Nova 2.0 Omni (Non-reasoning) | 1M | 8* | -- | -- | -- | -- | ||
Hermes 4 70B | 128k | 8* | -- | -- | -- | -- | ||
Falcon-H1R-7B | 256k | 8* | -- | -- | -- | -- | ||
Solar Pro 3 | 128k | 8 | $0.08 | 150 | 2.42 | 19.05 | ||
Gemma 4 E2B | 128k | 8* | -- | -- | -- | -- | ||
Qwen3 Omni 30B A3B (Reasoning) | 65.5k | 8* | -- | 101 | 1.91 | 26.66 | ||
Step3 VL 10B | 65.5k | 8* | -- | -- | -- | -- | ||
Llama 3.3 70B | 128k | 8* | -- | 85 | 1.67 | 7.53 | ||
Llama Nemotron Ultra | 128k | 8* | -- | -- | -- | -- | ||
ERNIE 4.5 300B A47B | 131k | 8* | -- | -- | -- | -- | ||
Hermes 4 405B | 128k | 7* | -- | 43 | 2.45 | 60.81 | ||
NVIDIA Nemotron Nano 12B v2 VL | 128k | 7* | -- | 47 | 10.20 | 63.15 | ||
Gemma 4 E4B (Non-reasoning) | 128k | 7* | -- | 43 | 0.75 | 12.25 | ||
Granite 4.1 30B | 131k | 7* | -- | -- | -- | -- | ||
NVIDIA Nemotron Nano 9B V2 | 131k | 7* | -- | 107 | 7.17 | 30.51 | ||
Hermes 4 405B (Non-reasoning) | 128k | 7* | -- | 43 | 2.38 | 13.90 | ||
Nemotron 3 Nano 4B | 262k | 7* | -- | -- | -- | -- | ||
Llama Nemotron Super 49B v1.5 (Non-reasoning) | 128k | 7* | -- | 41 | 8.25 | 20.32 | ||
K2-V2 (low) | 512k | 7* | -- | -- | -- | -- | ||
Kimi Linear 48B A3B Instruct | 1M | 7* | -- | -- | -- | -- | ||
Llama 3.1 405B | 128k | 7* | -- | -- | -- | -- | ||
LFM2.5-8B-A1B | 32.8k | 7* | -- | -- | -- | -- | ||
Ring-flash-2.0 | 128k | 7* | -- | -- | -- | -- | ||
Olmo 3.1 32B Think | 65.5k | 7* | -- | -- | -- | -- | ||
Command A | 256k | 7* | -- | 68 | 1.62 | 8.99 | ||
Qwen3.5 2B | 262k | 7* | -- | -- | -- | -- | ||
Llama 3.1 Nemotron 70B | 128k | 7* | -- | 59 | 8.27 | 16.82 | ||
Nemotron 3 Nano (Non-reasoning) | 1M | 7* | -- | 166 | 0.97 | 3.99 | ||
NVIDIA Nemotron Nano 9B V2 (Non-reasoning) | 131k | 7* | -- | 147 | 2.23 | 5.63 | ||
Hermes 4 70B (Non-reasoning) | 128k | 7* | -- | -- | -- | -- | ||
Granite 4.1 8B | 131k | 7* | -- | 89 | 0.80 | 6.45 | ||
Sarvam 30B (high) | 65.5k | 7* | -- | -- | -- | -- | ||
Olmo 3.1 32B Instruct | 65.5k | 6* | -- | -- | -- | -- | ||
Gemma 4 E2B (Non-reasoning) | 128k | 6* | -- | -- | -- | -- | ||
Llama 4 Scout | 10M | 6 | $0.12 | 84 | 0.86 | 6.79 | ||
R1 1776 | 128k | 6* | -- | -- | -- | -- | ||
Llama 3.2 90B (Vision) | 128k | 6* | -- | -- | -- | -- | ||
Celeris-1 | 131k | 6 | $0.05 | 1,412 | 0.60 | 0.96 | ||
Phi-4 Mini | 128k | 6* | -- | 45 | 0.86 | 12.00 | ||
EXAONE 4.0 32B (Non-reasoning) | 131k | 6* | -- | -- | -- | -- | ||
Qwen3.5 2B (Non-reasoning) | 262k | 6* | -- | -- | -- | -- | ||
Qwen3.5 0.8B | 262k | 6* | -- | -- | -- | -- | ||
DeepHermes 3 - Mistral 24B | 32k | 6* | -- | -- | -- | -- | ||
Jamba 1.7 Large | 256k | 6* | -- | -- | -- | -- | ||
Granite 4.0 H Small | 128k | 6* | -- | 27 | 18.80 | 37.23 | ||
Ministral 3 14B | 256k | 6 | $0.14 | 82 | 0.84 | 6.95 | ||
Qwen3 Omni 30B A3B | 65.5k | 6* | -- | 96 | 1.86 | 7.08 | ||
LFM2 24B A2B | 32.8k | 6* | -- | -- | -- | -- | ||
Phi-4 | 16k | 6* | -- | 41 | 2.52 | 14.82 | ||
Nova Micro | 130k | 6* | -- | 263 | 0.83 | 2.73 | ||
Granite 4.1 3B | 131k | 6* | -- | -- | -- | -- | ||
NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning) | 128k | 6* | -- | 64 | 2.36 | 10.14 | ||
Phi-4 Multimodal | 128k | 6* | -- | 17 | 0.85 | 30.19 | ||
MiniCPM-V 4.6 1.3B | 262k | 6* | -- | -- | -- | -- | ||
Jamba Reasoning 3B | 262k | 6* | -- | -- | -- | -- | ||
Reka Flash 3 | 128k | 6* | -- | -- | -- | -- | ||
Olmo 3 7B Think | 65.5k | 6* | -- | -- | -- | -- | ||
Molmo 7B-D | 4.1k | 6* | -- | -- | -- | -- | ||
Ministral 3 8B | 256k | 5 | $0.07 | 87 | 0.76 | 6.50 | ||
Llama 3.2 11B (Vision) | 128k | 5* | -- | 14 | 1.35 | 38.38 | ||
Qwen3.5 0.8B (Non-reasoning) | 262k | 5* | -- | -- | -- | -- | ||
Exaone 4.0 1.2B | 64k | 5* | -- | -- | -- | -- | ||
Olmo 3 7B | 65.5k | 5* | -- | -- | -- | -- | ||
Exaone 4.0 1.2B (Non-reasoning) | 64k | 5* | -- | -- | -- | -- | ||
LFM2.5-1.2B-Thinking | 32k | 5* | -- | -- | -- | -- | ||
Jamba 1.7 Mini | 258k | 5* | -- | -- | -- | -- | ||
LFM2 2.6B | 32.8k | 5* | -- | -- | -- | -- | ||
LFM2.5-1.2B-Instruct | 32k | 5* | -- | -- | -- | -- | ||
Granite 4.0 H 1B | 128k | 5* | -- | -- | -- | -- | ||
Gemma 3 270M | 32k | 5* | -- | -- | -- | -- | ||
Apertus 70B Instruct | 65.5k | 5* | -- | -- | -- | -- | ||
Granite 4.0 Micro | 128k | 5* | -- | -- | -- | -- | ||
DeepHermes 3 - Llama-3.1 8B | 128k | 5* | -- | -- | -- | -- | ||
Granite 4.0 1B | 128k | 5* | -- | -- | -- | -- | ||
Molmo2-8B | 36.9k | 5* | -- | -- | -- | -- | ||
LFM2 8B A1B | 32.8k | 5* | -- | -- | -- | -- | ||
Ministral 3 3B | 256k | 5 | $0.04 | 178 | 0.65 | 3.46 | ||
LFM2.5-VL-1.6B | 32k | 5* | -- | -- | -- | -- | ||
Granite 4.0 350M | 32.8k | 5* | -- | -- | -- | -- | ||
Tiny Aya Global | 8.19k | 5* | -- | -- | -- | -- | ||
Apertus 8B Instruct | 65.5k | 5* | -- | -- | -- | -- | ||
Granite 4.0 H 350M | 32.8k | 5* | -- | -- | -- | -- | ||
EXAONE 4.5 33B (Non-reasoning) | 262k | -- | -- | -- | -- | -- | ||
Claude Sonnet 5 (xhigh) | 1M | -- | -- | 66 | 28.53 | 36.06 | ||
Gemini 3 Deep Think | 128k | -- | -- | -- | -- | -- | ||
Claude Sonnet 5 (high) | 1M | -- | -- | 61 | 13.58 | 21.75 | ||
GPT-5.5 Pro (xhigh) | 922k | -- | -- | -- | -- | -- | ||
Cogito v2.1 | 128k | -- | -- | -- | -- | -- | ||
Key definitions
Frequently Asked Questions
Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) currently ranks #1 on the Artificial Analysis LLM Leaderboard with an Intelligence Index score of 53, out of 141 models ranked.
The top models by Intelligence Index are: 1. Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) (53), 2. Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback) (53), 3. GPT-6 Astra (max) (53), 4. GPT-6 Astra (xhigh) (53), 5. Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback) (51).
Celeris-1 is the fastest at 1,411.9 tokens per second, followed by Mercury 2 (743.9 t/s) and Gemini 2.5 Flash-Lite (Reasoning) (357.9 t/s).
Granite 4.2 3B has the lowest cost per Intelligence Index task at $0.01, followed by gpt-oss-20b (high) ($0.01) and NVIDIA Nemotron 3 Nano 30B A3B (Reasoning) ($0.02).
GLM-5.3 (max) is the highest-ranked open weights model with an Intelligence Index score of 45. There are 67 open weights models out of 141 total on the leaderboard.
The top open weights models by Intelligence Index are: 1. GLM-5.3 (max) (45), 2. Kimi K3 (max) (44), 3. GLM-5.3-Flash (42).
Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) leads among 123 reasoning models with an Intelligence Index score of 53. Reasoning models use extended thinking to solve complex problems before responding.
The leaderboard includes filters to narrow results by model type (reasoning vs non-reasoning), openness (open weights vs proprietary), and other criteria. You can also adjust prompt options to see how performance varies with different input lengths.
Click on any model name in the leaderboard to visit its dedicated comparison page with detailed charts covering intelligence, pricing, speed, latency, and more. You can also compare API providers for each model. View all models